AI+ 2026-09-21
xAI 发布 Grok 4.7:主打「安全攻防」的争议之作
2026 年 9 月 21 日,xAI 发布新一代模型 Grok 4.7(API 模型 ID:grok-4.7),上线首日即冲上 Hacker News 热榜前列,讨论热度超过 400 条评论。
关键信息
- 定价下探:200K prompt 以内 $2 / 百万输入 token(缓存命中 $0.50),输出 $6 / 百万 token——与上一代同价但任务长度(task horizon)更长;
- 主打卖点:官方称 Grok 4.7 在「强大的网络防御能力」与「合法用途的低拒答率」之间取得平衡,在 HackerBench v0.3 安全评测中得分居首;
- 参数规模:社区流传约 2.1 万亿参数(传闻口径,xAI 未在公告中确认);
- 第三方争议:尽管官方称其为「迄今最强模型」,第三方评测 Artificial Analysis Intelligence Index 仅给出 46 分,与宣传存在明显落差,引发社区对基准口径的讨论。
怎么看「低拒答率 + 网络攻防」的组合拳
xAI 一直以「少拒绝」作为差异化路线,这次的表述更进一步——把网络安全防御作为核心场景:渗透测试、红队演练、漏洞分析这类工作在通用模型上常因安全策略被拒,Grok 4.7 想接住这部分需求。HackerBench 安全分居首正是为这个定位背书。
但争议同样集中在这里:低拒答率与攻防能力的组合,天然伴随着滥用风险。模型在「合法安全研究」与「攻击工具化」之间的边界如何把关,xAI 尚未给出详细的安全卡(system card)说明。此外第三方指数与官方宣传的落差也提醒采购者:模型选型应以自己业务场景的实测为准,而不是任何一方的榜单。
对企业的启示
- 成本面:$2/$6 的定价已进入「白菜价」梯队,长任务(代码库级分析、多步 Agent 流程)的推理成本进一步下降,企业可以更大胆地把 LLM 嵌入批处理流程;
- 选型面:安全行业客户(渗透测试服务商、SOC 团队)多了一个专门优化的选项;但金融、医疗等强合规行业仍应谨慎评估低拒答模型的输出治理;
- 集成面:ProMen 在为企业搭建 AI 工作流时,始终建议「多模型路由」——不同环节用不同模型,以实测基准而非营销榜单决定分配。如果您在评估 Grok、Claude、GPT 或国产模型在企业场景的组合方案,欢迎与我们的 AI+ 团队交流。