xAI推出Grok 4.6模型 性能逼近GPT-5.6且定价更低

📅 2026/8/18 22:08:57
xAI推出Grok 4.6模型 性能逼近GPT-5.6且定价更低
xAI于2026年8月12日正式上线Grok 4.6模型输入价格为每百万token 2美元缓存输入0.5美元输出6美元提示token超过20万后价格翻倍。该模型支持50万token上下文窗口接受文本和图像输入输出仅限文本无长度限制。基准表现与实际差距Artificial Analysis Intelligence Index数据显示Grok 4.6 high版本与GPT-5.6 Soul并列位列Claude Opus 5之后。GDPval基准中Grok 4.6 high得分最高超过GPT-5.6 Soul和Claude Opus 5 Max。该基准覆盖工程、金融、AutoCAD、酒店和视频编辑等真实经济任务。Harvey Bench法律任务测试中Grok 4.6得分为15.8%GPT-5.6 Soul为2.5%Claude Opus 5为11.3%。Cursor Bench 3.2内部编码测试显示Grok 4.6落后于Claude Opus 5 Max。终端代理任务得分从15%提升至26%。每百万token任务成本约0.83美元低于同等智力水平模型的数倍价格。发布节奏与数据来源Grok 4.5于2026年7月8日上线Grok 4.6在四周内跟进。xAI已确认Grok 4.7正在训练目标三至四周后发布。该公司通过收购Cursor获取编码数据结合Colossus数据中心闲置GPU容量形成编码优先循环。官方发布说明显示Grok 4.6基于与Grok 4.5相同的约1.5万亿参数基础通过工程数据精调而成并非全新训练基础模型。Grok Bot的实际部署2026年8月11日同步上线的Grok Bot运行在持久云虚拟机上支持消息、审批、连接器和例程功能定位非技术知识工作者而非开发者。用户可在Cursor平台直接调用编码任务反馈积极。该工具与此前Grok系列的语音和视频模型形成互补但尚未披露与SpaceXAI同名模型的具体技术关联。定价策略的产业影响同等任务成本低于OpenAI和Anthropic同类产品Grok 4.6直接压缩了开发者在多模型切换中的预算压力。API支持低、中、高、xhigh四档推理强度默认高档用户可按需调整。这种定价在保持基准竞争力的同时改变了此前前沿模型普遍高价的格局。开发者可通过实际终端任务验证性价比而非仅依赖公开榜单。独立判断当前证据显示Grok 4.6已在特定法律和经济任务基准上形成局部优势定价与执行速度构成主要差异点。本文首发于赢政天下https://www.winzheng.com获取更多深度技术内容与资源欢迎访问官网。