Grok 4.6 多基準登頂,多項評測超越 Grok 4.5 High
此前已報道 Grok 4.6 上線。最新基準信息顯示,Grok 4.6 在 GDPVal-AA v2、AA-Briefcase、Harvey LAB 三項基準中位列第一,在 CursorBench、FrontierCode、APEX-Agents、APEX-SWE 四項基準中位列第二。具體成績分別爲 GDPVal-AA v2 1753、AA-Briefcase 1577、Harvey LAB 15.8%、CursorBench 69.9%、FrontierCode 61.3%、APEX-Agents 57.5%、APEX-SWE 56.4%。
其在所列每一項基準都超過 Grok 4.5 High,並在 Artificial Analysis Intelligence Index 以 61 分與 GPT-5.6 Sol Max 持平。Grok 4.6 即日起在 Cursor 和 Grok Build 中可用,首周使用量翻倍。