Guillermo Rauch:我们运行了全新的 Next.js 评估
中文全文 · AI 翻译
我们运行了全新的 Next.js 评估。结果统计如下: ① Opus 5.5 [𝟿𝟽%] ② GPT 6 Sol [𝟿𝟽%] ③ Fable 5.1 [𝟿𝟽%] ④ Grok 4.7 [𝟿𝟺%]
值得注意的是,Grok 的成本仅为其他模型的 1/2 至 1/7
对照原文
We ran fresh Next.js evals. The tally: ① Opus 5.5 [𝟿𝟽%] ② GPT 6 Sol [𝟿𝟽%] ③ Fable 5.1 [𝟿𝟽%] ④ Grok 4.7 [𝟿𝟺%] Notably, Grok is 2x-7x cheaper