Kimi-K3登顶AI编程榜,超越Claude Fable 5
Claude Fable 5 跌至 AI 编程排行榜第二
Claude Fable 5 的王者宝座易主——由中国 Moonshot AI 开发的全新模型 Kimi-K3,现已登顶 Arena 最新榜单,成为最佳网站代码生成模型。目前 Kimi-K3 得分 1,679 分,领先 Fable 5 的 1,631 分。
Arena 对 AI 模型的排名方式非常简单:随机给两套隐藏的模型分配同一任务,由用户投票选出更优结果。光是网页编码榜单,就有接近 470,000 票、涵盖 96 款模型。
Kimi-K3 如何超越 Claude Fable 5
这一逆袭可谓“黑马”。Moonshot 上一代模型 Kimi-K2.6 仅排第 18 名,Kimi-K3 一上线便一举夺魁。
Big news: Kimi-K3 by @Kimi_Moonshot is now #1 in the Frontend Code Arena with 1679 pts, surpassing Claude Fable 5.
This is a 17-place jump from Kimi-k2.6 (#18 -> #1).
In Frontend, Kimi-K3 ranked #1 in 6 of 7 domains: Brand & Marketing, Reference-Based Design, Data & Analytics,… https://t.co/YDN3BufGkC pic.twitter.com/Oa6teaQnWp
— Arena.ai (@arena) July 16, 2026
Kimi-K3 领先 48 分,并非险胜。相比之下,Fable 5 只比第三名——$OpenAI 的 GPT-5.6—多 13 分。此外,Kimi-K3 在七项代码生成细分赛道中拿下六项冠军,覆盖营销页面、数据看板、消费级应用等场景。Claude Fable 5 只在“游戏”一项保住了榜首。
Arena 前端代码排行榜,Kimi-K3 击败 Claude Fable 5。来源:Arena.ai
即便如此,Anthropic 仍拥有榜单前 20 中的 9 个席位。不过,这一时机对其来说颇为尴尬——就在几天前,Elon Musk 还公开称Anthropic 是行业领导者。围绕榜单的争议也再次升温,先前关于 Claude 的 AI 基准测试争端由此可见一斑。
Mark Zuckerberg 的 Muse Spark 1.1 亦榜上有名,位列第 11,仅在正式推出数日后完成上榜。
这一变化为何值得关注?
更具影响力的是,Kimi-K3 价格优势明显。Moonshot 官方定价为每百万输入 Token 仅 3 美元,输出则为 15 美元。相比之下,Arena 标注的 Fable 5 定价分别为 10 美元和 50 美元。
Moonshot 还宣布,将于 7 月 27 日前公布 Kimi-K3 的完整模型权重,届时任何人都可以免费下载并运行这一顶级代码模型。这一举措亦推动了更广泛的行业变革,中国本土模型在月度 Token 使用量上已超越美国同行。
竞争同样体现在多方博弈。阿里巴巴日前已通知员工,自 7 月 10 日起,因安全隐患,全面禁用 Claude Code。
接下来几周,随着更多投票结果公布,Kimi-K3 能否保持领先地位值得关注。
The post Claude Fable 5 跌至 AI 编程排行榜第二 appeared first on BeInCrypto Chinese.
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力