Opus 5.5与GPT-6系列模型性能、价格对比及选购建议
怪不得昨天我觉得 Fable 5.1 和 Astra 都同时降智了,原来两家都有大动作!
用具体场景和实测数据拆解不同模型的性价比,结构清晰且结论明确,适合创作者参考如何客观分析AI产品差异。
怪不得昨天我觉得 Fable 5.1 和 Astra 都同时降智了,原来两家都有大动作!
@AnthropicAI 先发布了 Opus 5.5,前后只隔了 90 分钟,@OpenAI 就发布了 GPT-6 Sol 和 Luna。
@bridgebench 让几个模型用同一个提示词做 3D 火箭发射场景,Opus 5.5 花了 1.52 美元、12 分钟,GPT-6 Luna 花了不到 1 美分、65 秒,你的 API 账单得重新算一遍了。
每百万 token 的输入 / 输出单价: GPT-6 Luna:$0.1 / $0.5 GPT-6 Sol:$2 / $10 Opus 5.5:$4 / $20 GPT-6 Astra:$10 / $50
Artificial Analysis 的智能指数上,Opus 5.5 拿了 58 分,在 212 个模型里排第一,Astra 53 分,Sol 48 分,Luna 37 分。
说实话,Sol 的分数只比上一代 GPT-5.6 Sol 高 1 分,OpenAI 这次主要是把 API 价格降到了 GPT-5.6 促销价的一半。
虽然Opus 5.5 的单价是 Sol 的两倍,但是它开 medium 档跑一个任务是 1.34 美元、51 分,Sol 开到 max 档是 1.06 美元、48 分,Opus 5.5 每个任务只多花 0.28 美元,分数高 3 分。
AA 跑完整套测试,Opus 5.5 花了 8708 美元,Sol 花了 1550 美元,钱多花在输出上:Opus 5.5 输出了 2.6 亿个 token,Sol 只输出了 7700 万个。
如果你天天用 Claude Code 跑命令行 agent,Opus 5.5 在 Terminal-Bench 4.0 上是 59.6%,Sol 是 44%,差了 15 个点,这点钱我觉得值得花。
如果你跑的是分类、抽取这种量大又简单的活,Luna 跑一个任务只要 0.07 美元,Opus 5.5 最便宜的 low 档一个任务也要 0.55 美元。
各档怎么选? 🔹 Opus 5.5 各档在 AA 上的分数和单任务成本:max 58 分 / 5.98 美元,high 54 分 / 1.82 美元,medium 51 分 / 1.34 美元,low 42 分 / 0.55 美元
🔹 Anthropic 官方说 Opus 5.5 比 Opus 5 便宜 40%,但 AA 用 max 档实测,Opus 5.5 一个任务 5.98 美元,Opus 5 是 5.86 美元,想省钱就得把档位调低
🔹 Sol 和 Luna 单次输入超过 272K token 的时候,整次请求的输入按 2 倍、输出按 1.5 倍计费
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力