跳到主内容
@wquguru
精选70Chubby♨️模型发布/更新多源精选 ×8

Gemini 4 Argon在AA指数与GPT-6 Astra持平

Even on AAI index Gemini 4 looks really really good! Fable-Class Model. Gemini 4…

原文
发到 X

Even on AAI index Gemini 4 looks really really good! Fable-Class Model. Gemini 4 Argon matches GPT-6 Astra on Artificial Analysis’s Intelligence Index.

即使在AAI指数上,Gemini 4的表现也真的非常好!属于Fable级模型。Gemini 4 Argon在Artificial Analysis的智能指数上与GPT-6 Astra持平。

53 points, versus Astra’s 53 and GPT-6.1 Sol’s 52. It also takes #1 on AutomationBench-AA.

得分为53分,与Astra的53分和GPT-6.1 Sol的52分相当。它在AutomationBench-AA上也排名第一。

On AA-Omniscience, Argon hallucinates far less: 15% versus Astra’s 51%. It is more willing to admit uncertainty, though its answer accuracy is lower: 50% versus 63%.

在AA-Omniscience(全知)测试中,Argon的幻觉率远低于Astra:15%对比51%。它更愿意承认不确定性,尽管其答案准确率较低:50%对比63%。

Yep, looks like a very good release. Kudos @GeminiApp

是的,看起来这是一次非常出色的发布。向 @GeminiApp 致敬

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →