精选70Teortaxes▶️ (DeepSeek 推特🐋铁粉 2023 – ∞)模型发布/更新
持续预训练/RL降低大模型事实性,仅Muse Spark例外
Horrifying. Do you see? Except for Muse Spark, continued pretraining/RL degrade…
Horrifying. Do you see? Except for Muse Spark, continued pretraining/RL degrade factuality in major model series. Gemini, GPT, Opus. But iirc this is not true for GLM-5, Minimax, Xiaomi. There clearly are different regimes.
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力