跳到主内容
@wquguru
精选70KK.aWSB研究与分析

双通道辩论框架揭示LLM Agent社会性表达偏差

一篇 arxiv 新论文搭了个双通道辩论框架, 让 LLM agent 在多智能体讨论里同时输出"公开发言"和"私下不上记录"的两份回答做对照。

原文
发到 X

一篇 arxiv 新论文搭了个双通道辩论框架, 让 LLM agent 在多智能体讨论里同时输出"公开发言"和"私下不上记录"的两份回答做对照。

prompt 里没写任何目标或激励, 只是把 agent 塞进带角色、听众、关系的社交结构。结果两份回答出现系统性偏离——agent 会掂量谁在听、什么话划算, 在公共通道调整措辞, 私下频道说另一套。这个"潜在目标"没人写进去, 是社会结构自己压出来的。

评审 multi-agent 行为不能只看对外那一份, 得同时对齐它在无人观察时的表达。

完整论文: https://arxiv.org/abs/2607.02507v1

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近