跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 3 事件 · 覆盖 3 家信源
今日头条 · Lead

OpenAI内部Codex使用数据:Agent正重塑知识工作

meng shao关联 3

OpenAI官方博客发布Codex使用数据,显示Agent正从研发向全部门渗透。关键发现:1)任务复杂度提升,约24%的Codex请求对应人类1小时以上工作,内部重度用户单日可并行跑60+小时Agent运行时长;2)从ChatGPT到Codex的结构性迁移,2026年6月OpenAI内部99.8%的output token来自Codex,工程部门率先过半,法务、财务、招聘随后;3)非开发者用户增长迅猛,自2025年8月以来个人用户增长137倍,组织用户增长189倍;4)岗位边界模糊,业务职能员工用Codex产出的工作中超过1/4是编码类任务。数据表明,知识工作的基本单位正从“一问一答”转向“委托长周期任务”。

#OpenAI#Codex#Agent

03

行业动态

Industry2

华尔街见闻(RSS)

Agent框架比模型本身对成功率影响大7倍

AI评估平台Braintrust从Hugging Face抓取1781条Agent生产环境运行轨迹,覆盖六款主流模型在六大类任务中的表现,用GPT-4o逐条打分。回归分析显示,在控制基准测试和模型后,智能体框架能解释约5.3%的成功率差异,模型仅解释0.7%,换框架的影响力是换模型的7倍以上。同一模型在不同框架下成功率波动可达80个百分点,如Claude在SWE-bench编程任务中,claude_code下成功率100%,tool_calling下仅14%。成本方面,开源模型在编程任务中每次成功成本远低于闭源,如Kimi K2.5配合claude_code仅0.73美元,而Claude Opus需4.28美元。GPT-4.1虽Token便宜,但因高失败率导致每次成功成本并不低。研究还发现,编码任务失败时伴随更多Token消耗,而对话任务失败时则更快结束。结论是,创业公司的核心竞争优势应从“选模型”转向“推理成本管理和部署效率”。

#Braintrust#Agent框架#推理成本

IT之家(RSS)

近400家美国报纸联合起诉OpenAI和微软侵犯版权

据IT之家6月26日消息,代表近400家纸媒的出版商联盟于6月24日向美国纽约南区联邦地区法院提起诉讼,指控微软和OpenAI未经授权抓取新闻内容用于训练Copilot和ChatGPT等AI模型,涉嫌侵犯版权并违反《数字千年版权法》。起诉书称,被告“系统性且秘密地”爬取出版商网站,复制文章等原创作品用于训练大语言模型,并删除版权管理信息。原告指出,AI产品基于出版商内容创造数十亿美元市场价值,但出版商未获分文。OpenAI回应称训练数据基于公开数据且符合合理使用原则,微软未予置评。

#OpenAI#微软#版权诉讼

往期存档