跳到主内容
NewsHub

日报

LIVE每早八时发报 · 更新于 00:34NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 15 事件 · 2 一手信源 · 覆盖 8 家信源
今日头条 · Lead

IBM暴跌26%创纪录,高盛警告软件熊市

IBM二季度业绩不及预期,股价创1968年来最大单日跌幅,高盛警告AI投资正系统性挤占传统软件支出。同日,Anthropic发布Claude Sonnet 5逼近Opus性能,纽约州签署全美首个数据中心暂停令,中国AI情感陪伴平台集体下架,行业格局加速重塑。

MarkTechPost(RSS)关联 4

PrismML 发布 Bonsai 27B:1-bit 与三值量化版 Qwen3.6-27B,可运行于笔记本和手机

PrismML 发布了 Bonsai 27B,这是 Qwen3.6-27B 的低比特量化版本,而非新预训练模型。架构保持不变,提供三值(Ternary)和 1-bit 两种变体,均采用 Apache 2.0 许可。三值版使用 {−1, 0, +1} 权重,每权重 1.71 比特,理想大小 5.9GB;1-bit 版使用 {−1, +1} 权重,每权重 1.125 比特,大小 3.9GB。两者均为多模态,支持 262K 上下文。在 15 项基准测试中,三值版保留 FP16 基线 94.6% 的性能,1-bit 版保留 89.5%。1-bit 版是首个适配手机的 27B 级模型,在 iPhone 上每 1% 电量可生成 672 个 token。模型通过 llama.cpp 和 MLX 运行,支持 OpenAI 兼容 API 和工具调用。

#PrismML#Bonsai 27B#Qwen3.6-27B

01

模型发布/更新

Model Releases3

MarkTechPost(RSS)

Anthropic 发布 Claude Sonnet 5:更智能、更便宜,逼近 Opus 4.8

Anthropic 发布 Claude Sonnet 5,定位为最具代理能力的中端模型,支持规划、驱动浏览器和终端、自主执行长任务。即日起成为 Free 和 Pro 计划的默认模型,Max、Team、Enterprise 用户可选,并已在 Claude Code 和 Claude Platform 上线。基准测试全面超越 Sonnet 4.6:SWE-bench Pro 63.2%(Sonnet 4.6 58.1%,Opus 4.8 69.2%),OSWorld-Verified 81.2%(78.5%),Terminal-Bench 2.1 80.4%(67.0%),HLE 57.4%(46.8%,Opus 4.8 57.9%)。知识工作基准 GDPval-AA v2 得分 1618,略超 Opus 4.8 的 1615。API 定价:输入 $2/百万 token,输出 $10/百万 token(截至 8 月 31 日促销价),之后恢复为 $3/$15;Opus 4.8 为 $5/$25。模型支持 effort 级别(低/中/高/极高),更高 effort 消耗更多推理 token。使用更新 tokenizer(与 Opus 4.7 相同),相同文本 token 数增加约 1.0-1.35 倍。安全性优于 4.6,但网络能力故意较低。

#Anthropic#Claude Sonnet 5#模型发布

Rohan Paul

295B模型压缩至1位,本地运行比云API快2.2倍

Atomic Chat 将腾讯开源的 295B 参数 MoE 模型 Hy3 极端压缩至 1 位,文件大小仅 92GB,并在 4 块 RTX 5090(128GB VRAM)上本地运行。与云端 API 相比,本地推理速度提升 2.2 倍(15.5 分钟 vs 34.3 分钟),且输出质量保持可用:两者均能通过单次提示生成可运行的 Flappy Bird、Arkanoid 和 Snake 游戏,无崩溃或明显视觉差异。Hy3 采用 Apache 2.0 许可证,企业可商用。

#Tencent#Hy3#模型压缩

Avi Chawla

NVIDIA 发布 Molt 强化学习框架,简化训练流程

NVIDIA 发布了名为 Molt 的强化学习框架,旨在简化 RL 训练流程。该框架允许用户通过一个 Python 文件定义环境和奖励逻辑,无需修改训练器代码。用户只需编写一个包含 step() 函数的类并返回奖励,框架即可处理其余部分,支持高达 1T 参数的 MoE 模型训练。Molt 摒弃了传统 RL 框架中环境代码内置于训练器、需要单独训练奖励模型并分配 GPU 的做法。它支持两种智能体接入方式:Env 类(用户定义 step() 函数)和 ChatAgent 类(用户自行编写循环,通过 OpenAI 或 Anthropic 客户端调用模型,框架启动本地 vLLM 引擎处理请求)。奖励可以来自字符串匹配评分器、沙盒子进程执行的代码或 LLM-as-judge 调用。Molt 内部使用 FSDP2 管理可训练 actor(可选 critic 用于 PPO),vLLM 引擎用于生成,Ray 队列用于异步通信,实现生成、训练和权重同步的重叠。扩展规模只需设置相应标志,框架自动跨 GPU 拆分模型,同一脚本可在单节点训练 8B 模型,也可在集群上训练 DeepSeek-V3 规模的 MoE 模型。

#NVIDIA#Molt#强化学习

02

产品发布/更新

Products2

Anthropic Newsroom(web_list)关联 4

Anthropic 推出 Claude for Teachers,免费服务美国 K-12 教师

Anthropic 宣布推出 Claude for Teachers,为美国经认证的 K-12 教师免费提供高级 Claude 功能、教学技能库,并连接基于证据的课程资源,覆盖全美 50 个州的学术标准。该产品旨在帮助教师实现差异化教学、掌握学习和小班教学等最佳实践,缓解时间与资源压力。Claude for Teachers 可连接 Learning Commons 获取课程标准,并整合 ASSISTments、Brisk Teaching、Canva Education 等 K-12 工具生态。教师可使用 Claude 规划课程、为不同水平学生调整材料,并通过 Claude Code 和 Cowork 实现数据分析、任务自动化。产品仅限教师使用,数据不用于模型训练,并符合 FERPA 隐私标准。Anthropic 还与美国教师联合会合作制定行业最佳实践。此外,Anthropic 发布了面向教师的 AI 素养课程,并开源教学技能库,计划在底特律公立学校社区学区进行试点评估。教师可在 2027 年 6 月 30 日前注册,获得一年免费访问权限。

#Anthropic#Claude#教育

MarkTechPost(RSS)

Mistral Vibe、Claude Code、Cursor、Codex 四大编码 Agent 横向评测

MarkTechPost 对四款主流编码 Agent(Mistral Vibe for Code、Claude Code、Cursor、OpenAI Codex)进行了横向对比,评测任务为:在现有 Python/FastAPI 服务中新增 /subscriptions 端点,包括脚手架搭建、测试生成与运行、最终提交 PR。评测维度包括功能脚手架、测试循环、PR/异步工作流、覆盖面、成本与可控性,每项 1-5 分,满分 25 分。结果:Mistral Vibe 以 22 分居首,其优势在于开源(Apache 2.0)、可自托管、支持微调、Pro 版仅 $14.99/月,且覆盖面最广(终端、VS Code、JetBrains、Zed、Web、移动端)。Claude Code 与 Codex 同获 21 分,Claude Code 在原始编码质量上领先,但成本较高且无自托管选项;Codex 跨设备异步能力突出,但 5 小时滚动窗口限制明显。Cursor 得 16 分,IDE 内联编辑体验优秀,但在全自动脚手架-PR 任务中结构上处于劣势。评测强调各工具基准测试不可直接比较,且厂商数据需谨慎对待。

#Mistral#Claude#OpenAI

03

行业动态

Industry8

IT之家(RSS)关联 4

DeepSeek 拟以 710 亿美元估值开启新一轮融资

据《金融时报》报道,深度求索(DeepSeek)已从本周开始与新投资者就新一轮融资展开初步磋商,计划以 710 亿美元的投前估值再次募集资金。三位消息人士称,DeepSeek 的首轮外部融资于今年 5 月末完成,筹集约 70 亿美元资金,其中约 30 亿美元来自创始人梁文峰,投后估值达 520 亿美元。知情人士透露,DeepSeek 之所以在短时间内启动新一轮融资,是为了支持大规模数据中心建设和人工智能芯片购买。DeepSeek 尚未就此报道作出回应。

#DeepSeek#融资#行业动态

华尔街见闻(RSS)关联 2

IBM暴跌26%创纪录,高盛警告软件熊市来临

IBM发布第二季度业绩预警,营收172亿美元低于预期的179亿美元,Non-GAAP每股收益2.93美元亦不及预期。股价盘中暴跌26%,创1968年以来最大单日跌幅。CEO Arvind Krishna将业绩不及预期归因于客户资本支出优先级突然转变,企业将大量预算转向AI基础设施硬件采购,导致多笔大型合同未能签署。高盛警告称,此次事件将印证“软件熊市情景”,预计软件与服务板块将出现广泛抛售。分析师指出,IBM大型机及关联的Transaction Processing业务疲软是主要拖累,而Red Hat等增长业务难以抵消。市场担忧AI投资开始系统性挤占传统软件支出,但部分分析师提示IBM存在个股执行问题,不宜简单映射至行业整体。

#IBM#高盛#AI资本开支

IT之家(RSS)关联 5

纽约州签署全美首个数据中心建设暂停令

纽约州州长凯西·霍楚尔签署行政命令,暂停新建功率超过50兆瓦的超大规模数据中心的环境许可,最长持续一年。此举旨在为政府制定监管规则争取时间,以降低数据中心对居民电价和环境的影响。该门槛高于州议会此前批准的20兆瓦标准,以避免影响小型数据中心。霍楚尔还要求公共服务部制定环境影响评估标准,并研究让数据中心运营商投资能源基础设施的机制。此外,她计划推动取消大型数据中心的销售税减免政策。美国多个州正加强对数据中心建设的监管,缅因州类似法案曾被否决。

#纽约州#数据中心#监管

The Verge AI(RSS)关联 4

Meta被诉用AI偏见工具大规模裁员

26名前Meta员工起诉公司,指控其使用AI工具不公平地针对休假的员工进行裁员。诉讼称,Meta通过内部AI工具收集绩效数据来决定裁员名单,但未能将休产假或病假的员工排除在排名系统之外,导致这些员工被不成比例地选中。AI评分不仅未考虑受保护休假,反而因员工行使休假权利而对其惩罚。

#Meta#诉讼#AI偏见

经济观察报

AI情感陪伴平台集体下架智能体,监管新规重塑行业格局

7月15日《人工智能拟人化互动服务管理暂行办法》正式施行,字节跳动豆包、阿里千问等头部AI应用宣布下线智能体功能,包括情感陪伴类产品。网易云音乐妙时、腾讯元宝智能体等也将下线。字节跳动提供数据迁移至独立应用“猫箱”的方案,但历史对话记忆无法迁移。新规禁止情感操纵、向未成年人提供虚拟亲密关系服务,要求强制防沉迷提醒等。部分平台和创业者转向海外市场,如PolyBuzz、Emochi等产品在欧美、东南亚等地发展,但面临算力成本高、商业变现难等挑战。行业分析认为,通用大模型主站与拟人化互动业务需物理隔离以降低合规风险。

#AI情感陪伴#监管#字节跳动

华尔街见闻(RSS)关联 2

谷歌向新云服务商推销TPU,挑战英伟达GPU主导地位

谷歌正将自研AI芯片TPU从内部基础设施推向外部市场,首次大规模瞄准长期依赖英伟达GPU的新兴云服务商(Neocloud)。据The Information报道,谷歌近期积极向多家新云服务商推销TPU,强调其在成本、稳定性等方面的优势,并提出为数据中心项目提供融资支持,承诺回租部分TPU以降低客户资金压力。英伟达迅速反制,推出GPU回租担保计划,并与部分客户讨论新的财务激励措施。谷歌还联合黑石成立新云服务商,计划自明年起向AI开发者出租TPU算力。目前TPU已吸引Anthropic、Meta、苹果等企业使用。

#谷歌#英伟达#TPU

Chubby♨️

哈萨比斯撰文:AGI 堪比电与火,影响是工业革命10倍

DeepMind 联合创始人、2024年诺贝尔化学奖得主 Demis Hassabis 发表关于 AGI 的乐观文章。他认为 AGI 不能与互联网或手机等标准技术突破相提并论,而更类似于电或火的发现,其影响将是工业革命的10倍,速度也是10倍。他警告网络安全风险已现实存在,生物和核威胁可能紧随其后,而商业和地缘政治竞赛正推动能力超越我们的理解。作为行业一贯的怀疑论者,他此次的乐观表态意义重大,并呼吁在几年内建立监管基础设施。

#Demis Hassabis#AGI#DeepMind

云头条

爱诗科技完成29亿元C轮融资

2026年7月14日,爱诗科技宣布完成整体C轮融资,累计融资29.8亿元人民币。其中C+轮由阿里巴巴领投,Lollapalooza Capital(王慧文家办)、常春藤资本、惠远资本、钟鼎资本、韩国未来资产、OCBC生态下Lion X基金、蓝色光标、CloudAlpha、iGlobe Partners等十余家机构参与。融资将用于视频生成基础模型、实时世界模型、全球化产品增长和产业场景落地。

#爱诗科技#融资#视频生成

往期存档