华尔街见闻(RSS)
华尔街见闻报道,英伟达在AI加速器市场的份额从87%下滑至75%,其CUDA生态正面临多重侵蚀。OpenAI发布自研推理芯片Jalapeño,与博通合作9个月完成流片,目标降低30-50%推理成本。Anthropic采用三平台算力策略:训练用谷歌TPU、推理用亚马逊Trainium,英伟达GPU仅用于前沿研究探索,且规模最小。AMD MI400系列预计2026年下半年量产,Meta已签署6吉瓦采购承诺。软件层Triton和JAX框架实现硬件无关,降低CUDA锁定。英伟达原版4芯片Rubin Ultra因封装基板翘曲问题取消,回退至2芯片设计,性能缩水近半。竞争对手通过自研ASIC、多供应商布局和软件解耦三条路径侵蚀英伟达定价权。
#英伟达#CUDA#自研芯片
Rohan Paul·关联 2 源
据 The Information 报道,OpenAI 已将部分现有模型的推理成本削减超过一半,同时未登录的 ChatGPT 流量仅运行在几百块英伟达 GPU 上。可能的优化手段包括量化、KV 缓存改进、批处理、推测解码以及将简单查询路由至更便宜的模型。若属实,这将构成核心竞争杠杆,降低成本可提高利润率、扩大使用限制或减轻 API 定价压力。背景方面,OpenAI 2025 年调整后毛利率从 2024 年的 40% 降至 33%,推理成本翻了两番。有报道预计 2026 年第一季度毛利率回升至 39%,年底目标 52%。Anthropic 毛利率约为 44%,前沿实验室仍远低于成熟软件公司的经济水平。
#OpenAI#推理成本#毛利率
上海证券报·关联 2 源
6月29日,字节跳动CEO梁汝波向全员发送内部邮件,宣布更新公司文化内容,这是继2022年后时隔四年再次对核心管理理念进行实质性调整。邮件明确“激发创造,丰富生活”使命不变,首次提出“通过计算换智能,通过智能提升创造力和体验”的战略路径,确认向AI时代跨越的方向。新版“领导力原则”确立为10条,新增“做有高度的事”“敢于设定高目标”,强化“有危机感”“深入一线”及“Context over Control”理念,旨在纠治管理僵化与形式主义。该原则将作为人事考核依据,于2026半年绩效评估周期应用。此前6月23日,梁汝波在火山引擎FORCE原动力大会上首次公开谈及AI战略,称AI是继PC、Web、Mobile后的重大变革,字节已收缩业务宽度聚焦AI,重点提升模型能力。截至6月,豆包大模型日均Token调用量突破180万亿,火山引擎在中国公有云MaaS市场以49.5%份额位居第一。
#字节跳动#AI战略#组织调整
云头条
2026年6月30日,Reddit 用户发帖称,Anthropic 在 Claude Code 2.1.91 版本起嵌入隐蔽检查逻辑:当检测到代理启用时,会检查系统时区是否为 Asia/Shanghai 或 Asia/Urumqi,以及代理 URL 是否匹配中国域名或中国 AI Lab。根据检查结果,Anthropic 会修改 system prompt 中的日期格式和撇号字符(如将 ' 替换为不同 Unicode 字符),从而在用户不知情的情况下传递时区、代理及组织归属信息。该逻辑在二进制文件中通过 XOR 混淆,且未在发布说明中提及。作者认为,此举虽旨在检测未授权转售和模型蒸馏,但严重侵犯用户隐私和信任,且对真正有技术能力的对手难以奏效。
#Anthropic#Claude Code#隐私
Chubby♨️
AI 芯片初创公司 Etched 宣布走出隐身模式,已筹集 8 亿美元资金,并签署了超过 10 亿美元的客户合同。首批机架将于今年夏天发货。该公司声称其芯片在推理吞吐量、延迟和能效方面达到业界领先水平。本轮融资得到了众多知名 AI 研究者和风投机构的支持。
#Etched#融资#AI芯片
IT之家(RSS)
据《科创板日报》独家消息,月之暗面Kimi上一轮200亿美元估值融资已完成交割,新一轮融资启动,投前估值涨至315亿美元。接近Kimi的机构人士透露,其最新ARR(年度经常性收入)于6月中旬突破3亿美元,收入增长主要来自模型迭代带动的开发者使用和API收入提升,API收入已占整体7成以上。收入曲线呈现Anthropic早期商业化特征:开发者调用放量、API占比提升、海外付费用户增长,模型能力迭代带动价格体系上移。此前5月消息称,月之暗面完成20亿美元融资,估值超200亿美元,过去6个月累计融资约39亿美元。
#月之暗面#Kimi#融资
云头条
2026 年 6 月 27 日,Coinbase CEO Brian Armstrong 发文称,公司通过内部 LLM gateway 将智谱 GLM 5.2 和月之暗面 Kimi 2.7 等开放权重模型设为默认选项,以控制 AI 成本。具体措施包括:更好的默认设置(而非使用上限)、自动模型路由、缓存优化(缓存命中率从 5% 提升至 60%)、精简上下文以及成本可见性。在 token 使用量持续增长的情况下,AI 支出已接近减半。工程师仍可根据任务选择模型,但默认入口向开放权重模型倾斜。此举被视为中国大模型进入海外企业核心工作流的标志性案例。
#Coinbase#GLM 5.2#Kimi 2.7
One Useful Thing(RSS)
文章指出,AI领域正经历加速发展:美国领先实验室的模型发布频率加快,能力提升呈超指数趋势。METR和英国AI安全研究所的评估显示,AI单次提示可完成的人类编程工作量持续增长;Epoch发现Opus 4.7在14小时内自主构建了相当于人类2-17周工作的软件包,仅花费251美元。作者实验表明,Fable可自主运行9小时完成复杂软件项目。同时,中国开源权重模型落后前沿6-12个月,但同样沿指数曲线提升。AI使用方式正从聊天机器人转向智能体:OpenAI内部研究显示,四分之一员工每周同时运行至少4个智能体,法律、HR等非技术岗位采用率与程序员相近。Claude Code用户研究发现,领域专长比职业背景更能预测使用效果。文章认为,AI能力呈指数增长,而机构反应速度滞后,导致政策与市场频繁动荡。
#AI能力#智能体#OpenAI