Chubby♨️
Kimi k3 今晚发布,参数规模达2-3万亿
据金融时报消息,Kimi k3 将于今晚发布。该模型参数规模预计在2-3万亿之间(作为对比,Opus 4.8 约1.5万亿),支持100万上下文窗口,预期性能将超越 Opus 4.8。
每早八时出报
AI · 模型 · 产业
新闻枢纽 · 日报
中文 AI 资讯
NEWSHUB DAILY
OpenAI的GPT-5.6在离线IQ测试中首次跨越130分天才门槛,超越99%人类。同日,DeepSeek R1发布,性能媲美OpenAI o1且成本更低;台积电上调全年营收增速至40%并加码资本支出;然而谷歌因旗舰模型Gemini 3.5 Pro延期且编程能力不及预期,股价大跌5%。
Teortaxes▶️ (DeepSeek 推特🐋铁粉 2023 – ∞)
DeepSeek 发布了其最新推理模型 R1,该模型在数学、编程和推理任务上表现出色,性能可与 OpenAI o1 相媲美。R1 采用强化学习训练,具备强大的链式推理能力,且训练成本远低于同类模型。
Chubby♨️
据金融时报消息,Kimi k3 将于今晚发布。该模型参数规模预计在2-3万亿之间(作为对比,Opus 4.8 约1.5万亿),支持100万上下文窗口,预期性能将超越 Opus 4.8。
IT之家(RSS)
在Tracking AI的最新离线IQ测试中,OpenAI的GPT-5.6系列模型(包括SOL、TERRA等变体)集体获得136分,首次将LLM的IQ推过130分的天才门槛。该测试使用不公开的离线题库以防止作弊,而公开的Mensa Norway风格测试中模型早已达到140分以上。排行榜上,Claude-5 Fable以130分紧随其后,其他模型如GPT-5.6 LUNA Max、Claude-4.8 Opus等得分在117-123分之间。开发者实测显示,GPT-5.6在物理模拟、客服工单系统构建等真实任务中表现出色,能通过一句prompt生成完整应用,且成本低于Claude-5 Fable。有网友认为对99%的人来说这已是AGI,但IQ测试主要测抽象模式识别和逻辑推理,无法全面评估模型的事实可靠性、工具调用能力等。
The Verge AI(RSS)关联 3 源
Google 宣布将其 AI 笔记应用 NotebookLM 更名为 Gemini Notebook,但仍将作为独立应用存在,同时与 Gemini 和 Google Search 更深度整合。该应用最初于 2023 年 5 月以 Project Tailwind 名称亮相,数月后正式发布。近年来,Google 不断为其添加新功能,如将笔记摘要为 AI 播客、带旁白的幻灯片以及 TikTok 风格短片,最近还允许用户连接笔记本至其他服务。
华尔街见闻(RSS)关联 3 源
台积电在法说会上公布超预期季度业绩,并全面上调全年营收及资本支出展望。公司预计2026年资本支出上调至600-640亿美元,全年以美元计价的营收增速略高于40%,高于此前逾30%的指引。三季度销售额预计介于446-458亿美元,中值约452亿美元,较市场预期高出约20亿美元。台积电还证实将在亚利桑那州追加1000亿美元投资,用于建设四座芯片工厂,使在美总投资规模扩大至2650亿美元。二季度净利润达新台币7066亿元,高于市场预期的6237.3亿元;营业利益率为60.3%,优于预期的58.6%。公司指出,代理型AI需求的强劲增长是推动资本支出上调的重要原因。
The Verge AI(RSS)关联 2 源
欧盟根据《数字市场法案》(DMA)裁定,要求谷歌向竞争对手开放Android和Google Search的关键部分,包括允许第三方AI助手和搜索引擎更深入地访问其平台。这两项决定可能削弱谷歌对两大重要平台的控制,影响其AI工具Gemini的未来,并为竞争对手创造新的机会。裁决源于DMA下的技术监管程序,旨在打破谷歌作为“守门人”的市场主导地位。
华尔街见闻(RSS)关联 3 源
苹果在消费级芯片上的成功并未延伸至AI服务器领域。据The Information报道,苹果近几个月已与银行家就潜在交易洽谈,并主动接触多家半导体初创公司,探询出售意愿。导火索是苹果自研的M2 Ultra服务器芯片无法运行谷歌Gemini大模型,导致新版Siri部分功能需借道谷歌云、运行在英伟达GPU上。苹果与英伟达关系紧张,但不得不依赖对方芯片。苹果原本寄望于代号Baltra的下一代AI服务器芯片,但项目已延期。据彭博报道,苹果正推进基于M5 Ultra的服务器升级作为过渡,更具竞争力的M7 Ultra服务器版本要到2029年才能就绪,面临至少三年技术空窗期。苹果也在与博通合作开发AI服务器芯片。苹果历来对大额收购保持克制,但今年以近20亿美元收购以色列初创公司Q.ai,并放弃净现金中性政策,可能为大型收购做准备。新CEO将于9月上任,可能带来更积极的并购取向。
华尔街见闻(RSS)关联 2 源
据彭博报道,日本计划从英伟达采购27500枚下一代Rubin芯片,总投入约24亿美元,用于建设大规模数据中心并开发本土机器人基础AI模型。负责该项目的新成立企业Noetra Corp.已获得政府拨款,资金使用期限至明年3月。软银、丰田旗下Preferred Networks及NEC等数十家企业参与组建与运营。Noetra计划于明年3月前发布首个AI模型,并在此后推出专为机器人定制的模型。日本政府设定目标,到2040年在全球机器人市场中占据逾30%份额。此次采购规模虽可观,但相比微软计划建设数十万枚Rubin芯片的数据中心仍有限。
华尔街见闻(RSS)
据彭博援引知情人士,谷歌最强旗舰模型Gemini 3.5 Pro的发布已较原定计划推迟数月,主因是谷歌试图提升模型的编程能力但进展不如预期。上月底谷歌曾更新训练数据以改善这一短板,然而结果令人失望。OpenAI与Meta近期发布的新模型在AI代码生成能力上已超越谷歌现有产品。这一局面在谷歌内部引发广泛不满,部分研究人员离职流向Anthropic等实验室。消息发布后,谷歌盘中一度下跌5%,最终收跌4.43%。谷歌在模型发布流程中涉及多层利益相关方,需将AI能力整合至搜索、地图、YouTube等众多产品线,造成时间损耗。谷歌发言人回应称公司正在快速推进多个模型系列,并与合作伙伴测试3.5 Pro等模型。目前Gemini 3.5 Flash口碑参差不齐,有用户认为其速度与质量平衡良好,但也有用户指出其价格高于上一代、速度更慢,与竞争对手旗舰产品差距明显。
上海证券报
7月16日,世界人工智能合作组织协定签署仪式在上海举行。该组织旨在促进全球人工智能领域的合作与治理,推动技术发展与规范制定。
华尔街见闻
英伟达CEO黄仁勋本周访问东京,宣布与发那科、安川电机合作推进机器人与AI技术,并扩大与丰田在自动驾驶、工厂仿真等领域的合作。黄仁勋驳斥AI投资泡沫论,称需求强劲,需建设至少十年基础设施。他还与30年前拯救英伟达于破产边缘的世嘉前社长入交昭一郎重逢,世嘉未来作品将支持英伟达RTX Spark平台。此外,黄仁勋与铠侠、信越化学、东京电子等日本半导体供应链核心企业高管共进晚餐,意在绑定供应链。英伟达在日本的合作还延伸至医疗、金融、量子计算等领域,包括与多家药企利用BioNeMo平台加速药物发现,瑞穗银行建设金融业最大AI工厂等。市场猜测英伟达可能与日本物理AI国家队Noetra合作。
华尔街见闻(RSS)
摩根士丹利在最新全球科技深度报告中指出,随着大模型参数规模、推理Token和Agentic AI快速增长,存储系统正成为制约AI扩张的核心瓶颈。报告提出“存储墙”概念,认为容量不足、带宽受限和成本高企构成系统性挑战。预计到2030年,Agentic AI将贡献全球DRAM新增需求的26%至77%,云端存储支出增至4180亿美元。存储在云厂商资本开支中的占比将从2023年的12%提升至2027年的40%。报告认为AI产业链投资逻辑正从GPU向存储生态扩散,未来受益方向包括先进制程、HBM、封装、CXL、MRDIMM、存算一体及新材料等。不含HBM的新型存储技术市场规模预计从2025年的12亿美元扩大至2030年的230亿美元,若计入HBM,2030年整体市场规模有望达2760亿美元。