Hugging Face 博客(RSS)关联 7 源
GLM-5.2发布:专为长时任务设计
Hugging Face 博客发布了 GLM-5.2 模型,该模型专为长时任务(Long-Horizon Tasks)设计,旨在提升在需要长期规划和多步推理的场景中的表现。GLM-5.2 在多个基准测试中展示了其在长上下文理解和复杂任务执行方面的改进。
每早八时出报
AI · 模型 · 产业
新闻枢纽 · 日报
中文 AI 资讯
NEWSHUB DAILY
AI行业正经历成本与地缘政治的双重震荡:微软考虑将中国开源模型DeepSeek V4的微调版本引入Copilot,以应对高昂的模型调用成本;同日,DeepSeek完成510亿元首轮外部融资,估值近4000亿元。与此同时,英伟达B200租赁价将翻倍,算力期货合约即将推出,进一步凸显供需矛盾。在G7午餐会上,AI领袖已跻身地缘政治决策核心,技术竞赛与成本博弈正重塑行业格局。
MarkTechPost(RSS)关联 3 源
OpenAI 发布了一种名为 Deployment Simulation 的预部署安全方法。该方法通过在候选模型上重放过去的对话,模拟其在实际部署中的行为,从而在模型发布前评估风险。核心流程是:取近期部署对话,移除原模型回复,用候选模型重新生成,然后评估新回复中的失败模式。该方法可估计部署时不良行为的频率,并在发布后通过真实流量验证。OpenAI 在 GPT-5 系列模型上进行了测试,分析了约 130 万条去标识化对话,中位乘法误差为 1.5 倍。该方法还能降低模型对评估的感知(evaluation awareness),使模拟流量与真实流量几乎无法区分。此外,该方法已扩展至 Agent 工具调用场景,通过模拟工具调用评估编码 Agent 的内部部署风险。
Hugging Face 博客(RSS)关联 7 源
Hugging Face 博客发布了 GLM-5.2 模型,该模型专为长时任务(Long-Horizon Tasks)设计,旨在提升在需要长期规划和多步推理的场景中的表现。GLM-5.2 在多个基准测试中展示了其在长上下文理解和复杂任务执行方面的改进。
小互
OpenAI 宣布 Codex 产品(包含 App 客户端、命令行 CLI 和开发包 SDK)将支持直接接入任何开源大模型,不强制绑定 OpenAI 自家的模型。同时,OpenAI 发布了文档,手把手教开发者如何将 Codex 客户端底层的模型替换为免费的开源模型。
IT之家(RSS)关联 3 源
谷歌推出新一代Google Home智能音箱,搭载Gemini for Home AI语音助手,支持自然语言交流与多步骤语音指令。该音箱采用球形设计,提供360°环绕音效,具备先进麦克风系统,可自动适应环境。支持与Google TV Streamer配合组成立体声系统。硬件配置包括1GB LPDDR4内存、四核Cortex-A55 2.0 GHz处理器及4GB存储。顶部有电容触控区,机身包裹3D织物,提供三种配色。定价100美元,6月25日上市。
Rohan Paul关联 14 源
G7人工智能午餐会显示,前沿AI领导者已进入地缘政治决策的讨论中。会议将Sam Altman、Dario Amodei、Demis Hassabis、Arthur Mensch、Aidan Gomez、Uljan Sharka、Victor Riparbelli、Robin Rombach、Alex Wang、Marc Benioff以及Sarvam和Sakana的负责人与各国领导人安排在同一房间。Sam Altman坐在美国总统特朗普和埃及总统塞西之间,是午餐会上首位发言的CEO。权力格局变化明显:政府可以制定法律,但只有少数私人实验室能够构建模型、测试其危险能力、限制访问或提供运行所需的基础设施。在G7中,当前的直接争夺围绕前沿AI访问权展开,因为Anthropic的Fable 5和Mythos 5触发了美国出口管制,官员担心先进模型可能帮助大规模发现软件漏洞。
IT之家(RSS)关联 4 源
企查查数据显示,DeepSeek 于 2026 年 6 月 16 日完成首轮外部融资,融资规模约 510 亿元,企业估值近 4000 亿元。投资方包括创始人梁文锋、腾讯、宁德时代、网易、京东、Monolith 砺思资本、IDG 资本、正心谷投资、拾象科技以及国家人工智能产业投资基金。DeepSeek 成立于 2023 年 7 月,此前由幻方量化全资支持。本轮融资中,梁文锋要求外部投资者将资金投入由其管理的有限合伙企业,并设置五年锁定期,仅国家人工智能产业投资基金直接入股并享有投票权。融资所得计划用于扩展 AI 基础设施、加强研发、员工股权激励及商业化。
华尔街见闻(RSS)关联 3 源
据Axios报道,微软正在考虑将中国开源模型DeepSeek V4的微调版本引入其企业AI工具Copilot Cowork,作为OpenAI和Anthropic模型的低成本替代选项。微软预计将在未来数周内确定并公布最终选择。微软负责Copilot业务的执行副总裁Charles Lamanna表示,部分用户使用成本高昂,因此公司已宣布将Copilot Cowork切换为按计算量计费模式。高盛Delta-One交易台负责人Rich Privorotsky指出,当前AI行业面临“价值万亿的问题”:更低的智能成本是在创造需求还是摧毁定价权。数据方面,追踪AI Token价格的Silicon Data Token指数已连续13个交易日中有12个交易日下跌。微软的多模型策略反映了行业转向:不再押注单一供应商,而是根据任务复杂度和成本灵活调配模型。
华尔街见闻(RSS)关联 2 源
中国证监会主席吴清在2026陆家嘴论坛上宣布,科创板第五套上市标准适用范围将扩大至人工智能大模型行业,允许尚未盈利或收入规模较小的AI企业以市值为核心指标申请上市。他还表示,将适时发布规范发展资本市场人工智能的指导意见,并支持符合条件的港股上市公司在境内上市。此外,证监会将会同人民银行研究推进人民币外汇期货试点,支持外资在华新设独资或合资证券、基金、期货机构。吴清透露,新“国九条”发布两年多来,社保、保险等机构持有A股流通市值增长85%,净买入1.3万亿元。下一步将拓宽资金来源,引导养老金、保险资金加大股权投资力度,并优化并购重组机制,降低交易成本。
华尔街见闻(RSS)
据The Information报道,OpenAI向股东披露的2026年第一季度财务数据显示,公司营收57亿美元,现金消耗37亿美元,均较上年同期增长约三倍。Q1净亏损逾213亿美元,其中约124亿美元为非现金会计费用,经营亏损为93亿美元。毛利率从33%微升至39%,但研发支出高达86亿美元,远超毛利润22亿美元。截至季末,账面现金及有价证券超730亿美元,主要来自3月底的大规模融资。公司预测全年现金消耗250亿美元,明年达570亿美元。此外,截至2025年底,OpenAI对云服务商的算力采购承诺高达6650亿美元,大部分未体现在资产负债表上,构成未来固定负担。
Chubby♨️
Anthropic CEO Dario Amodei 和 Google DeepMind CEO Demis Hassabis 呼吁组建一个“美国主导的联盟”,以制定人工智能相关的规则和标准,并将中国排除在外。Amodei 在演讲中表示,该联盟应构建对前沿模型和硬件(包括芯片及其他关键组件)的访问机制,以排除中国。这标志着新冷战时代的到来,技术竞争将从根本上排斥对手的参与,因为技术影响国家安全与战略。
华尔街见闻(RSS)
AI推理基础设施服务商Baseten首席执行官Tuhin Srivastava透露,其云服务商已通知,英伟达B200 GPU的每小时租赁单价将在10月合同续约时从2.63美元涨至5.10美元,涨幅约94%。他表示,云服务商提前数月主动报价,表明算力持续紧缺,需求方议价空间极小。供给端方面,当前采购1000块GPU的交付排期已延至明年第二季度,等待周期长达12至15个月。Baseten成立于2019年,提供生产级AI推理基础设施服务,已获英伟达战略投资。
华尔街见闻(RSS)
初创公司Silicon Data携手芝商所(CME)推出全球首个AI算力期货合约,旨在为AI开发商和金融机构提供对冲GPU算力价格波动的工具。该合约以Silicon Data编制的GPU基准指数为定价依据,目前正等待美国商品期货交易委员会(CFTC)监管审批。合约将算力标准化为可交易的大宗商品,类似航空燃油对冲逻辑。Silicon Data创始人Carmen Li预计算力期货市场规模将超过石油期货。ProShares和Rex Shares等资管公司已提交挂钩该合约的ETF申请。标准化是核心挑战,仅英伟达H100芯片就有逾50种配置,需归一化为基准配置。SpaceX已在招股书中引用其GPU租用价格数据。
Avi Chawla
该内容总结了2026年AI工程的全栈技术栈,涵盖从模型基础到生产部署的十个层次:1)基础层(token、嵌入、Transformer、注意力机制、上下文窗口、位置编码、混合专家);2)模型行为(预训练、后训练、采样、温度、推理模型、多模态、测试时计算);3)提示工程(系统提示、少样本、思维链、结构化输出、提示缓存、自一致性、元提示);4)检索(分块、向量数据库、混合搜索、重排序、检索评估、查询重写、GraphRAG);5)Agent(函数调用、ReAct、规划、反思、多智能体、计算机使用、人在回路);6)上下文工程(上下文管理、压缩、记忆、MCP、Agent框架、即时检索、结构化笔记);7)微调(SFT、LoRA、RLHF、DPO、蒸馏、GRPO、RLVR);8)推理优化(量化、KV缓存、批处理、推测解码、vLLM服务、FlashAttention、PagedAttention);9)评估(基准、LLM-as-judge、黄金数据集、幻觉检测、回归测试、轨迹评估、红队测试);10)LLMOps与安全(可观测性、成本追踪、护栏、PII脱敏、反馈循环、提示注入防御、模型路由)。