跳到主内容

日报

LIVE每早八时发报 · 更新于 00:00NewsHub Daily · 中文 AI 资讯精选

新闻枢纽 · 日报

本期 25 事件 · 覆盖 10 家信源
今日头条 · Lead

字节发布SeedRealtime全双工大模型

今日字节跳动正式推出原生音视频全双工大模型SeedRealtime,并已在豆包App全量上线,实时音视频交互体验成为焦点。与此同时,谷歌DeepMind领导层调整、Jeff Dean离职创业,AI领域人才与资本动作频频。DeepSeek重启第二轮融资,投前估值达5000亿元,行业热度持续攀升。

08:56华尔街见闻(RSS)关联 2

字节推出SeedRealtime音视频全双工大模型,已在豆包App全量上线

8月5日,字节跳动正式推出原生音视频全双工大模型SeedRealtime,并宣布该模型已在豆包App全量上线。用户将豆包更新至最新版本后,可通过“打电话”功能进入视频通话界面,体验实时音视频AI交互。SeedRealtime采用统一端到端架构,原生融合音频、视频与文本三种模态信号,不再依赖外部语音活动检测(VAD)进行轮次判断,而是在连续的多模态信息流上同步完成感知、理解、决策与表达。字节方面披露,SeedRealtime在音视频联合理解、主动交互能力、流畅的交互节奏三个方向实现关键突破。端到端人工评测数据显示,相比传统级联系统,SeedRealtime将音视频对话中的节奏问题减少约一半。

#字节跳动#SeedRealtime#多模态

01

模型发布/更新

Model Releases2
03

行业动态

Industry8

16:01Sundar Pichai关联 3

谷歌调整DeepMind领导层:哈萨比斯任首席科学家

谷歌CEO皮查伊宣布调整Google DeepMind领导层:Demis Hassabis升任DeepMind主席及Alphabet首席科学家,继续领导Isomorphic Labs,专注AGI与科学发现;Koray Kavukcuoglu接任DeepMind高级副总裁,负责模型开发、研究及Gemini应用与开发团队。Koray在DeepMind工作13年,曾领导深度学习团队并推动WaveNet和DQN等突破。

#Google DeepMind#人事变动#Demis Hassabis

17:28Rohan Paul关联 2

谷歌首席科学家Jeff Dean离职创业,成立Discovery Loop

谷歌首席科学家Jeff Dean在任职27年后离职,创办新公司Discovery Loop,旨在构建能自主运行研究循环的AI。Jeff Dean是谷歌第30号员工,曾编写存储和计算系统,并于2011年创立Google Brain,推动TPU发展。新公司聚焦自动化机器学习研究,未来拓展至硬件设计、药物发现和清洁能源。联合创始人包括Sanjay Ghemawat、Quoc Le和Oriol Vinyals。Radical Ventures和Khosla Ventures共同领投种子融资,Alphabet作为创始投资者和云合作伙伴,提供至少一年的算力支持。消息公布后,谷歌股价下跌约4%。

#Google#Jeff Dean#创业

01:32华尔街见闻(RSS)

DeepSeek重启第二轮融资,投前估值5000亿元

据《财经》报道,DeepSeek重启第二轮融资,计划募资500亿元,投前估值约5000亿元,较首轮提升约43%,预计8月下旬完成签约。首轮融资于4月开启、6月交割,金额500亿元,估值超3500亿元。第二轮融资曾在7月底暂停,原因之一是创始人梁文锋对网上流传言论不满。目前部分机构称尚未接到重启消息,通道仍暂缓。首轮投资方包括国家人工智能产业投资基金、腾讯、宁德时代等。若本轮顺利,两轮融资总额将超1000亿元。

#DeepSeek#融资#大模型

03:24华尔街见闻(RSS)

Gavin Baker谈AI抛售:GPU价格逆势上涨50%-60%

知名科技投资人Gavin Baker在播客中复盘2026年7月AI及半导体板块抛售,称市场恐慌与硅谷基本面背离。他梳理抛售导火索:Meta出租算力被误读、开源模型引发算力需求担忧、DUV光刻机传闻等,但认为均非实质利空。唯一认真对待的风险是信用市场,实际利率上升、信用利差走阔,但若超大规模云厂商经营性现金流加速,未来建设可自我融资。他援引案例称,某初创公司续租Blackwell集群价格七个月上涨50%-60%,推理云公司预计合同到期后支付价格翻倍。他还分析内存LTA博弈论、英伟达信用包装加收益分成模式,以及SpaceX算力布局。最大尾部风险是监管而非技术。

#Gavin Baker#AI投资#市场分析

03:06华尔街见闻(RSS)

摩根大通:亚洲科技股回调25-30%是买入时机

摩根大通在8月5日发布的亚洲科技策略报告中表示,亚洲科技股及费城半导体指数近期累计下跌25%至30%,但基本面未现走弱信号,EPS预期未来数季仍将上调,超大规模云服务商2027年资本开支指引上行,当前是买入时机。该行强调AI扩展定律依然成立,四大云厂商公有云收入同比增速连续多季加速,2026年第二季度单季新增收入约150亿美元,合同积压规模持续扩张。预计七大超大规模云服务商合计资本开支2026年同比增长约103%至约9010亿美元,2027年再增65%至约1.49万亿美元。子板块中,半导体设备与IC基板最具配置价值,存储板块态度审慎。

#摩根大通#亚洲科技股#AI资本开支

02:07华尔街见闻(RSS)

高盛上调中国大模型收入预期,Agent与编码驱动token消费

高盛分析师Ronald Keung在8月3日研报中,将中国大模型厂商2026年末合计ARR预期从100亿美元上调至130亿美元,并预测2030年达1250亿美元。Jefferies研报显示,OpenRouter平台上中国模型连续14周包揽调用量前五,DeepSeek V4 Flash单周消耗7.22万亿token登顶。高盛指出,智谱和MiniMax收入估计分别上调35%和22%—64%,高端模型定价约每百万token 1美元,低端低至0.06—0.2美元。Agent与编码场景的token消耗是普通问答的1000倍,推动中国模型token份额达63.5%。

#高盛#中国大模型#ARR

01:46华尔街见闻(RSS)

Arista Q2业绩超预期,上调指引至126亿美元,供应链成瓶颈

Arista Networks二季度营收同比增长38%至30.4亿美元,首次突破单季30亿美元,调整后每股收益1.02美元,均超预期。公司上调2026财年收入指引至约126亿美元,较此前高出11亿美元。管理层表示需求强劲,但供应链是主要瓶颈,紧张局面或延续至2028年。公司通过多年采购承诺(从36亿增至97亿美元)和扩大制造产能提升交付确定性。AI网络业务分scale up、scale out和scale across三类,其中scale across战略重要性上升。微软和Meta仍是核心大客户。

#Arista#AI网络#财报

05

技巧与观点

Tips7

21:56MarkTechPost(RSS)

用 Google Meridian 构建端到端贝叶斯营销组合模型

本教程使用 Google Meridian 构建完整的贝叶斯营销组合建模工作流。首先安装依赖库、验证 GPU 可用性,并探索包含媒体曝光、支出、控制变量、促销、转化、人口和收入的地理级营销数据集。然后将原始列映射到 Meridian 的数据模式,定义基于 ROI 的可解释先验,配置模型并使用先验和后验 NUTS 采样进行拟合。训练后,评估收敛性和预测准确性,检查渠道贡献、ROI、边际 ROI、有效性、广告库存、饱和度和响应曲线,并使用 Analyzer API 提取自定义后验指标。最后,优化固定和灵活预算,生成可共享的 HTML 报告,并保存拟合模型以供复用。

#Google Meridian#贝叶斯建模#营销组合模型

19:42Simon Willison 博客(RSS)

用Claude Fable 5从旧推文一键生成完整3D游戏

Simon Willison 在四年前一条推文的基础上,用 Claude Fable 5(在 Claude Code for web 中运行)从推文中的两张图片和简短描述自动构建了一个完整的浏览器 3D 游戏《Raccoon Heist》。他给出了详细提示词,要求模型独立工作、频繁提交并推送,以便通过 GitHub Pages 实时预览。Fable 5 使用 Three.js 构建游戏,并调用 OpenAI 的 gpt-image-2 生成纹理和标题画面,还通过 Playwright 自测,修复了移动端可见性问题。

#Claude#AI编程#Claude Code

14:10Exponential View(RSS)

管理AI代理的七条经验:从终点线到重启

Exponential View 团队基于六个月使用 AI 代理的经验,更新了七条管理建议。核心包括:先写可测试的终点线,如用 36 个测试用例替代描述性指令;将智能用在能改变结果处,用便宜模型做粗活,如 OpenClaw 常运行在 DeepSeek V4 Flash 上;用杠杆而非 token 数衡量价值,Azeem 的每周审计显示代理完成 62 项任务,成本约 800 美元,而人工估计需 19000 美元和 48 小时;不要争论,直接重启。文章还提到,2025 年 5 月约四分之一 Codex 用户每月至少请求一次相当于人类 8 小时的工作。

#AI代理#工程实践#管理经验

07:54小互

Higgsfield开源AI电影《Hell Grind》全部提示词

AI视频公司Higgsfield将其95分钟AI故事片《Hell Grind》的全部提示词和制作方法开源。项目包含115,446次生成记录,按场次整理在108个文件夹中,共计4万多条提示词,其中4,561条为中文提示词。所有镜头共用的12行“技术底座”被单独列出,涵盖从皮肤毛孔到60:30:10配色等细节,可直接复用。此外,还提供了人、道具、场景、怪物的三视图资产表。这一开源资源为AI影视创作者提供了完整的实操参考。

#Higgsfield#AI电影#开源

10:45InfoQ 中国(RSS)

不碰核心代码,用AI将7-Zip压缩速度提升97%

InfoQ 中国报道了一个实验:一位开发者在不修改核心代码的前提下,利用 AI 辅助优化,将 7-Zip 的压缩速度提升了 97%。文章详细描述了实验过程,包括如何通过 AI 分析性能瓶颈、调整编译选项和参数配置,最终实现显著加速。该实验展示了 AI 在性能优化领域的应用潜力,为开发者提供了一种新的优化思路。

#AI优化#7-Zip#性能优化

02:23向阳乔木

播客总结提示词:用 Sonnet 4.6 写出高质感中文文章

作者分享了一篇广受好评的小宇宙播客总结,并公开了其使用的提示词。该提示词基于 Raycast AI 中的 Sonnet 4.6 模型,开启 web search,生成后需多轮校对。提示词详细定义了角色设定(向阳乔木)、目标读者(有技术背景的从业者)、语言风格(口语化、短段落、生活化类比)、格式规范(中文标点、禁用破折号)、禁用表达(如“不是……而是”“想象一下”等 AI 腔句式)、写作结构(开头需信息量钩子、正文每段一事、结尾给行动结论)以及忠实度要求(保留关键数据、不改变原意)。并附有自查清单,帮助用户生成逻辑清晰、读感流畅的中文内容。

#提示词#播客总结#Raycast

01:21Latent Space(RSS)

Megakernels 已死又复活:推理工程大师课激辩

Latent Space 的推理工程大师课播客中,嘉宾就 Megakernels(巨型内核)展开激烈讨论。Ali 认为融合内核无法解决张量并行下的非线性操作通信问题,且编写优化良好的巨型内核难度极高,许多公司最终未在生产中运行,因为 TensorRT-LLM 和模块化内核可并行优化各组件,速度更快。NVIDIA 的 Rubin 架构设计似乎旨在消除巨型内核的优势,使该研究方向难以为继。然而,Cursor 开源了其 NVL72 MoE 训练巨型内核 MoK,据称整体吞吐量提升 41%,可节省数十亿美元成本。讨论还涉及 NVIDIA 的依赖触发机制等。

#Latent Space#推理工程#Megakernels

往期存档