今日概览
- P0 一手信源: 4 条
- P1 权威媒体: 8 条
- 多源印证: 8 条全部有≥2个独立来源
- 关键词: [谷歌AI重组, SeedRealtime, 星载AI算力, 千亿MoE视频开源, Alpamayo 2 Super, Gemini接棒, 光模块禁令, Perplexity上诉]
重大事件
1. 谷歌 AI 领导层大重组:哈萨比斯卸任 DeepMind CEO,Jeff Dean 离职创办 Discovery Loop
- 来源: 谷歌官方博客/皮查伊内部信(P0)| WSJ、路透社、CNBC、新浪财经、网易科技(P1)| 印证数:6 个独立来源
- AI推荐分: 81(aihot)
- 摘要: 8月5日,谷歌宣布 AI 部门重大重组:诺贝尔奖得主、Google DeepMind CEO 哈萨比斯卸任,转任 DeepMind 董事长并出任新设立的 Alphabet 首席科学家(同时继续领导 AI 制药公司 Isomorphic Labs),专注 AGI 社会影响与长期研究方向;在谷歌工作 27 年的首席科学家 Jeff Dean 正式离职,与 Oriol Vinyals、Quoc Le、Sanjay Ghemawat 共同创办公益公司 Discovery Loop(探索循环),谷歌作为创始投资人与云合作伙伴参与;DeepMind CTO Koray Kavukcuoglu 升任高级副总裁,直接向皮查伊汇报,负责 Gemini 4 等下一代模型开发。Alphabet 股价在消息公布后一度下跌约 4%。
- 影响: 这是谷歌自 2023 年 Brain 与 DeepMind 合并以来最大的一次 AI 领导层变动。哈萨比斯从日常运营转向 AGI 治理与前沿科学,四位资深研究员集体出走创业,恰逢 Gemini 旗舰版研发进度落后、OpenAI/Anthropic 今夏相继挖走谷歌 AI 明星员工——谷歌 AI 进入「换帅+留人」双重考验期,也标志着头部实验室的核心人才开始向独立创业流动。
- 链接: https://www.wsj.com/tech/ai/googles-chief-scientist-is-leaving-after-27-yearsto-start-his-own-ai-company-6abad73d
- 价值点: 谷歌 AI 权力结构一夜重塑,是当日全球 AI 行业最重要的人事地震,将直接影响 Gemini 路线图与全球 AI 人才格局。
2. 字节跳动发布原生音视频全双工大模型 SeedRealtime,已全量上线豆包
- 来源: 字节跳动 Seed 官方博客(P0)| IT之家、凤凰网科技、财联社(P1)| 印证数:4 个独立来源
- AI推荐分: 78(aihot)
- 摘要: 8月5日,字节跳动 Seed 发布原生音视频全双工大模型 SeedRealtime,并在豆包 App 全量上线(通过「打电话」进入视频通话界面体验)。模型以统一端到端架构原生融合音频、视频与文本,支持「边看、边听、边说」的实时交互,具备音视频联合理解、主动交互与更自然的对话节奏三项核心能力;端到端人工评测显示,相比级联系统,音视频对话中的抢话、回应延迟与背景噪声误触发等节奏问题减少约 50%。
- 影响: SeedRealtime 不依赖 ASR/视觉模型/TTS 多模块串联,也不依赖外部 VAD 判断轮次,是业界率先将音视频全双工技术规模化落地到国民级 App 的案例;它把 AI 交互从被动问答推向「持续感知环境、主动协作」的全模态自然交互,直接参与实时多模态能力的第一梯队竞争。
- 链接: https://seed.bytedance.com/zh/blog/seedrealtime-%E9%9F%B3%E8%A7%86%E9%A2%91%E5%85%A8%E5%8F%8C%E5%B7%A5%E5%A4%A7%E6%A8%A1%E5%9E%8B%E5%8F%91%E5%B8%83-%E8%B5%B0%E5%90%91%E5%85%A8%E6%A8%A1%E6%80%81%E8%87%AA%E7%84%B6%E4%BA%A4%E4%BA%92
- 价值点: 字节把音视频全双工交互从实验室带进数亿用户的豆包,全模态自然交互进入规模化落地阶段。
3. SpaceX 与英伟达合作:Starmind AI1 卫星算力载荷独家采用 Vera Rubin
- 来源: SpaceX/英伟达官方公告(P0)| TeslaRati、Interesting Engineering(P1)| 印证数:3 个独立来源
- AI推荐分: 75(aihot)
- 摘要: 8月4日,SpaceX 宣布与英伟达合作设计 Starmind AI1 卫星算力载荷——规划星座中的首颗卫星,每颗搭载英伟达 Rubin GPU 与 Vera CPU,可在轨运行数据中心级 AI 负载;马斯克在 SpaceX 上市后首场财报电话会上表示,公司 AI 基础设施将独家采用英伟达硬件,并设定今年底 2GW、2027 年底约 10GW 的算力目标。英伟达同步推出 Space-1 Vera Rubin 模块,称其太空推理算力最高可达 H100 的 25 倍。
- 影响: 星载 AI 算力把「数据中心」概念推向太阳同步轨道(持续太阳能供电、不依赖地面电网)。SpaceX 与英伟达的独家绑定既是马斯克 AI 基建版图的关键落子,也意味着 AI 基础设施竞赛从地面机房延伸到太空——轨道算力与低轨星座的组合可能重塑边缘计算、地理情报与科学观测等场景。
- 链接: https://www.teslarati.com/spacex-and-nvidia-team-up-on-musks-orbital-ai-bet
- 价值点: 全球首个公开的「AI 算力上太空」量产方案,英伟达锁定马斯克系 AI 基建的独家硬件地位。
4. Sand.ai 开源全球首个千亿级 MoE 视频生成模型 MAGI-2 Preview
- 来源: 量子位/新浪科技、智东西/新浪看点、搜狐科技(P1)| 印证数:3 个独立来源
- 摘要: 8月5日,北京 AI 视频创企 Sand.ai 发布并开源全球首个千亿级 MoE 视频生成模型 MAGI-2 Preview:总参数 114B、单次前向仅激活约 6B,采用 Multi-Head MoE 架构与统一单流设计,文本、视频、音频在同一 Transformer 中音画同出;按 8 卡 H100 行情,生成 10 秒 1080P 视频成本约 0.5 元,约为行业主流模型的十分之一;在 Artificial Analysis 图生视频榜单进入全球前十(第六)。
- 影响: MAGI-2 把 MoE 的扩展路径从语言模型系统性迁移到视频生成,验证「千亿容量+低激活成本」在视频赛道的可行性;开源为学术界与中小团队提供私有化部署与微调选项。与本周 MiniMax H3(7/31 发布、8/3 开源)形成共振,视频生成的开源军备竞赛进入千亿参数时代,闭源厂商面临定价与生态双重压力。
- 链接: https://finance.sina.com.cn/tech/csj/2026-08-05/doc-inimfwqi5233694.shtml
- 价值点: 全球首个千亿 MoE 视频模型开源,为视频生成 Scaling 探明「MoE+单流」新路径。
5. NVIDIA 开源 Alpamayo 2 Super:34B 可商用推理型 VLA 模型瞄准 Robotaxi
- 来源: NVIDIA 官方博客/Hugging Face(P0)| MarkTechPost(P1)| 印证数:2 个独立来源
- AI推荐分: 79(aihot)
- 摘要: 8月5日前后,英伟达发布并开源 Alpamayo 2 Super——面向 Robotaxi 与自动驾驶的 34B 视觉-语言-动作(VLA)模型:由 32B 视觉-语言主干(基于 Cosmos 3 Super Reasoner 强化学习后训练)+ 2.3B 扩散动作解码器构成,一次前向即可从环视视频输出规划轨迹、因果解释(Chain-of-Causation)、元动作与自动标注;权重以 Linux 基金会 OpenMDW-1.1 许可开源,代码 Apache 2.0,商用与再分发无需额外授权;训练数据约 11.5 万小时多摄行车视频与 370 万条因果链轨迹;在 LingoQA 评测中以 79.2 分排名第一(近 40 个模型中),并超越 Qwen2.5-VL 72B、Gemini 2.5 Pro、GPT-4o 等基线。
- 影响: Alpamayo 2 Super 是英伟达把「推理型 VLA」开源商用化的关键一步:模型输出的可解释因果链可直接对接 Halos 安全验证流程与 ISO/PAS 8800,作为自动标注器可将标注周期从数月压缩到数天;开源商用许可意味着 Robotaxi 玩家能以低成本自建「会思考的驾驶模型」,加速 L4 自动驾驶从感知范式转向推理范式。
- 链接: https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available/
- 价值点: 首个可商用开源推理型 VLA 旗舰,英伟达在自动驾驶开源化叙事中再落一子。
6. Google Assistant 9月4日起逐步停服,「Hey Google」由 Gemini 全面接棒
- 来源: IT之家、Android Authority、Mashable(P1)| 印证数:3 个独立来源
- AI推荐分: 78(aihot)
- 摘要: 8月5日,谷歌通过电子邮件通知安卓用户:移动端 Google Assistant 将于 9月4日起陆续停止服务,符合条件设备将分批迁移,Gemini 成为默认助理,「Hey Google」唤醒词与电源键长按均改由 Gemini 响应,Wear OS 手表、耳机等配对设备同步切换,迁移后无法回退;运行旧系统或未开放 Gemini 地区的设备暂时保留 Assistant。
- 影响: 运行近十年的 Google Assistant 正式进入退场倒计时,标志谷歌消费者 AI 入口全面收拢到 Gemini 单一体系。对用户是语音助手体验的代际切换,对依赖 Assistant 生态的开发者与智能家居设备则意味着迁移适配成本,也进一步压缩第三方语音助手在安卓生态的生存空间。
- 链接: https://www.ithome.com/0/986/174.htm
- 价值点: 谷歌用一份邮件官宣了「Gemini 时代」的起点时间表,AI 助理市场进入代际洗牌。
7. 美国 FCC 拟禁止进口中国新型光模块等数据中心设备(拟议阶段)
- 来源: 路透社(P1)| 观察者网、中新经纬、财经杂志、华尔街见闻(P2 印证)| 印证数:5 个独立来源
- 摘要: 8月4日,路透社援引四名知情人士报道,美国联邦通信委员会(FCC)正起草规定,拟禁止进口中国制造的新型光收发器(光模块核心部件),并覆盖路由器、无线电设备、视频监控、无人机等品类;美国官员希望 2026 年内公布实施,知情人士称 FCC 仍可能修改或搁置该限制。中国驻美使馆回应称,敦促美方「倾听两国工商界客观、理性的声音」,并称对任何严重损害中方利益的行为将采取一切必要措施予以回应。据 Counterpoint Research,中际旭创占全球数据中心光收发模块市场约 27%;美国创新基金会报告称,Coherent、Lumentum 的生产规模不足以短期取代中国供应商。
- 影响: 若禁令落地,中美科技供应链博弈将从半导体向通信基础设施全链条延伸:美国 AI 数据中心建设可能面临至少 2 年光模块供给缺口并推高云厂商成本,中国光模块龙头(中际旭创、新易盛等)的美国收入敞口将直接承压(中际旭创约 57% 海外收入来自美国)。目前仍处拟议阶段,细则口径与云厂商游说结果存在变数。
- 链接: https://www.guancha.cn/internation/2026_08_04_826167.shtml
- 价值点: FCC 拟议禁令把 AI 算力竞争推进到「机房物料清单」层面,光模块成为中美科技博弈的新焦点。
8. 美国第九巡回上诉法院中止亚马逊禁令,Perplexity 购物智能体重返亚马逊
- 来源: the-decoder、Customer Experience Magazine、theoutpost、beeble(P1)| 印证数:4 个独立来源
- AI推荐分: 75(aihot)
- 摘要: 美国第九巡回上诉法院发布行政中止令,暂停执行加州地方法院此前针对 Perplexity 的初步禁令,使其 AI 购物智能体(Comet 浏览器)得以暂时继续在亚马逊平台运行;上诉法院将审理 Perplexity 提出的更长期中止请求。案件始于 2025 年 11 月亚马逊起诉 Perplexity,指控其 Comet 智能体未经授权访问用户账户、损害平台体验与广告收入,Perplexity 则主张用户有权选择自己的 AI 工具。
- 影响: 这是美国联邦法院罕见地直接限制 AI 工具在商业平台运行的案件,上诉法院的中止裁定为「代理式电商」(agentic commerce)与用户自主选择 AI 的权利提供了司法支持;后续全案审理将触及 CFAA(计算机欺诈与滥用法)如何适用于受用户指示行事的 AI 智能体这一前沿法律问题,可能成为定义 AI Agent 与平台关系的标杆判例。
- 链接: https://the-decoder.com/us-appeals-court-allows-perplexitys-ai-shopping-agent-back-on-amazon
- 价值点: 首个「AI 购物智能体 vs 平台」重大诉讼在上诉阶段反转,为 Agent 访问商业平台的边界提供判例方向。
趋势观察
- 全球 AI 人才与权力结构进入「重组窗口」:谷歌同日官宣哈萨比斯卸任 DeepMind CEO、Jeff Dean 等四位资深研究员出走创业(事件1),叠加此前 OpenAI/Anthropic 对谷歌 Gemini 团队的挖角,头部实验室的核心人才开始流向独立创业,AI 竞争从模型比拼延伸到「人的争夺」。
- AI 基础设施的边界被同时推向「天上」与「供应链」:SpaceX 与英伟达合作把 Vera Rubin 算力送上卫星(事件3),而 FCC 拟禁中国光模块直指数据中心机房物料(事件7)——算力军备竞赛正在轨道与供应链两个新维度同时展开。
- 开源视频与自动驾驶模型进入「千亿参数+可商用」阶段:Sand.ai 开源全球首个千亿 MoE 视频模型 MAGI-2(事件4)、英伟达开源可商用的 34B 推理型 VLA 模型 Alpamayo 2 Super(事件5),与本周 MiniMax H3 的开源生态形成共振,开源阵营从语言模型全面扩展到音视频与具身决策。
信息来源说明
今日主要信源:谷歌官方博客/皮查伊内部信、字节 Seed 官方博客、英伟达官方博客、SpaceX/英伟达官方公告、Hugging Face、路透社、WSJ、CNBC、新浪财经、网易科技、搜狐科技、cnBeta、量子位、智东西、IT之家、凤凰网科技、财联社、观察者网、中新经纬、财经杂志、华尔街见闻、MarkTechPost、TeslaRati、Interesting Engineering、the-decoder、Customer Experience Magazine,共 26 个来源。 略过信息:7 条(原因:昨日已收录且今日无新进展——DeepSeek V4 延期、白宫 AI 审查框架、MiniMax H3 生态、Anthropic-Volta 算力协议、苹果诉 OpenAI、L3/L4 自动驾驶国标、千问办公公测(8/3 启动超 48h);单源未印证——X 帖来源条目(SpaceX 已获独立媒体印证故收录,Grok 视频分析等未收录))
📅 生成于 2026-08-06 05:30 | 信息完整性:P0 4条 P1 8条 P2 0条