本期日报涵盖蚂蚁百灵 Ling-3.0-flash 开源、商汤 SenseNova U1 统一推理与图像生成、OpenAI GPT-Live 实时音频新架构、Cloudflare Agents 平台发布、工信部首部 L3/L4 自动驾驶强制性国标、Anthropic 与 Volta 签署 100 亿美元算力协议等 16 条重要动态。

模型发布/更新

1. 蚂蚁百灵发布 Ling-3.0-flash 开源权重

来源:X:蚂蚁百灵 (@AntLingAGI)
蚂蚁百灵正式发布 Ling-3.0-flash 的开源权重,提供官方 BF16 和 FP8 量化版本,开发者可根据硬件性能和部署需求灵活选择。该模型进一步降低了国产大模型的部署门槛。
查看原文

2. 商汤 SenseNova U1 开源:统一推理与图像生成

来源:X:商汤 SenseTime (@SenseTime_AI)
商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式可逐步生成图文内容。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。
查看原文

3. OpenRouter 上线 FLUX 3 Video 统一多模态模型

来源:X:OpenRouter (@OpenRouter)
Black Forest Labs 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。这是一个统一的视频、音频、图像和动作预测多模态模型家族,基于统一架构联合训练,支持严肃、创意、电影感等多种风格输出。
查看原文

4. NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶

来源:NVIDIA Blog
NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出,面向 Robotaxi 与自动驾驶场景。
查看原文

5. 腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别

来源:公众号:腾讯混元
腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,支持上下文纠错、热词注入及高噪耳语场景。已上线腾讯云 API,元宝 App 首发并免费开放。
查看原文

产品发布/更新

6. GPT-Live 实时音频新架构发布

来源:X:Greg Brockman (@gdb)
OpenAI 联合创始人 Greg Brockman 宣布 GPT-Live 实时音频新架构。GPT-Live 可以在说话的同时聆听,从客户端到模型重建了语音栈,让音频持续流动,更深入的推理和工具使用不会打断对话。
查看原文

7. Cloudflare 推出 Agents 平台,全面布局智能体开发基础设施

来源:Cloudflare Blog
Cloudflare 在 Agents Week 中集中发布多项产品:Cloudflare Agents 平台将部署在平台上的智能体会话统一到一个视图,率先上线 agent tracing 功能(支持 OpenTelemetry 兼容框架);Agent Development Lifecycle(ADLC)让 AI 智能体承担更多开发流程;CI SDK 支持在 Cloudflare 上为百万级仓库运行 CI/CD 流水线;Local Tracing 为本地 Worker 调用自动捕获 OpenTelemetry 追踪。
查看原文

8. 面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件

来源:公众号:面壁智能(MiniCPM)
面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程,一周内自动优化 100+ 工业与科学软件,全程零人工介入。
查看原文

9. 微软开源 Orchard 智能体训练框架

来源:X:Microsoft Research (@MSFTResearch)
微软发布开源框架 Orchard,面向研究社区用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。
查看原文

10. SpecForge v0.3.0 发布:统一投机解码栈

来源:LMSYS Blog(Chatbot Arena 团队)
LMSYS 发布 SpecForge v0.3.0,将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。
查看原文

行业动态

11. Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议

来源:X:Rohan Paul (@rohanpaul_ai)
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 NVIDIA 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。
查看原文

12. 工信部发布首部 L3/L4 自动驾驶系统安全要求强制性国标

来源:IT之家
工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721-2026)强制性国家标准获批发布,拟于 2027 年 7 月 1 日起实施。这是我国首部针对 L3 级有条件自动驾驶和 L4 级高度自动驾驶系统的强制性国标,由 2024 年推荐性国标升级而来,为自动驾驶产品明确了统一的安全准入基线。
查看原文

13. GPT-5.6 Luna 降价 80% 永久生效

来源:X:Tibo (@thsottiaux)
OpenAI 基础设施负责人确认,GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久性的。效率提升不会消失。这一降价在 Anthropic Fable 5 发布五天后推出,进一步加剧了前沿模型市场的价格竞争。
查看原文

技巧与观点

14. GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码

来源:GitHub Blog
GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者,显著提升 AI 生成代码的可审查性和合并效率。
查看原文

15. 在单颗 AMD MI300X 上运行 DeepSeek V4 Flash

来源:Hacker News 热门(buzzing.cc 中文翻译)
一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。
查看原文

16. 杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长

来源:Tomer Tunguz 博客(VC 分析)
科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却呈现分化趋势:Anthropic Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则将 GPT-5.6 Luna 价格下调 80%。文章分析了 AI 定价分层策略如何在不同模型间平衡利润与市场份额,以及杰文斯悖论在 AI 算力领域是否可持续。
查看原文


数据窗口:2026-08-03 19:00 ~ 2026-08-05 09:00(UTC+8)
由 WorkBuddy 自动整理生成 | 数据来源:AI HOT、Anthropic Newsroom、Bloomberg、Google DeepMind Blog 等

本日报由 AI 自动整理生成,数据来源:AI HOT、Anthropic Newsroom、Bloomberg、Google DeepMind Blog 等。内容涵盖模型发布、产品更新、行业动态及实用技巧,每日更新。

最后修改:2026 年 08 月 05 日
如果觉得我的文章对你有用,请随意赞赏