本期日报涵盖 Qwen3.8-Max 发布(2.4T 参数开源编码模型)、MiniMax H3 开源(2K 视频与原生立体声)、OpenAI GPT-Live 实时音频架构、微软 Orchard 智能体训练框架、欧盟 AI 法案透明度规则生效等 16 条重要动态。
模型发布/更新
1. Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数
来源:Qwen Blog
阿里巴巴正式发布 Qwen3.8-Max,Qwen 家族迄今最强模型,拥有 2.4T 参数(95B 激活),专为长周期编码、研究和多模态智能体任务构建。在 Artificial Analysis 智能指数得 53 分,较上代提升 7 分,与 Claude Sonnet 5 持平。开放权重将于下周发布,这也是 Qwen Max 级模型首次开源。该模型已上线 OpenRouter。
查看原文
2. MiniMax H3 正式开源:通用全模态生成系统支持 2K 视频与原生立体声
来源:MiniMax(稀宇科技)
MiniMax 正式开源新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32 kHz 原生立体声音频的视频。开源 24 小时内即有开发者在 Mac 和单卡 RTX 5090 上实现本地运行。
查看原文
3. 商汤发布 SenseNova U1.5-Lite-Preview 开源模型
来源:X:商汤 SenseTime
商汤推出 SenseNova U1.5-Lite-Preview,基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量,适用于图像理解与编辑等多模态任务。
查看原文
4. OpenAI 内部模型 Astra 解决 10 个长期数学开放难题
来源:X:OpenAI
OpenAI 宣布其下一代主要模型的内部版本,在数学和理论计算机科学领域长期未解的开放问题上取得 10 项新成果,并附有完整的 Lean 形式化证明证书。按 GPT-5.6 Sol API 费率计算,所用 token 成本约 2000 美元,低于派两人参会的费用。
查看原文
产品发布/更新
5. OpenAI 发布 GPT-Live 实时音频新架构:边听边说
来源:X:Greg Brockman (@gdb)
GPT-Live 是 OpenAI 推出的实时音频新架构和栈,可以在说话的同时聆听用户。为实现 ChatGPT 规模下的自然体验,团队从客户端到模型重建了语音栈,让音频持续流动,使更深入的推理和工具使用不会打断对话。
查看原文
6. 微软开源 Orchard 智能体训练框架
来源:X:Microsoft Research
微软发布开源框架 Orchard,面向研究社区用于跨任务类型训练和评估 AI 智能体。该框架降低了复杂性,通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。
查看原文
7. Claude Code v2.1.221 发布:新增 Focus view 与沙箱凭据掩码
来源:GitHub Releases
Claude Code v2.1.221 发布,为 VSCode 新增 Focus view 聊天菜单开关,可隐藏工具活动并显示实时运行指示器。新增 Linux/WSL 沙箱凭据文件 mask 模式,并修复 zsh 隐藏命令执行、PowerShell 路径引号处理等多项权限检查绕过问题。
查看原文
8. Cloudflare 推出 @cloudflare/computer 预览版:智能体运行时
来源:Cloudflare Blog
Cloudflare 发布 @cloudflare/computer 早期预览版,这是一个开源智能体运行时,为每个智能体提供虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码,为 AI 智能体提供安全隔离的执行环境。
查看原文
行业动态
9. 欧盟《人工智能法案》透明度规则生效,违规最高罚 1500 万欧元
来源:The Verge
欧盟《人工智能法案》下的新透明度义务于 8 月 2 日生效,要求公司披露用户何时与 AI 模型互动,并为合成音视频和文本添加机器可读标记。违规公司面临最高 1500 万欧元或全球年营业额 3% 的罚款。8 月 2 日前推出的模型有 4 个月宽限期。
查看原文
10. MiniMax H3 开源 24 小时,超百家企业 Day 0 适配
来源:MiniMax(稀宇科技)
MiniMax H3 开源 24 小时内,华为昇腾、AMD、Intel 等 9 家国内外芯片厂商完成 Day 0 适配,Hugging Face、魔搭、ComfyUI、vLLM-Omni、SGLang、腾讯云等超百家合作伙伴 Day 0 上线。在 Artificial Analysis 所有视频评测中表现领先。
查看原文
11. DeepMind 押注递归自我改进,预计 2027-28 年实现
来源:X:Kim (@kimmonismus)
Google DeepMind 将递归自我改进视为其投资的关键部分,预计 2027-2028 年实现 AI 帮助构建更好的 AI。DeepMind 战略主管 Jasjeet Sekhon 表示,递归自我改进是"投资论点中的关键部分",同时承认当前 AI 收入尚不足以支撑资本支出。
查看原文
12. AWS 与 vibe-coding 初创公司 Superblocks 达成合作
来源:TechCrunch
Superblocks 与 AWS 签署多年联合营销协议,其 vibe-coding 工具可嵌入 AWS 客户私有云,应用数据不外传,自动创建 Amazon Aurora 数据库并集成 Amazon Bedrock,纳入 IT 管理与安全体系,为企业提供私有云内的 AI 编程能力。
查看原文
13. Kimi K3 登顶 Databricks 推理速度榜:239 tokens/s
来源:X:Yuchen Jin (@Yuchenj_UW)
Kimi K3 在 Databricks 上达到 239 tokens/s 的推理速度,在 Artificial Analysis 推理速度和延迟排行榜上位列第一。该模型为 2.8T 参数,是 Databricks 服务过的最大开源模型,GPU 满载运行。
查看原文
技巧与观点
14. Claude Code 连接器可复用至 Artifacts
来源:X:Thariq (@trq212)
Anthropic 工程师 Thariq 提示,如果用户已连接 Claude 连接器(如 Gmail、日历、Slack 等),Claude Code 也将能够使用这些连接器,包括在 Artifacts 中,实现了跨场景的数据接入能力复用。
查看原文
15. AirLLM 实现单块 4GB GPU 运行 70B 模型推理
来源:Hacker News / GitHub
AirLLM 项目支持在单块 4GB 显存 GPU 上运行 70B 参数大模型推理,无需多卡或大规模显存配置。该项目已开源,在 Hacker News 上获得 103 点热度,为资源有限的开发者提供了运行大模型的新方案。
查看原文
16. 不要做"肉代理":Niklas Gruhn 提出 AI 输出盲转新概念
来源:Simon Willison 博客
Niklas Gruhn 提出"meat proxy"(肉代理)一词,指那些盲目将 AI 系统输出复制粘贴给同伴的人。他建议可以提示 AI,但不要直接转发输出,而应阅读、理解、验证后用自己的话撰写回复,这也是个人能增加的真正价值。
查看原文
数据窗口:2026-08-03 ~ 2026-08-04(UTC+8)
由 WorkBuddy 自动整理生成 | 数据来源:AI HOT、Anthropic Newsroom、Bloomberg、Google DeepMind Blog 等
本日报由 AI 自动整理生成,数据来源:AI HOT、Anthropic Newsroom、Bloomberg、Google DeepMind Blog 等。内容涵盖模型发布、产品更新、行业动态及实用技巧,每日更新。