本期日报涵盖 OpenAI 将下一代模型 Astra 列为首个"关键"网络安全模型并暂停部分开发、蚂蚁百灵 Ling-3.0-flash 开源 124B MoE 模型、Claude Code 自动模式将于 8 月 14 日起默认开启、AMD 收购 Taalas 将 AI 模型直接烧录进芯片等 15 条重要动态。

模型发布/更新

1. 蚂蚁百灵开源 Ling-3.0-flash:124B MoE 混合推理模型

来源:IT之家 / 蚂蚁百灵
蚂蚁集团旗下百灵大模型正式开源 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等多个量化版本。模型从预训练起采用混合线性架构(KDA+MLA 5:1 堆叠、1/64 稀疏 MoE),在 Artificial Analysis 智能指数上得分 38,较上代提升 24 分,以更少激活参数追平 MiMo-V2.5 和 Qwen3.8-Max。已获 SGLang、DeepInfra 等 Day-0 推理支持。
查看原文

2. Google DeepMind 推出 WeatherNext 气旋预测模型,AI 预报飓风平均提前 24 小时

来源:IT之家
Google DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气候研究的进步,可为防灾减灾争取宝贵时间窗口。
查看原文

3. Qwen-Image-3.0-Pro 上线:4.5K token 提示词,12 种语言原生支持

来源:阿里云(X)
阿里云发布 Qwen-Image-3.0-Pro 图像理解模型,支持 4.5K token 提示词输入,文本识别准确率达 100%(含无破损 logo 识别),原生支持 12 种语言。定价灵活可扩展,高分辨率处理低至 0.03 美元,已可投入生产使用。
查看原文

产品发布/更新

4. Claude Code 自动模式 8 月 14 日起默认开启,间接提示注入趋零

来源:Anthropic / Claude Blog
Anthropic 宣布自 8 月 14 日起,Claude Code 中 Pro、Max 和 Team 用户的默认权限模式将改为自动模式。该模式通过独立分类器审查 Shell 命令和操作,在 1053 人测试中捕获 89% 的危险命令,而人工审批仅捕获 14%(50 次提示后降至约 5%)。第三方评估中 720 次提示注入攻击均未成功。安全分类器的 token 消耗不再计入使用限额。Adobe、Nuro、Gusto 等企业团队已在生产环境采用。
查看原文

5. Cloudflare 推出 Kitesurf:专为 AI 智能体设计的浏览器

来源:Cloudflare Blog
Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。该产品为 AI 智能体提供安全、隔离的网页交互环境,无需本地浏览器依赖。
查看原文

6. LangChain 推出 Managed Deep Agents 公开测试版

来源:LangChain Blog
LangChain 的 Managed Deep Agents 进入公开测试版,可将 Deep Agents 部署到托管的 LangSmith 运行时。该服务提供持久化执行、记忆、沙箱、通道、评估及生产级基础设施,让开发者无需自建运行时即可在生产环境运行深度智能体。
查看原文

7. Seedance 2.5 API 上线:单次 30 秒视频,支持 50 个角色参考

来源:火山引擎 / Runway
火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从 15 秒提升至 30 秒,并支持最高 50 个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。Runway 和 Krea 已同步接入该模型。
查看原文

8. 千问功能上新:思考研究、定时任务、办公助理、语音通话

来源:千问 APP(阿里)
千问今日上线多项新功能,并支持最新旗舰模型 Qwen3.8-MAX。"思考研究"在原"深度思考"基础上升级,强化复杂推理与工具调用;"定时任务"可预设执行时间自动完成周期工作;"办公助理"能连接备忘录、日历等应用并操作电脑;"语音通话"功能也已上线。
查看原文

行业动态

9. OpenAI 将 Astra 列为首个"关键"网络安全模型,暂停部分开发

来源:TechCrunch / The Verge / OpenAI
OpenAI 周五宣布,内部评估显示下一代模型 Astra 在智能体编码和网络安全方面取得重大进展,无法排除其达到《准备框架》中"关键"网络安全阈值的可能性。这是前沿 AI 实验室首次因网络安全担忧而公开放缓模型开发。OpenAI 已暂停未满足强化安全要求的内部活动,将 Astra 转入隔离测试环境,限制网络与工具访问,并加强模型权重保护。Sam Altman 表示正努力让 Astra 普遍可用,但需更多时间确保安全。
查看原文

10. 三星、SK海力士、美光 2027 年存储产能全部售罄给 AI 公司

来源:IGN / Hacker News
新报告显示,三星、SK海力士和美光三大存储厂商 2027 年的存储产能已全部被 AI 公司预订售罄。这意味着 AI 算力扩张对高带宽存储(HBM)等存储芯片的需求正持续挤压供应,未来存储市场可能面临更紧张的供需格局。
查看原文

11. AMD 收购 Taalas:将 AI 模型直接烧录进芯片,推理速度远超竞品

来源:The Decoder
AMD 收购加拿大 AI 芯片初创公司 Taalas,后者将模型架构与训练参数直接嵌入芯片,推理速度极快但每颗芯片锁定单一模型。其演示芯片运行 Llama 3.1-8B 时,每用户每秒处理超 16000 tokens,远超竞品。AMD 计划将此技术用于下一代 AI 推理芯片。
查看原文

12. 甲骨文禁止 OpenJDK 贡献者提交 AI 生成代码

来源:Hacker News / DealRoom
甲骨文以安全和知识产权风险为由,禁止 OpenJDK 贡献者提交 AI 生成的代码,但允许开发者私下用 LLM 调试和审查代码。该政策与公司内部实践形成鲜明对比:联合创始人 Larry Ellison 此前称 AI 模型已在编写甲骨文的代码,联合 CEO 也表示甲骨文大部分代码由 AI 生成。
查看原文

13. Databricks 将 AI 编码支出降低 70%,开源关键基础设施组件

来源:Databricks Blog / Hacker News
Databricks 通过迁移至更高效模型、动态路由及元 harness 等策略,将 AI 编码支出降低 70%,同时保持每用户成本大致固定。该公司已开源其关键基础设施组件 Omnigent 与 Unity AI Gateway,为行业提供了规模化 AI 编码成本管理的实践参考。
查看原文

技巧与观点

14. François Chollet:未来 AI 将走向符号学习,LLM 不是终局

来源:X(François Chollet)
ARC-AGI 创始人 François Chollet 表示,他在 2024 年底 o3 测试时计算演示后改变了看法,认为 LLM 研究路线可实现无上限的能力扩展,"不会有墙"。但他仍预测 15 年后的 AI 不会基于 LLM 技术栈,而将转向其最优最终形态——符号学习。这一观点为当前以 LLM 为主的 AI 发展路径提供了长期反思视角。
查看原文

15. 文生图竞技场更新:GPT Image 2 全项第一,Nano Banana 2 性价比领先

来源:Artificial Analysis(X)
Artificial Analysis 更新文生图竞技场,按 10 类真实用例与 9 项能力评测模型,覆盖营销、电商、UI/UX 设计等场景。GPT Image 2 在所有用例和能力榜单均列第一;Nano Banana 2 以 67 美元/千图的价格展现出突出的性价比优势。
查看原文


数据窗口:2026-08-07 ~ 2026-08-08(UTC+8)
由 WorkBuddy 自动整理生成 | 数据来源:AI HOT、Anthropic Newsroom、TechCrunch、Cloudflare Blog、Databricks Blog 等

本日报由 AI 自动整理生成,数据来源:AI HOT、Anthropic Newsroom、Bloomberg、Google DeepMind Blog 等。内容涵盖模型发布、产品更新、行业动态及实用技巧,每日更新。

最后修改:2026 年 08 月 08 日
如果觉得我的文章对你有用,请随意赞赏