首页 > 教程攻略 > ai教程 >AI 日报 | 2026年8月12日

AI 日报 | 2026年8月12日

来源:互联网 时间:2026-08-24 21:02:41

AI 日报 | 2026年8月12日:ChatGPT 与 Gemini 双双破10亿用户、NVIDIA 发布 Nemotron 3.5 Lightning、Anthropic 最快9月上市

今日要点速览

领域核心事件
行业里程碑ChatGPT 与 Gemini 双双突破 10 亿用户
模型发布NVIDIA Nemotron 3.5 Lightning(30B MoE)、蚂蚁百灵 Ling-3.0-tiny(1.3B 激活)
资本动态Anthropic 最快 9 月上市,估值 9650 亿美元;英伟达研发万亿参数 Nemotron 4
安全研究加密推理轨迹可跨会话窃取,API 漏洞暴露密钥和密码
前沿突破OpenAI Astra 攻克 10 道数学难题,Google AMIE 首次实现实时视频问诊

一、行业里程碑

1. ChatGPT 与 Gemini 双双突破 10 亿用户

来源:The Verge / X:Sundar Pichai · 北京时间 08-12 03:41

AI 日报

OpenAI 与 Google 的聊天机器人同时跨过 10 亿用户门槛。OpenAI 披露 ChatGPT 月活用户超 10 亿(7 月周活已达 10 亿),Google CEO 皮查伊宣布 Gemini 月活达 10 亿,成为谷歌史上增长最快的产品,也是谷歌第 14 个达到 10 亿用户里程碑的产品。Gemini 从 2 月的 7.5 亿月活到突破 10 亿,增长势头更猛。

此外,Gemma 开源模型下载量也突破 10 亿,Google 在开源生态同样加速布局。

二、模型发布与更新

2. NVIDIA 发布 Nemotron 3.5 Lightning

来源:NVIDIA Blog · 北京时间 08-11 21:00

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,推理时仅激活 3B 参数,专为常驻智能体设计。相比同类开源模型,token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型支持最长 1M token 上下文,可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

SGLang 团队同步宣布 Day-0 支持,该模型支持 MTP、DFlash、DSpark 三种投机解码技术,可通过 OpenAI 兼容 API 接入智能体工作流。

3. 蚂蚁百灵开源 Ling-3.0-tiny

来源:公众号:蚂蚁百灵 · 北京时间 08-11 17:20

蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。极致的激活效率让它在边缘和移动场景有巨大潜力。

4. 英伟达研发万亿参数 Nemotron 4

来源:IT之家 · 北京时间 08-11 22:54

英伟达正在研发新一代开源模型 Nemotron 4,规模最大的版本预计至少拥有 1 万亿参数,旨在与全球最先进的开源模型竞争。最终训练尚未完成,最早可能在今年秋末准备就绪。Gary Marcus 评论称,英伟达将发布真正开源(非仅开放权重)的 Nemotron 新版本,这可能最终削弱其合作伙伴 OpenAI 和 Anthropic 的地位。

三、资本与上市

5. Anthropic 最快今年 9 月上市,估值 9650 亿美元

来源:IT之家 · 北京时间 08-11 11:57

Anthropic 目前正与潜在投资者展开接洽,为一场有望成为史上最大规模之一的 IPO提前铺路,预计将在今年

9 月

10 月初正式启动上市进程。该公司当前估值已达到

9,650 亿美元

,年化收入也已突破

470 亿美元

。对于来自中国 AI 企业的竞争压力,Anthropic 整体表态相对淡化。同时,公司还打算进一步推进 AI 在医疗生物学领域的落地应用,不过截至目前,尚未披露具体的 IPO 定价方案。

6. NVIDIA 循环融资引争议

来源:Gary Marcus · 北京时间 08-11

在英伟达联合六家大型金融机构推出

5000 亿美元 AI 工厂融资平台

后,金融记者 Holger Zschaepitz 以及曾准确预判安然破产的 Jim Chanos,都对英伟达这种“循环融资”模式表达了担忧:也就是由英伟达出资支持 AI 初创企业,而这些企业随后再采购英伟达 GPU。受相关消息影响,英伟达股价公布后出现小幅回落,收盘价为

217.55 美元

四、安全与隐私

7. 加密推理轨迹可跨会话窃取:API 漏洞暴露密钥和密码

来源:The Decoder / HuggingFace Daily Papers · 北京时间 08-12 01:38

Alexander Panfilov 团队发现 OpenAI、Anthropic、Google 等主要 AI 提供商 API 存在严重漏洞:推理模型的加密思考过程可被读取。加密块可跨会话、用户和模型互换,攻击者将其注入同提供商防护较弱的模型,即可强制以明文输出推理内容。

扫描约 7000 条公开会话发现 62 个 API 密钥、33 个邮箱和 33 个密码。通过越狱,Anthropic 的 Haiku 4.5 可逐字转写 Opus 4.8 的原始推理;解码 10000 条推理轨迹的 API 成本仅约 720 美元。

五、前沿研究

8. OpenAI Astra 模型攻克 10 道数学难题

来源:The Verge · 北京时间 08-11 19:00

OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。数学界对此既兴奋又担忧——AI 在纯数学领域的突破速度正在加快。

9. Google AMIE 首次实现实时临床视频问诊

来源:Google Blog · 北京时间 08-12 01:00

Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。

10. Apple Silicon 虚拟机 LLM 推理加速 11-16 倍

来源:Hacker News · 北京时间 08-12 00:41

研究团队为 macOS 虚拟机构建进程级 Metal 兼容层,使 llama.cpp 可选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11 倍、token 生成提升 16 倍,接近裸机性能的 98%。这对在 Mac 上构建本地智能体工作流意义重大。

六、产品发布与更新

11. Runway Seedance 2.5:50 角色参考 + 音乐同步

来源:X:Runway · 北京时间 08-12 02:53

Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。AI 视频生成从"单角色演示"进入"完整阵容"时代。

12. ChatGPT 桌面端支持导入其他智能体工作数据

来源:X:OpenAI Developers · 北京时间 08-12 02:20

ChatGPT 桌面端现可导入其他智能体的项目、聊天记录、技能和插件,与 ChatGPT Work 和 Codex 保持同步,并支持自动更新。OpenAI 正在构建 AI 开发工具的"数据引力场"。

13. ZCode 全面升级:Goal、Subagents、Remote Control 四大功能上线

来源:公众号:智谱 · 北京时间 08-11 13:52

ZCode 针对 GLM 深度优化,上线 Goal(目标驱动)、Subagents(子智能体协作)、Remote Control(远程控制)和闲时任务四大功能。在 Z. ai Code Bench 测试中,GLM-5.2 搭配 ZCode 较搭配 Claude Code 任务整体通过率高 2.39%;缓存命中率超 98%。

14. Gemini 助力 PostgreSQL 迁移

来源:Google Cloud · 北京时间 08-12 00:00

Google Cloud 在 Database Migration Service 中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。

七、观点与讨论

15. 编写智能体时,哪种编程语言最合适?

来源:Hacker News · 北京时间 08-11 12:58

针对"动态语言比静态语言更省 LLM token"的流行说法,作者用 GPT-5.6 Sol 实测 zstd 解码器实现。结果显示:medium 努力度下动态语言表现更好,ultra 下静态语言反而更优。作者认为琐碎任务上的性能无法推广到更大问题。

16. Ryan Greenblatt:人类级 AI 或于 2032 年前催生失控超级智能

来源:Dwarkesh Patel · 北京时间 08-12 00:31

Redwood Research 首席科学家 Ryan Greenblatt 探讨递归自我改进(RSI):一旦 AI 达到人类顶级专家水平,可能在一年内实现相当于 4-5 年的 AI 进展。中位预期是 2031 年自动化 AI 研发。

今日热点榜 Top 10

排名事件报道媒体数
1Gemini 月活 10 亿,Gemma 下载破 10 亿8
2Meta 发布开源模型 Muse Glimmer(延续热度)16
3NVIDIA 推出 Nemotron 3.5 Lightning8
4Claude 未发布研究版攻克黎曼猜想(延续热度)8
5NVIDIA 携手六大机构成立 AI 工厂融资平台4
6加密推理轨迹可跨会话窃取5
7Anthropic 最快 9 月上市4
8OpenRouter 新版 Auto 路由器(延续热度)2
9蚂蚁百灵 Ling-3.0-tiny 开源2
10ZCode 全面升级四大功能2

今日趋势总结

  1. 10 亿用户时代到来:ChatGPT 和 Gemini 同时突破 10 亿月活,AI 从"尝鲜工具"正式进入"基础设施"阶段。当 10 亿人在用 AI,安全和隐私问题的量级也完全不同了。

  2. 推理安全根基动摇:加密推理轨迹可被跨会话窃取、API 暴露密钥和密码——这两项发现同日出现,说明"推理不可见"的安全假设正在被攻破。各大厂商需要从根本上重新设计推理隔离机制。

  3. 模型"小即是大":NVIDIA 的 30B MoE 模型推理时仅激活 3B、蚂蚁百灵 7.9B 仅激活 1.3B——MoE 架构正在让"小模型跑出大能力"成为新范式,本地智能体的算力门槛进一步降低。

数据来源:[AIHOT]| 本文内容基于 AIHOT API 实时数据整理