Claude 上文本水印、Sol 提速14倍、GLM-5.3 编程夺冠
• Anthropic 于 8 月 14 日官宣为 Claude 生成文本嵌入隐形水印,不增加 token、不影响输出质量,8 月 2 日后发布的模型默认启用,更早模型数月内补齐,主因是满足欧盟 AI 法案,检测 API 尚未放出。 A·97% 已核实
• OpenAI 与 Cerebras 于 8 月 13 日预览 Ultrafast 服务档,GPT-5.6 Sol 输出最高 750 tokens/秒、较标准档快约 14 倍,首批仅对少量 API 客户限量开放,官方称 GDP-Val 端到端提速 5.6 倍且质量不降。 B+·92% 多源一致
• OpenAI 于 8 月 7 日披露下一代模型 Astra 在内部评测中无法排除达到准备度框架网络安全「关键」级,已暂停不满足加固要求的相关活动、加严权重保护与沙箱隔离,并强调尚未做出最终定级。 B+·76% 多源一致 · 链接探活失败
• Meta 于 8 月 10 日配合扎克伯格开源长文发布 Muse Glimmer,主打单张显卡在 Mac/PC 本地运行,并承诺开放旗舰 Muse Spark 1.2 权重,同时设 10 亿美元社区基金对冲数据中心扩张争议。 B·78% 待复核
• 谷歌 8 月 13 日发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周;FrontierCode 1.1 由 34.4% 升至 43.6%,DeepSWE v1.1 达 65.3%,引入价 0.75/3.75 美元每百万 token,为上代一半,2027 年起恢复原价。 A·96% 已核实
• 智谱 8 月 14 日发布 GLM-5.3,基座与 GLM-5.2 相同、增益全部来自后训练扩展,编程能力提升约 50%,Terminal-Bench 3.0 由 4.6 跃至 28.3、DeepSWE v1.1 达 66.9,称两周内完成安全加固后开源权重。 B-·83% 同源引述
• DeepSeek 8 月 13 日将线上旗舰切换为 DeepSeek-V4-Pro-0813,官方文档确认支持思考模式、reasoning_effort 与工具调用,并可经 Anthropic 兼容端点接入 Claude Code,智能体能力为本次升级重点。 B+·90% 多源一致
• 阿里 8 月 3 日发布旗舰 Qwen3.8-Max、并于 8 月 12 日开源权重,总参 2.4 万亿、推理激活约 950 亿,支持百万 token 上下文与原生视觉,国内 API 定价 12/36 元每百万 token。 B·76% 待复核
• 谷歌 8 月 5 日 AI 高层地震:Hassabis 卸任 DeepMind CEO 转任董事长兼 Alphabet 首席科学家,Jeff Dean、Ghemawat、Vinyals、Quoc Le 集体出走共创 Discovery Loop,谷歌参股,Gemini 双技术负责人半年内先后离任。 B+·77% 多源一致 · 链接探活失败
• 安全合规首次明显改写发布节奏:同周内 OpenAI 因网络能力暂停 Astra、Anthropic 为欧盟 AI 法案上线文本水印、智谱把 GLM-5.3 开源权重推迟两周做安全加固,治理从事后审查前移为发布前置条件。 B+·88% 多源一致
• 谷歌 8 月 11 日宣布 Gemini App 突破 10 亿月活,为其第 14 个十亿级产品,较 ChatGPT 于 6 月达标晚约两个月,C 端通用助手入口之争进入双寡头格局。 B+·89% 多源一致
• 旗舰层价格策略分化:Gemini 3.7 Flash 引入价腰斩、OpenAI 下调 GPT-5.6 Luna 价格走量,而 DeepSeek 对高性能档逆势提价并自 8 月 17 日起实行分时定价,低价开源与性能溢价两条路线首次正面分叉。 B·64% 待复核 · 链接探活失败
• 「OpenAI 于 8 月 2 日发布 1 万亿参数 GPT-5」——出自 SEO 内容农场,与 OpenAI 现役 GPT-5.6 命名线直接矛盾,无任何一手源,剔除。
• 「Astra 内部版解出十个数学与理论计算机未解难题,并有 Fields 奖得主 Gowers 背书推荐发表」——仅见聚合站转述,未找到 OpenAI 官方博客或所称 GitHub 上的 Lean 形式化证明,剔除。
• 「DeepSeek 部分 API 价格上涨最高达 1100%、缓存未命中输入达 1.32 美元每百万 token」——仅单家英文聚合站给出,与中文源的分时定价口径冲突,官方定价页未核到,剔除。
• 「Anthropic 存在名为 Mythos 5 的模型,网络安全基准 83.8%」——该型号仅出现在一家聚合站,Anthropic 官方新闻室与模型列表中无此名称,疑为杜撰,剔除。
• 「斯坦福与 Arc Institute 研究称 AI 设计出 16 种能杀死已对天然噬菌体产生抗性的细菌的病毒」——仅聚合站单源,未检索到论文原文或机构新闻稿,议题敏感故剔除。
• 「特斯拉 Model Y L 将搭载豆包大模型承担语音交互(称 8 月 22 日消息)」——日期晚于今日,疑为往期内容错标或页面时间戳污染,无法核实,剔除。
• 「智谱新一代模型将命名 GLM-5.5 并带来史诗级升级」——为发布前传闻,现已被 8 月 14 日实际发布的 GLM-5.3 证伪,剔除。
| 条目 | 等级 | 可信度 | 探活 | 来源 |
|---|---|---|---|---|
| Anthropic 于 8 月 14 日官宣为 | A | 97% | ✓活 | anthropic.com/news/claude-text-watermark… |
| OpenAI 与 Cerebras 于 8 月 | B+ | 92% | ✓活 | cerebras.ai/blog/accelerating-gpt-5-6-sol-ultr… |
| OpenAI 于 8 月 7 日披露下一代模型 | B+ | 76% | ✗死 | axios.com/2026/08/07/openai-astra-model-delay-… |
| Meta 于 8 月 10 日配合扎克伯格开源长 | B | 78% | ✓活 | cbc.ca/news/business/meta-open-weight-ai-9.730… |
| 谷歌 8 月 13 日发布 Gemini 3.7 | A | 96% | ✓活 | blog.google/innovation-and-ai/models-and-resea… |
| 智谱 8 月 14 日发布 GLM-5.3,基座 | B- | 83% | ✓活 | ithome.com/0/989/689.htm… |
| DeepSeek 8 月 13 日将线上旗舰切换 | B+ | 90% | ✓活 | api-docs.deepseek.com/news/news0813… |
| 阿里 8 月 3 日发布旗舰 Qwen3.8-M | B | 76% | ✓活 | developer.aliyun.com/article/1753496… |
| 谷歌 8 月 5 日 AI 高层地震:Hassa | B+ | 77% | ✗死 | cnbc.com/2026/08/05/google-chief-scientist-jef… |
| 安全合规首次明显改写发布节奏:同周内 OpenA | B+ | 88% | ✓活 | techcrunch.com/2026/08/07/openai-says-it-slowe… |
| 谷歌 8 月 11 日宣布 Gemini App | B+ | 89% | ✓活 | techcrunch.com/2026/08/11/googles-gemini-app-s… |
| 旗舰层价格策略分化:Gemini 3.7 Fla | B | 64% | ✗死 | venturebeat.com/technology/googles-gemini-3-7-… |
*评分:A 官方一手抓原文 / B+ ≥2独立源 / B 单家权威或未复核 / B- 同源引述 / C 二手(不采)。本期 WebSearch=15 WebFetch=9 成本≈$1.3977754999999998。自动生成,源已分级核验。*
AISOS 自动情报 · 信息源经分级核验 · 2026-08-15