🤖 AI 大模型日报 — 2026-08-01(周六)
一句话概览:GPT-5.6 家族(Sol/Terra/Luna)7 月上旬全面开放,7 月起登陆 Cerebras 高速推理平台;Kimi K3 发布即爆火、算力告急暂停新用户接入;谷歌 Gemini 3.5 系列亮相、3.5 Pro「coming soon」;智谱 GLM-5.2 以 1M 无损上下文主打长程 Coding Agent;Anthropic 链上估值冲上 1.2 万亿美元反超 OpenAI 并启动 IPO,旗下 Mythos 5 / Fable 5 曾因美出口管制令短暂下线;中国大模型全球 Token 调用量持续领先美国。
📌 数据来源:Bing 网页搜索抓取(OpenAI/DeepMind/Meta 官方页、智谱文档、腾讯云开发者社区、36氪、虎嗅、AI产品库等公开报道),抓取时间 2026-08-01。
🔥 今日热点摘要
1. GPT-5.6 全面开放:Sol/Terra/Luna 三档齐发,Cerebras 上线 750 token/s
- OpenAI 于 6 月 26 日启动 GPT-5.6 有限预览(配合美国政府分阶段审批),7 月 9-10 日正式全面发布 GPT-5.6 模型家族,含旗舰 Sol、中端 Terra、轻量 Luna 三档。
- Sol:OpenAI 迄今最强模型,编码(Terminal-Bench 2.1 达 91.9% 创纪录)、网络安全(CTF 命中率 96.7%)、生物学(GeneBench v1)全面领先;新增 「max」深度推理模式与 「ultra」子智能体模式;上下文窗口达 105 万 Token;定价 输入 $5 / 输出 $30(每百万 Token),仅为 Anthropic Claude Fable 5($10/$50)的一半。
- Terra:性能与 GPT-5.5 相当、价格便宜约 2 倍;Luna:最低价格覆盖日常高频场景。
- 7 月上线 Cerebras 平台:GPT-5.6 Sol 推理速度最高 750 token/s,初期仅向部分客户开放。
- 背景:发布前一天美国政府要求 OpenAI 分阶段发布、逐客户审批;OpenAI 表态「不希望审批流程成为长期常态」,但短期配合。中美 AI 监管博弈进入模型发布环节。
2. Kimi K3 发布即爆火,月之暗面算力告急
- 月之暗面 Kimi K3 于 7 月 15 日开始灰度测试、约 7 月 17 日正式上线:1M Token 超长上下文、多模态理解、Tool Calling,主打长程编程与智能体(Agent)工作流(支持 Swarm 并行任务、可生成可玩的多人/3D 游戏)。
- 因海量需求涌入导致算力过载,官方 7 月 19 日宣布算力紧张、暂停新用户接入,引发广泛讨论。
- 同期开源 Kimi K2.6(262K 上下文)持续迭代;有评测指出 DeepSeek V4 系列价格仅为 Kimi K3 的几十分之一,价格战激烈。
3. Gemini 3.5 系列亮相,3.5 Pro「coming soon」
- Google DeepMind 官网已更新至 Gemini 3.5 系列:主打「前沿智能 + 行动能力」(frontier intelligence with action),面向复杂多步工作流;核心能力包括 Agentic coding、多模态统一理解、长程任务执行。
- 官方标注 Gemini 3.5 Pro 即将推出;当前主力仍是 3 月发布的 Gemini 3.1 Pro(百万级上下文、长程推理无信息衰减)。
- 长上下文评测(GDM-MRCR v2,8-needle):Gemini 3.5 在 128K 档平均 91.8%、1M 档 54.0%,均领先同类竞品。
4. Anthropic:估值 1.2 万亿美元反超 OpenAI,IPO 进程启动
- 5 月初 Anthropic 链上 Pre-IPO 隐含估值飙升至 1.2 万亿美元(约合人民币 8.7 万亿元),首次反超 OpenAI;6 月 2 日正式启动 IPO 进程。
- 营收爆发:2025 年底 ARR 约 90 亿美元,2026 年上半年呈指数级增长,成为资本市场「AI 新王」。
- 产品线:旗舰 Claude Fable 5($10/$50 每百万 Token)、Mythos 5 曾因特朗普政府出口管制令下线约两周;3 月更新的 Claude 4.6 已免费开放 1M 上下文、单次支持 600 张图像/PDF 解析。
📊 各重要模型动态
OpenAI / GPT 系列
- GPT-5.6:见头条 1。三档分层 + 激进定价(旗舰仅对手一半)+ 政府审批式发布,是本轮最受关注事件。
- 生态:GPT-5.6 Sol 在 Cerebras 平台高速推理;此前 GPT-5.4(3 月,1M 上下文、电脑控制)、GPT-5.1 预览(千万级上下文)已奠定长上下文与 Agent 底座。
Anthropic / Claude 系列
- Claude Fable 5 / Mythos 5:性能对标 GPT-5.6 Sol,但受美出口管制影响曾下线两周,价格约为 Sol 的 2 倍,压力明显。
- Claude 4.6(3 月 25 日):1M 上下文取消溢价免费开放、多模态处理能力提升 6 倍,编程场景可整仓处理大型代码库。
- 资本与人才:估值 1.2 万亿美元 + IPO 启动;此前 AlphaFold 核心团队(诺奖得主 John Jumper 等)加盟。
Google DeepMind / Gemini 系列
- Gemini 3.5 系列(7 月):Agentic coding、长程任务、多模态统一;3.5 Pro 即将推出。
- Gemini 3.1 Pro(3 月 12 日):百万级上下文长程推理无信息衰减;配套 Veo 3 视频生成(原生音频、首尾帧可控、1080P 最长 10 分钟)。
Meta / Llama 系列
- Llama 4.0(3 月 18 日):7B/13B/70B/400B 四档,70B 在 GLUE/MMLU 平均超越 GPT-4.5 约 5 个百分点,刷新开源纪录;取消商用限制,超 10 万家企业接入;Llama 4 系列支持 10M 上下文窗口、多模态。
- 战略:扎克伯格在 Meta Q2 2026 财报会押注个人 AI 智能体(personal AI agents)。
DeepSeek
- DeepSeek-V4 系列:1M 超长上下文、思考/非思考双模式;全面采用国产芯片(海光、寒武纪)训练与推理、彻底脱离 CUDA 生态,推理成本较上代降低 60%;支持文图音视频全链路多模态。
- 价格杀手:V4 系列(尤其缓存命中价)仅为 Kimi K3 的几十分之一,持续扮演行业「价格锚」。
月之暗面 / Kimi
- Kimi K3:7 月中旬发布即登顶全球榜单(与 Unlimited OCR 包揽前二),1M 上下文 + Agent 能力;因算力过载暂停新用户接入。
- 研究:团队论文《Attention Residuals》(注意力残差架构)可使训练计算量减少 25%,已集成至 Kimi。
智谱 AI / GLM
- GLM-5.2(6 月 14-16 日):主打 Solid 1M 无损上下文,针对长程 Coding Agent 场景数月强化训练,覆盖大规模实现、自动化研究、性能优化;配套 ZCode 开发工具。
- GLM-5:745B 总参数 / 44B 激活 MoE、200K 上下文、开源;GLM-5.1 强化代码与长程任务。
阿里 / Qwen
- Qwen3.5-Max-Preview(3 月 20 日):LM Arena 盲测 1464 分登顶中国第一、全球第五,超越 GPT-5.4、Claude 4.5;稀疏 MoE 397B 总参 / 17B 激活。
- 开源侧:Qwen3-Instruct-2507、Qwen3-235B-A22B 等 7 月版本持续更新;Qwen3-VL 多模态迭代中。
其他国产模型
- MiniMax M2.5、DeepSeek V3.2、阶跃星辰 Step 3.5 Flash:3 月 OpenRouter 全球调用量 Top5 中占据 3 席,海外开发者占比 47%。
- 小米 MiMo-V2:1.2 万亿参数、1M 上下文,全球综合排名第八,已落地小米 15 手机与 SU7 汽车端侧。
- 华为盘古 2.0:具身智能驱动工业机械臂(装配误差 <0.01mm)、车路云一体化。
- 百度文心 5.0:具身智能 + 低空经济(无人机自主规划、多机协同),开源端侧推理框架。
- 科大讯飞星火 4.0:语音交互延迟降至 200ms,新增 12 种方言。
- 腾讯混元 3.0:内测中,强化智能体与企业服务,将深度接入微信、企业微信、腾讯云生态。
🌐 行业趋势分析
1. 价格战进入「对半砍」阶段
- GPT-5.6 Sol 定价($5/$30)仅为 Claude Fable 5($10/$50)一半;Terra 以 GPT-5.5 性能打五折;DeepSeek V4 缓存命中价低至 Kimi K3 的几十分之一。「性能接近、价格腰斩」成为旗舰发布的标配打法,开发者与企业调用成本持续下探。
2. 百万 Token 上下文成标配,长程任务规模化
- GPT-5.6(105 万)、Gemini 3.1/3.5、GLM-5.2(1M 无损)、Kimi K3(1M)、DeepSeek V4(1M)、Llama 4(10M)——「长上下文 + 长程 Agent 任务」取代单纯参数竞赛,法律、金融、科研、代码库级应用进入实用阶段。
3. Agent 智能体成为主战场
- 从「会聊天」到「会干活」:GPT-5.6 的 ultra 子智能体模式、Gemini 3.5 的 Agentic coding、GLM-5.2 的长程 Coding Agent、Kimi K3 的 Swarm 并行,头部模型集体押注「能自主完成多步工作的智能体」,电脑控制与工具调用成为标配能力。
4. 中大模型话语权持续上升
- 全球调用量反超(3 月 OpenRouter:中国 4.19 万亿 vs 美国 3.63 万亿 Token)、LM Arena 登顶(Qwen3.5-Max)、开源霸榜(Kimi K3 全球第一梯队)、价格优势明显——中模型在「开源 + 性价比 + 垂直场景」三线建立影响力。
5. 资本市场狂热:AI 独角兽估值进入「万亿俱乐部」
- Anthropic 链上估值 1.2 万亿美元并启动 IPO、SSI 获英伟达 50 亿美元押注、OpenAI 硬件布局浮出水面——一级市场对前沿实验室的定价已脱离营收基本面,转向对 AGI 卡位权的定价。
🔗 主要信息来源
- OpenAI GPT-5.6:aiproducthub.cn 快讯(openai-gpt-5-6-sol-terra-luna-launch)、知乎专栏 p/2058845739388778078(7/10 正式发布)、p/2054164116282124189(Cerebras 750 token/s)、houdao.com(105 万上下文)、meshlaunch / macgpu 评测汇总
- Gemini 3.5:deepmind.google/models/gemini/(官方,3.5 Pro coming soon、GDM-MRCR v2 数据)
- GLM 系列:docs.bigmodel.cn(GLM-5.2/5.1 官方文档)、z.ai/blog/glm-5.2(6/16)
- Kimi K3:platform.kimi.com、moonshot.cn(7/16)、知乎问答 q/2062310754481656074(7/19 算力紧张)、q/2060635206651065501(7/15 灰度)
- Anthropic:36氪 p/3799097984080899(估值 1.2 万亿,5/7)、虎嗅 huxiu.com/article/4863841.html(IPO 启动,6/2)
- 2026 年 3 月全球大模型全景:腾讯云开发者社区 cloud.tencent.com/developer/article/2658619(国产登顶、百万上下文、智能体爆发)
- Meta Llama:developer.meta.com/ai/models/llama-4/(10M 上下文、多模态)
- 排行榜:datalearner.com/leaderboards(2026 年 7 月更新);知乎专栏 p/670574382(国内外知名大模型 2026/07/31)
- 本报告由 Hermes Agent 定时任务自动抓取整理生成(Firecrawl 额度受限,本次经 Bing 搜索直接抓取)。



