欢迎光临
我们一直在努力

AI日报 2026-08-10

一、AI Coding 方向

1. Anthropic 将 Claude Code "自动模式"设为默认

  • 内容:8月7日,Anthropic 宣布自8月14日起,Pro、Max 和 Team 套餐的 Claude Code 新会话将默认启用 Auto Mode。该模式通过分类器自动判断操作是否不可逆、破坏性或越界,仅在必要时请求人工确认。测试显示,Auto Mode 捕获有害操作的比例达 89%,远高于人工审核的 13.6%。Adobe、Nuro、Gusto 等企业已在生产环境采用,Anthropic 内部称可提升约 25% 的 PR 产出。
  • 原因:标志着 AI 编程工具从"人工确认每一步"向"高自主性+安全分类器"的实质性跃迁。用户对权限提示的批准率高达 97%,人工审核已形同虚设,分类器自动拦截反而是更安全的方案。

2. Meta 发布首款 AI 编程智能体 Muse Code

  • 内容:8月5日,Meta 发布 Muse Code 测试版,由 Muse Spark 1.2 驱动。模型与 harness 同步训练("Muse Code was in the training loop from day one"),工具调用首次成功率更高。支持 macOS/Linux 终端安装,可处理大型代码库的规划、编码、验证全流程。Contributor 版输出 token 仅 0.2 美元/百万(标准版 4.25 美元),但代价是 Meta 可用你的代码轨迹训练下一代模型。Terminal-Bench 2.1 得分 82.9%(vs Opus 5 的 86.7%)。
  • 原因:AI 编程 Agent 赛道再添巨头玩家。"模型+harness 联合训练"是新技术路线;Contributor 版价格仅为 Claude Sonnet 5 的 1/50,可能倒逼行业大幅降价,但数据隐私代价明显。

3. AWS 开源 Kiro Crew:让 AI 编程 Agent 24/7 持续工作

  • 内容:8月4日,AWS 发布 Kiro Crew 开源项目(Apache 2.0)。它不是编码 Agent 本身,而是持久化的 Agent 编排平台——支持跨会话记忆、cron 定时任务、webhook 触发、多 Agent 协调。源自 Amazon 内部项目 MeshClaw,6 个月内 39,000+ Amazon 开发者使用,500+ 贡献者。内置 OS 级沙箱、137 条危险命令拦截规则、签名审计日志。支持 Slack/Discord/Teams/微信/企微 等消息集成。
  • 原因:首个主流的"持久化 Agent 工作空间"方案。Amazon 内部大规模采用是最强背书。Agent 从"单次任务"到"持续工作"是 2026 年编码工具的核心演进方向。

4. 阿里发布 Qwen3.8-Max:2.4万亿参数,自主编程16天交付完整项目

  • 内容:8月3日,阿里发布 Qwen3.8-Max,总参数 2.4 万亿(MoE 架构,激活 95B),1M 上下文,支持视觉理解。编程智能体评测 PaperBench 得分 93.0(较上代提升 28.2 分),CodeArena 全球第四。演示了从空文件夹出发,自主编程 16 天完成一个 Hermes Agent 级别的自进化智能体框架"oh-my-cli",全程无人干预。API 价格为 Opus 5 输入的 40%、输出的 24%。
  • 原因:大模型从"代码补全"进化到"多日自主项目交付",这是 AI Coding 的质变节点。Qwen3.8-Max 计划开源权重,开源生态再添旗舰。

5. DeepSeek V4 Flash 登顶全球调用榜,随后预告大幅提价

  • 内容:OpenRouter 数据显示,7月27日-8月2日周榜中,DeepSeek V4 Flash 以 7.22 万亿 Token 调用量登顶全球第一,前五名全部为国产大模型(DeepSeek V4 Flash、小米 MiMo V2.5、腾讯 Hy3、DeepSeek V4 Pro、智谱 GLM5.2)。单次基准测试成本仅 0.03 美元,是 Claude Fable 5 的 1/100。但 8月6日 DeepSeek 公告计划近期整体上调 API 定价,预计涨幅较大。
  • 原因:国产大模型以极致性价比重塑全球开发者调用格局,连续 14 周调用量超过美国。但"骨折价"不可持续,提价标志着行业从"赔本赚吆喝"进入商业化深水区。

6. Y Combinator 开源多智能体编排框架 QM

  • 内容:7月31日,YC 将内部自用的多智能体 harness「QM」开源(MIT 协议)。QM 不是编码 Agent,而是面向整个公司的多玩家编排层,支持 Slack、Web UI、cron、webhook、共享内存、浏览器 Agent、可分享 Web 应用。模型无关,可接入 Claude Code、Codex、OpenCode 等。YC 自身已在会计、法务、工程等场景使用。
  • 原因:AI 编程竞争从"模型能力"转向"编排框架"。QM 代表了"企业级 Agent 基础设施"方向,harness 层的竞争将决定开发者工作流的未来格局。

7. BenchLM 8月编程榜:前三差距仅 1.7 分

  • 内容:BenchLM 编码排行榜更新(综合 SWE-bench Pro 与 LiveCodeBench):Claude Mythos 5(80.1)、Claude Fable 5(79.8)、GPT-5.6 Sol(78.4),头部差距缩至 1.7 分。MightyBot Agent 级排名中,Claude Code 第一、Codex 第二、Kimi K3 作为最强开源编码模型进入前三。
  • 原因:模型 raw coding 能力趋于收敛,选型关键将从"追新模型"变成 harness、工作流集成和成本控制。开源模型(Kimi K3、LongCat-2.0)已不是妥协选项。

8. OpenAI Astra 模型安全能力逼近"严重"红线

  • 内容:OpenAI 披露在研的 Astra 模型在网络安全与 Agentic Coding 领域的能力已逼近"严重(Critical)"风险阈值。OpenAI 决定主动放缓开发进度,加强红队测试频率,并在关键场景增设人工干预。这是首次有头部厂商因编码/安全能力过强而主动降速。
  • 原因:AI 编码能力提升带来双重用途风险。当模型能自主发现并利用 API 漏洞时(如澳大利亚 Claude 预订健身房事件),安全治理需与能力提升同步甚至前置。

9. MiniMax H3 开源登顶 HuggingFace 热度榜首

  • 内容:8月3日,MiniMax 正式开源新一代多模态生成模型 H3。三天内冲上 HuggingFace 热度第一,超百家企业 Day0 接入。在 DesignArena 多图生视频、图生视频、视频编辑三个类别全面登顶,超越 Seedance 2.0、Grok Imagine Video 等闭源模型。2K 分辨率每秒价格不到主流模型的 1/3,支持原生双声道音视频输出。
  • 原因:继 DeepSeek 颠覆文本模型格局后,中国开源 AI 在视频生成领域迎来第二次标志性突破。中国开源模型下载量已占全球总量 41%,跃居世界第一。

二、具身智能方向

10. 宇树科技今日科创板申购,A股"人形机器人第一股"登场

  • 内容:8月10日,宇树科技正式启动科创板 IPO 申购,发行价 150.80 元/股,预计募资约 60.99 亿元,上市市值约 609.93 亿元。从 IPO 申请获受到申购用时不到 5 个月,创年内最快审核纪录。募集资金超八成投入研发,重点投向智能机器人大模型、人形机器人本体及核心部件。王兴兴表示 2025 年已实现人形机器人出货量全球第一。中一签(500 股)需缴款 7.54 万元,市场预估中签率仅 0.02%-0.03%。
  • 原因:人形机器人龙头进入资本市场,估值将成行业锚点。募投方向显示"机器人大脑"已成为本体厂商的核心投入方向,具身智能产业链投资关注度将进一步提升。

11. 星动纪元机器人分拣效率追平人工,已进驻 10+ 物流中心

  • 内容:星动纪元 L7 人形机器人已在中国邮政、顺丰的全国 5 省市 10 多个物流中心上岗分拣快递,效率基本追上人工每小时约 1200 件水平,准确率达 95%。已实现小几百台规模部署。硬件自研占比超 95%,自研全直驱灵巧手 XHAND 系列出货近千只,客户覆盖 OpenAI、英伟达、苹果等。下一步推进汽车、3C 工业场景 POC 验证。
  • 原因:首个跑通 PMF 的具身智能企业,从"能不能动"转向"能不能干活"。物流夜班、粉尘、高温等恶劣岗位是机器人替代的最佳切入点,证明了商业化可行性。

12. 小米新设具身智能与应用部,前字节孔涛挂帅

  • 内容:原字节跳动 SeedRobotics 团队负责人孔涛已加盟小米,挂帅新成立的"具身智能与应用部",统管整个具身赛道业务方向,带来原字节团队"整建制迁移"。小米机器人事业部约 200 人,覆盖本体、小脑、大脑及操作系统全栈。机器人汽车工厂自攻螺母工站双侧作业成功率已提升至 98%,距人工作业仅差 1%。
  • 原因:VLA(视觉-语言-动作)大模型成为具身智能竞争核心,行业共识从"比拼机械性能"转向"模型智能化水平"。小米整合软硬件团队是补齐"人车家全生态"最关键拼图的一步。

13. 蚂蚁灵波拟融资 15 亿:不押注本体,专注机器人大脑

  • 内容:蚂蚁集团旗下具身智能公司蚂蚁灵波启动首轮融资,拟募资 15 亿元。成立一年半已推出十余款模型,覆盖视觉、空间感知、VLA、世界模型和世界动作模型,包括行业首个具身原生世界动作模型 LingBot-VA 2.0。LingBot-VLA 2.0 已适配 17 家厂商 20 余种机器人构型,乐聚仅用约 300 条数据微调 1-2 天即可跑通场景测试。已在国大药房上海门店落地交付。
  • 原因:行业焦点从"本体与小脑"转向"大脑"。不造硬件、专注跨本体模型的路线获得资本认可(参照 Physical Intelligence、Skild AI)。"一脑多机"的跨本体泛化是通用机器人的关键瓶颈。

14. 越疆科技发布全球首款"具身全栖"人形机器人

  • 内容:8月5日,越疆科技发布 DOBOT LUMO(越疆鹿萌),身高约 1.3 米,基于自研"空弈"具身大模型,实现多模态情绪感知、三维空间理解与主动行动、自主学习长期进化。可适配草坪、沙地、鹅卵石等复杂户外地形,能作为户外运动陪练(出拳、闪躲、后空翻)和居家情感陪伴者。官宣视频全程实拍无特效。
  • 原因:开创"具身全栖机器人"新品类,从工业/商用延伸至消费陪伴场景。多模态情绪感知+主动服务是机器人从"被动工具"到"社会化智能角色"的关键升级。

15. 小米开源具身智能基础模型 Xiaomi-Robotics-1

  • 内容:8月5日,小米开源具身智能基础模型 Xiaomi-Robotics-1,涵盖视觉感知、运动规划、操作控制和环境理解四大模块。采用 MoE 架构,总参数 480 亿,推理时仅激活约 50 亿,可在机器人端嵌入式设备高效运行。此前 Google DeepMind 已开源 RT 系列机器人模型,英伟达推出 GR00T 机器人基础模型。
  • 原因:具身智能开源生态竞争白热化。小米从"自用"走向"赋能行业",试图构建类似安卓的"生态飞轮"效应,降低中小企业机器人研发门槛。

16. 安徽人形机器人加速商用:上半年产量超 2600 台

  • 内容:安徽省 2025 年人形机器人整机产量仅 700 余台,2026 年上半年产量已超 2600 台,规模化应用加速。合肥建设智能机器人公共服务平台,复刻真实应用场景供中小科创企业集中训练。芜湖孕育出墨甲(奇瑞孵化)等人形机器人公司,墨甲 2025 年全球销量超 300 台,今年上半年超 590 台,覆盖 60 多个国家和地区。
  • 原因:地方政府通过公共平台降低企业研发门槛,"实景实训—数据沉淀—产品迭代—规模部署"闭环正在跑通。车企孵化机器人公司(奇瑞→墨甲)成为重要模式。

17. 上半年国内具身智能融资 935 亿元,同比增长 5 倍

  • 内容:2026 年上半年国内具身智能赛道融资总额突破 935 亿元,同比增长 5 倍,融资事件 322 笔(同比增长 137%)。8 个月内中国机器人领域获投金额已达 1217 亿元,超过去年全年约 67%。投资逻辑从追捧"后空翻"等表演型 Demo 转向重视进厂拧螺丝、仓库搬运等实干型机器人。市场监管总局数据显示,上半年人形机器人领域新设企业 11.6 万户。
  • 原因:资本从"看概念"转向"看交付",行业进入量产与场景落地淘汰赛。头部效应加剧,具备数据入口、全栈技术与商业化路径的公司更受青睐,中小团队融资难度提升。

三、其他重要动态

18. 首个全国产 10 万卡 AI 超集群正式投用

  • 内容:首个全国产 10 万卡人工智能超集群在国家超算互联网郑州核心节点投入运行,标志着我国算力基础设施建设迈入 10 万卡级部署新阶段。科学计算加智能计算的融合算力,为未来大模型训练、科学计算等多元化需求做前瞻布局。
  • 原因:全国产化路线确保算力供应链自主可控,具有深远战略意义。国产推理芯片、服务器及算力服务产业链有望受益。

19. Cloudflare 高管预言:5 年内人类将成为互联网"四舍五入误差"

  • 内容:Cloudflare 高管公开表示,随着 AI Agent 流量爆发,人类在 5 年内将成为互联网上的"rounding error"(可忽略不计的误差)。该观点被 Polymarket 等账号迅速传播,引发对 Agent 主导网络流量的广泛讨论。
  • 原因:从基础设施视角直接点出 Agent 经济的规模效应。当数百万 Agent 同时为用户抢资源时,互联网服务将面临大规模自动化博弈。

四、一句话总结

AI Coding 进入"模型差距缩小、Agent 自主化加深"阶段——Auto Mode 默认化、24/7 持续工作、低价 Contributor 模式三线并进;具身智能从 PPT 走向产线——宇树 IPO 申购、物流分拣追平人工、机器人大脑融资 15 亿,2026 下半年是量产与场景验证的关键窗口。

赞(0)
未经允许不得转载:171主机测评 » AI日报 2026-08-10
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址