一句话总结
2026年7月9-10日全球AI领域密集发布重大进展:OpenAI推出GPT-5.6三档模型系列与ChatGPT Work智能体,整合Codex能力;SpaceXAI发布Grok 4.5大模型性能对标旗舰级产品;蚂蚁灵波开源多款具身智能模型;Meta推出Muse Spark 1.1多模态推理模型;国内阶跃星辰将发布全球首款AI智能体手机;投融资、算力基建、安全治理等多领域同步活跃,AI技术加速向智能体化、具身化、全栈化方向演进。
一、模型与技术突破
1.1 通用大模型(大语言模型与多模态模型)
OpenAI:正式发布GPT-5.6模型系列,包含旗舰版Sol、均衡版Terra和高性价比版Luna三档。Sol面向高难度编程、前端设计、科研、安全与长程Agent工作,令牌效率相比前代提升1.72倍,ALE专业工作流评估得分53.6领跑行业,定制芯片上推理速度达750 tokens/秒;Terra性能接近GPT-5.5但成本减半,适合日常生产力任务;Luna为最快最便宜模型,适合大批量处理和高频调用。Ultra模式默认协调四个Agent并行处理复杂任务。API定价:Sol输入5美元/百万token、输出30美元;Terra输入2.5美元、输出15美元;Luna输入1美元、输出6美元。系列模型在编码、知识工作、网络安全、科学任务场景提升显著,增强computer use能力和设计判断能力。
SpaceXAI(马斯克旗下):联合Cursor发布Grok 4.5旗舰大模型,采用1.5T参数MoE架构,性能追平Claude Opus系列,速度更快成本更低。SWE-Bench Pro得分64.7%,Terminal Bench 2.1达83.3%,整体打平GPT-5.5、逼近Opus 4.8。推理速度达80 TPS,同任务Token消耗仅为Opus 4.8的四分之一,输入2美元、输出6美元,专为编码与智能体任务训练,新增法律、金融等专业领域长周期任务处理能力,已上线Cursor全平台。一小时内可自主开发完整FPS射击游戏。
Meta:推出Muse Spark 1.1多模态推理模型与Meta Model API公开预览,面向Agentic tasks设计,具备100万token上下文窗口,能主动管理并压缩历史信息。提升工具使用、计算机使用、编码和多模态理解能力,可规划、调用工具、连接MCP、使用自定义技能,委派并行子Agent,跨多个应用导航,在复杂代码库真实任务上明显提升。在税务、医疗和法律专业榜单超越Grok 4.5,以低成本著称,输入输出费用远低于同类产品。美国开发者享20美元免费额度。
零一万物:CEO李开复发布新产品**“万策”**,帮助企业决策者利用AI提升效率和竞争力,强调AI转型需由企业一号位亲自推动,分享企业应用AI面临的三大挑战及解决方案。
MiniMax:完成160亿港元新一轮融资,计划推出参数达2.7万亿的新一代大模型,在逻辑推理和复杂任务上有新突破。创始人闫俊杰宣布零薪酬直至实现AGI,并将股份用于激励团队和开源社区。
智谱AI:提出异步强化学习新方案SAO,攻克智能体训练不稳定难题,已成功应用于GLM-5.2训练流程,在代码和推理基准上大幅领先同类方案。完成约314.1亿港元配售,资金用于大模型技术研发、算力建设及生态布局。
快手:发布KAT-Coder-Pro V2.5旗舰级Agentic Coding编程模型,围绕长程工程能力、通用Agentic能力与大规模Agentic强化学习体系三大维度系统性升级,自研AutoBuilder自动化流水线提升运行环境构建成功率,目标从单点代码补全演进为可独立完成完整软件工程任务的AI Agent。
Mistral(法国):推出机器人导航模型Robostral Navigate,仅8B参数,纯凭单RGB摄像头完成自主导航,全新场景成功率达76.6%(训练场景79.4%)。
字节跳动:Seedance 2.5视频生成模型将于7月16日全量开放API,支持30秒单段原生视频直出,参考素材容量提升至最高50个全模态素材,引入更具可控性的视频生成与编辑功能。曝光超长视频Beta模式,时长可达180秒(3分钟)。发布Seedream 5.0 Pro多模态图像创作模型,在图文匹配、结构合理性、文字渲染等基础能力上全面升级,突破复杂信息可视化、交互式精准编辑、真实影像质感、原生多语种生成四大核心能力。
Reve:发布Reve 2.1图像模型,基于结构化布局精准渲染,保持原生4K输出,提示词理解、外语文字渲染、结构规划进一步增强。Arena.ai文生图排行榜位列第2,仅次于OpenAI的gpt-image-2。
1.2 垂直大模型
歌歌AI(杭州音律闪动):推出国内首个纯中文AI音乐大模型,主打华语流行、国风和民谣创作,零预训练和独特技术栈解决中文歌词演唱技术难题,生成效率行业领先。与字节跳动签署非独家版权分成协议,音乐在抖音等平台广泛使用。启动中国民乐专属AI模型研发及线下采风项目,采集和传承传统民族音乐声音。
巨量引擎:发布Mamoda 2.5广告治理大模型,首次将MoE混合专家架构与DiT扩散模型结合,为业内首个DiT-MoE视频生成基座。总参数250亿,每次仅激活约30亿,稀疏度约12%,128个细粒度专家采用Top-8路由策略。OpenVE-Bench等三大评测基准登顶,T2V推理效率相比行业主流开源模型提升11至15倍。
许锦波团队:发布AI原生生物经济操作系统MoleculeOS,能够自动拆解和调度生物研发任务,实现从单一工具到全流程管理的转变,标志生物领域研发基础设施重大革新。
蘑菇车联:展示MogoMind大模型,具备交通数据感知等六大能力,已落地城市交通管理等全场景应用。
中国电信:发布天翼智安2.0,采用"1+1+X"架构,解决智能体资产不可视、权限失控等问题。
1.3 专项技术突破
上海交通大学(黄佳诺):大三学生为首提出Domino新算法,通过分离因果建模和自回归草稿过程,在Qwen3-4B和Qwen3-8B模型上实现平均5.47至7.92倍推理速度提升,论文发表于arXiv,代码已开源。
清华大学与马普所:联合推出d-OPSD扩散语言模型在线自蒸馏学习范式,无需参考解和额外教师模型,少量训练步数即可达到或超越强化学习效果,在多个数学推理任务上表现出更高效率和性能。
清华大学AIR研究院:开发AI数学家系统AIM,参与完成84页量子算法论文,从辅助解题演进到协助探索问题和方向选择,展示人机协同科研能力。
清华大学、上海交大、北邮:联合提出MemSlides定制化PPT生成AI,能根据用户偏好定制风格,多轮修改中记住临时要求与长期喜好,GitHub获400+ star,登顶Hugging Face Daily Papers榜首。
北京大学:在ICML 2026提出HOI-Edit基准与SCPE自纠错框架,用于评估和优化图像中复杂的人与物体交互编辑任务,层级化认知评测、自动评测协议及多智能体自纠错方法提升复杂交互准确性,已开源数据集和代码。
复旦大学等机构:提出Afford-VLA视觉规划框架,将任务相关的交互区域直接送入动作生成模块,让机器人更准确识别和执行操作任务,多个基准测试表现出色,具备较强鲁棒性和泛化能力。核心设计包括可学习query主动定位交互区域、mask pooling聚合局部特征、直通式Top-K池化让动作损失反向指导可供性学习。
Google量子AI团队:在《Nature》发表论文,利用强化学习智能体替代传统校准流程,实现量子纠错实时连续控制。逻辑量子比特稳定性提升约3.5倍,已优化基线上再降逻辑错误率20%,可扩展至近4万个控制参数。
Google DeepMind:创始人谢尔盖·布林表示不同领域AI模型呈现明显收敛趋势,Gemini在数学和科学问题达业界领先水平,肯定Transformer架构具备支撑AGI实现的能力,内部研发资源越来越多地投入"用AI构建AI"工作。
康奈尔大学与哈佛团队:提出"状态-预测分离"SPS架构,训练数据需求降至传统架构的40%,提升跨领域泛化能力。
PrismML(美国):将阿里Qwen 3.6的270亿参数模型压缩至不足4GB,适配iPhone 17 Pro运行。
深码科技:推出4D高斯世界模型,构建几何真实、时间连贯的数字空间,解决视频生成结构失真问题。
高德:联合清华、北大等推出WorldRoam-Bench评测基准,含600余测试案,覆盖室内外及城市场景;发布Phys AI Data数据系统,提供面向物理AI训练的一站式空间数据基座。
ACL 2026:年会在美国圣地亚哥举行,投稿12148篇创历史新高(增45%),主会接收2297篇(录取率18.9%)。三篇最佳论文第一作者均为华人,分别研究大模型未完成体悖论、工作记忆约束编码效率、局部注意力表达力。中国大陆作者占全部作者54%。
OpenAI:挑战SWE-Bench Pro编程评测基准,确认731项任务中约30%存在问题(测试过严、提示不全、覆盖不足、误导性描述四类),前沿模型8个月通过率从23.3%飙至80.3%不合理,撤回推荐并呼吁重建评测标准。
1.4 AI框架
蚂蚁灵波:开源全球首个面向具身智能的大规模MoE视频基础模型LingBot-Video,专注物理规律准确性,适用于机器人和人形智能,提供低成本数据生成、策略评估,支持动作规划。融合超过7万小时具身数据,多维度奖励系统优化美学质量、物理合理性和任务完成度,开源模型权重、提示词重写工具、代码和技术报告。
原力灵机:发布新一代具身基础模型DM0.5(开源项目OpenDM),参数规模扩大至4B,数据量增加400%(达15万小时),Zero-Shot导航成功率提升31%。结合高质量真机、Egocentric和场景重建数据,架构创新支持更复杂任务执行。原生记忆、分层推理和对齐架构实现强Zero-shot泛化,可运行于4090显卡。发布开发者平台DexDev及多智能体混合作业系统Ferrata,包含后训练工具DFOL2.0(降低真机数据需求60%)、操作系统DexOS和开源协议ECP,推出业界首个具身MaaS按量付费服务。
蚂蚁灵波:发布全球首个具身原生预训练模型LingBot-VA 2.0,专为机器人设计,从数据到架构全面为物理世界操作设计。四大核心设计:语义视觉-动作分词器提升指令跟随与动作精度;严格因果预训练范式确保视觉预测和动作生成遵循单向时间顺序;MoE架构扩大模型容量兼顾推理效率;增强异步推理机制(Foresight Reasoning)实现实时闭环控制。单卡150Hz实时推理效率,RoboTwin 2.0仿真基准测试成功率高达93.6%。
蚂蚁灵波:开源全球首个小时级实时交互世界模型LingBot-World 2.0,实现长时间无衰减高质量画面生成,具备自主演化功能。采用因果预训练与混合双向自回归注意力掩码机制抑制长时漂移,720p/60fps低延迟高清交互,14B模型权重与代码开源,支持施法、攻击、跳跃等动作及文本驱动环境事件,内置Agent机制与多人同世界互动,适用于游戏、创作及机器人训练。
蚂蚁灵波:发布LingBot-Vision开源1B骨干网络与LingBot-Depth 2.0深度感知模型。LingBot-Vision在深度估计上超越7B模型,蒸馏版0.3B尺寸缩小23倍仍匹配7B精度,基于分类边界场训练精准解析物体边缘。LingBot-Depth 2.0在14个深度补全基准上领先,能处理透明物体、反射表面等难题。
LIMSSR:针对训练阶段多模态观测不完整挑战,重新定义不完全多模态学习为条件序列推理任务,利用LLM语义推理能力通过提示引导上下文感知模态插补和多维表示融合,无需直接重建缺失模态。引入掩码感知双路径聚合策略动态校准推理不确定性缓解幻觉,三个动作质量评估数据集上显著超越现有方法。
MobileForge:无需人工标注实现移动GUI代理目标应用适应的框架,通过MobileGym进行真实目标应用交互探索自动挖掘可执行课程任务,利用HiFPO实现提示引导多尝试回滚、层次化轨迹反馈及步骤级GRPO策略优化。AndroidWorld和MobileWorld基准上显著提高多个基础模型成功率。
Gas Town:多智能体编排系统,专为Claude Code、GitHub Copilot等AI编程助手设计,提供持久化工作状态追踪。通过市长、钻井平台、船员、臭鼬等核心概念构建可扩展协作框架,支持同时管理20-30个AI代理,利用Git工作树和Beads账本技术记录工作状态,引入邮箱、身份标识和交接机制实现自动化去中心化代理间通信与任务分配。
RoboTALES:结合大语言模型与视觉模型的双阶段具身智能框架,利用任务对齐视频生成进行规划,让机器人预测未来并更稳定执行复杂操作。
LeRobot(Hugging Face):发布VLA-JEPA,首个将世界模型整合进VLA策略的训练方法。训练时引入JEPA世界模型在潜在空间预测下一帧动态,推理时世界模型被完全移除,无额外计算开销。
M3 Proctor:多模态Agent记忆系统,索引阶段为图片、图表、PDF等生成文本代理并挂载模态标签,查询时先用文本代理回答,置信度不足时才升级读取原图,token减少70%。
LMCache:开源KV缓存管理工具,独立进程运行于推理引擎之外,存储复用系统提示和文档KV缓存,支持跨GPU、CPU、磁盘和远程存储并行数据搬运。采用CacheBlend技术允许缓存复用超出精确前缀范围,H200+235B模型上首token延迟降低14倍、解码速度提升4倍,节约90%成本。
GRAM训练方法:Anthropic联合AE Studio提出,将双用途能力(如疫苗研发/制造病原体)封装为可移除模块,动态控制模型能力边界,保持有益功能同时降低安全风险。
Infinigen 2.0:程序化生成3D世界的开源系统,1分钟CPU时间内生成室内3D场景,支持家具、建筑元素、电器、日常物体生成,可导出用于Omniverse、Unreal等实时模拟器中的具身智能训练。
GaussianGPT:自回归3D场景生成研究,将3D Gaussian场景压缩成离散token,用Transformer逐token预测生成空间结构和外观,支持完整3D场景生成、自动补全、外扩。
二、智能体与AI应用
OpenAI:推出ChatGPT Work工作型智能体,由GPT-5.6与Codex能力驱动,可研究分析信息、跨连接应用和文件执行操作,创建完整文档、表格、演示文稿、报告和Sites。支持跨应用自主操作(Slack、Teams、Drive、Salesforce等)、长程工作能力(可持续数小时)、定时任务与监控(Scheduled Tasks)、增强版Computer Use。网页和移动端面向付费计划逐步推出,Pro、Pro Lite、Enterprise、Edu优先。每周用户超500万,销售流程从数周缩短至24小时。
OpenAI:新版ChatGPT桌面应用整合Chat、Work、Codex三大功能,支持macOS和Windows。原桌面应用保留为ChatGPT Classic。Work可在用户授权下使用本地文件和桌面应用,内置浏览器访问网站和网页工具。Codex新增diff内联编辑、侧边栏PR review、更快的computer use,一个项目支持多个仓库。
OpenAI:升级Chrome浏览器ChatGPT扩展,可在侧边栏直接调用,支持读取网页内容、跨标签页执行操作、访问本地文件系统、编辑主流办公文档。停用独立AI浏览器Atlas(8月9日停止工作),能力整合至Chrome扩展与桌面应用。
OpenAI:ChatGPT Sites进入公开测试,可把工作、想法、数据和文件转成交互式网站或轻应用(仪表盘、项目追踪器、发布日历、原型、内部门户、报告),支持公开发布并生成URL分享。Business和Enterprise已可用,Pro、Pro Lite、Edu公测。
OpenAI:发布GPT-Live语音交互系统,采用全双工架构支持实时连续对话,边听边说、实时打断、实时回应,学会适时垫话、安静等待,抗环境噪音能力强。前后台解耦设计:前台负责流畅对话,后台调用GPT-5.5处理搜索、推理、计算等复杂任务,对话不中断。支持三档推理强度(Instant/Medium/High)、联网搜索、记忆、图片识别、文件上传,语音对话中可弹出可视化卡片。对话流畅度评分从3.80升至4.96,面向全球ChatGPT用户逐步推出。
Anthropic:推出**Claude Reflect(AI镜子)**测试版,追踪和可视化用户使用Claude的方式,展示过去1/3/6/12个月使用主题、高峰、任务类型和协作模式。基于4D AI Fluency Framework分析目标描述、输出判断、任务委派、结果负责四个维度,支持免打扰时段和休息提醒。面向开启Memory的Free、Pro、Max用户开放。
Anthropic:Claude Fable 5在六大行业能力指数全部八项指标中包揽第一,Opus 4.8在六项指标中位列第二。Artificial Analysis测试显示单项任务成本3.48美元。
百度:"百度搭子"重磅升级,个人版全面优化、企业版亮相、搭子联盟启动,提升复杂办公任务执行效率,确保数据和成果在组织内部安全流转,目标让智能体深度参与90%以上工作流程。
腾讯:拟收购新加坡AI初创公司Manus,以20亿美元估值成为最大股东,发力智能体生态。Manus计划在香港上市。前OpenAI研究员田永龙加入腾讯大语言模型部,参与视觉语言模型研发。腾讯云发布Agent Bucket,为亿级智能体提供原生独立云空间。
阶跃星辰:将发布全球首款AI智能体手机,由华勤技术/努比亚代工,搭载骁龙8系平台,定价3500元以上,AI智能体作为系统级交互入口,可跨应用完成预订、查询等复杂任务,7月13日发布,落地节奏快于OpenAI(计划2027年)。努比亚将于7月17日WAIC 2026展示。
支付宝AI开放平台:正式上线,商家可接入"阿宝"并实现一次接入、多端分发,啄木鸟家庭维修首批接入。
亚马逊:推进代号Moonraker的AI智能体项目,使Alexa串联执行多步复杂任务,测试阶段使用数百块英伟达GPU,预计2026年GPU支出超1亿美元,正使用Anthropic模型测试。
EverMind:发布自进化智能体框架"渡鸦",通过双向记忆与改写自身代码能力解决大模型"失忆症"痛点。
AICUBE:新型智能家居设备,训练生成特定人物特征和语言能力的数字分身,支持跨应用控制、自然语言编程,可定制为家庭成员声音和形象,提供娱乐、健康管理等智能化服务。
智梦可:前头部新造车智驾团队负责人杜宇创立,推出AI睡眠超充垫,四位一体设计结合温控技术和数据驱动模型,通过监测和调节温度改善睡眠质量,计划扩展到更广泛健康管理领域。
淘宝:内容成长引擎GrowBrain,以LLM Agent为决策中枢,Plan-Execute-Summarize三段式编排,统一调度潜力预估、流量分配、流量诊断三个子Agent,替代传统规则系统实现内容冷启智能决策。
OpenClaw:知名开源个人智能助理项目转型为非营利基金会,创始团队携手微软与英伟达共同维护独立性,每周新增用户达四百五十万名。
Google Cloud:AlphaEvolve自主算法优化智能体全面可用(GA),由DeepMind共同构建、Gemini驱动,在Frontier超算上生成百亿亿次GPU内核、发现全新量子纠错方案、药物发现分子模拟速度提升4倍、预测任务提高准确率并减少90%运行时间。
三、物理AI/机器人
原力灵机:发布通用具身基础模型DM0.5和机器人本体Apex,40亿参数,训练数据提升400%,零样本学习、长时记忆与抗干扰能力大幅提升,不同机器人平台迁移能力增强。
蚂蚁灵波:
- LingBot-Video:全球首个面向具身智能的大规模MoE视频基础模型,开源,专注物理规律准确性,适用于机器人仿真、动作预测。
- LingBot-VA 2.0:全球首个具身原生预训练模型,机器人操作成功率突破93.6%,预测式控制提升动作预测和执行效率,单卡150Hz实时推理。
- LingBot-World 2.0:全球首个小时级实时世界模型,开源,长时间无衰减高质量生成,自主演化,适用于机器人训练。
- LingBot-Vision / LingBot-Depth 2.0:深度感知模型全面升级,面向空间AI和机器人。
宇树科技:G1人形机器人在海外完成全球首例活体外科手术,美国加州大学团队成功实施动物胆囊切除术。基于宇树G1的人形机器人Surgie在《自然》发表论文,成功为活猪实施腹腔镜胆囊切除术,为通用人形机器人首次完成活体手术。Surgie重仅27公斤,成本远低于达芬奇系统,通过遥操作实现精准操作,精度接近达芬奇但速度较慢。
1X(挪威):推出二十五轴人形灵巧手,拥有25个主动控制轴,肌腱驱动触觉控制系统模拟人类手指,传感器感知微小压力与滑动变化。
复旦大学等:提出Afford-VLA视觉规划框架,解决机器人操作中空间交互理解问题,让机器人精准找到操作物体最佳位置,多个基准测试表现出色。
Mistral:Robostral Navigate机器人导航模型,仅需普通RGB摄像头即可完成自主导航,全新场景成功率超76%。
RoboTALES:具身智能新框架,结合大语言模型与视觉模型双阶段规划,让机器人预测未来并更稳定执行复杂操作。
莫斯科:举办首场人形机器人婚礼,新郎罗伯特与芭蕾舞娘玛蒂尔达结为夫妻,机器狗多格玛提克递送手圈,展现智能技术融入日常生活趋势。
南京大会:展示具身智能三大突破:脑机接口解决意图解码难题,类人灵巧操作提升机器人执行能力。
四、硬件与基础设施
中科曙光:首个全国产十万卡AI超集群"登峰"正式落成,启动第二套系统研制,采用原生超智融合技术路线,具备高可用性和长周期运行能力,定义新行业标准。
国家超算互联网:郑州核心节点上线,具备超10万卡国产AI算力,为全国最大单体国产算力资源池。
广东国产万卡集群:总投资55亿元,部署30个昇腾910C超节点,建成9000P智算池,90天完工。
商汤科技:WAIC 2026期间联合寒武纪、沐曦、海光、摩尔线程、壁仞、曦智科技、硅基流动等近20家国产芯片与AI Infra伙伴,共同官宣国产AI基础设施生态共建计划,加速国产化进程。
剑桥大学Dawn AI超算:因极端高温(37.7°C)瘫痪一周(6月27日至7月6日),影响350个科研项目(帕金森新药分子筛查、个性化癌症疫苗靶点发现、海冰预测模型等)。由1024块Intel GPU、256台液冷服务器组成,暴露出AI基础设施在气候变暖背景下的脆弱性。
OpenAI:首款自研推理专用ASIC芯片Jalapeño,构建全栈AI生态系统。GPT-5.6基于Cerebras定制硬件,推理速度达750 tokens/秒,采用多晶圆芯片协同和轻量化设计。新增美国银行5.2亿美元信贷额度,可动用信贷总额突破50亿美元。
DeepSeek:秘密启动自研AI推理芯片项目,秘密组建芯片团队减少对NVIDIA和华为依赖,已接触芯片设计、代工和存储合作伙伴,瞄准AI推理这一行业最大成本领域。
英伟达:H200芯片有望获准入华,头部企业或获批采购总量低于20万颗,性能为前代H100的两倍。Rubin Ultra AI机架成本预计高达2100万美元,高带宽内存成本大幅增加。黄仁勋称英伟达软件工程师更愿构建智能体而非写代码,转向设计基准和安全护栏。
Meta:计划今年9月量产自研AI芯片Iris(MTIA四代路线图),由博通与台积电合作。在加拿大建设首座数据中心,设计容量1GW,总投资130亿加元,采用100%清洁能源与液冷系统。启动五个吉瓦级机房建设工程,算力明后年逼近行业龙头水平。考虑出租部分AI基础设施,探索AI云业务创收。
三星电子:自主研发4纳米制程AI PC芯片Gaia,计划明年量产,采用优化的神经网络处理单元架构。
美光科技:计划到2035年将美国晶圆厂与技术投资提高到超过2500亿美元,AI驱动内存需求激增,目标美国国内生产40% DRAM产量。
JEDEC:发布SPHBM4新标准(JESD330-4),支持传输速率22.4至46 GT/s,最高带宽2.944 TB/s。
Rambus:新一代DDR5 RDIMM芯片组,传输速率达9600 MT/s,AI推理中模型加载速度提高30%。
北京大学团队:研发全球首款毫秒级神经动力学系统芯片,脑皮层表面重建任务较GPU提速最高478.18倍。
DDR内存:DDR4 8Gb合约价三季度涨幅上调至50%,企业级SSD需求激增,供需失衡或延续两年。
SK海力士:280亿美元美国股票发行获超7倍认购,用于建设新厂及采购设备,有望成全球史上第二大股票发行。美国IPO定价每份ADS 149美元,发行1.779亿份ADR,认购金额接近2000亿美元。
Quadric:发布DevStudio基于CI/CD的NPU模型自动编译与性能评测平台,每次SDK发布时300+模型库自动重新评测。
工业富联:上半年归母净利润预计234亿至244亿元,同比增长93%-101%,AI服务器营收同比增长超230%。
浪潮信息:中报预告超预期,股价两连板创历史新高,受益国内算力需求景气。
Yole Group:预测2026年全球半导体产业收入达1.6万亿美元,最早2027年逼近2万亿美元,AI基础设施推动变革。
五、企业动态
OpenAI:
- 发布GPT-5.6三档模型系列、ChatGPT Work智能体、新版ChatGPT桌面应用(整合Codex)
- GPT-Live全双工语音模型全球推送
- 停用Atlas浏览器,能力迁移至Chrome扩展与桌面端
- ChatGPT群聊创建与加入停用(7月9日起)
- ChatGPT Sites公开测试
- 自研推理芯片Jalapeño
- 新增美国银行5.2亿美元信贷,总额超50亿美元
- 首席未来学家约书亚·阿希亚姆宣布离职(7月24日)
- 超级对齐团队已解散,安全研究职能分散到其他团队
- 收购Northslope扩大"前置部署工程师"团队
- 秘密提交IPO申请推迟至2027年
Anthropic:
- 推出Claude Reflect功能
- 重置所有用户5小时和每周速率限制应对GPT-5.6竞争
- 前美联储主席伯南克加入长期利益信托基金
- 宪法AI由哲学家主导设计,3H原则(无害>诚实>有用)
- Amanda Askell领导"人格对齐团队"制定Claude宪法(约23000字开源文件)
- 6月1日秘密提交IPO申请,预计三季度利润超10亿美元
- 联合AE Studio提出GRAM安全训练方法
Meta:
- 发布Muse Spark 1.1多模态推理模型与Meta Model API
- 启动五个吉瓦级机房建设
- 自研AI芯片Iris计划9月量产
- 加拿大首座1GW数据中心投资130亿加元
- CTO复盘Llama 4掉队:技术储备被Llama 3透支
- 扎克伯格进入"创始人模式"抢算力抢人才
- 考虑出租AI基础设施探索云业务
- 秘密研发"超级感知"AI眼镜原型,全天候录制引隐私争议
SpaceXAI / xAI:
- 联合Cursor发布Grok 4.5大模型
- 收购Cursor后首款联合训练产品
- Grok 4.5一小时自主开发FPS射击游戏
蚂蚁集团/蚂蚁灵波:
- 开源LingBot-Video(全球首个具身智能MoE视频模型)
- 发布LingBot-VA 2.0(具身原生预训练模型)
- 开源LingBot-World 2.0(小时级实时世界模型)
- 发布LingBot-Vision与LingBot-Depth 2.0
字节跳动:
- Seedance 2.5视频模型7月16日全量开放API
- Seedream 5.0 Pro图像创作模型发布
- 与歌歌AI合作版权分成
零一万物:李开复发布"万策"企业决策产品,强调AI转型需一号位推动
MiniMax:完成160亿港元新一轮融资,创始人零薪酬直至AGI,计划推出2.7万亿参数新模型
智谱AI:提出SAO异步强化学习方案,完成约314.1亿港元配售
快手:发布KAT-Coder-Pro V2.5编程模型
百度:"百度搭子"重磅升级,企业版亮相
腾讯:
- 拟接盘Manus成最大股东(估值20亿美元)
- 田永龙入职攻坚视觉语言模型
- 腾讯云发布Agent Bucket
- 微信6月推8项AI更新(支付、输入、读书等全接入)
阶跃星辰:将发布全球首款AI智能体手机,印奇出任董事长
原力灵机:发布DM0.5具身模型、Apex机器人、DexDev开发者平台
歌歌AI/音律闪动:推出纯中文AI音乐模型,与字节跳动版权合作,启动民乐AI研发
Utopai Studios:发布PAI 2.0长篇AI视频模型,估值达10亿美元成独角兽,好莱坞导演PJ Ace用其制作3分钟历史短片
Lyzr:通过自主研发的AI代理SivaClaw完成1亿美元B轮融资,估值5亿美元,开创AI代理主导融资先例
General Intuition:完成3.2亿美元融资,打造物理AI基础模型平台,投后估值23亿美元
Ollama:完成6500万美元B轮融资,每月用户超890万,覆盖85%财富500强公司
Gradium(巴黎):获1亿美元种子轮融资,投资方含英伟达,用于在旧金山设点
OpenClaw:转型为非营利基金会,微软英伟达参与维护
DeepSeek:秘密自研AI推理芯片,减少对外依赖
华为:智能驾驶总裁欢迎特斯拉FSD入华,称明年国内高速场景迈入L3大规模商用
Waymo:无人驾驶出租车即将登陆圣迭戈、拉斯维加斯、坦帕和丹佛四个新城市
HTC:重心转向AI、智能眼镜与VIVERSE平台,上半年营收同比下滑9.73%
苏宁易购:碧英科技与骋风而来签署AI算力战略协议
中关村科金:推出得助MaaS平台,Token OM与Token Hub双架构
蘑菇车联:展示MogoMind大模型,全场景交通管理落地
荣耀:MagicOS与沪上阿姨联名,YOYO助手自动识别订单生成取餐码;台湾发布600系列AI影像手机
科大讯飞:参与"鹏城云脑"项目获2025年度国家科技进步奖一等奖
天立国际:"天立学科大脑"入选联合国AI for Good案例,服务107所学校、25万师生
六、产品更新
GitHub Copilot:
- 推出企业托管的OTel遥测导出功能,管理员控制导出端点、协议、服务名称等
- 新增仓库概览功能,自动为不熟悉的仓库生成摘要与README
Pika:推出Director’s Suite实验性AI视频创作产品,智能体驱动全流程电影制作,从概念到成片,邀请制访问
即梦/Seedance 2.0:新增3D场景拖放构建功能,无需Blender,直接拖放3D角色和元素构建场景,精确控制摄像机角度和运镜
MOSS团队:开源MOSS-Transcribe-Diarize-0.9B语音转录模型,0.9B参数,支持90分钟长音频、128k长上下文,多说话人识别,热词偏置
微信:6月推8项AI更新:微信支付AI接入工具箱2.0(文档转Mermaid Token降50%)、QQ邮箱内测Agent Mail、企业微信灰度AI助理"大圆"、微信输入法语音智能整理、微信读书一键总结Skill、公众号评论区最多9张图、微信支付AI专属卡
鸿蒙PC版钉钉:8.2.6版本新增AI听记、AI表格等功能
微软:启动iPad版Word新版本(2.109)测试,重点引入Copilot AI助手
iPad版Word:Copilot AI助手测试中
OpenAI ChatGPT扩展:Chrome侧边栏原生运行,浏览网页、跨标签协调、访问本地文件
七、投资
MiniMax:完成160亿港元新一轮融资,用于AI基础设施及模型研发
智谱AI:完成约314.1亿港元配售
Lyzr:1亿美元B轮融资,估值5亿美元(AI代理SivaClaw主导)
General Intuition:3.2亿美元融资,投后估值23亿美元(物理AI基础模型)
Ollama:6500万美元B轮融资,月活890万用户
Gradium(巴黎):1亿美元种子轮融资,英伟达参投
EvenRealities(深圳):1.5亿美元Pre-B轮融资,投后估值超10亿美元(AI眼镜赛道)
北京月之暗面:新增社保基金长三角科技创新股权投资基金等股东,注册资本增至约152.4万人民币
Fundamentum:筹备目标2亿美元第三只基金,专注印度技术消费、金融科技及AI领域
OpenAI:收购Northslope扩大前置部署工程师团队
淡马锡:计划未来5年将AI投资占比从6%提升至15%
高盛:建议做多中国AI价值链,估算中国AI相关市值约4万亿美元
深圳市委:强调抢抓AI技术迭代窗口期,加大关键领域投资布局
人社部:"十五五"规划部署人工智能就业创造计划
长鑫科技:7月16日科创板IPO申购,拟募资295亿元,阿里巴巴累计投入约76亿元
OpenAI:新增美国银行5.2亿美元信贷额度,总信贷超50亿美元
美联储:6月会议纪要首次将AI基础设施投资列为三大通胀主要风险之一
八、行业观点与社会影响
安全与治理
AI编程工具安全警报:Claude Code、Cursor和OpenAI Codex在企业环境中频繁触发安全警报,行为与黑客攻击高度相似。Sophos CIXA行为引擎发现多项高风险操作(凭据访问、LOLBins合法二进制文件滥用),挑战现有安全检测机制。
开源代码供应链攻击:AI Now研究院披露"Friendly Fire"新型攻击手段,通过开源代码供应链劫持主流AI代码代理工具,执行安全测试时植入恶意程序,覆盖Claude和GPT等大模型,利用默认配置绕过防护获取远程代码执行权限。
LLM代理安全对齐失效:传统安全对齐对LLM代理无效,攻击隐藏在工具调用序列中而非文本提示里,测试拒绝率不足35%。攻击者将漏洞利用改写为普通请求,文本看似无害但工具调用序列构成攻击。
AI模型安全测试报告:Jürgen Schmidhuber(现代AI之父)等多国团队发布SearchGEO框架测试13个主流大模型,发现不同模型安全性存在显著差异,LLM助手面临搜索内容操纵风险,需更全面系统防护。
IDA Pro AI恶意样本分析:多agent框架Spore集成REAI、FindCrypt等工具,实现恶意软件自动化深度分析,代码已公开GitHub。
工信部预警:Claude Code存在安全后门风险,阿里巴巴宣布7月10日起全员禁用该系列产品。
模拟部署安全评估:科研人员开发模型安全评估新框架,模拟真实部署环境测试大模型,在GPT-5系列上成功预测潜在安全风险。
物理审计架构:科学机器学习领域发布物理审计验证工作流,提升算法在工程场景的可靠表现,防止违反因果关系等物理规律。
OpenAI政府合作原则:公布与政府和国家安全机构合作的核心原则,涵盖负责任AI使用、民主问责制、公共安全保障。
哲学与伦理
梵蒂冈AI通谕:教宗利奥十四世发布《壮丽人性》通谕(42,300字),副标题"论在人工智能时代守护人性"。指出技术非恶也非中立,需警惕AI权力过度集中、AI驱动失业可能成社会灾难,强调尊严先于功能。
AI公司引入哲学家:Google DeepMind、Anthropic等西方AI公司聘请哲学家参与治理。DeepMind 2017年成立伦理与社会研究部门,Iason Gabriel提出对齐六层框架(指令、意图、偏好、知情偏好、利益、价值);2026年聘用Henry Shevlin研究机器意识,提出外部行为、内部表征、普适道德三层评估框架应对"行为主义复仇"。Anthropic由Amanda Askell领导"人格对齐团队",宪法AI以亚里士多德美德伦理为基础,四大优先级(广泛安全、广泛合乎伦理、遵守指引、真正有帮助),哲学家直接参与预训练和微调全流程。
超级对齐团队解散:OpenAI超级对齐团队成立不到一年解散,Ilya Sutskever和Jan Leike相继离职,算力资源争取困难,安全研究职能分散引发独立性担忧。
社会影响
AI台风预报违法:中央气象台通报网络博主用AI模型擅自发布台风预报并收费,属违法气象预报,依据《气象法》可处罚款5万元以下。
声音AI克隆维权难:短视频配音员小鱼声音遭AI克隆,赢得侵权首案但声音已扩散至数百账号,维权困难。
美国家长AI担忧:50%美国受访家长担心孩子过度依赖AI工具,30%称孩子已使用,仅22%家长表示学校提供官方AI工具。
AI职场风险:从业者因AI虚构竞品、篡改代码或伪造法条导致项目延误甚至处罚。
AI学习差距:家长认知决定下一代轨迹,部分少年深入研究Codex落地企业应用,部分孩子暑假仍从事体力劳动。
纽约时报vs OpenAI版权诉讼:纽约时报指控OpenAI在ChatGPT版权诉讼中隐藏证据,称其建立超7800万条对话数据库、虚报搜索训练数据能力,申请法院制裁。诉讼裁决将直接影响生成式AI数据合规标准。
生成式AI备案:截至2026年5月,全国超500款生成式AI服务完成算法与大模型双备案,企业需提交安全评估报告。
深圳龙岗AI城管:试点部署本地AI城管模型,日均处理案件超300件,问题处置周期缩短三分之一。
亚马逊云GraphRAG:将药研周期缩短87%,通过知识图谱加速分子筛选与分析,制药企业已开始采用。
行业观点
谷歌白皮书:软件工程从"语法"转向"意图",85%专业开发者定期使用AI编程智能体,AI生成代码占比41%。AI编程演进分五阶段:自动补全、内联建议、聊天生成、编程智能体、自主智能体。区分氛围编程(随意验证试错)与智能体工程(自动化测试、CI/CD关卡、LLM裁判)。
腾讯研究院:大模型API市场垄断竞争,超500家厂商、市场份额分散、领先模型更迭频繁,赫芬达尔-赫希曼指数持续走低。"卖token"模式恐难实现可持续盈利。
翁荔博客:AI自进化先优化外部系统(Harness)而非模型权重,Harness决定模型如何调用工具、管理上下文、执行任务,是递归自我改进近期可行路径。
Meta CTO复盘:单体万能大模型时代已终结,未来是昂贵高智能模型与廉价垂直小模型分层协作,自研模型是不被收高额"租金"的底牌。
黄仁勋观点:英伟达软件工程师更愿构建智能体而非写代码,工程师转向设计基准和安全护栏,枯燥工作交给智能体。
布林观点:Transformer架构具备支撑AGI实现的能力,不同领域AI模型呈现收敛趋势,内部越来越多投入"用AI构建AI"。
摩根士丹利:美股七大科技龙头相对标普500估值溢价创十多年新低,从30%以上回落至10%附近,市场对巨额AI资本开支失去耐心。
阿波罗首席经济学家:AI盈利兑现周期拉长成为全市场难题,Token定价持续下行,中国模型Token消耗量已超美国竞品,云巨头盈利预期或过于乐观。
高盛:中国AI相关市值约4万亿美元,资金低配和硬件需求带来重估机会。
九、学习与研究资源
开源项目:
- LingBot-Video:首个面向具身智能的开源大规模MoE视频生成模型,权重、代码、技术报告全开源
- OpenDM/DM0.5:通用具身智能VLA模型开源项目,含训练推理脚本、数据集示例、评估流程
- Domino算法:大模型推理加速算法,5.47-7.92倍提速,代码开源
- AffordVLA:统一视觉语言动作框架,机器人视觉规划
- LIMSSR:不完全多模态学习框架
- MobileForge:移动GUI代理目标应用适应框架
- Gas Town:多智能体编排系统,AI编程助手状态管理
- Crawl4AI:专为大模型优化的开源爬虫工具,71.8k星
- PentAGI:全自主AI安全代理渗透测试工具,19.3k星
- DesktopCommanderMCP:Claude桌面终端控制工具,6.5k星
- awesome-design-md:智能体UI设计规范项目,99.6k星即将破十万
- Nanograd:纯Python/NumPy轻量级自动求导引擎,API模仿PyTorch,含神经网络模块、优化器、损失函数
- The-Absolute-Code:开源代码资源集合项目
- RapidLightning:遗传编程集成模型,Claude Code三个月构建,编译为无依赖C语言动态库,纳秒级推理
- llama.cpp:更新AMD ROCm/HIP支持
研究论文:
- d-OPSD扩散语言模型自蒸馏(清华+马普所)
- Domino推理加速算法(上交)
- FrontierOR大规模优化算法设计LLM评测基准(MIT)
- EvoAgentBench智能体自我进化能力评测基准
- M3 Proctor多模态Agent记忆系统
- VLA-JEPA世界模型监督VLA训练(Hugging Face LeRobot)
- 上海AI Lab世界模型综述(三位一体架构:Agent+Evaluator+World Model)
- 谷歌量子纠错强化学习(Nature)
- Surgie人形机器人腹腔镜手术(Nature)
- ACL 2026最佳论文三篇(华人一作)
教学资源:
- 开源教学Skill:输入年级、学科、知识点,AI生成复习资料、知识图解、练习内容、可视化课程并自动讲解
- Netflix在Hugging Face发布视频数据集和模型
评测基准:
- SWE-Bench Pro(OpenAI质疑30%任务有缺陷)
- FrontierOR(MIT,优化算法设计能力)
- EvoAgentBench(智能体自我进化)
- WorldRoam-Bench(高德,600余测试案)
- Artificial Analysis开放性指数(K2 think v2最高分)
- Arena.ai文生图排行榜
十、总结与洞察
模型分层化趋势明确:OpenAI GPT-5.6三档模型(Sol/Terra/Luna)、Meta Muse Spark 1.1、Grok 4.5等产品共同印证行业从单体万能大模型转向"旗舰高智能+均衡主力+轻量高频"分层协作格局,价格战加剧,Token成本持续下探,性价比成为核心竞争力。
智能体成为核心战场:ChatGPT Work、Claude Code、百度搭子、AI智能体手机等密集发布,标志AI从对话工具向主动执行的智能体跃迁。跨应用操作、长程任务执行、定时自动化、计算机使用能力成为标配,浏览器和操作系统正从信息窗口进化为AI执行工作台。
具身智能加速突破:蚂蚁灵波系列模型(LingBot-Video/VA 2.0/World 2.0)、原力灵机DM0.5、宇树G1手术机器人等多点开花,中国团队在世界模型、具身VLA领域取得全球领先地位,视频模型正向物理世界模拟器转变。
全栈自研成巨头共识:OpenAI自研Jalapeño推理芯片、Meta自研Iris芯片、DeepSeek秘密启动芯片项目、国产十万卡超集群落地,AI厂商向上游硬件延伸,算力自主可控成为战略刚需。
安全治理挑战升级:AI编程工具行为类黑客、供应链攻击、LLM代理对齐失效等新型安全风险不断暴露,传统文本安全护栏对智能体时代失效。哲学、伦理、法律多维度治理探索同步推进,AI安全从技术问题扩展为社会系统工程。
中国AI价值链重估:国产算力基建、大模型、具身智能、应用落地全面推进,高盛等机构看多中国AI价值链,科创50指数大涨,资金从海外向中国AI板块切换趋势显现。

