🎬 视频版直达:https://www.bilibili.com/video/av117261364895226/
💡 今日趋势速览:GPT-6 Sol演示版疑似泄露,效果超预期并碾压同代GPT-6 Astra,震动业界;DeepSeek灰度测试语音对话提供四种音色,微信灰度上线小微AI功能矩阵,AI助手加速多模态化,巨头正面硬刚,行业竞争再度升温。
🎯 今日要点
📋 今日内容汇总
🤖 AI动态
🧪 芯片半导体
📌 模型排行榜
🤖 AI动态
1. GPT-6 Sol 演示版本泄露,效果超预期
GPT-6 Sol 首个演示版本疑似遭泄露,据称其输出效果远超预期,表现力直接碾压同代模型 GPT-6 Astra,令业界震惊。有观点认为这将是 OpenAI 对整个 AI 生态系统的又一次重大变革。以下是官方给出的 demo


🔗 https://x.com/Mr_Salio/status/2098832275261546641
2. DeepSeek 灰度测试语音对话功能,提供四种朗读音色
来源:原文 | cnBeta
DeepSeek 正在灰度测试语音对话功能,被测试到的用户可在 App 右上角看到一个小喇叭按钮。同时,设置页面新增了音色选择选项,提供四种朗读音色供用户切换。此次测试标志着 DeepSeek 正从纯文本交互向多模态交互拓展,进一步完善 AI 助手的使用体验。



🔗 https://www.ithome.com/1/001/498.htm
3. 微信灰度上线 AI 功能矩阵「小微」,覆盖修图与翻译
来源:原文 | IT之家 (ITHome)
微信灰度上线一批 AI 功能,统一绑定在小微:发图可美化、修图、提取文字,朋友圈长按可 AI 点评,扫码可识别翻译,聊天里说句话就能让 AI 润色或翻译,此前公众号也已有 AI 总结。目前仅部分用户可体验,是否全量看官方。

🔗 https://x.com/RocM301/status/2098629460572639334
4. 阿里 Qoder CLI 个人版 v1.1.50 开放自定义模型接入
阿里Qoder宣布,自v1.1.50起,Qoder CLI正式向个人版用户开放自定义模型接入。该工具是阿里2025年10月发布的AI编程命令行工具,属Qoder智能体编程平台形态之一。填入API地址、模型ID和API Key即可接入自带模型,国际版和CN版均适用。


🔗 https://www.ithome.com/1/001/597.htm
5. 阿里千问办公上架麒麟软件商店,已原生适配全部主流操作系统
阿里企业级 Agent 产品千问办公上架麒麟软件商店,银河麒麟用户搜索即可安装。千问办公已支持 Windows、macOS、HarmonyOS、银河麒麟、统信 UOS 等主流操作系统;双方团队在系统登录联动、设备互联、技能调用等核心链路完成攻坚与原生适配。


🔗 https://www.ithome.com/1/001/562.htm
6. Codex 宠物改版:弹窗直接回复,支持语音与文本
Codex 宠物功能改版:无需打开客户端主界面,直接通过宠物的弹出窗口即可回复特定内容,交互更方便快捷,并支持语音和文本两种输入模式。这次改版让宠物从陪伴展示变成可交互的快捷入口,进一步降低 Codex 的日常使用门槛。以下是官方给出的 demo

🔗 https://x.com/xiaohu/status/2098743051170795859
7. 微软 Copilot 接入 Grok,先面向 Frontier 客户
微软宣布在 Copilot 中上线更多模型:来自 SpaceXAI 的 Grok 模型正在 Word、Excel 和 PowerPoint 的 Copilot 中逐步推出,首先面向 Microsoft Frontier 项目客户进行小范围发布,后续有望逐步扩大覆盖范围,让更多办公用户用上第三方模型。以下是官方给出的 demo

🔗 https://x.com/Microsoft365/status/2098791167185785301
8. Grok Bot 疑似向 Grok Heavy 用户逐步推出
TestingCatalog发现,Grok Bot正在Grok网页版向Grok Heavy订阅用户推出,上线后用户可直接在网页界面创建自己的机器人并与之互动。目前官方尚未发布公告,此次推出可能分阶段进行或存在地区限制,开放范围与时间表有待确认。


🔗 https://x.com/testingcatalog/status/2098533001403515368
9. 旗舰模型 Fugu Ultra v2 登陆 OpenRouter
Sakana AI 宣布旗舰编排引擎 Fugu Ultra v2 正式上线 OpenRouter 平台。该引擎面向复杂多步推理、自主研究与全栈软件开发场景打造,追求极致性能表现。开发者现在即可通过 OpenRouter 调用这款旗舰模型,体验其在长程任务编排与自主研究方面的能力。

🔗 https://x.com/SakanaAILabs/status/2098795892895580512
10. Qwen3.8-27B 登陆 Cerebras,开放模型获得极速推理
阿里 Qwen 团队宣布 Qwen3.8-27B 现已在 @cerebras 上运行,推理速度飞快,用户可立即体验。开放权重模型与极速推理硬件相遇,开发者无需自行部署 27B 模型即可低延迟调用,Qwen 开放生态的可用性再获提升。以下是官方给出的 demo


🔗 https://x.com/Alibaba_Qwen/status/2098676748972122394
11. Astra 官方致信用户:完成重置并修复多项质量问题
来源:原文 | rohanpaul_ai
Astra 团队说明重置与质量问题整改进展:一些为旧模型编写的技能触发过于频繁或阻止模型自查,已修复;一项可选的上下文管理实验曾导致回复过早停止或回复旧消息,影响约 4000 至 5000 名用户,已禁用;并移除了配置不当的引擎。

🔗 https://x.com/thsottiaux/status/2098612714704891959
12. DeepSeek V4.1 Flash 的 Agent 框架性能对比
DeepSeek V4.1 Flash 技术报告的章节 5.3.4 对比了模型在不同 Coding Agent 框架下的表现具体来看,测试涵盖 Claude Code、Codex、OpenCode 等,极简主义的 mini-SWE 反而以 74.2 拿下 DeepSWE 全场最高分,各框架下性能表现相对一致,对工具选型有实用参考价值。


🔗 https://x.com/shao__meng/status/2098615707953254567
13. 配套CLI与Skills,浙大开源可插拔Agent评测底座
浙大团队开源可插拔 Agent 评测底座,配套 CLI 与 Skills,主打告别海量脚手架。传统 Agent 评测需为每个被测对象单独搭脚手架,维护成本高;该底座以可插拔方式接入,借助自带 CLI 与 Skills 降低成本,让开发者专注 Agent 能力而非测试基础设施。

🔗 https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247922331&idx=2&sn=31d53cffe48bc2b01fe20512a63dc043
🧪 芯片半导体
14. OpenAI 公开自研 AI 推理芯片 Jalapeno 完整架构
OpenAI在Hot Chips 2026大会上公布了与博通联合开发的首颗定制推理加速器Jalapeno的完整架构,采用台积电3nm工艺设计上不追求纸面峰值性能,而是力求让ChatGPT和API用户感受到更快的响应速度, siliconcodesign 也对其展开系统架构解析,超越单纯的FLOPS参数,探讨周边网络架构。


🔗 https://x.com/dotey/status/2098836752765006266
15. 英特尔 NPU 驱动 1.38 支持 Ubuntu 26.04 LTS
英特尔正式发布Linux NPU Driver 1.38,核心变化是官方支持Ubuntu 26.04 LTS,此前已能在该系统运行驱动覆盖从Meteor Lake到Wildcat Lake的全部五代NPU平台,实现跨代兼容,搭配默认Linux内核即可稳定使用。此外,较新硬件负载测试通过率达98%,用户可从GitHub发布页面下载安装包。



🔗 https://news.mydrivers.com/1/1150/1150696.htm
16. 苹果 A20 Pro 刷新 Geekbench 7 单核纪录
苹果 A20 Pro 手机 SoC 在 Geekbench 7 单核测试中刷新纪录:这颗 2nm 芯片大幅领先所有智能手机处理器,对比台式机英特尔酷睿 i9 与 AMD 锐龙 9 最高领先 32%,甚至超越了最新的笔记本电脑处理器,移动端芯片的单核性能优势进一步扩大。


🔗 https://www.tomshardware.com/pc-components/cpus/apples-a20-pro-shatters-geekbench-7-single-core-record-2nm-chip-beats-desktop-intel-core-i9-and-amd-ryzen-9-by-up-to-32-percent
17. DeepSeek 减少 HBM 使用量,三星、SK 海力士股价同时下跌
DeepSeek V4.1 Flash 通过 CSA2 架构与 FP4 存储将 KV Cache 压缩至上一代约四分之一,引发市场对 HBM 单位需求下降的担忧,三星与 SK 海力士股价一度分别下跌约 3.5% 和 2.2%,但当前 HBM 供应依然紧张,对供需格局的冲击仍有待观察。

🔗 https://www.bestblogs.dev/article/7b17ee7c93?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item
📌 模型排行榜
18. Artificial Analysis AI 模型能力排行榜
最后是今日的 AI 模型能力排行榜单,智力榜前三为Claude Fable 5.1与GPT-6 Astra并列第一(均53分),Claude Opus 5以51分居第三。头部呈双雄缠斗、Anthropic系紧随之势。国产开源方面,GLM-5.3以45分列第7,Kimi K3以44分列第9,稳居前十。

🔗 https://artificialanalysis.ai/
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。



