🎬 视频版直达:https://www.bilibili.com/video/av117295439419630/
💡 今日趋势速览:Anthropic被曝灰度Fable 5.2与Opus 5.2两款旗舰,同时打磨双更新,谷歌Gemini 4 Pro定价与2M上下文规格遭泄露,阿里Qwen 4预计15天内发布并瞄准GPT-6 Astra,OpenAI则推迟GPT-6 Sol疑先发Muse竞品,巨头密集憋招,旗舰模型大战一触即发。
🎯 今日要点
📋 今日内容汇总
🤖 AI动态
🔌 AI基础设施
🧪 芯片半导体
📦 开源项目
📌 模型排行榜
🤖 AI动态
1. Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试
多位独立测试者报告,Anthropic 正在灰度下一代模型对此可运行提示词自查:询问模型重置哥 Tibo 是谁,若能清晰答出,说明你已用上新模型不止 Fable,Opus 5 同样出现被路由至 Opus 5.2 的案例,两款均未官宣、预计下周发布,Anthropic 正在同时打磨两个旗舰更新。



🔗 https://x.com/notjazii/status/2100893667846402306
2. Gemini 4.0 Pro 规格泄露,定价 $2.25/$11.25
谷歌下一代旗舰模型 Gemini 4 Pro 参数遭泄露,规格显示其每百万 token 输入定价 $2.25、输出 $11.25,并提供 2M token 上下文窗口与之配套的泄露基准表中,Gemini 4 Pro 在 Terminal-Bench 2.1 拿下 95.3%,还声称在多项基准中领先 GPT-6 Astra,整体表现显著超出预期。


🔗 https://x.com/ravikiran_dev7/status/2100925399777833165
3. Qwen 4 爆料:预计 15 天内发布,目标对标 GPT-6 Astra
泄露信息称阿里 Qwen 4 预计未来 15 天内发布,目标达到 GPT-6 Astra 水准。爆料未涉及参数规模与开源计划,但结合此前 vLLM 代码库中出现的 Qwen 4 适配记录,发布传闻或有技术依据。目前,阿里尚未确认,可信度仍待观察。

🔗 https://x.com/Priyannkaaaa/status/2100806396128399433
4. GPT-6 Sol 被曝延期:OpenAI 疑下周先发 Muse 竞品
据爆料, OpenAI 已推迟 GPT-6 Sol 发布,原因指向下周先行推出对标 Meta Muse 的智能体竞品。此前泄露显示 Sol 采用与 Astra 相同的 4 月 30 日知识截止,首个输出样本上周已流出。新模型暂无明确发布时间表。

🔗 https://x.com/Mr_Salio/status/2100918470959333427
5. MiniMax Code CLI 现已开放
来源:原文 | RyanLeeMiniMax
MiniMax官方宣布MiniMax Code CLI现已开源,这款面向开发者的命令行编程工具正式对外可用。该版本以MIT许可证向全球开发者开放,当前为v0.4.12版。而在FrontierHarness Eval评测中,MiniMax Code以76.7%的通过率领先,单任务平均耗时4分33秒位居首位。


🔗 https://x.com/MiniMax_AI/status/2100930515058753830
6. Qwen3.8-Flash 速度翻倍,QwenWork 生成专业演示文稿
阿里云介绍 Qwen3.8-Flash 速度提升一倍,配套 QwenWork 可将用户想法与文件转化为结构清晰的专业演示文稿,标准模式下 1000 积分约可生成 100 份演示文稿、每份约 10 积分,官方称真正的产出、合理的预算。以下是官方给出的 demo

🔗 https://x.com/alibaba_cloud/status/2100828276964966732
7. PrismML 发布 Bonsai 2 27B:压缩 9 倍至 5.9GB
来源:原文 | 思维怪怪 (Tech) (Twitter)
PrismML基于Qwen3.8 27B推出三值模型Bonsai 2 27B,体积压缩9倍至5.9GB,保留原模型98.2%的综合评测表现。该模型已依据Apache 2.0许可证发布,维持262K长上下文,可经MLX或CUDA内核在个人设备直接运行,RTX 5090上推理速度达143 tokens/s。


🔗 https://x.com/Gorden_Sun/status/2100843160423534985
8. Vercel AI Gateway 上线 GPT-Live 1 音频模型
Vercel 宣布 GPT-Live 1 现已上线 AI Gateway,开发者可直接调用。该模型为全双工音频模型,可边说话边聆听、随时被打断,并支持客户端委托在后台运行任意文本模型,模型标识为 openai/gpt-live-1。

🔗 https://x.com/vercel_dev/status/2100963500881526784
9. Muse for Mac 正式发布,可跨应用与文件工作
来源:原文 | TechMeme (Twitter)
Muse for Mac 今日正式发布。这款工具可跨电脑上的应用、文件、日历、笔记和消息工作,用户可自行控制它能访问哪些内容。开发团队目前迭代速度非常快,产品现已开放下载。

🔗 https://x.com/finkd/status/2100713341555712149
10. Nano Banana 2.5 已部署,将于下周正式发布
来源:原文 | Lyraxana (Twitter)
Nano Banana 2.5(代号 spicy-mayo)已部署并将于下周正式发布,合作伙伴现可通过 Vertex 使用,模型名称为 nano-banana-2.5,思考等级含 minimal、medium、high,图像输出尺寸支持 512、1K、2K、4K。

🔗 https://x.com/lyraxana/status/2101001666640154779
11. Meta SAM 3.1 上线,单次 API 调用完成检测分割跟踪
Meta 将 Segment Anything Model(SAM)3.1 上线 Meta Model API,开发者用一句短语描述目标,一次调用即可在图像和视频中完成检测、分割与跟踪,返回像素级精确的分割掩码和身份一致的视频跟踪轨迹,推理引擎已针对 SAM 3.1 架构调优。以下是官方给出的 demo

🔗 https://x.com/MetaforDevs/status/2100993422865944967
12. ChatGPT 桌面端应用支持安装 Chrome 扩展
ChatGPT 桌面端应用上线 Chrome 扩展支持,用户可将每天在用的扩展带入应用内置浏览器,在其中安装、固定并直接使用自己常用的扩展,日常依赖扩展的操作无需再切换到外部浏览器完成。以下是官方给出的 demo

🔗 https://x.com/JamesZmSun/status/2100995281097769216
13. Grok 语音转录 2.0 发布,号称全球最精确语音转录模型
Grok 语音转录模型 Voice Transcribe 2.0 正式发布,发布方称其为目前全球最精确的语音转录模型,可将语音音频转换为文本记录。此次公告未附带具体评测数据或基准对比,模型实际表现有待后续验证。

🔗 https://x.com/SpaceXAI/status/2101005248311726387
14. 智谱回应 ZCode 仓库数据上传争议:源于 Repo Wiki 功能
智谱回应ZCode仓库数据上传争议该功能生成Wiki页面时可能将仓库数据上传云端官方文档还明确,Repo Wiki不读取.git、依赖目录、构建产物或缓存。此外,ZCode宣布将近期开源代码并邀请第三方评估机构审查,全体用户将获一次额外的每周配额重置,今日发放。


🔗 https://x.com/0xLogicrw/status/2100887439321473392
15. 腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力
腾讯 WorkBuddy 5.5.6 上线全栈「应用」生成能力该能力自带云数据库、文件存储、注册登录和 AI 调用伴随能力上线,WorkBuddy 国内个人版会员权益随之调整其中免费用户可拥有累计 5G 资料库空间,各会员版本可开启云服务的应用个数与每月资源点额度各不相同。




🔗 https://www.ithome.com/1/004/283.htm
16. NVIDIA 发布 NVFP4 版 GLM-5.3,省约 1.66 倍显存
NVIDIA 在 Hugging Face 发布 4 位 NVFP4 量化版 GLM-5.3,将权重与激活精度从 8 位降至 4 位,磁盘和 GPU 显存占用缩小约 1.66 倍,同时在主要推理和编程基准测试中保持与 BF16 相当的准确率。

🔗 https://x.com/HuggingPapers/status/2100722688964825130
17. Qwen-Image-2.1 早期访问申请关闭,入选者将获 API
Qwen-Image-2.1 Early Access 早期访问申请通道已经关闭,团队正在逐一审核每一份提交,入选申请者将很快收到 API 访问权限。本次早期测试报名十分踊跃,发布方对用户的参与热度表示感谢。

🔗 https://x.com/ModelScope2022/status/2100902121810137295
🔌 AI基础设施
18. 华为昇腾 950 智算集群 9 月 30 日启用
来源:原文 | 网易科技
华为全联接大会 2026 上,华为云 CEO 周跃峰宣布昇腾 950 智算集群将于 9 月 30 日面向中国客户提供服务,11 月 30 日面向海外市场全面提供服务。华为云还将推出智能体记忆系统 CMS 记忆存储,搭载 CMS 的华为云将于 2027 年一季度上线。

🔗 https://wallstreetcn.com/livenews/3167239
🧪 芯片半导体
19. 中科院 GAA 晶体管新突破:DUV 光刻机可造 3nm 芯片
中国科学院公布新型全环绕栅极GAA晶体管架构,在DUV光刻机上实现开关比超50万倍,理论上可解锁3nm等效性能,无需EUV光刻机。该架构栅极从四面包裹电流通道,相比FinFET控制更精准,几乎杜绝漏电,为国产芯片绕开EUV、迈向先进制程提供了可行路径。


🔗 https://news.mydrivers.com/1/1152/1152076.htm
📦 开源项目
20. Violoop 登陆 Kickstarter,20 小时众筹百万美元
Violoop 是手掌大小的个人 Agent 桌面硬件,与年初爆火的 OpenClaw 均可让 Agent 自主看屏幕、操作键鼠、跨软件工作,因而被称为「硬件龙虾」。时隔五个月,该设备登陆 Kickstarter,上线 20 小时众筹达 100 万美元。


🔗 https://mp.weixin.qq.com/s?__biz=MzAxOTcxNTIwNQ==&mid=2457995838&idx=1&sn=6c76b08b595d73efdee9ef07c1da22a3
📌 模型排行榜
21. Artificial Analysis AI 模型能力排行榜
最后是今日的 AI 模型能力排行榜单,智力榜头部由 Claude Fable 5.1(max with fallback)与 GPT-6 Astra(max)同以 53 分并列第一,Claude Opus 5 以 51 分居第三。开源/国产方面,Qwen3.8 Max 以 45 分列第 7,GLM-5.3 同为 45 分居第 8,Kimi K3 以 44 分排第 10。

🔗 https://artificialanalysis.ai/
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。






