欢迎光临
我们一直在努力

Fable5.2曝光!Gemini 4 Pro定价流出!Qwen 4十五天发布?GPT-6 Sol延期!巨头神仙打架杀疯了 | 9月19日 AI日报

🎬 视频版直达:https://www.bilibili.com/video/av117295439419630/

💡 今日趋势速览:Anthropic被曝灰度Fable 5.2与Opus 5.2两款旗舰,同时打磨双更新,谷歌Gemini 4 Pro定价与2M上下文规格遭泄露,阿里Qwen 4预计15天内发布并瞄准GPT-6 Astra,OpenAI则推迟GPT-6 Sol疑先发Muse竞品,巨头密集憋招,旗舰模型大战一触即发。

🎯 今日要点

  • Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试
  • Gemini 4.0 Pro 规格泄露,定价 $2.25/$11.25
  • Qwen 4 爆料:预计 15 天内发布,目标对标 GPT-6 Astra

  • 📋 今日内容汇总

    🤖 AI动态

  • Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试
  • Gemini 4.0 Pro 规格泄露,定价 $2.25/$11.25
  • Qwen 4 爆料:预计 15 天内发布,目标对标 GPT-6 Astra
  • GPT-6 Sol 被曝延期:OpenAI 疑下周先发 Muse 竞品
  • MiniMax Code CLI 现已开放
  • Qwen3.8-Flash 速度翻倍,QwenWork 生成专业演示文稿
  • PrismML 发布 Bonsai 2 27B:压缩 9 倍至 5.9GB
  • Vercel AI Gateway 上线 GPT-Live 1 音频模型
  • Muse for Mac 正式发布,可跨应用与文件工作
  • Nano Banana 2.5 已部署,将于下周正式发布
  • Meta SAM 3.1 上线,单次 API 调用完成检测分割跟踪
  • ChatGPT 桌面端应用支持安装 Chrome 扩展
  • Grok 语音转录 2.0 发布,号称全球最精确语音转录模型
  • 智谱回应 ZCode 仓库数据上传争议:源于 Repo Wiki 功能
  • 腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力
  • NVIDIA 发布 NVFP4 版 GLM-5.3,省约 1.66 倍显存
  • Qwen-Image-2.1 早期访问申请关闭,入选者将获 API
  • 🔌 AI基础设施

  • 华为昇腾 950 智算集群 9 月 30 日启用
  • 🧪 芯片半导体

  • 中科院 GAA 晶体管新突破:DUV 光刻机可造 3nm 芯片
  • 📦 开源项目

  • Violoop 登陆 Kickstarter,20 小时众筹百万美元
  • 📌 模型排行榜

  • Artificial Analysis AI 模型能力排行榜

  • 🤖 AI动态

    1. Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试

    多位独立测试者报告,Anthropic 正在灰度下一代模型对此可运行提示词自查:询问模型重置哥 Tibo 是谁,若能清晰答出,说明你已用上新模型不止 Fable,Opus 5 同样出现被路由至 Opus 5.2 的案例,两款均未官宣、预计下周发布,Anthropic 正在同时打磨两个旗舰更新。

    Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试

    Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试

    Anthropic 被曝双模型灰度:Fable 5.2 已开始路由测试

    🔗 https://x.com/notjazii/status/2100893667846402306


    2. Gemini 4.0 Pro 规格泄露,定价 $2.25/$11.25

    谷歌下一代旗舰模型 Gemini 4 Pro 参数遭泄露,规格显示其每百万 token 输入定价 $2.25、输出 $11.25,并提供 2M token 上下文窗口与之配套的泄露基准表中,Gemini 4 Pro 在 Terminal-Bench 2.1 拿下 95.3%,还声称在多项基准中领先 GPT-6 Astra,整体表现显著超出预期。

    Gemini 4.0 Pro 规格泄露,定价 $2.25/$11.25

    Gemini 4.0 Pro 规格泄露,定价 $2.25/$11.25

    🔗 https://x.com/ravikiran_dev7/status/2100925399777833165


    3. Qwen 4 爆料:预计 15 天内发布,目标对标 GPT-6 Astra

    泄露信息称阿里 Qwen 4 预计未来 15 天内发布,目标达到 GPT-6 Astra 水准。爆料未涉及参数规模与开源计划,但结合此前 vLLM 代码库中出现的 Qwen 4 适配记录,发布传闻或有技术依据。目前,阿里尚未确认,可信度仍待观察。

    Qwen 4 爆料:预计 15 天内发布,目标对标 GPT-6 Astra

    🔗 https://x.com/Priyannkaaaa/status/2100806396128399433


    4. GPT-6 Sol 被曝延期:OpenAI 疑下周先发 Muse 竞品

    据爆料, OpenAI 已推迟 GPT-6 Sol 发布,原因指向下周先行推出对标 Meta Muse 的智能体竞品。此前泄露显示 Sol 采用与 Astra 相同的 4 月 30 日知识截止,首个输出样本上周已流出。新模型暂无明确发布时间表。

    GPT-6 Sol 被曝延期:OpenAI 疑下周先发 Muse 竞品

    🔗 https://x.com/Mr_Salio/status/2100918470959333427


    5. MiniMax Code CLI 现已开放

    来源:原文 | RyanLeeMiniMax

    MiniMax官方宣布MiniMax Code CLI现已开源,这款面向开发者的命令行编程工具正式对外可用。该版本以MIT许可证向全球开发者开放,当前为v0.4.12版。而在FrontierHarness Eval评测中,MiniMax Code以76.7%的通过率领先,单任务平均耗时4分33秒位居首位。

    MiniMax Code CLI 现已开放

    MiniMax Code CLI 现已开放

    🔗 https://x.com/MiniMax_AI/status/2100930515058753830


    6. Qwen3.8-Flash 速度翻倍,QwenWork 生成专业演示文稿

    阿里云介绍 Qwen3.8-Flash 速度提升一倍,配套 QwenWork 可将用户想法与文件转化为结构清晰的专业演示文稿,标准模式下 1000 积分约可生成 100 份演示文稿、每份约 10 积分,官方称真正的产出、合理的预算。以下是官方给出的 demo

    Qwen3.8-Flash 速度翻倍,QwenWork 生成专业演示文稿

    🔗 https://x.com/alibaba_cloud/status/2100828276964966732


    7. PrismML 发布 Bonsai 2 27B:压缩 9 倍至 5.9GB

    来源:原文 | 思维怪怪 (Tech) (Twitter)

    PrismML基于Qwen3.8 27B推出三值模型Bonsai 2 27B,体积压缩9倍至5.9GB,保留原模型98.2%的综合评测表现。该模型已依据Apache 2.0许可证发布,维持262K长上下文,可经MLX或CUDA内核在个人设备直接运行,RTX 5090上推理速度达143 tokens/s。

    PrismML 发布 Bonsai 2 27B:压缩 9 倍至 5.9GB

    PrismML 发布 Bonsai 2 27B:压缩 9 倍至 5.9GB

    🔗 https://x.com/Gorden_Sun/status/2100843160423534985


    8. Vercel AI Gateway 上线 GPT-Live 1 音频模型

    Vercel 宣布 GPT-Live 1 现已上线 AI Gateway,开发者可直接调用。该模型为全双工音频模型,可边说话边聆听、随时被打断,并支持客户端委托在后台运行任意文本模型,模型标识为 openai/gpt-live-1。

    Vercel AI Gateway 上线 GPT-Live 1 音频模型

    🔗 https://x.com/vercel_dev/status/2100963500881526784


    9. Muse for Mac 正式发布,可跨应用与文件工作

    来源:原文 | TechMeme (Twitter)

    Muse for Mac 今日正式发布。这款工具可跨电脑上的应用、文件、日历、笔记和消息工作,用户可自行控制它能访问哪些内容。开发团队目前迭代速度非常快,产品现已开放下载。

    Muse for Mac 正式发布,可跨应用与文件工作

    🔗 https://x.com/finkd/status/2100713341555712149


    10. Nano Banana 2.5 已部署,将于下周正式发布

    来源:原文 | Lyraxana (Twitter)

    Nano Banana 2.5(代号 spicy-mayo)已部署并将于下周正式发布,合作伙伴现可通过 Vertex 使用,模型名称为 nano-banana-2.5,思考等级含 minimal、medium、high,图像输出尺寸支持 512、1K、2K、4K。

    Nano Banana 2.5 已部署,将于下周正式发布

    🔗 https://x.com/lyraxana/status/2101001666640154779


    11. Meta SAM 3.1 上线,单次 API 调用完成检测分割跟踪

    Meta 将 Segment Anything Model(SAM)3.1 上线 Meta Model API,开发者用一句短语描述目标,一次调用即可在图像和视频中完成检测、分割与跟踪,返回像素级精确的分割掩码和身份一致的视频跟踪轨迹,推理引擎已针对 SAM 3.1 架构调优。以下是官方给出的 demo

    Meta SAM 3.1 上线,单次 API 调用完成检测分割跟踪

    🔗 https://x.com/MetaforDevs/status/2100993422865944967


    12. ChatGPT 桌面端应用支持安装 Chrome 扩展

    ChatGPT 桌面端应用上线 Chrome 扩展支持,用户可将每天在用的扩展带入应用内置浏览器,在其中安装、固定并直接使用自己常用的扩展,日常依赖扩展的操作无需再切换到外部浏览器完成。以下是官方给出的 demo

    ChatGPT 桌面端应用支持安装 Chrome 扩展

    🔗 https://x.com/JamesZmSun/status/2100995281097769216


    13. Grok 语音转录 2.0 发布,号称全球最精确语音转录模型

    Grok 语音转录模型 Voice Transcribe 2.0 正式发布,发布方称其为目前全球最精确的语音转录模型,可将语音音频转换为文本记录。此次公告未附带具体评测数据或基准对比,模型实际表现有待后续验证。

    Grok 语音转录 2.0 发布,号称全球最精确语音转录模型

    🔗 https://x.com/SpaceXAI/status/2101005248311726387


    14. 智谱回应 ZCode 仓库数据上传争议:源于 Repo Wiki 功能

    智谱回应ZCode仓库数据上传争议该功能生成Wiki页面时可能将仓库数据上传云端官方文档还明确,Repo Wiki不读取.git、依赖目录、构建产物或缓存。此外,ZCode宣布将近期开源代码并邀请第三方评估机构审查,全体用户将获一次额外的每周配额重置,今日发放。

    智谱回应 ZCode 仓库数据上传争议:源于 Repo Wiki 功能

    智谱回应 ZCode 仓库数据上传争议:源于 Repo Wiki 功能

    🔗 https://x.com/0xLogicrw/status/2100887439321473392


    15. 腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力

    腾讯 WorkBuddy 5.5.6 上线全栈「应用」生成能力该能力自带云数据库、文件存储、注册登录和 AI 调用伴随能力上线,WorkBuddy 国内个人版会员权益随之调整其中免费用户可拥有累计 5G 资料库空间,各会员版本可开启云服务的应用个数与每月资源点额度各不相同。

    腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力

    腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力

    腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力

    腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力

    🔗 https://www.ithome.com/1/004/283.htm


    16. NVIDIA 发布 NVFP4 版 GLM-5.3,省约 1.66 倍显存

    NVIDIA 在 Hugging Face 发布 4 位 NVFP4 量化版 GLM-5.3,将权重与激活精度从 8 位降至 4 位,磁盘和 GPU 显存占用缩小约 1.66 倍,同时在主要推理和编程基准测试中保持与 BF16 相当的准确率。

    NVIDIA 发布 NVFP4 版 GLM-5.3,省约 1.66 倍显存

    🔗 https://x.com/HuggingPapers/status/2100722688964825130


    17. Qwen-Image-2.1 早期访问申请关闭,入选者将获 API

    Qwen-Image-2.1 Early Access 早期访问申请通道已经关闭,团队正在逐一审核每一份提交,入选申请者将很快收到 API 访问权限。本次早期测试报名十分踊跃,发布方对用户的参与热度表示感谢。

    Qwen-Image-2.1 早期访问申请关闭,入选者将获 API

    🔗 https://x.com/ModelScope2022/status/2100902121810137295


    🔌 AI基础设施

    18. 华为昇腾 950 智算集群 9 月 30 日启用

    来源:原文 | 网易科技

    华为全联接大会 2026 上,华为云 CEO 周跃峰宣布昇腾 950 智算集群将于 9 月 30 日面向中国客户提供服务,11 月 30 日面向海外市场全面提供服务。华为云还将推出智能体记忆系统 CMS 记忆存储,搭载 CMS 的华为云将于 2027 年一季度上线。

    华为昇腾 950 智算集群 9 月 30 日启用

    🔗 https://wallstreetcn.com/livenews/3167239


    🧪 芯片半导体

    19. 中科院 GAA 晶体管新突破:DUV 光刻机可造 3nm 芯片

    中国科学院公布新型全环绕栅极GAA晶体管架构,在DUV光刻机上实现开关比超50万倍,理论上可解锁3nm等效性能,无需EUV光刻机。该架构栅极从四面包裹电流通道,相比FinFET控制更精准,几乎杜绝漏电,为国产芯片绕开EUV、迈向先进制程提供了可行路径。

    中科院 GAA 晶体管新突破:DUV 光刻机可造 3nm 芯片

    中科院 GAA 晶体管新突破:DUV 光刻机可造 3nm 芯片

    🔗 https://news.mydrivers.com/1/1152/1152076.htm


    📦 开源项目

    20. Violoop 登陆 Kickstarter,20 小时众筹百万美元

    Violoop 是手掌大小的个人 Agent 桌面硬件,与年初爆火的 OpenClaw 均可让 Agent 自主看屏幕、操作键鼠、跨软件工作,因而被称为「硬件龙虾」。时隔五个月,该设备登陆 Kickstarter,上线 20 小时众筹达 100 万美元。

    Violoop 登陆 Kickstarter,20 小时众筹百万美元

    Violoop 登陆 Kickstarter,20 小时众筹百万美元

    🔗 https://mp.weixin.qq.com/s?__biz=MzAxOTcxNTIwNQ==&mid=2457995838&idx=1&sn=6c76b08b595d73efdee9ef07c1da22a3


    📌 模型排行榜

    21. Artificial Analysis AI 模型能力排行榜

    最后是今日的 AI 模型能力排行榜单,智力榜头部由 Claude Fable 5.1(max with fallback)与 GPT-6 Astra(max)同以 53 分并列第一,Claude Opus 5 以 51 分居第三。开源/国产方面,Qwen3.8 Max 以 45 分列第 7,GLM-5.3 同为 45 分居第 8,Kimi K3 以 44 分排第 10。

    Artificial Analysis AI 模型能力排行榜

    🔗 https://artificialanalysis.ai/

    以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

    赞(0)
    未经允许不得转载:171主机测评 » Fable5.2曝光!Gemini 4 Pro定价流出!Qwen 4十五天发布?GPT-6 Sol延期!巨头神仙打架杀疯了 | 9月19日 AI日报
    分享到: 更多 (0)

    评论 抢沙发

    • 昵称 (必填)
    • 邮箱 (必填)
    • 网址