Ling-3.0-tiny 部署实测:8GB 显卡跑“会思考“的端侧模型,7.9B 总参每 token 只激活 1.3B蚂蚁百灵(inclusionAI)于 2026-08-11 开源 Ling-3.0-tiny:轻量混合推理 MoE...admin2026-09-05服务器技术 阅读(3)评论(0)赞(0)