大模型数据集全景总结:训练、预训练、微调、评测数据集完整指南
本文全面梳理大模型领域相关的开源数据集,涵盖预训练语料、指令微调数据、偏好对齐数据、评测基准数据四大类,提供下载地址、使用方法和最佳...
本文全面梳理大模型领域相关的开源数据集,涵盖预训练语料、指令微调数据、偏好对齐数据、评测基准数据四大类,提供下载地址、使用方法和最佳...
本文全面梳理大模型领域相关的开源数据集,涵盖预训练语料、指令微调数据、偏好对齐数据、评测基准数据四大类,提供下载地址、使用方法和最佳...
角色设定型助手的微调技巧 目录 0. TL;DR 与关键结论1. 引言与背景2. 原理解释3. 10分钟快速上手4. 代码实现与工程要点5. 应用场景与案例...
Agent 场景下的 Qwen 微调方法 目录 0. TL;DR 与关键结论1. 引言与背景2. 原理解释3. 10分钟快速上手4. 代码实现与工程要点5....
今天这篇是 Qwen3.5 小型模型系列(0.8B / 2B / 4B / 9B)的专属本地部署教程,重点讲 Unsl...
作者:吴业亮 博客:wuyeliang.blog.csdn.net 1 PEFT技术核心原理 参数高效微调(Param...
面向电商导购场景的 Qwen 微调:从 SFT 到生产部署 目录 0. TL;DR 与关键结论1. 引言与背景2. 原理解释3. 10 分钟快...
面向电商导购场景的 Qwen 微调:从 SFT 到生产部署 目录 0. TL;DR 与关键结论1. 引言与背景2. 原理解释3. 10 分钟快...
大模型微调下半场:如何用 Python 将 100 篇 PDF 文档自动清洗为微调“黄金数据集” 上一篇我们用一张 RTX 3060 游戏本把 Qwen3.5:...
DGX Spark与传统GPU:大模型微调的性能与成本深度解析 1. 硬件架构的革命性差异 在AI计算领域,DGX Spark与传统GPU的差异远不止于性能...