想快速对比不同AI模型在Claude Code里的实际效果,可以在leadhi.cn这类AI模型聚合平台上切换体验,一个界面搞定效率高很多。
Claude Code到底是什么
跟网页版Claude不同,Claude Code是Anthropic推出的命令行AI编程助手。它不是你问一句它答一句的聊天工具,而是能直接操作项目文件、理解代码结构、执行终端命令的AI同事。
2026年的一个重要变化是:Claude Code的模型底层是开放的,你可以给它接任何兼容Anthropic协议的模型。这意味着国内开发者有了更多选择。
安装:三种方式任选
方式一:原生安装器(推荐)。PowerShell里一条命令搞定,不需要Node.js,装完自动后台更新。
方式二:npm安装。先装Node.js 18以上版本,然后一条npm命令安装。国内网络慢的话可以先切npm镜像源。
方式三:WSL安装。Windows用户如果熟悉Linux环境,WSL下安装体验最好。
安装完验证一下版本号,能看到版本输出就说明成功了。
配置:国内开发者的关键一步
Claude Code需要配置API密钥才能使用。国内用户推荐API Key方式,通过兼容Anthropic协议的平台接入更稳定。
配置文件在用户目录下的.claude目录里。还有个关键文件需要加一行跳过官方登录流程的配置。
有个大坑必须提:Claude Code底层强制调用Anthropic原生协议,不兼容OpenAI格式接口。如果平台只支持OpenAI协议会直接报错。
日常必会的10个斜杠命令
Claude Code内置了50多个斜杠命令。不用死记,但了解核心命令的用途才能打开使用思路。
/clear——清空对话开始新会话。做完一个任务切到下一个时用,避免旧信息干扰。清空的对话不会丢失,后续还能通过/resume找回来。
/compact——压缩对话释放上下文空间。聊着聊着上下文就满了,AI注意力会涣散。/compact把之前的对话浓缩成摘要,腾出空间继续工作。建议在每完成一个阶段性任务后主动执行,不要等自动压缩——自动压缩可能在你实现关键逻辑时触发,导致重要细节被压缩掉。
/model——切换AI模型。日常用Sonnet,复杂重构切Opus,简单查询用Haiku。
/plan——进入规划模式。让Claude先制定执行计划给你看,确认方案没问题后再动手实现。涉及3个以上文件的修改,先用/plan确认方案。
/cost——查看当前会话的token消耗和预估费用。建议每次长对话后都检查一下,避免不知不觉花太多。
/review——检查所有未提交的代码变更。按安全、性能、代码规范分类输出问题。推荐提交前流程:/review → /simplify → 跑测试 → git commit。
/btw——旁路提问,不进入主对话上下文。正在做一个任务时突然想问个不相关的小问题,用/btw就不会占用token窗口也不会干扰后续任务。
/rewind——把对话和代码回退到之前的某个节点。Claude改了一堆代码但你觉得改歪了,用它回到之前的任意节点,对话记录和文件改动都会一起回退。
/init——自动扫描项目代码,生成CLAUDE.md项目描述文件。每个新项目的第一步操作。
/doctor——诊断安装环境。出现网络异常、模型切换失败、响应变慢等问题时,优先用这个命令定位原因。
省钱:这才是核心话题
这是大多数人最关心但最不愿意正视的问题。Anthropic披露的企业部署平均成本是每位开发者每个活跃日13美元。但通过优化,账单能压到原来的30%到40%。
模型分级是最大的杠杆。 Opus输入成本大约是Sonnet的1.7倍,但更关键的是Opus消耗Token的速度大约是Sonnet的两倍。大多数编码任务Sonnet就够了,Opus留给复杂架构决策。
理解提示缓存机制。 模型每次收到消息都要从头"读"一遍完整输入。提示缓存的机制是:第一次算完笔记后存下来,下次遇到相同的输入前缀直接用存好的笔记,读取缓存的成本只有重新计算的十分之一。
这意味着三个反直觉的策略:
- 缓存还热时,继续聊比开新会话便宜。 频繁/clear等于反复为不变的内容付全价。
- 复杂任务一次做对,比来回改三轮更省。 开着深度思考一次搞定,比关掉之后反复改的总成本更低。
- 长内容给路径,别往对话里贴。 不要把10000行日志粘贴到对话里,直接把文件路径发给它。
CLAUDE.md要精简。 官方建议控制在200行以内。不是每次都用的内容挪到refs目录按需加载。有开发者把CLAUDE.md精简后,每会话固定加载降低了76%。
文件过滤立省60%。 在项目根目录创建.claudeignore文件,排除node_modules、dist等大目录。单次交互token消耗可从15万降到6万。
用/permissions限制模型的阅读范围。 在配置文件中用deny严格限制模型可读取的范围。模型有时候会陷入长达5分钟以上的代码库搜索循环,permissions.deny能从源头减少这种浪费。
几个进阶技巧
用/goal让Claude自己干到底。 设定一个完成条件,Claude Code会自动持续工作,不需要你每一轮都按回车确认。特别适合睡觉前丢一个任务,第二天早上直接验收。但条件必须是Claude执行过程中能自证的,比如"跑某个命令的结果是什么"。
用/background释放终端。 把当前会话放到后台跑。比如让Claude跑一个耗时的重构任务,不想一直开着终端等它。
用/branch探索不同方向。 从当前对话分支出一个新会话。想试试另一种实现思路又怕原来思路找不回来,先/branch出去探索,不满意再回来。
趋势判断
2026年Claude Code的竞争维度已经从"能不能写对代码"变成了"能不能控制住成本"。社区里有人说我们正处在"补贴算力时代的末期"。与其赌哪家补贴更久,不如搞清楚成本结构,把钱花在刀刃上。
省Token的核心思路就一句话:让缓存尽可能多地被命中,让上下文尽可能少地装无关内容。先跑一次/cost看看当前的token分布,然后逐项优化。建议默认习惯是"能继续就继续","开新会话"是特定条件触发的优化操作。



