Claude Code + Cowork 实战:CLAUDE.md、模型路由与可抄的工作流(2026 版)
不讲玄乎的"效率飞升"。这篇拆开 Claude Code 和 Cowork 的真实用法:怎么写 CLAUDE.md、怎么在 Opus 4.8 和 Sonnet 5 之间路由、怎么用 git 检查点兜底,以及一套能直接抄的 prompt 工作流。
先给结论:Claude Code 是跑在终端里的命令行 Agent,Cowork 是桌面端的 Agent 工作区;两者共用你的 Claude Pro / Max 订阅额度。真正决定产出质量的不是"哪个工具更神",而是三件小事——① 在项目根目录写好
CLAUDE.md(Claude Code 每次启动自动读的项目记忆),② 用.claude/settings.json管权限而不是所谓的.claude/config.yaml(那个文件不存在),③ 复杂设计用 Opus 4.8、批量改代码用 Sonnet 5 做模型路由。把这三件事做对,一个人确实能把过去要拆几天的活压缩成一天;做不对,它照样给你写一堆要返工的代码。本文给出可直接复制的配置和 prompt。最后更新:2026 年 7 月
作者是全栈开发者,主力栈 TypeScript + Next.js + Python,日常用 Claude Code 半年、Cowork 三个月。下面的工作流是我自己在真实项目里跑出来的;凡是没有公开跑分支撑的判断,我都标了"体感",不会把主观感受包装成实测数据。
Claude Code 和 Cowork 分别是什么,什么时候用哪个
很多人把这俩混为一谈,其实定位不同。
Claude Code 是 Anthropic 官方的命令行工具,装完在项目目录里敲 claude 就进入交互式会话。它能读你的整个代码库、直接编辑文件、跑测试、执行 git 和数据库迁移——不是给你贴 diff 让你手动粘,而是自己动手。适合已经在终端里干活的人:改一个模块、批量重构、写测试、排查报错,都在同一个上下文里完成。
Cowork 是 Claude 桌面端的 Agent 工作区,同样走你的 Claude 订阅登录。你把一个偏"项目级"的目标交给它,它会自己拆解成子任务、逐步执行、跑构建看报错再改,最后把结果交回来。相比在终端里手动一条条推进,Cowork 更像"托管式":适合你想先离开键盘、让它把一整段脏活先跑一轮的场景,比如"把整个仓库的 lint 错误清一遍""按这份 spec 把三个页面的骨架先搭出来"。
怎么选(体感):需要精细控制、每一步都想看着改的,用 Claude Code;任务边界清晰、你愿意让它自己 loop 一段时间的,用 Cowork。多数时候我是两个混用——Cowork 先铺量,Claude Code 收尾抠细节。
五分钟装好,并且配置对
安装 Claude Code
# 通过 npm 全局安装
npm install -g @anthropic-ai/claude-code
# 验证
claude --version
# 进项目目录启动
cd /path/to/your/project
claude
首次运行会让你登录 Claude 账号(Pro 或 Max)。认证后,用量从你的主订阅额度扣:Pro 用 Pro 的额度,Max 5x 有 5 倍额度,Max 20x 更宽。不需要单独买 API Key——这点常被问到。
写 CLAUDE.md:让它每次都懂你的项目
这是投入产出比最高的一步,也是原来很多教程写错的地方——没有 .claude/config.yaml 这个文件。Claude Code 读的是项目根目录的 CLAUDE.md(纯 Markdown),每次启动自动加载,等于给它一份常驻的"项目说明书"。一个够用的模板:
# 项目说明
## 技术栈
- Next.js 15 App Router + TypeScript(strict 模式)
- 数据库:Prisma + PostgreSQL
- UI:shadcn/ui + Tailwind
- 包管理:pnpm(不要用 npm install)
## 约定
- 组件放 src/components,页面路由放 src/app
- API 用 route.ts,返回统一 { data, error } 结构
- 所有新代码必须过 `pnpm typecheck` 和 `pnpm lint`
- 提交信息用中文,遵循 Conventional Commits
## 不要做的事
- 不要引入新的状态管理库(项目只用 React Context)
- 不要改 prisma/schema.prisma 之外的迁移逻辑
- 改完一个模块停下来,等我确认再继续
体感:写不写这份文件,代码贴合项目风格的程度差别很明显——没有它,Claude 会按"通用最佳实践"发挥,经常和你现有的模式打架。它不是玄学,就是把你原本要反复口述的上下文固化下来。
用 .claude/settings.json 管权限,而不是每次都点确认
项目根目录的 .claude/settings.json 控制权限、钩子和环境变量。默认每次执行敏感命令都会问你,配好允许清单能少一堆打断:
{
"permissions": {
"allow": [
"Bash(pnpm typecheck)",
"Bash(pnpm lint)",
"Bash(pnpm test:*)",
"Bash(git diff:*)",
"Bash(git add:*)"
],
"deny": [
"Bash(git push:*)",
"Bash(rm -rf:*)"
]
}
}
把只读或低风险命令放 allow,把 git push、删库这类放 deny 兜底。不确定字段怎么写就查官方文档,别照抄网上过时的 YAML 配置——那些多半是旧版本或干脆是编造的。
模型怎么选:Opus 4.8 还是 Sonnet 5
2026 年 7 月的基线是:Sonnet 5(2026-06-30 发布)已经是 Claude 的默认模型,Opus 4.8 是更强的旗舰档,上面还有顶配的 Fable 5。如果你还在文档里看到 Opus 4.5/4.6、Sonnet 4.5 之类的写法,那是过时的旧帖,已作废。
Claude Code 里用 /model 就能切换。我的路由原则很简单:想清楚"要它动脑"还是"要它干活"。架构设计、跨文件的复杂重构、难 bug 定位用 Opus 4.8;写 CRUD、调样式、按已定方案铺模板代码用 Sonnet 5。下面是能点名基准的真实公开跑分,帮你判断而不是听我拍脑袋:
| 模型 | SWE-bench Verified | SWE-bench Pro(更难) | OSWorld(电脑操作) | Terminal-Bench 2.1 | API 定价(输入/输出) |
|---|---|---|---|---|---|
| Claude Fable 5(顶配) | ~95% | 最高档 | 顶配 | — | $10 / $50 |
| Claude Opus 4.8 | 88.6% | 69.2%(领先) | 83.4%(领先) | 74.6% | $5 / $25 |
| Claude Sonnet 5 | 85.2% | 63.2% | 81.2% | 80.4%(该列最高) | $2 / $10(促销至 8/31) |
| GPT-5.5(对照) | 88.7% | 58.6% | 78.7% | 78.2% | $5 / $30 |
几个能直接拿来做决策的事实:
- 标准 SWE-bench Verified 上 Opus 4.8 和 GPT-5.5 基本打平(88.6 vs 88.7);但越难的变体 SWE-bench Pro,Opus 4.8 领先越明显(69.2 vs 58.6)——真正硬的重构任务,Opus 4.8 的优势才显出来。电脑操作类的 OSWorld 上 Opus 4.8 也是全表最高(83.4%)。
- Sonnet 5 的 SWE-bench Verified 85.2% 已经很能打,价格却只有 Opus 的零头。所以日常大多数活交给 Sonnet 5 完全够,只在真需要时切 Opus 4.8,能省下大量额度(体感能明显拉长 Max 额度的可用时长)。
- Terminal-Bench 2.1(纯终端 Agent)上 GPT-5.5(78.2)反超了 Opus 4.8(74.6)——但别漏看:同一张表里 Sonnet 5(80.4)才是这项的最高分。也就是说终端重度的活儿你未必要离开 Claude,便宜的 Sonnet 5 就很能打;真要横向比,GPT-5.5 在同一梯队、值得对照,但它并没有在这项领先全场。想看完整横评见 AI 编程工具横评。
- Fable 5 的 SWE-bench ~95% 是当前最强,但 $10/$50 的定价和按额度计费,对日常编程是过剩——留给真正卡住的难题就行。
我的实战工作流:把一周的后台压到一天
上个月接了个需求:给一个现有 Next.js 电商项目加管理后台,含商品、订单、用户三个模块。按过去手写的节奏这是好几天的量,我用下面的流程一天做完了。先说清楚:一天完成是我这次的真实经历,不是保证——项目越熟悉、CLAUDE.md 写得越好,提速越明显;反之会打折。下面是可复制的步骤,不是效率玄学。
步骤 1:先让它读代码、出方案,不要直接写
接到新需求别急着"从零开始写"。先让它读一遍相关的现有代码再给方案,产出的代码会贴合你的既有模式得多。Cowork 里开个任务:
读一遍这个项目的 src/app、src/components 和 prisma/schema.prisma,然后为管理后台设计架构:商品管理(CRUD + 图片上传)、订单管理(列表 + 状态变更 + 搜索)、用户管理(列表 + 角色 + 封禁)。用 shadcn/ui 的 DataTable。先只给文件结构、路由设计和需要新增的 Prisma 字段,不要现在就写实现。
这一步用 Opus 4.8,因为是"动脑"的活。产出是目录结构、路由规划(含权限中间件)、schema 变更建议和要装的组件清单。方案我看过、调了两处,才进入实现。
步骤 2:切 Claude Code,按模块推进,一个模块一次提交
切到终端启动 claude,/model 切到 Sonnet 5(铺量阶段),逐模块给清晰 prompt。
> 按刚才确认的架构实现商品管理模块:
> - 列表页:DataTable,支持搜索、分页、排序
> - 创建/编辑页:共用表单(标题、描述、价格、图片上传),编辑时预填
> - 删除:二次确认对话框
> - API 路由 route.ts:GET(列表+分页) / POST / PUT / DELETE,返回 { data, error }
> 写完先跑 pnpm typecheck,通过再停下等我看 git diff。
关键纪律:每做完一个模块就 git commit 一次。这是 AI 协作里最省心的兜底——下一个模块万一跑歪,git reset 一句话回到上个干净状态,不用和它反复纠缠。我把三个模块拆成三次会话、三次提交,中间穿插 git diff 复查。
步骤 3:让 Cowork 跑构建、自己修
三个模块齐了,开个 Cowork 任务做收尾:
跑 pnpm build 和 pnpm typecheck,把所有类型错误和编译警告列出来并修掉;然后起 dev server,逐页确认功能。改完再跑一遍 build 确认通过,最后把你改了哪些文件、为什么改,列个清单给我。
它自己 loop:build → 定位报错 → 改 → 重跑,直到通过;顺手发现 middleware 没覆盖新路由也一并补上。这段我确实是在旁边看日志、没动手。但我没统计"首次通过率百分之多少"——那种数字我给不出真的,就不编。能确定的是:有 CLAUDE.md 约束类型和 lint、有 git 检查点兜底,返工量比我早期瞎用时小得多。
可直接抄的四个 prompt 模板
① 让它先复盘再动手(新需求开场用)
先别写代码。读 [相关文件],用三五句话讲清现在这块是怎么组织的、有哪些模式我应该沿用。然后给出实现新需求的方案,等我确认。
② 收敛输出、留检查点
实现 [模块]。写完只做这三件事:跑 pnpm typecheck、把改动文件列出来、停下等我看 diff。不要顺手改其它模块。
③ 让它自己修构建错误
跑 pnpm build,把每个报错的文件、原因、你的修法列出来,逐个修,最后重跑 build 确认全绿。不确定的地方标出来问我,不要瞎猜着改。
④ 难 bug 定位(切 Opus 4.8)
这个 bug 现象是 [描述]。先给我三个最可能的原因和各自的验证方法,别急着改。我们先确认根因再动手。
五个让它少返工的习惯
1. CLAUDE.md 常写常更新
每次它做了"不该做"的事,就把这条规则加进 CLAUDE.md。它是活文档,越用越准。
2. 模块化推进,别一次性交整个项目
拆成模块逐个过。上下文更聚焦,出错回滚成本低(一次只退一个模块),你也能在模块间调方向。指望它一口气写完整个项目基本都会翻车。
3. 用 git 当安全网,而不是 undo
每个可用状态都 commit。AI 会犯错,但只要有干净的检查点,犯错的代价就趋近于零。
4. Opus 4.8 与 Sonnet 5 分工,别一个模型走到黑
动脑用 Opus 4.8,干活用 Sonnet 5。合理路由既省额度,也常常质量更好——难题给够脑力,杂活别浪费旗舰。
5. 先复盘再写,比"从零开始"强
让它先读现有代码、给改进建议,再基于这个理解写新功能。它对你的代码模式有了认知,产出的贴合度明显更高(体感)。
套餐怎么选
Claude Code 和 Cowork 都需要 Pro 或 Max 订阅,用量从主订阅额度扣。按编程强度选:
- 每天写 1–2 小时 → Claude Pro($20)够用,适合先试水。
- 每天写 3–5 小时 → Claude Max 5x($100),Pro 额度容易在下午就见底。
- 全天候重度 → Claude Max 20x($200),额度最宽,多开会话不心疼。
Pro 和两档 Max 到底差多少、怎么选,见 Claude Max 5x 与 20x 对比。国内怎么开通、支付宝付款流程见 Claude Pro 国内购买指南。在 DGT Store 下单支付宝直付,约 10 分钟交付。
常见问题 FAQ
Q:Claude Code 和 Cowork 需要单独买 API Key 吗?
A:不需要。两者都用你的 Claude Pro 或 Max 订阅登录,用量从订阅额度里扣,不走单独的 API 计费。
Q:配置文件到底是 CLAUDE.md 还是 .claude/config.yaml?
A:是项目根目录的 CLAUDE.md(纯 Markdown 项目记忆,自动加载)和 .claude/settings.json(权限、钩子、环境变量)。没有 .claude/config.yaml 这个文件,看到这种写法基本是过时或编造的教程。
Q:Opus 4.8 和 Sonnet 5 我平时该用哪个?
A:默认用 Sonnet 5(SWE-bench Verified 85.2%,便宜),架构设计、复杂重构、难 bug 才切 Opus 4.8(SWE-bench Pro 69.2% 领先)。Claude Code 里用 /model 切换。
Q:我看到有教程写 Opus 4.5、Sonnet 4.5,是不是我版本旧了?
A:不是你旧,是那篇教程旧。2026 年 7 月的正确基线是 Sonnet 5(默认)、Opus 4.8(旗舰)、上面还有顶配 Fable 5。Opus 4.5/4.6、Sonnet 4.5 都已作废。
Q:终端重度的自动化任务,Claude 是最优解吗?
A:Terminal-Bench 2.1 上 GPT-5.5(78.2%)反超了 Opus 4.8(74.6%),所以纯终端 Agent 场景值得把 GPT-5.5 拿来对比。但同一项里 Claude Sonnet 5(80.4%)才是最高分,终端重度也不必急着离开 Claude;标准编码和难重构上 Claude 也仍占优。完整对比看 AI 编程工具横评。
Q:Cowork 会不会自作主张把我不想改的地方也改了?
A:会,如果你不约束它。所以要在 CLAUDE.md 写清"不要做的事",在 prompt 里明确"只做这个模块、改完停下等确认",并用 .claude/settings.json 把 git push、rm -rf 放进 deny。配合 git 检查点,越界了一句 reset 就回来。
Q:一个人用它真能把一周的活压到一天吗?
A:在项目熟、CLAUDE.md 写得好、任务拆得清的前提下,我自己做到过。但这是经历不是保证——项目越陌生、约束越少,提速越打折。别把它当固定倍率的承诺。
Q:Fable 5 那么强,日常是不是该一直用它?
A:不建议。Fable 5 SWE-bench ~95% 确实最强,但 $10/$50 定价、按额度计费,对日常 CRUD 是过剩。留给真正卡死的难题,其余交给 Sonnet 5 / Opus 4.8 更划算。
Q:额度用超了会怎样,会不会偷偷扣钱?
A:订阅按档位给额度,到量后当期受限、恢复后继续,不会在订阅之外自动扣费。强度上来了就升档,Pro→Max 5x→Max 20x,对应 $100 与 $200 两档。
Q:国内怎么开通、怎么付款?
A:可在 DGT Store 下单,支付宝直付,约 10 分钟交付,具体开通流程见 Claude Pro 国内购买指南。售后条款以商品页说明为准。

