Skip to content

Commit f9261d5

Browse files
committed
docs(ai-coding): 新增 DeepSeek V4 + Claude Code 实战文章
合并 DeepSeek V4 和降价两篇文章,去除降价相关内容, 整合代码审计、Flyway 集成、多模型协同等实战场景。
1 parent 08a1ee5 commit f9261d5

3 files changed

Lines changed: 296 additions & 0 deletions

File tree

docs/.vuepress/sidebar/ai-coding.ts

Lines changed: 4 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -18,6 +18,10 @@ export const aiCoding = arraySidebar([
1818
text: "Claude Code 接入第三方模型实战",
1919
link: "cc-glm5.1",
2020
},
21+
{
22+
text: "DeepSeek V4 + Claude Code 实战",
23+
link: "deepseek-v4-claude-code",
24+
},
2125
],
2226
},
2327
{

docs/ai-coding/README.md

Lines changed: 2 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -17,6 +17,7 @@ head:
1717
- [《IDEA 搭配 Qoder 插件实战》](./idea-qoder-plugin.md):从接口优化到代码重构,展示如何在 JetBrains IDE 中利用 AI 完成从分析到落地的完整闭环
1818
- [《Trae + MiniMax 多场景实战》](./trae-m2.7.md):使用 Trae IDE 接入 MiniMax 大模型,通过 Redis 故障排查和跨语言重构场景,分享 AI 辅助编程的实战经验与踩坑心得
1919
- [《Claude Code 接入第三方模型实战》](./cc-glm5.1.md):通过 Claude Code 接入 GLM-5.1,完成 JVM 智能诊断助手搭建和百万级数据量慢查询治理,分享 AI 辅助编程的工作方法与踩坑心得
20+
- [《DeepSeek V4 + Claude Code 实战》](./deepseek-v4-claude-code.md):深入体验 DeepSeek V4 与 Claude Code 的集成,实测代码审计、Flyway 集成、多模型协同等场景,评估 V4-Pro 和 V4-Flash 的真实代码能力
2021

2122
## AI 编程技巧
2223

@@ -35,6 +36,7 @@ head:
3536
- [IDEA + Qoder 插件多场景实战:接口优化与代码重构](./idea-qoder-plugin.md) - 通过深分页优化、祖传代码重构两个真实案例,展示 AI 辅助编程的实战效果
3637
- [Trae + MiniMax 多场景实战:Redis 故障排查与跨语言重构](./trae-m2.7.md) - 使用 Trae IDE 接入 MiniMax 大模型,通过 Redis 故障排查和跨语言重构场景,分享 AI 辅助编程的实战经验
3738
- [Claude Code 接入第三方模型实战:JVM 智能诊断与慢查询治理](./cc-glm5.1.md) - 通过 Claude Code 接入 GLM-5.1,完成 JVM 智能诊断助手搭建和百万级数据量慢查询治理
39+
- [DeepSeek V4 + Claude Code 实战:代码能力深度测评](./deepseek-v4-claude-code.md) - 深入体验 DeepSeek V4 与 Claude Code 的集成,实测代码审计、Flyway 集成、多模型协同等场景
3840

3941
### AI 编程技巧
4042

Lines changed: 290 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -0,0 +1,290 @@
1+
---
2+
title: DeepSeek V4 + Claude Code 实战:代码能力深度测评
3+
description: 深入体验 DeepSeek V4 与 Claude Code 的集成,实测代码审计、数据库迁移、模型升级等多个场景,评估 V4-Pro 和 V4-Flash 的真实代码能力。
4+
category: AI 编程实战
5+
head:
6+
- - meta
7+
- name: keywords
8+
content: DeepSeek V4,Claude Code,AI编程,代码审计,Agent Coding,V4-Pro,V4-Flash
9+
---
10+
11+
<!-- @include: @article-header.snippet.md -->
12+
13+
# DeepSeek V4 + Claude Code 实战:代码能力深度测评
14+
15+
这几天 AI 圈基本被一件事刷屏了——DeepSeek V4 发布,同步开源。从技术报告里的 benchmark 数据到社区的实测反馈,到处都在讨论。
16+
17+
开源模型在对话和写作上已经做得相当成熟,各家你追我赶,迭代速度肉眼可见。但 Agent Coding 是另一回事。
18+
19+
让模型自主分析项目结构、理解多文件依赖、给出能直接落地的工程方案——这种活没有捷径,全靠硬实力。
20+
21+
之前各家模型在这个方向上一直在进步,但实际用过就知道,离"放心交给它独立完成"始终还差那么一点。
22+
23+
所以这次 V4 发布,Guide 第一反应就是直接接入 Claude Code 上手干活。
24+
25+
这篇文章接近 **7000 字**,建议收藏,通过本文你将搞懂:
26+
27+
1. **Claude Code 接入 DeepSeek V4 的两种方式**:配置文件法 + CC Switch 可视化切换
28+
2. **三个真实开发任务的实战记录**:V4-Pro 干起活来到底怎么样
29+
3. **DeepSeek V4-Pro 和 Flash 的核心参数与定价**:值不值得切
30+
4. **场景建议**:什么时候该用,什么时候先观望
31+
32+
## Claude Code 接入 DeepSeek V4
33+
34+
Claude Code 强在它的工具链和执行力,但 Claude 官方模型太贵,加上现在 Claude 太容易封号。这次 DeepSeek V4 提供了一个 **Anthropic 兼容接口**,这意味着 Claude Code 可以直接对接 DeepSeek,不需要任何第三方适配层。
35+
36+
### 方式一:配置文件法(推荐)
37+
38+
如果你本机没有安装 Claude Code 的话,先运行下面这行命令安装(Node.js 18+):
39+
40+
```bash
41+
npm install -g @anthropic-ai/claude-code
42+
```
43+
44+
编辑或新增 Claude Code 配置文件 `~/.claude/settings.json`,添加 `env` 字段,把后端地址、模型和 API Key 都写进去:
45+
46+
```json
47+
{
48+
"env": {
49+
"ANTHROPIC_AUTH_TOKEN": "your_deepseek_api_key",
50+
"ANTHROPIC_BASE_URL": "https://api.deepseek.com/anthropic",
51+
"ANTHROPIC_MODEL": "DeepSeek-V4-Pro",
52+
"API_TIMEOUT_MS": "3000000",
53+
"CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC": "1"
54+
}
55+
}
56+
```
57+
58+
注意替换 `your_deepseek_api_key` 为你的 DeepSeek API Key。如果你使用的是 DeepSeek-V4-Flash,把 `ANTHROPIC_MODEL` 改为 `DeepSeek-V4-Flash` 即可。
59+
60+
配置完成后启动 Claude Code:
61+
62+
```bash
63+
claude
64+
```
65+
66+
首次启动需要选择信任当前文件夹。
67+
68+
### 方式二:CC Switch(可视化切换)
69+
70+
如果你想在 DeepSeek、Claude、MiniMax 等多个 Provider 之间灵活切换,推荐安装 **CC Switch**。这是一个专门管理 Claude Code 模型切换的小工具,支持一键横跳,还支持管理 Skills、MCP 和提示词。
71+
72+
![CC Switch 主界面](https://oss.javaguide.cn/github/javaguide/ai/coding/cc-switch-main-interface.png)
73+
74+
启动 CC Switch,点击右上角 **"+"** ,选择自定义供应商,Base URL 填写 `https://api.deepseek.com/anthropic`,API Key 填写你的 DeepSeek API Key。
75+
76+
![CC Switch 添加 DeepSeek Provider](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/cc-switch-add-deepseek-provider.png)
77+
78+
将模型名称改为 `DeepSeek-V4-Pro`(或 `DeepSeek-V4-Flash`),完成后点击右下角的"添加"。
79+
80+
### 验证是否生效
81+
82+
直接在命令行输入 `claude` 或者进入 Claude Code 界面之后再次输入 `/status` 确认,model 为 `DeepSeek-V4-Pro` 即表示接入成功。
83+
84+
![验证是否生效](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/verify-deepseek-v4-ready.png)
85+
86+
之后你就可以用 DeepSeek V4-Pro 来驱动 Claude Code 的所有能力了。
87+
88+
## 实战一:升级 LLM 多 Provider 预设模型列表
89+
90+
我手头有一个多智能体股票分析项目,已经快一个月没启动了。这次重新启动,第一件事就是把过时的模型配置更新掉。
91+
92+
项目 Settings 页面之前只有一个纯文本输入框让用户手动填写模型名,不够友好。
93+
94+
我需要做两件事:**搜索各家 LLM 的最新模型版本**,然后**给前端加一个下拉选择**
95+
96+
提示词很简单:
97+
98+
> /tavily-search 搜索当前 deepseek、glm 和 openai 最新的模型,然后调整全局配置中默认模型推荐和示例。并且,当前这几个 LLM 图标太 AI 味了,帮我换一个上档次点。
99+
100+
任务不大,但有个细节值得说——如果不配 `/tavily-search` Skill,单纯靠大模型的训练数据截止日期来猜最新版本,大概率会出错。我之前用其他模型没配 Tavily 的时候,反复提示了好几遍才把各家最新模型版本搞对。
101+
102+
关于 Tavily 的使用可以参考:[Claude Code 对接 AI Agent 搜索引擎 Tavily 实现高质量搜索](https://mp.weixin.qq.com/s/kAk7lLVgYzZrD9xJs3AUkQ)
103+
104+
DeepSeek V4-Pro **一次搞定**
105+
106+
![搜索并更新最新 LLM 模型](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/search-and-update-latest-models.png)
107+
108+
模型配置全部更新成功,各家推荐的模型示例都切到了最新版本。改了三个文件:
109+
110+
1. **`application.yml`**——新增 DeepSeek 预设 Provider,GLM 默认模型升级到 `glm-5`
111+
2. **`.env.example`**——补上 DeepSeek 环境变量,Kimi 默认改为 `kimi-k2.6`
112+
3. **`SettingsPage.tsx`**——加了 `PROVIDER_PRESETS` 常量,Model 和 Embedding Model 改成 combo box
113+
114+
最终四个 Provider 的推荐模型列表(截至 2026.04.25):
115+
116+
| Provider | 推荐模型 |
117+
| --------- | --------------------------------------------------------------- |
118+
| DashScope | `qwen3.6-flash``qwen3.5-plus``qwen3-max``qwq-32b` 等 8 款 |
119+
| DeepSeek | `deepseek-v4-flash``deepseek-v4-pro` |
120+
| GLM | `glm-5.1``glm-5``glm-4.7-flash` 等 8 款 |
121+
| Kimi | `kimi-k2.6``kimi-k2.5``kimi-k2-thinking` 等 5 款 |
122+
123+
![编辑 DeepSeek 模型配置](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/edit-deepseek-model-config.png)
124+
125+
## 实战二:数据库迁移方案诊断与 Flyway 集成
126+
127+
第二个任务更有挑战性。
128+
129+
因为换了新电脑,所有环境都是重新搭建的。项目有两个 SQL 文件,一个在项目启动时自动执行了,另一个没有。这块逻辑我也忘了,需要让模型帮我诊断。
130+
131+
![技能管理界面报错](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/skill-management-error.png)
132+
133+
提示词:
134+
135+
> 当前项目有两个 SQL 文件,`sql/init.sql` 在项目启动自动执行了,`sql/V2__knowledge_skill.sql` 没有自动执行。请你帮我分析一下是什么原因,然后用合理的方式优化现存的问题。
136+
137+
DeepSeek V4-Pro 的分析很到位:**`V2__knowledge_skill.sql` 没有被挂载到 Docker 容器中,项目也没有引入任何数据库迁移工具**,而 `init.sql` 是在容器启动时自动执行的——这是 Docker Compose 配置里写死的。
138+
139+
![数据库表未执行原因分析](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/database-table-analysis.png)
140+
141+
它给出的解决方案是**集成 Flyway 作为数据库迁移工具**
142+
143+
Flyway 是 Java 生态中最成熟的数据库迁移方案之一,用文件命名约定(如 `V1__init.sql``V2__knowledge_skill.sql`)自动管理迁移顺序。
144+
145+
整个过程 DeepSeek V4-Pro 完成了以下工作:
146+
147+
1. 分析了 Docker Compose 配置中 `init.sql` 的挂载逻辑
148+
2. 发现 `V2__knowledge_skill.sql` 缺失的原因
149+
3. 引入 Flyway 依赖,编写迁移配置
150+
4. 重构 SQL 文件命名,确保迁移顺序正确
151+
152+
> 这里踩了个坑:我中途不小心调整了 iTerm2 的窗口大小,导致终端里的对话历史突然错乱了。
153+
154+
第一次运行后,Flyway 没有成功执行。我把错误日志贴过去,经过两轮调教后修复成功。
155+
156+
![DeepSeek 完成 Flyway 集成后的总结](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/deepseek-flyway-integration-summary.png)
157+
158+
这个问题值得单独拿出来讲——因为 DeepSeek V4-Pro 在第一次集成时也踩到了这个坑,经过两轮调试才找到根因。
159+
160+
**Spring Boot 4.x 对自动配置模块做了大规模拆分**`FlywayAutoConfiguration` 已从 `spring-boot-autoconfigure` 中移除,迁移到了独立模块 `spring-boot-flyway`
161+
162+
如果你只引入了 `flyway-core` 这个第三方库,Spring Boot **不会自动触发任何迁移**。最坑的是,**启动日志里也不会有任何 Flyway 相关输出**——完全没有报错,只是静默地什么都不做。这个坑特别容易迷惑人,让你怀疑是配置写错了,然后在 `yml` 文件里反复折腾。
163+
164+
使用官方 Starter,它会将自动配置模块一并带入:
165+
166+
```xml
167+
<dependency>
168+
<groupId>org.springframework.boot</groupId>
169+
<artifactId>spring-boot-starter-flyway</artifactId>
170+
</dependency>
171+
<!-- PostgreSQL 方言支持仍需单独引入 -->
172+
<dependency>
173+
<groupId>org.flywaydb</groupId>
174+
<artifactId>flyway-database-postgresql</artifactId>
175+
</dependency>
176+
```
177+
178+
记住这个教训:**Spring Boot 4.x 时代,很多你习惯直接引第三方库就能自动装配的功能,现在需要找对应的官方 Starter。** 自动配置被拆出去了,但文档里不一定显眼地提醒你。
179+
180+
## 实战三:AI 面试平台对接 DeepSeek
181+
182+
我们的 AI 智能面试辅助平台目前已经新增了多模型切换和配置功能,DeepSeek 也已经支持了。
183+
184+
和实战一一样,对接最新模型整个过程是一遍过的,就不重复贴过程了。我们直接看效果。
185+
186+
通过配置界面,将默认模型切换到 DeepSeek,选择 **deepseek-v4-flash**
187+
188+
![将面试平台的模型切换到 deepseek-v4-flash](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/interview-guide-model-deepseek-v4-flash.png)
189+
190+
然后上传一份简历,基于这份简历生成一次模拟面试,来看看效果。
191+
192+
面试题是通过 deepseek-v4-flash 生成的,答案也是让 DeepSeek 在快速非思考模式下给出的(有两个问题没有回答)。
193+
194+
![模拟面试评估结果](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/interview-guide-model-deepseek-v4-flash-interview.png)
195+
196+
Flash 模型,非思考模式,生成质量已经不错了。考虑到 Flash 的定价,这个性价比相当能打。
197+
198+
## 实战四:项目代码审计与多模型协同
199+
200+
我手头的多智能体股票分析项目,MVP 版本已经跑起来了,支持股票分析、多策略、告警、技能、多模型、通知等功能。但开发过程中赶进度,代码质量没顾上好好把关。
201+
202+
这次我试了一个思路:**用便宜的模型做审计,用贵的模型做决策和修复**
203+
204+
在 Claude Code 里直接让 DeepSeek V4-Pro 启动多个 Agent,从安全性、功能正确性、代码质量等不同维度扫描整个项目,把发现的问题汇总写入文档。
205+
206+
![DeepSeek V4-Pro 扫描分析代码](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/deepseek-v4-pro-scan-analyze-code.png)
207+
208+
V4-Pro 确实找出来不少问题,最紧急的 TOP 5:
209+
210+
1. **API Key 明文存储** — 加密器已实现但未接入
211+
2. **系统管理接口无权限控制** — 普通用户可修改 LLM 配置
212+
3. **Redis 反序列化漏洞**`activateDefaultTyping` 允许任意类实例化
213+
4. **硬编码第三方 API Key** — Bocha 真实密钥提交在代码中
214+
5. **功能 Bug** — History 页"重新分析"按钮因路由参数未读取而失效
215+
216+
我大概过了一遍,基本都是合理的。安全类问题尤其值得重视,第 3 条 Redis 反序列化漏洞如果被利用,后果很严重。
217+
218+
接下来我把 V4-Pro 找出来的问题直接丢给 **GPT-5.5** 复核。
219+
220+
![GPT5.5 对 DeepSeek V4-Pro 找出的问题进行修复](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/gpt5-5-fix-problems-found-by-deepseek-v4-pro.png)
221+
222+
**为什么不让 V4-Pro 自己修?** 因为代码审计和代码修复是两种能力,用不同模型交叉验证更靠谱——一个负责找问题,一个负责确认问题并执行修复。
223+
224+
GPT-5.5 复核后直接执行了修复,整个过程很顺。
225+
226+
这个案例的重点不是 V4-Pro 有多强,而是**用便宜模型干活、用贵模型把关**这个思路。V4-Pro 做代码扫描的成本几乎可以忽略,同样的事交给 GPT-5.5 或 Claude Opus 4.6 来做,费用至少高出两个数量级。
227+
228+
## 实战五:全项目扫描分析
229+
230+
这个就简单了,我主要是想验证一下 V4-Pro 的分析质量,顺便看看最后的 Token 消耗。
231+
232+
![让 V4-Pro 扫描分析 agent-invest](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/claudecode-deepseek-v4-pro%5B1m%5D.png)
233+
234+
![V4-Pro 扫描分析 agent-invest 的结果](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/v4-pro-scan-analyze-result-of-agent-invest.png)
235+
236+
这是 V4-Pro 最终输出的文档,整体质量还是非常高的,很全面:
237+
238+
![V4-Pro 最终输出的 agent-invest 文档](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/v4-pro-final-output-agent-invest-document.png)
239+
240+
## DeepSeek V4 一览:看完实战再看数字
241+
242+
看完上面几个实战任务,再来补一下 DeepSeek V4 的硬参数,会更有体感。
243+
244+
这次 V4 系列同时发布了两款模型:
245+
246+
| 规格 | DeepSeek-V4-Pro | DeepSeek-V4-Flash |
247+
| ----------------- | ------------------------------- | ------------------------------- |
248+
| 总参数 | **1.6T** | **284B** |
249+
| 每 token 激活参数 | 49B | 13B |
250+
| 上下文窗口 | **1M tokens** | **1M tokens** |
251+
| 推理模式 | 非思考 / Think High / Think Max | 非思考 / Think High / Think Max |
252+
| 开源协议 | MIT | MIT |
253+
254+
几个关键数字值得注意:
255+
256+
- **V4-Pro 的 Codeforces 评分 3206**,在四家主流模型(Claude Opus 4.6、GPT-5.4 xHigh、Gemini 3.1 Pro High)中排第一
257+
- **SWE-bench Verified 80.6%**,跟 Claude Opus 4.6(80.8%)几乎打平,但 API 价格便宜了两个数量级
258+
- **1M 上下文场景下**,V4-Pro 的单 token 推理 FLOPs 只有 V3.2 的 **27%**,KV 缓存用量只有 **10%**
259+
260+
![V4 Benchmark 数据](https://oss.javaguide.cn/github/javaguide/ai/coding/deepseek-v4/v4-benchmark.png)
261+
262+
再看定价:
263+
264+
| API 定价(每百万 token) | DeepSeek-V4-Flash | DeepSeek-V4-Pro | Claude Sonnet 4.7 |
265+
| ------------------------ | ----------------- | --------------- | ----------------- |
266+
| 输入(缓存未命中) | $0.14 | $1.74 | $3.00 |
267+
| 输入(缓存命中) | $0.028 | $0.145 | $0.30 |
268+
| 输出 | $0.28 | $3.48 | $15.00 |
269+
270+
Flash 的输出价格不到 Claude Sonnet 的 **1/50**,Pro 的输出价格约为 Sonnet 的 **1/4**,输入端两者差距更小。
271+
272+
放到这个定价体系里看,Flash 在日常对话、内容生成、简单问答场景几乎没什么对手。
273+
274+
另外有一点需要注意:**API 迁移零成本**,改个 model 名就行。`deepseek-chat``deepseek-reasoner` 将在 7 月 24 日后停用,尽早切换到新模型名。
275+
276+
## 场景建议
277+
278+
| 场景 | 推荐 | 理由 |
279+
| ---------------------------------- | ----------------------------- | -------------------------------------------------- |
280+
| 日常对话、内容生成、简单问答 | **V4-Flash** | 价格极低,性能足够 |
281+
| Agent Coding、代码重构、全项目分析 | **V4-Pro** | SWE-bench 80.6%,Codeforces 3206,复杂任务成功率高 |
282+
| 复杂编码、精准问答、前沿科学推理 | **Claude Opus 4.6 / GPT-5.5** | 和顶级模型还有差距 |
283+
284+
## 总结
285+
286+
DeepSeek V4 在 Agent Coding 和代码理解场景上,明显上了一个台阶。V4-Pro 在 SWE-bench Verified 上拿到了 80.6%,Codeforces 评分 3206 排第一,这个实力对应这个价格,性价比确实到位了。
287+
288+
不过,DeepSeek-V4-Pro 在没有 Coding Plan 的情况下,价格还是偏高。V4-Flash 的定价很香,但在开发场景还无法成为主力。
289+
290+
另外,在复杂的编码、精准问答和前沿科学推理上,跟 Claude Opus 4.6 还有不小距离。不过考虑到 Flash 的价格优势——还要什么自行车?

0 commit comments

Comments
 (0)