Deep Code v0.3.1 发布说明
本次更新为 Deep Code 带来了本地图片读取工具 ReadImage、视觉模型 deepseek-v4-flash-vision-exp、DeepSeek Files API 支持,以及支持最新的推理强度控制。
全新功能
1. 图片理解工具:ReadImage
过去 Deep Code 处理图片主要依赖 UnderstandImage 这类外置识图能力:模型先把图片交给外置工具,再把文字描述拿回来。这种方式在模型不支持多模态时很有用,但模型实际上无法直接“看到”原图。
DeepSeek 上线首个官方多模态视觉模型后,图片输入正式成为 V4 系列的能力。v0.3.1 新增的 ReadImage 工具能让本地图片能以视觉模型支持的格式直接进入对话,真正实现“让模型看图”。
支持格式与限制:
| 项目 |
说明 |
| 输入格式 |
PNG、JPEG、WebP、GIF |
| 源文件大小 |
单文件不超过 20 MiB |
| 解码像素 |
不超过 6400 万像素 |
| 单边长度 |
不超过 8192 px |
| 发送给模型的图片 |
最长边缩放到 2048 px 以内,编码后不超过 4 MiB |
ReadImage 也借鉴了DSH的下列特性:
- 拒绝空文件、损坏文件、伪造扩展名和超限图片;
- 自动应用 EXIF 方向信息,统一转到 sRGB 色彩空间;
- 保留透明通道(优先选择 PNG/WebP 编码);
- 对低色彩图片(如截图、图标)使用 PNG 调色板编码,避免 JPEG 压缩带来的模糊;
- 大图自动缩小;如果发生缩放,会把原始尺寸告诉模型并给出坐标换算提示,方便模型在 UI 截图、设计稿上定位元素。
DeepSeek 官方视觉输入支持 base64、公网 URL、Files API file_id 三种方式;ReadImage 负责把本地图片处理成可直接使用的形态(默认 base64 内联,开启 Files API 后自动转为 file_id)。
自动判定规则:
- 多模态模型(默认包含
deepseek-v4-flash-vision-exp)使用 ReadImage
- 非多模态模型(如
deepseek-v4-pro、deepseek-v4-flash)继续使用 UnderstandImage 外置识图
- 如果自动判定与实际模型能力不符,可用
multimodal 配置手动覆盖
2. 视觉模型:deepseek-v4-flash-vision-exp
/model 现在提供三个 DeepSeek V4 模型选项:
deepseek-v4-pro
deepseek-v4-flash
deepseek-v4-flash-vision-exp ← 新增
官方规格要点:
- 支持 JPEG、PNG、GIF、WebP,单次请求最多 600 张图片;
- 图片可通过 base64、公网 URL 或 Files API
file_id 发送;
- 定价与 deepseek-v4-flash 一致,图片按输入 token 计费(单张缩放后约 384 tokens)。
官方参考:DeepSeek Vision 指南
3. DeepSeek Files API
默认情况下,多模态图片会以 base64 形式内联在会话消息里,同一张图片在多次请求中无法复用。启用 Files API 后,Deep Code 会先把图片上传到 DeepSeek 官方文件服务,聊天请求中只携带 file_id,大幅减小请求体积,也能复用同一批图片。
在 settings.json 中开启:
{
"filesApiEnabled": true,
"filesApiTimeoutMs": 60000,
"fileExpiresAfterSeconds": 604800,
"fileRefreshMarginSeconds": 3600,
"fileQuotaCleanupBatch": 100,
"maxRequestFilesBytes": 134217728
}
| 配置项 |
默认值 |
说明 |
filesApiEnabled |
false |
是否通过 DeepSeek Files API 发送图片 |
filesApiTimeoutMs |
60000 |
单张图片上传超时(最大 600000 ms,即 DeepSeek 规定的 10 分钟) |
fileExpiresAfterSeconds |
604800 |
远端文件有效期,默认 7 天(官方允许 1 小时到 30 天) |
fileRefreshMarginSeconds |
3600 |
剩余有效期低于该值时重新上传 |
fileQuotaCleanupBatch |
100 |
配额不足时,单次清理的最旧 Deep Code 文件数 |
maxRequestFilesBytes |
134217728 |
单次请求内图片原始字节总上限(128 MiB) |
官方参考:DeepSeek Files API
4. 低推理强度:low
DeepSeek V4 系列模型的思考模式已支持三档推理强度,官方建议:简单任务用 low,日常 Agent 任务用 high,复杂场景用 max。Deep Code 的 /model 同步接入了这三档:
Thinking mode [max] ← Deep Code 默认
Thinking mode [high]
Thinking mode [low] ← 新增
No thinking
官方参考:DeepSeek Thinking Mode
改进与优化
默认模型切换为 deepseek-v4-flash
从 v0.3.1 开始,未显式配置模型时,Deep Code 默认使用 deepseek-v4-flash,之前默认是 deepseek-v4-pro。
调整背景:DeepSeek 于 8 月上线 V4-Pro 正式版后,同时启用“峰谷定价”,高峰时段价格为空闲时段的两倍,输出价格最高从 6 元/百万 tokens 涨至 27 元/百万 tokens。
太贵了!作为日常编码助手,deepseek-v4-flash 的性价比更适合作为默认使用。
影响:
- 新用户安装后开箱即用
deepseek-v4-flash。
- 如果用户之前在
settings.json 里显式设置了 env.MODEL 或 model,配置不受影响。
- 需要更强推理时,随时用
/model 切换为 deepseek-v4-pro,或使用视觉模型 deepseek-v4-flash-vision-exp。
其他改进
- Skill 内容直接进入工具结果:加载 Skill 时,之前是加载为 system 消息。现在完整指令会作为工具结果返回给模型,这借鉴了DSH的做法。
- VSCode 插件同步支持图片处理:VSCode Companion 内置了 Sharp 按需加载器,在插件环境中初次使用
ReadImage 时动态安装依赖二进制,并显示安装进度。
- 修复 WebSearch 偶发失败问题:修复部分网页无法访问时可能导致整次搜索失败的问题,提升联网搜索的稳定性和结果可用性。
升级方式
# 全局更新到最新版
npm install -g @vegamo/deepcode-cli@latest
# 查看当前版本
deepcode --version
完整配置说明见 docs/configuration.md。
感谢使用 Deep Code!如有问题或建议,欢迎在 GitHub 仓库 提交 issue。
Full Changelog: v0.2.1...v0.3.1
Deep Code v0.3.1 发布说明
本次更新为 Deep Code 带来了本地图片读取工具
ReadImage、视觉模型deepseek-v4-flash-vision-exp、DeepSeek Files API 支持,以及支持最新的推理强度控制。全新功能
1. 图片理解工具:
ReadImage过去 Deep Code 处理图片主要依赖
UnderstandImage这类外置识图能力:模型先把图片交给外置工具,再把文字描述拿回来。这种方式在模型不支持多模态时很有用,但模型实际上无法直接“看到”原图。DeepSeek 上线首个官方多模态视觉模型后,图片输入正式成为 V4 系列的能力。v0.3.1 新增的
ReadImage工具能让本地图片能以视觉模型支持的格式直接进入对话,真正实现“让模型看图”。支持格式与限制:
ReadImage也借鉴了DSH的下列特性:DeepSeek 官方视觉输入支持 base64、公网 URL、Files API
file_id三种方式;ReadImage负责把本地图片处理成可直接使用的形态(默认 base64 内联,开启 Files API 后自动转为file_id)。自动判定规则:
deepseek-v4-flash-vision-exp)使用ReadImagedeepseek-v4-pro、deepseek-v4-flash)继续使用UnderstandImage外置识图multimodal配置手动覆盖2. 视觉模型:
deepseek-v4-flash-vision-exp/model现在提供三个 DeepSeek V4 模型选项:官方规格要点:
file_id发送;官方参考:DeepSeek Vision 指南
3. DeepSeek Files API
默认情况下,多模态图片会以 base64 形式内联在会话消息里,同一张图片在多次请求中无法复用。启用 Files API 后,Deep Code 会先把图片上传到 DeepSeek 官方文件服务,聊天请求中只携带
file_id,大幅减小请求体积,也能复用同一批图片。在
settings.json中开启:{ "filesApiEnabled": true, "filesApiTimeoutMs": 60000, "fileExpiresAfterSeconds": 604800, "fileRefreshMarginSeconds": 3600, "fileQuotaCleanupBatch": 100, "maxRequestFilesBytes": 134217728 }filesApiEnabledfalsefilesApiTimeoutMs60000fileExpiresAfterSeconds604800fileRefreshMarginSeconds3600fileQuotaCleanupBatch100maxRequestFilesBytes134217728官方参考:DeepSeek Files API
4. 低推理强度:
lowDeepSeek V4 系列模型的思考模式已支持三档推理强度,官方建议:简单任务用
low,日常 Agent 任务用high,复杂场景用max。Deep Code 的/model同步接入了这三档:官方参考:DeepSeek Thinking Mode
改进与优化
默认模型切换为
deepseek-v4-flash从 v0.3.1 开始,未显式配置模型时,Deep Code 默认使用
deepseek-v4-flash,之前默认是deepseek-v4-pro。调整背景:DeepSeek 于 8 月上线 V4-Pro 正式版后,同时启用“峰谷定价”,高峰时段价格为空闲时段的两倍,输出价格最高从 6 元/百万 tokens 涨至 27 元/百万 tokens。
太贵了!作为日常编码助手,
deepseek-v4-flash的性价比更适合作为默认使用。影响:
deepseek-v4-flash。settings.json里显式设置了env.MODEL或model,配置不受影响。/model切换为deepseek-v4-pro,或使用视觉模型deepseek-v4-flash-vision-exp。其他改进
ReadImage时动态安装依赖二进制,并显示安装进度。升级方式
完整配置说明见 docs/configuration.md。
感谢使用 Deep Code!如有问题或建议,欢迎在 GitHub 仓库 提交 issue。
Full Changelog: v0.2.1...v0.3.1