Skip to content

【Release Notes】v0.3.1 #318

Description

@qorzj

Deep Code v0.3.1 发布说明

本次更新为 Deep Code 带来了本地图片读取工具 ReadImage、视觉模型 deepseek-v4-flash-vision-exp、DeepSeek Files API 支持,以及支持最新的推理强度控制。

全新功能

1. 图片理解工具:ReadImage

过去 Deep Code 处理图片主要依赖 UnderstandImage 这类外置识图能力:模型先把图片交给外置工具,再把文字描述拿回来。这种方式在模型不支持多模态时很有用,但模型实际上无法直接“看到”原图。

DeepSeek 上线首个官方多模态视觉模型后,图片输入正式成为 V4 系列的能力。v0.3.1 新增的 ReadImage 工具能让本地图片能以视觉模型支持的格式直接进入对话,真正实现“让模型看图”。

支持格式与限制:

项目 说明
输入格式 PNG、JPEG、WebP、GIF
源文件大小 单文件不超过 20 MiB
解码像素 不超过 6400 万像素
单边长度 不超过 8192 px
发送给模型的图片 最长边缩放到 2048 px 以内,编码后不超过 4 MiB

ReadImage 也借鉴了DSH的下列特性:

  • 拒绝空文件、损坏文件、伪造扩展名和超限图片;
  • 自动应用 EXIF 方向信息,统一转到 sRGB 色彩空间;
  • 保留透明通道(优先选择 PNG/WebP 编码);
  • 对低色彩图片(如截图、图标)使用 PNG 调色板编码,避免 JPEG 压缩带来的模糊;
  • 大图自动缩小;如果发生缩放,会把原始尺寸告诉模型并给出坐标换算提示,方便模型在 UI 截图、设计稿上定位元素。

DeepSeek 官方视觉输入支持 base64、公网 URL、Files API file_id 三种方式;ReadImage 负责把本地图片处理成可直接使用的形态(默认 base64 内联,开启 Files API 后自动转为 file_id)。

自动判定规则:

  • 多模态模型(默认包含 deepseek-v4-flash-vision-exp)使用 ReadImage
  • 非多模态模型(如 deepseek-v4-prodeepseek-v4-flash)继续使用 UnderstandImage 外置识图
  • 如果自动判定与实际模型能力不符,可用 multimodal 配置手动覆盖

2. 视觉模型:deepseek-v4-flash-vision-exp

/model 现在提供三个 DeepSeek V4 模型选项:

deepseek-v4-pro
deepseek-v4-flash
deepseek-v4-flash-vision-exp   ← 新增

官方规格要点:

  • 支持 JPEG、PNG、GIF、WebP,单次请求最多 600 张图片;
  • 图片可通过 base64、公网 URL 或 Files API file_id 发送;
  • 定价与 deepseek-v4-flash 一致,图片按输入 token 计费(单张缩放后约 384 tokens)。

官方参考:DeepSeek Vision 指南

3. DeepSeek Files API

默认情况下,多模态图片会以 base64 形式内联在会话消息里,同一张图片在多次请求中无法复用。启用 Files API 后,Deep Code 会先把图片上传到 DeepSeek 官方文件服务,聊天请求中只携带 file_id,大幅减小请求体积,也能复用同一批图片。

settings.json 中开启:

{
  "filesApiEnabled": true,
  "filesApiTimeoutMs": 60000,
  "fileExpiresAfterSeconds": 604800,
  "fileRefreshMarginSeconds": 3600,
  "fileQuotaCleanupBatch": 100,
  "maxRequestFilesBytes": 134217728
}
配置项 默认值 说明
filesApiEnabled false 是否通过 DeepSeek Files API 发送图片
filesApiTimeoutMs 60000 单张图片上传超时(最大 600000 ms,即 DeepSeek 规定的 10 分钟)
fileExpiresAfterSeconds 604800 远端文件有效期,默认 7 天(官方允许 1 小时到 30 天)
fileRefreshMarginSeconds 3600 剩余有效期低于该值时重新上传
fileQuotaCleanupBatch 100 配额不足时,单次清理的最旧 Deep Code 文件数
maxRequestFilesBytes 134217728 单次请求内图片原始字节总上限(128 MiB)

官方参考:DeepSeek Files API

4. 低推理强度:low

DeepSeek V4 系列模型的思考模式已支持三档推理强度,官方建议:简单任务用 low,日常 Agent 任务用 high,复杂场景用 max。Deep Code 的 /model 同步接入了这三档:

Thinking mode [max]    ← Deep Code 默认
Thinking mode [high]
Thinking mode [low]    ← 新增
No thinking

官方参考:DeepSeek Thinking Mode

改进与优化

默认模型切换为 deepseek-v4-flash

从 v0.3.1 开始,未显式配置模型时,Deep Code 默认使用 deepseek-v4-flash,之前默认是 deepseek-v4-pro

调整背景:DeepSeek 于 8 月上线 V4-Pro 正式版后,同时启用“峰谷定价”,高峰时段价格为空闲时段的两倍,输出价格最高从 6 元/百万 tokens 涨至 27 元/百万 tokens。

太贵了!作为日常编码助手,deepseek-v4-flash 的性价比更适合作为默认使用。

影响:

  • 新用户安装后开箱即用 deepseek-v4-flash
  • 如果用户之前在 settings.json 里显式设置了 env.MODELmodel,配置不受影响。
  • 需要更强推理时,随时用 /model 切换为 deepseek-v4-pro,或使用视觉模型 deepseek-v4-flash-vision-exp

其他改进

  • Skill 内容直接进入工具结果:加载 Skill 时,之前是加载为 system 消息。现在完整指令会作为工具结果返回给模型,这借鉴了DSH的做法。
  • VSCode 插件同步支持图片处理:VSCode Companion 内置了 Sharp 按需加载器,在插件环境中初次使用 ReadImage 时动态安装依赖二进制,并显示安装进度。
  • 修复 WebSearch 偶发失败问题:修复部分网页无法访问时可能导致整次搜索失败的问题,提升联网搜索的稳定性和结果可用性。

升级方式

# 全局更新到最新版
npm install -g @vegamo/deepcode-cli@latest

# 查看当前版本
deepcode --version

完整配置说明见 docs/configuration.md

感谢使用 Deep Code!如有问题或建议,欢迎在 GitHub 仓库 提交 issue。

Full Changelog: v0.2.1...v0.3.1

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions