JOTO
联系我们
← AI 智库
多模态模型

DeepSeek Harness 更新:官方多模态支持

2026 年 8 月 21 日

DeepSeek Harness 连续发布 v0.1.0-rc.7、v0.1.0-rc.8 和 v0.1.1-rc.1 三个版本,重点增强多模态能力(新增 DeepSeek-V4-Flash-Vision-Exp 模型支持图文输入)、子代理协作灵活性(Codex/Claude Code 接入 Job Panel)及稳定性(修复长会话、终端兼容等问题)。MCP/ACP 支持图片附件持久化,PTC Mode 支持转发嵌套图片。

自开发者预览版 v0.1.0-rc.6 首日发布以来,DeepSeek Harness 已连续完成三次版本更新:v0.1.0-rc.7、v0.1.0-rc.8,以及今天发布的 v0.1.1-rc.1。这三次更新主要围绕多模态能力、子代理协作、跨平台兼容和日常使用体验展开,同时修复了社区反馈的一系列问题。感谢每一位开发者的试用、反馈与共建。

多模态能力进一步增强

DeepSeek 模型适配器新增 DeepSeek-V4-Flash-Vision-Exp 多模态模型选项,并支持配置原生图片请求。/goal/plan 等命令可接收图文输入,@ 菜单可引用文件和会话;MCP/ACP 同时支持图片附件持久化,PTC Mode 支持转发嵌套图片。

子代理与插件组合更加灵活

Codex 与 Claude Code 子代理接入 Job Panel,并支持作为 Profile Bundle 按需安装,并支持非交互权限模式和多个命名实例。插件也可以自行注册设置卡片,让能力扩展与任务管理更加便捷。

稳定性与使用体验持续提升

三次更新集中修复了长会话、终端兼容、模型请求与沙箱权限等问题,并优化了提问卡片、Markdown 表格、多行输入和会话切换等交互细节,让日常使用更加稳定、顺畅。

DeepSeek Harness 多模态界面示意图
DeepSeek Harness 多模态界面示意图

JOTO 企业落地观察

  • 企业部署多模态智能体时,需评估 Vision 模型对图像理解的精度边界与沙箱环境对本地文件访问的权限策略,尤其在金融、医疗等强合规场景中,图文混合输入可能触发额外的数据出境或审计要求。
  • 子代理按 Profile Bundle 按需安装的设计,降低了企业级智能体系统的初始部署复杂度,但命名实例与非交互权限模式的组合,要求团队在 RAG 知识工程阶段即明确各子代理的上下文隔离粒度与知识源绑定关系。
  • MCP/ACP 对图片附件的持久化支持,使企业知识库可原生承载扫描件、流程图、架构图等非文本资产,但需同步构建图像元数据标注与语义检索链路,否则将导致多模态 RAG 的召回率显著低于纯文本场景。
  • PTC Mode 下嵌套图片的转发能力,提升了跨系统协作效率,但企业在构建 AI 安全治理策略时,必须将图片内容识别(如 OCR、NSFW 检测)纳入默认流水线,避免未经审查的视觉信息在组织内传播。

立即咨询 JOTO

JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询

想把这些做法用到你的业务里?

留下你的场景和痛点,我们帮你判断从哪一步开始。

联系我们
联系我们

开启企业级 AI 落地

留下你的行业、部门和当前痛点,我们会在 1 个工作日内与你联系,帮你判断适合先做什么、需要准备哪些数据、适合什么平台。

微信咨询
扫码添加,一对一沟通
JOTO 微信咨询二维码
发送邮件
jotoai@jototech.cn

填写需求单

收到你的信息后,我们将在 1 个工作日内与你取得联系。