DeepSeek Harness系统提示词泄漏 指向Agent运行时新方向
有用户在𝕏发布消息称DeepSeek Harness的系统提示词发生泄漏。该用户查看提示词后发现,DeepSeek的目标不止是打造“DeepSeek版Codex”。
提示词中占主要篇幅的内容,并非指导模型生成优质代码,而是定义智能体(Agent)的工作方式。DeepSeek Harness当前明确由deepseek-v4-flash驱动,给模型设置了非常严格的运行框架。
框架对文件操作、权限管理、任务状态都做出了明确规定:读取文件需走专用read命令,搜索文件需走glob命令,修改文件前需要先观察文件,后台任务必须记录任务ID,越界后仅可重试一次权限升级,长任务保留独立目标状态,会话恢复或分支后需要重新激活目标。
DeepSeek Harness还定义了多套完全不同的执行模式:普通任务直接执行,长程任务进入目标模式、可跨多轮自主执行,少量任务可交给子智能体默认后台运行,大规模并行任务进入工作流、用JavaScript编排多个智能体。
它还有单独的Ralph Loop机制,每一轮都会创建一个完全“失忆”的新智能体,不继承上一轮对话,仅通过共享工作区保留长期记忆,逐轮迭代。
这套框架已经接近智能体的进程模型:大语言模型负责推理,Harness负责状态、权限、记忆、调度、并行、恢复和收敛。
DeepSeek Harness实际是在尝试解答一个底层问题:当智能体从单次回答问题,转为连续工作数小时、调用数十个工具、启动多个子智能体、还能在失败后恢复,该用什么运行时来管理它。
之前行业聚焦提示词工程,下一阶段行业将开始转向运行时工程。如果deepseek-v4-flash搭配Harness就能获得明显更强的智能体表现,未来评估模型能力可能不能只看裸模型的性能。模型×Harness才是完整的智能体能力。