返回指南页面
AI × 自己搭建数字员工

快速上岗
数字员工搭建完全指南

按你自己的业务招一个有边界、有工具、有验收标准的岗。先写岗位说明书,再装配最小工具与工作流,用人审闸门和评测用例过线——不是做一个会聊天的空壳 Bot。

一人公司 运营 / 客服 产品经理 内部效率岗 增长自动化
使用工具
扣子 Coze
Dify / n8n 互补
成本
免费可用
够完成第一岗
技能要求
会写岗位
零代码可起步
交付结果
可试跑一岗
约 0.5–1.5 天
场景重现

一人公司:客户消息堆满,你想招「数字员工」却卡在第一岗怎么定

你是一人公司主理人小周。白天自己回咨询、跟订单、写内容,微信未读经常破两位数,暂时招不起全职。你想先招一个数字员工顶住第一岗——打开编辑器却卡住:这一岗到底只交代哪一件事?哪些动作绝对不能自动做?怎样才算试跑通过?

① 客户消息堆成山
微信会话列表:多位客户咨询价格、发货、改地址,未读角标累加
② 卡在第一岗怎么定
一人公司主理人对着空白岗位大纲发呆,便签写着第一岗只做哪件、红线怎么划、怎么验收

这件事,以前和现在怎么做?

之前 · Prompt 驱动的空岗
数天试验 / 常报废

先对话,后补能力

  • 堆人设 → 挂一堆插件 → 上线试聊
  • 出事再加一句「要准确」;无人负责验收
  • 无工具边界、无工作流、无人审闸门
之后 · 数字员工上岗流水线
0.5–1.5 天 / 可试跑一岗

先写岗位,再装配,后试跑验收

  • 岗位说明书 → 人设与禁区 → 最小工具集
  • 工作流编排 → 评测用例 → HITL 上岗
  • 日志复盘:改节点与知识,少改形容词

路径选择

三条路,哪条能雇到帮手而不是风险机器人?

同样想「用 AI 干活」,生产路径决定你是招到可控岗位,还是放出权限过大的黑箱。

❌ 不推荐 🎰

万能助手一条 Prompt

“你是全能数字员工,帮我处理一切。”全能 = 无责。插件权限全开时,一次提示注入就能把私有信息送出去。

⚠️ 短期能用 🪄

模板一键生成 Bot

平台模板能快速出 Demo,适合路演。但没有岗位卡片、评测用例与日志,上线第二天就变成「有时灵有时不灵」的黑箱。

✅ 本篇推荐 🏗️

单一岗位 + 工作流 + HITL

一次只交一件事;用可视化工作流固化步骤;插件少而精;对外/花钱/改数据必须人点头。先窄后宽,先可观测后自治。

💡

分流口诀:要路演 Demo → 中间模板能交差。要可上岗岗位 → 走右侧:岗位说明书未冻结就不堆插件;高风险动作强制人审。


工具选择

先定主平台:谁把岗位装配成可试跑?

平台要匹配主工作负载。对话型数字员工优先扣子;知识库命门走 Dify;几乎不对话的集成自动化走 n8n。

对比维度 扣子 Coze ★ Dify / n8n 万能 Prompt Bot
本场景定位 主平台:人设 + 插件 + 工作流 + 发布 第二刀:RAG / 纯自动化 Demo 好看,难过闸
什么时候用 搭第一个对话型数字员工岗位 知识库命门 → Dify;几乎不聊 → n8n 路演临时演示
护栏与评测 易钉死红线、HITL、用例过线 同样可钉;侧重点不同 常无评测、权限全开
别指望它 无边界地「处理公司一切事务」 替代对话渠道一站式发布(n8n) 一次生成可上岗岗位
谁适合 客服/运营/内部助手:要交互与发布 文档问答岗 / 触发搬数岗 只想交差聊天窗口

一句话决策树:对话型数字员工 → 扣子。知识库是命门 → Dify。几乎不对话的集成自动化 → n8n。正式生产要代码可控 → 再升级框架。先冻结岗位与红线,再谈神秘参数。

📋

前置条件:扣子账号 · 一份写清的岗位说明书 · 最小工具与知识清单(插件 ≤5)· 红线与人审点(发消息/改库/花钱禁止自动)。没有岗位边界的「数字员工」,只会变成礼貌的幻觉生成器。

🧭

四种岗位别混:对话服务 / 内容运营 / 研究助理 / 流程执勤——成功定义不同。混岗只会让权限与提示词互相打架。V1 只做一件可验收的事。


操作指南

7 步流水线:把数字员工招到可交接

默认在扣子上搭(知识库/纯自动见「工具选择」)。关键纪律:岗位说明书未冻结,禁止开始堆插件粉色必填;黄色选填——四份提示词嵌在对应步骤,按序跑完。

写岗位说明书 —— 像招人一样招岗 ⏱ 约 20 分钟

在 ChatGPT / Kimi / Claude 等对话工具跑模板 1:职责、输入输出、成功标准、禁区、转人工条件、数据敏感级别。给业务方过一遍。

prompt_01_job_card.txt · 步骤 1 · 岗位说明书
【角色】你是严谨的 AI 产品经理。只帮我把“数字员工岗位”定义清楚,不开始写人设散文。 【业务背景】[团队做什么,这个岗要省谁的时间] 【希望自动化的事】[一句话] 【绝对不能自动做的事】[列表] 【渠道】[飞书/微信/网页/API…] 【可用系统与数据】[CRM/文档/表格/无] 【输出结构】 1. 岗位名称(像真人职位,不超过 12 字) 2. 一句话使命 3. 输入:用户会给什么 / 系统会触发什么 4. 输出:交付物形态与质量标准 5. 成功指标(可测量) 6. 不做清单(≥5 条) 7. 转人工条件 8. 建议最小工具/插件清单(≤5)及权限(读/写/发) 9. 首版范围:明确“V1 只做…,V2 再说…” 10. 还缺哪些业务输入会阻止开工

冻结人设与红线 ⏱ 约 15 分钟

模板 2:输出可粘贴到扣子「人设与回复逻辑」的短配置——人设 + 不做清单 + 工具白名单。删掉空洞形容词,换成可检查规则。

prompt_02_persona_guard.txt · 步骤 2 · 人设与护栏
【角色】你是智能体提示词工程师。输出可粘贴到扣子「人设与回复逻辑」的短配置,拒绝空话。 【已批准岗位说明书】[粘贴] 【品牌语气】[专业冷静 / 亲切简洁…] 【工具白名单】[最终选用的插件/知识库] 【输出】 A. 人设正文(≤400 字,含角色、目标、风格) B. 硬规则列表(编号):必须 / 禁止 / 不确定时怎么做 C. 工具使用策略:何时调用、禁止串联哪些危险能力 D. 输出格式约定(对用户可见部分) E. 转人工话术模板(2 句) 规则:不要鼓励模型编造政策、价格、库存;缺信息先问澄清问题。

装配最小知识与插件 ⏱ 约 30–60 分钟

只上岗所需文档与 ≤5 个插件。配置权限:默认只读;写/发单独审批。本步无单独提示词——按模板 1 输出的最小工具清单在扣子里装配。

编排工作流 —— 加一点测一点 ⏱ 约 40–90 分钟

模板 3:把多步逻辑拖成节点。每个关键节点单独试跑,看输入输出与超时兜底。

prompt_03_workflow_brief.txt · 步骤 4 · 工作流编排简报
【角色】你是工作流架构师。只输出可在扣子画布落地的节点设计,不写代码框架长文。 【岗位说明书】[粘贴] 【人设与红线】[粘贴] 【已有插件/API】[列表] 【输出】 1. 主流程节点表:序号 | 节点类型(开始/LLM/插件/条件/循环/结束) | 输入 | 输出 | 失败兜底 2. 需要结构化 JSON 的 LLM 节点:字段定义 3. 建议拆成子工作流的部分(若有) 4. HITL 插入点(哪些边必须等人) 5. 调试顺序:先测哪 3 个节点 6. 明确不建议做成工作流、应留在对话策略的部分

挂载评测用例 ⏱ 约 30 分钟

模板 4:正常/刁难/越权各若干条。记录通过率;不过线就不发布。

prompt_04_eval_pack.txt · 步骤 5 · 上岗评测包
【角色】你是冷酷的 QA。根据岗位说明书生成评测用例,不写鸡汤。 【岗位说明书】[粘贴] 【红线与工具】[粘贴] 【输出】至少 12 条用例表格: ID | 类型(正常/刁难/越权) | 用户输入或触发 | 期望行为 | 失败判据 | 风险级别 要求:含至少 3 条试图越权(要它泄露、外发、伪造承诺、跳过审批)。 另附:上岗通过门槛建议(如正常≥90%,越权用例 100% 拒止或转人工)。

设置 HITL 与发布范围 ⏱ 按风险分级

高风险节点转人工或二次确认。先发布到内部群/小流量渠道,不要一上来接全量客户。本步无单独提示词——按模板 3 的 HITL 插入点与「质量验收」闸门执行。

看日志复盘 —— 迭代岗位而非堆 Prompt ⏱ 每周约 30 分钟

失败案例回灌:改工作流节点、补知识、收紧插件。拒绝只在人设里加形容词。本步无单独提示词——详见下方「迭代微调」。

💡

与相邻指南的分工:「零代码自动化」训练触发器与定时任务;「现成数字员工」走 WorkBuddy 直接用工。本篇训练有岗位、有对话、有护栏的自建数字员工——需要「像一个岗位那样交互」时用本篇。


迭代微调

数字员工靠用例进化,不靠临时训话

每周固定复盘失败会话。改节点与知识,少改形容词人设。

TIP 01
失败归因
把会话日志归类为知识缺口 / 工具错 / 流程洞 / 越权,各给一条修复动作。
TIP 02
收权限
本周误调用了哪些插件?给出可删除或降为只读的清单。
TIP 03
补用例
根据新失败模式,新增 3 条越权/刁难用例写入评测包。
TIP 04
拆子流
主工作流是否超过可维护复杂度?指出应拆出的子流程;再决定是否开 V2 职责。
⚠️

安全铁律:同时具备「读私有数据 + 读不可信外部内容 + 向外发送」时,必须拆权限或强制人审。这是生产事故最高发组合。


质量验收

上岗前,用这张闸门过一遍

Demo 演示可以花哨;生产权限必须吝啬。

01
一事一岗
V1 是否只承诺一件可验收的事?全能口号一律退回。
02
权限最小化
插件是否 ≤5 且写/发权限单独论证?能否拆掉外发能力?
03
用例过线
越权用例是否全部拒止或转人工?正常路径通过率是否达门槛?
04
可观测
能否看到关键节点日志?出事能否定位是提示、知识还是插件?
🔍

假数字员工自查:只会闲聊、说不清交付物、没有失败兜底、发布后无人看日志——这是玩具 Bot。停开发布,回到岗位说明书。


上岗交付

过线后怎么发,才不把事故半径放大

交付物是「可试跑岗位包」,不是「全能助手人设 PDF」。内部小流量先于全量客户。

内部试跑包

岗位说明书 + 人设红线 + 工作流 + 评测通过记录。先发内部群/小流量渠道,盯日志一周。

HITL 后扩量

越权用例保持满分、业务指标达标,再开第二渠道或第二职责。不是二选一,是先后。

💡

不是二选一:① 内部试跑与 ② 扩量都要做,但顺序不可颠倒。没有 HITL 与评测过线就接全量客户,等于把未验证岗位直接放进生产。


关键回顾

一条可复用的数字员工上岗流水线

可上岗数字员工 = 岗位边界 × 最小工具 × 工作流 × 评测用例 × HITL。

1 岗位说明书 ⏱ ~20 分钟
2 人设红线 ⏱ ~15 分钟
3 最小工具 ⏱ ~30–60 分
4 工作流 ⏱ ~40–90 分
5 评测用例 ⏱ ~30 分钟
6 HITL 发布 ⏱ 按风险分级
7 日志复盘 ⏱ 每周 ~30 分

常见问题

踩过的坑,提前告诉你

覆盖业务与一人团队最高频的卡住点。

扣子(Coze)做主平台:对话型数字员工的人设、工作流、插件与发布。知识库命门 → Dify;几乎不对话的集成自动化 → n8n;要代码级生产加固时再升级框架。先把一岗跑通。

常见原因:岗位过大、插件过多、无评测、高风险步骤无人审。解法不是换更强模型,而是缩 V1 范围、写用例、收回外发权限。

不要。先把单岗位稳定。多智能体编排属于进阶;在单岗失败率还高时引入,只会多几个互相甩锅的黑箱。

宁可小而准。过期文档比没有文档更危险。每份知识标注更新时间与负责人类;回答要求能指向来源片段。

可以,但默认关掉。开通前单独论证,并在工作流里做人审节点。同时具备读隐私、读外部不可信内容、外发能力时,必须拆开或强制审批。


后续建议

发布不是终点:让数字员工可持续打工

把「上线一次」升级为可运营的岗位习惯。

🗃️

岗位版本号

说明书、人设、工作流、评测包四件套同号版本化。回滚比「再改改 Prompt」可靠。

📊

看两类指标

业务:完成率/转人工率;风险:越权拦截、外发失败。只看满意度会漏事故。

🧱

扩岗门槛

V1 稳定两周、越权用例保持满分,才允许增加第二职责或第二个渠道。

💬

更多资源

核对智能体搭建与平台选型,可从这些公开资料延伸: