文章

AI 总跳过 SOP?Stepgate 把步骤和验收门槛做成 MCP

静水流深 9-28 09:09 · 1,190 字 · 约 4 分钟 · 34 次阅读
我发布了文章:《AI 总跳过 SOP?Stepgate 把步骤和验收门槛做成 MCP》

给 AI 一份 Markdown 操作手册,并不等于它会逐条执行。上下文一长,Agent 可能合并步骤、提前写结论,甚至把“已经查询”当成查询结果。Stepgate 想解决的正是这一层问题:它把流程写成 YAML stepfile,再通过 MCP 把整套流程暴露为一个工具。

运行时,客户端模型一次只能看到当前步骤。当前输出通过门槛后,Stepgate 才会返回下一步;远程 API 和 MCP 工具也由 Stepgate 代为调用,凭据从服务端环境变量读取,不交给模型。门槛可以使用 JSON Schema、JSONLogic 或 HTTP 验证器,还能拿模型提交的内容与本轮 API 实际返回的数据核对。比如生成依赖升级说明时,版本号必须等于 npm Registry 返回值,否则这一项会被拒绝并要求重做。

它更适合“有固定顺序、存在权威数据、结果能够机械验收”的工作,例如域名到期检查、软件版本核对、工单分类、报价采集和结构化研究。纯创意写作反而不是优势场景:Stepgate 能保证流程走到了哪一步,却不能保证模型写出的分析天然正确;门槛写得太宽,错误内容一样会通过。

试用门槛不高,但运行 MCP 客户端的机器需要 Node.js 22.18 或更新版本。可以先查看内置流程:

npx -y stepgate --list

选定流程后,把 npx -y stepgate market-research 作为 MCP 服务命令加入客户端,并在 MCP 环境配置里提供该流程所需的 API Key。建议一开始就加上 --ledger-dir .stepgate/ledgers:每次执行会生成带哈希链的 JSONL 记录,包含步骤、工具调用、门槛判定和重试信息。它可以发现记录被事后修改,但账本只保存请求与输出的哈希和长度,不是完整业务数据归档。

真正落地时,不要一上来迁移整套运营流程。先挑一个两三步的小任务:把输入定义成结构化字段,让确定性的查询交给机械步骤,再给最终输出设置“字段必须完整”“数值必须来自 API 返回”等门槛。故意提交一次错误数据,确认门槛确实拦截;然后中断一次运行,检查超时和账本是否符合预期。连接 Claude Code、Claude Desktop、Cursor 和 VS Code 的配置差异可直接看项目连接文档。

目前还有几个现实限制:它主要面向远程 API 和 MCP 工具,不是任意本地脚本编排器;默认单步最多 100 次工具调用、单个工具结果最多传给模型 20000 个字符、运行空闲 30 分钟后会被放弃。需要人工批准的 approve 门槛,截至 2026 年 9 月 28 日只有终端版 Claude Code 能正常展示;桌面端、VS Code 和无交互模式可能直接拒绝。因此这还是一个适合从非关键流程开始验证的新工具,而不是替换现有 CI、队列和审批系统的成熟平台。

登录 后参与评论

还没有人评论,来抢沙发