CASE STUDY03
AI TOOLING / AGENT WORKFLOW
DevFlow Copilot
面向开发工作流的 AI 工具,提供 Provider 路由、Prompt 模板、状态管理、日志诊断和历史记录。
REAL LOCAL RUN / REPOSITORY EVIDENCE02
RUN TRACE / EVIDENCE
RUN TRACE / EVIDENCE1440 × 900 pxVIEW ORIGINAL · DevFlow Copilot 真实运行截图 →画面来自项目仓库保存的真实本地运行截图,不是概念图或第三方产品截图。
/ PROBLEM & OWNERSHIP
不只保存结果,
还要保存生成过程。
AI Coding Demo 很容易变成聊天套壳。项目需要展示一次生成为什么发生、使用了哪个 Prompt Version、Provider 是否降级、调用了什么工具、生成结果如何进入人工审核。
/ SYSTEM PATH
一次 Run 的十二步可回放证据。
- 01选择 Prompt Template + Version
- 02校验并渲染变量
- 03创建 GENERATING 记录
- 04创建 Agent Run + Prompt Render Step
- 05可选关键词 Knowledge 检索
- 06Provider Router 选择执行路径
- 07失败时记录 fallback reason
- 08写入 Generation Trace
- 09记录 Tool Call
- 10结果进入 READY_FOR_REVIEW
- 11Review: PENDING / SAVED / CONFIRMED / REJECTED
- 12不改代码、不提交 Git、不部署
/ DECISIONS & FAILURE CHECKS
让 Prompt、Provider、Tool 与 Review 同源。
01默认 local-rule,真实 Provider 可选
无 API Key 也能稳定回放工作流;OpenAI-compatible Provider 只在显式配置时启用。
+
- 未选择 / 取舍
- 未为了展示而伪造真实模型调用;默认结果不能被描述为 LLM 推理质量。
- 失败验证
- Provider 路由测试验证不可用、超时与允许降级时记录 fallback reason。
02一次 Run 聚合全部证据
AgentStep 关联 Prompt、Provider、Generation、Tool Call 与 Human Review。
+
- 未选择 / 取舍
- 未把证据散落成互不关联的日志页面;代价是需要稳定的 Run 标识与实体关系。
- 失败验证
- AgenticWorkflowIntegrationTest 回放步骤关联与最终审核状态。
03Prompt Version 必须持久化
Run 记录具体 Template 与 Version,而不是只保留最终渲染文本。
+
- 未选择 / 取舍
- 多保存版本与渲染上下文会增加数据结构,但可以解释同一输入为何产生不同结果。
- 失败验证
- 变量缺失或模板不匹配时,渲染测试阻止进入正常生成链路。
04Human Review 只改变审核状态
生成结果进入 READY_FOR_REVIEW,再由 PENDING、SAVED、CONFIRMED 或 REJECTED 表达人工结论。
+
- 未选择 / 取舍
- 未让确认动作直接写代码或触发部署,减少不可逆自动化风险。
- 失败验证
- REJECTED 只保留审核结果与证据,不执行文件修改、Git commit 或部署。
05Knowledge Base 保持关键词基线
当前仅使用关键词 / 简单相似度作为可解释的辅助检索。
+
- 未选择 / 取舍
- 未声称 Vector DB、Embedding 或复杂 RAG;能力范围较窄但可复现。
- 失败验证
- 未命中知识时仍可进入 Provider 或 local-rule 路径,Trace 必须记录检索结果为空。
06不包装成复杂多 Agent Runtime
Agent Run 是工作流证据聚合模型,不代表多个自治 Agent 之间的协商与规划。
+
- 未选择 / 取舍
- 放弃夸张命名,换取与当前代码、测试和页面一致的可验证表述。
- 失败验证
- 前端 view-model 测试只验证 Run Evidence 展示,不证明自治 Agent 行为。
/ FEATURED FAILURE CASE
成功结果只说明正常路径;失败结果用于检查设计是否真的守住边界。
PRIMARY · PROVIDER FALLBACK
Provider 失败时仍保留可解释 Run
- SETUP
- OpenAI-compatible Provider 被显式选择,但调用失败且配置允许降级。
- EXPECTED
- 记录 Provider 选择、失败原因与 fallback reason,再进入可审核结果。
- OBSERVED
- 路由转入 local-rule,Generation Trace 与 Agent Run 仍关联,结果进入 READY_FOR_REVIEW。
- LESSON
- 降级不是隐藏失败,而是把失败原因作为 Run 证据的一部分。
BOUNDARY默认 local-rule 不代表真实 LLM;受控 Provider 验证不代表生产稳定性或广泛兼容。
其他失败回放
REVIEW REJECTED人工拒绝不会修改代码+
- EXPECTED
- 保存审核结论与 Trace,不触发代码或部署动作。
- OBSERVED
- 状态进入 REJECTED,证据链保留,仓库文件与 Git 不被自动修改。
- LESSON / BOUNDARY
- Human Review 是状态门禁,不是隐式执行器。 项目没有自动提交 Git 或生产部署能力。
/ VERIFIED EVIDENCE
Run 证据、测试与当前提交边界。
01 / ciCI VERIFIEDdevflow-copilot main @ c9cefd4
2026-07-31 · CI 证明该提交的 frontend 与 backend job 通过,不代表已生产部署。GitHub Actions #30552289460 ↗02 / documentation12-STEP RUN REPLAYPrompt Version → Provider → Trace → Tool → Review
2026-07-31 · 工作流证据链,不代表复杂多 Agent Runtime。Architecture ↗03 / ciFRONTEND TEST + BUILD PASSdevflow-copilot @ c9cefd4
2026-07-31 · 不代表已部署或已完成全部浏览器兼容验收。GitHub Actions frontend job ↗04 / ciBACKEND MAVEN VERIFY PASSdevflow-copilot @ c9cefd4
2026-07-31 · 不代表容器运行或生产可用。GitHub Actions backend job ↗ / SOURCE INDEX
每个入口都固定到对应仓库与证据提交;链接说明打开的具体内容。
/ HONEST BOUNDARIES
不把 Demo,
包装成生产系统。
- 默认使用本地 Demo 数据和 local-rule fallback,不把它写成真实 LLM 推理。
- Knowledge Base 是关键词 / 简单相似度,不声称 Vector DB。
- Agent Run 是证据聚合工作流,不声称复杂多 Agent Runtime。
- metrics_snapshot 固定在旧提交 3b54c08 且采集时工作树非干净,旧数量不绑定当前 c9cefd4。
- Human Review 不自动修改代码、提交 Git 或部署生产环境。
NEXT CASE / 01CommerceFlow AI Mall↗