CASE STUDY03

AI TOOLING / AGENT WORKFLOW

DevFlow Copilot

面向开发工作流的 AI 工具,提供 Provider 路由、Prompt 模板、状态管理、日志诊断和历史记录。

MY ROLE / AI COLLABORATION

我负责 PromptOps 定位、工作流边界、验收口径和公开证据核对;Codex/Claude 辅助实现与整理,所有能力声明以当前提交和可打开证据为准。

STACK

Java 17 · Spring Boot · Vue 3 · TypeScript · Provider Router · Flyway

STATUS

CI VERIFIED

REAL LOCAL RUN / REPOSITORY EVIDENCE02
DevFlow Copilot Agent Run Trace Evidence 页面VIEW ORIGINAL · DevFlow Copilot 真实运行截图
REAL RUN SCREENSHOTDevFlow Copilot

画面来自项目仓库保存的真实本地运行截图,不是概念图或第三方产品截图。

不只保存结果, 还要保存生成过程。

AI Coding Demo 很容易变成聊天套壳。项目需要展示一次生成为什么发生、使用了哪个 Prompt Version、Provider 是否降级、调用了什么工具、生成结果如何进入人工审核。

一次 Run 的十二步可回放证据。

  1. 01选择 Prompt Template + Version
  2. 02校验并渲染变量
  3. 03创建 GENERATING 记录
  4. 04创建 Agent Run + Prompt Render Step
  5. 05可选关键词 Knowledge 检索
  6. 06Provider Router 选择执行路径
  7. 07失败时记录 fallback reason
  8. 08写入 Generation Trace
  9. 09记录 Tool Call
  10. 10结果进入 READY_FOR_REVIEW
  11. 11Review: PENDING / SAVED / CONFIRMED / REJECTED
  12. 12不改代码、不提交 Git、不部署

让 Prompt、Provider、Tool 与 Review 同源。

01

默认 local-rule,真实 Provider 可选

无 API Key 也能稳定回放工作流;OpenAI-compatible Provider 只在显式配置时启用。

未选择 / 取舍
未为了展示而伪造真实模型调用;默认结果不能被描述为 LLM 推理质量。
失败验证
Provider 路由测试验证不可用、超时与允许降级时记录 fallback reason。
02

一次 Run 聚合全部证据

AgentStep 关联 Prompt、Provider、Generation、Tool Call 与 Human Review。

未选择 / 取舍
未把证据散落成互不关联的日志页面;代价是需要稳定的 Run 标识与实体关系。
失败验证
AgenticWorkflowIntegrationTest 回放步骤关联与最终审核状态。
03

Prompt Version 必须持久化

Run 记录具体 Template 与 Version,而不是只保留最终渲染文本。

未选择 / 取舍
多保存版本与渲染上下文会增加数据结构,但可以解释同一输入为何产生不同结果。
失败验证
变量缺失或模板不匹配时,渲染测试阻止进入正常生成链路。
04

Human Review 只改变审核状态

生成结果进入 READY_FOR_REVIEW,再由 PENDING、SAVED、CONFIRMED 或 REJECTED 表达人工结论。

未选择 / 取舍
未让确认动作直接写代码或触发部署,减少不可逆自动化风险。
失败验证
REJECTED 只保留审核结果与证据,不执行文件修改、Git commit 或部署。
05

Knowledge Base 保持关键词基线

当前仅使用关键词 / 简单相似度作为可解释的辅助检索。

未选择 / 取舍
未声称 Vector DB、Embedding 或复杂 RAG;能力范围较窄但可复现。
失败验证
未命中知识时仍可进入 Provider 或 local-rule 路径,Trace 必须记录检索结果为空。
06

不包装成复杂多 Agent Runtime

Agent Run 是工作流证据聚合模型,不代表多个自治 Agent 之间的协商与规划。

未选择 / 取舍
放弃夸张命名,换取与当前代码、测试和页面一致的可验证表述。
失败验证
前端 view-model 测试只验证 Run Evidence 展示,不证明自治 Agent 行为。

成功结果只说明正常路径;失败结果用于检查设计是否真的守住边界。

其他失败回放

  • REVIEW REJECTED人工拒绝不会修改代码
    EXPECTED
    保存审核结论与 Trace,不触发代码或部署动作。
    OBSERVED
    状态进入 REJECTED,证据链保留,仓库文件与 Git 不被自动修改。
    LESSON / BOUNDARY
    Human Review 是状态门禁,不是隐式执行器。 项目没有自动提交 Git 或生产部署能力。

Run 证据、测试与当前提交边界。

01 / ciCI VERIFIED

devflow-copilot main @ c9cefd4

2026-07-31 · CI 证明该提交的 frontend 与 backend job 通过,不代表已生产部署。GitHub Actions #30552289460
02 / documentation12-STEP RUN REPLAY

Prompt Version → Provider → Trace → Tool → Review

2026-07-31 · 工作流证据链,不代表复杂多 Agent Runtime。Architecture
03 / ciFRONTEND TEST + BUILD PASS

devflow-copilot @ c9cefd4

2026-07-31 · 不代表已部署或已完成全部浏览器兼容验收。GitHub Actions frontend job
SECONDARY VIEW / TRACEABLE UI05B
DevFlow Copilot AI Coding Workbench 真实运行页面VIEW ORIGINAL · DevFlow Copilot 真实运行截图
REAL RUN SCREENSHOTDevFlow Copilot

不把 Demo, 包装成生产系统。

  • 默认使用本地 Demo 数据和 local-rule fallback,不把它写成真实 LLM 推理。
  • Knowledge Base 是关键词 / 简单相似度,不声称 Vector DB。
  • Agent Run 是证据聚合工作流,不声称复杂多 Agent Runtime。
  • metrics_snapshot 固定在旧提交 3b54c08 且采集时工作树非干净,旧数量不绑定当前 c9cefd4。
  • Human Review 不自动修改代码、提交 Git 或部署生产环境。
NEXT CASE / 01CommerceFlow AI Mall