demo-runbook.md 6.4 KB

挑战杯黄金 Demo 演示手册

一句话主线

为了完成一汽 DCP 26→6 工程收敛,dcp_user.mobile 能不能迁移并删除?

不要把演示讲成“平台有六个菜单”。全程只回答这一个问题:系统如何从代码、契约和运行事实出发,经多智能体与本体推理,形成可追溯、可审批的工程决策。

演示前 15 分钟

  1. 在项目目录启动服务:
   .\.venv\Scripts\ontorefactor-governance.exe --host 127.0.0.1 --port 8010
  1. 从上传开始演示时,打开:http://127.0.0.1:8010/?demo=1&tab=agent;从总览开始则打开 http://127.0.0.1:8010/?demo=1
  2. 确认项目为“挑战杯 · DCP 手机号迁移治理”。若不存在,点击“一键准备挑战杯 Demo”。
  3. 下载工作台中的三份演示文件,进入“智能体工作台”,点击“测试模型连接”。
  4. 浏览器设为 90% 或 100% 缩放,开启全屏;关闭消息通知和无关窗口。
  5. 保留 data/demo-overview.png 作为断网时的首页备份图。

当前机器已经预热了一次真实 LongCat-2.0 运行。运行记录包含模型、Prompt 版本、输入/输出 Token、耗时与请求/响应哈希,现场可以直接打开审计轨迹。

7 分钟演示脚本

时间 页面与操作 建议讲法 屏幕证据
0:00–0:50 智能体工作台,上传 01-dcp-user.sql “我们不从一张做好的图开始,而是从企业真实会提供的数据库定义开始。平台先识别文件类型、表字段、敏感字段和内容哈希。” 上传预检卡:1 张表、7 个字段、敏感字段、SHA-256
0:50–1:40 选择 LongCat,点击“开始智能治理分析” “LambdAgent 同时执行资产发现、LongCat 业务语义分析和确定性治理控制;等待期间先解释三条职责边界。” 模型在线状态与运行按钮;完成后显示元素、断言、问题数量
1:40–2:25 打开审计轨迹与证据中心 “原始文件不是分析后就丢弃,而是连同哈希、模型、Prompt、Token 和执行步骤一起保存。” SourceArtifact 原文、模型、Token、Prompt v2、哈希
2:25–3:15 上传 OpenAPI 或资产清单,只做预检 “同一个入口还能接收接口契约和现有资产清单,文件类型会自动判断。正式接入时可由 CI/CD 调用同一 API。” API/Schema 或资产数量预览;无需再次运行完整模型
3:15–4:15 返回总览,点击“查看字段级影响半径” “传统搜索只能找到代码引用;本体图能从字段跨到 API、任务、业务对象、Owner、安全策略和质量门禁。” 31 个影响对象、56 条已接受关系、三跳影响列
4:15–5:05 点击步骤 04“候选断言” “模型结论不是事实。模型建议都有置信度并强制为 pending;只有人工接受后才能进入权威图谱。” pending 状态、接受/驳回按钮、最高置信度上限 85%
5:05–6:10 点击步骤 05“治理门禁” “门禁不采用模型的主观判断,而是执行确定性规则:3 个生产消费者未归零、完整率只有 99.87%、两项签字未完成,因此禁止破坏性 DDL。” 4 条核心开放问题与负责人
6:10–7:00 标准交付并回到总览 “业务、软件、治理语义进入 M3–M0 四层模型并可导出 JSON-LD。AI 把证据搜集和影响评审压缩为分钟级,但最终决策仍可复核。” JSON-LD、暂缓删除 与整改路径

开场和收尾原话

开场:

在大型工业软件重构中,最难的不是生成一段新代码,而是回答“改了以后会不会出事故”。今天我们只演示一个问题:为了把 DCP 的 26 个工程收敛为 6 个工程,用户手机号字段能不能迁移并删除?

收尾:

系统没有替企业负责人做决定。它把代码、契约、运行数据和专家责任统一成治理本体,让智能体快速提出候选,让确定性门禁守住生产安全,让每个结论都能回到证据。这才是面向东北工业数字化的可落地智能体。

评委常问问题

为什么有多个智能体?

它们不是多个聊天机器人,也不是多个独立微服务,而是一条进程内 LambdAgent 流水线的专业职责:资产发现、LongCat 语义分析、治理控制和结果合成。拆分职责是为了单独验证、替换和审计。

大模型会不会直接修改生产系统?

不会。模型只能生成白名单关系的 M1 候选,置信度最高 0.85,状态强制为 pending;删除、授权、发布等高风险动作由确定性门禁和人工审批控制。

怎么证明真的调用了大模型?

打开“智能体工作台”的运行轨迹。系统记录 LongCat-2.0、Prompt v2、输入/输出 Token、模型耗时、请求哈希和响应哈希,同时保存 ModelInference 证据。

本体不是概念图吗,为什么有工程价值?

这里的关系是可计算断言,携带证据、置信度、生成者、有效期和审核状态。字段变化可以沿图计算到 API、任务、业务对象、责任人和门禁,而不只是画一张静态图。

断网或模型超时怎么办?

确定性资产发现、影响分析、规则门禁和已落库审计记录全部可离线运行。现场展示使用预热的真实 LongCat 记录;需要证明连通性时只点击“测试模型连接”,不等待完整重跑。

现场不要做

  • 不要从空白项目开始手工录入数据;使用工作台提供的演示文件。
  • 如果现场网络明显不稳定,将语义模式切到“仅确定性规则”完成上传分析,再用右侧预热记录证明 LongCat 的真实调用。
  • 不要点击“重新校验”,它会根据当前候选模型重新生成辅助问题,改变首页基准数字。
  • 不要现场接受或驳回断言,除非已经准备好重新初始化演示数据库。
  • 不要展示或朗读 API Key。

故障兜底

  • 页面项目不对:打开 http://127.0.0.1:8010/?demo=1
  • Demo 数据不存在:点击“一键准备挑战杯 Demo”,该操作幂等。
  • LongCat 不可用:展示已完成的运行轨迹和 ModelInference 证据,并说明确定性门禁不依赖在线模型。
  • 服务未启动:在项目目录执行启动命令后刷新页面。
  • 网络完全不可用:使用 data/demo-overview.png 讲完问题、证据数字、门禁结论和整改路径。