llm-integration.md 2.3 KB

LongCat-2.0 接入与安全边界

调用协议

  • Provider:LongCat
  • Model:LongCat-2.0
  • OpenAI 兼容入口:https://api.longcat.chat/openai/v1/chat/completions
  • 认证:Authorization: Bearer <LONGCAT_API_KEY>
  • 默认温度:0.1
  • 默认关闭思考模式:LONGCAT_THINKING=disabled。治理语义抽取使用严格结构化协议,关闭思考可降低延迟和超时风险;需要复杂推理时可显式设为 enabled
  • 默认最大输出:4096 tokens
  • 请求使用 response_format=json_object;若仍出现语法或字段协议错误,智能体会进行一次受控格式修复
  • 超时:120
  • 对 HTTP 429、5xx 和临时网络错误执行指数退避重试

LONGCAT_API_KEY 只从服务端环境读取。状态 API 只返回 configured: true/false,不返回密钥内容、长度、前缀或哈希。

智能体边界

LongCat 分支接收确定性解析后的 M1 资产目录,不接收原始 DDL、数据库口令或请求头。允许模型建议:

  • 数据表/API/Schema 对应的业务对象;
  • Owner 角色;
  • publicinternalconfidentialrestricted 分类;
  • 完整性、唯一性、有效性、一致性、及时性质量规则;
  • 不涉及自动执行的治理问题。

模型不得:

  • 引用资产白名单之外的对象;
  • 创建 M0 运行事实;
  • 返回白名单之外的关系;
  • 把置信度提高到 0.85 以上;
  • 直接接受断言、关闭问题、执行 SQL 或修改生产系统。

输出闭环

模型输出经过以下步骤:

  1. 提取 JSON,拒绝自然语言或不可解析结果;
  2. 使用 Pydantic 严格校验字段和数量;
  3. 验证所有资产引用;
  4. 将关系限制为 REPRESENTSOWNED_BYCLASSIFIED_ASVALIDATES
  5. 强制所有断言为 inferred + pending
  6. 建立 ModelInference 证据;
  7. 保存模型、Prompt 版本、Token、耗时和请求/响应哈希;
  8. 由用户在“语义断言”页面接受或驳回。

运行模式

请求模式 行为
auto 有密钥使用 LongCat,无密钥使用规则语义
llm 必须使用 LongCat;缺少密钥或调用失败时返回错误
deterministic 永远不调用模型

部署变量 ONTOREFACTOR_LLM_MODE 可以设置为 autorequireddisabled,从服务端统一约束所有请求。