推理: 本地 Mock
演示版 · 合成数据
演示
观测
配置

四场景 Demo

对应 JD 四大场景 · 选择智能体 → 输入 → 查看状态机结果与全链路 Trace
导购示例「我想买北欧风格预算800的小户型客厅沙发自用」· 运营示例 task=reviews, sku=SF-CHR-01

验收看板

P0 用药禁忌场景 · 数据来自南京 V100 半联调实测(真实数据,非编造)
延迟告警:当前 V100 + Qwen3.8-27B 的热请求 ~80s、冷启动 ~329s,与甲方 P0 阈值(≤800ms / ≤5s)差约 2 个数量级。跨区网络延迟仅 29ms,非瓶颈。这是硬件(V100 无 Tensor Core)× 模型规模(27B)的物理边界。
热请求 P95(实测)
80.4s
阈值 ≤ 800ms
冷启动(实测)
328.7s
阈值 ≤ 5s
跨区网络延迟
29ms
非瓶颈 ✓

P0 场景关键词命中率

延迟对比(对数刻度)

实测 阈值

P0 用例明细

调用链 Trace

最近处置记录(可观测)

智能体清单

已注册的四大智能体

推理端点

控制台对接 LLM 推理的配置(默认走本地 Mock,可切南京 V100)
⚠️ 远端端点需安全组放行 / nginx 反代后可达。当前默认本地 Mock。