外观
能力清单
蓝精灵当前承担两类判定任务:隐患照片定性、视频行为复核。两类都由智悟调用,输入什么、输出哪些字段、边界在哪,这一页说清。
隐患照片定性
输入一张现场照片,外加企业当前生效的检查项字典(类型编号、名称、备注、上级类型)。模型按字典给结论,字典里没有的类型不会出现在结果里。
输出字段:
| 字段 | 含义 |
|---|---|
scene | 画面场景的一句话描述 |
verdict | 有没有隐患 |
typeId | 隐患类型,取自企业检查项字典 |
level | 风险等级建议 |
description | 隐患描述,口径与现场安全员的写法一致 |
suggestions | 整改建议 |
几条边界:
- 类型对齐企业字典。 字典是一棵树,有父类有叶子。模型优先给叶子类型,拿不准时落到父类,不会硬凑一个叶子。
- 等级只是建议。 一般与较大两级由模型区分,重大及以上等级不由模型单独判定,由规则与人工把关。最终等级永远是安全员确认的那一个。
- 描述短而准。 输出向现场标注口径看齐,安全员少改字。
- 结果固定为 JSON。 每次都可解析,调用方不需要处理自由文本。
后处理不在模型里。类型编号校验、等级强制规则、父子类型对调这些属于随手拍的业务规则,仍由随手拍 AI 服务执行。
视频行为复核
边缘 AI 节点对打架、倒地、攀爬这类复杂行为不做独立承诺,只组装证据:连续画面拼成的时序蒙太奇、逐帧时间线与人体姿态点,以行为候选事件上行虹元。智悟收到候选后交蓝精灵看一次连续画面。
输出字段:
| 字段 | 含义 |
|---|---|
abnormal | 有没有异常 |
action | 行为类别:打架、倒地、攀爬,或无异常 |
confidence | 置信度 |
reason | 判定理由,写清在哪几格看到了什么 |
智悟按置信度分三档处理:
| 置信 | 处理 |
|---|---|
| 无异常,或置信低于阈值 | 直接写误报裁定,回流节点,不建任务 |
| 置信达标 | 事件换成真实行为科目,套响应规则,建任务并通知 |
| 置信很高 | 同上,另标高置信,值守台优先看 |
阈值由智悟配置,默认值见照片判定与行为复核。判定失败会重试,仍失败退回人工复核任务,候选不会悄悄消失。
按企业口径判
判定用的提示词不写死在代码里。它作为口径对象登记在虹元,带版本号与指纹,正文里用占位符引用企业的类目表。每条判定返回 promptVersion,格式是"版本号加指纹",事后能对上当时用的是哪一版。没有登记口径的租户退回内置版本,不借用别的租户的。
换客户、换字典、换判定标准,改的是虹元里的口径与知识,模型不必重训、不必重新交付。
结构化输出与可追溯
每次判定除业务字段外还带一组追溯字段:
| 字段 | 含义 |
|---|---|
promptKey / promptVersion | 用的哪条口径、哪一版 |
model / modelKey / modelVersion | 用的哪个模型、哪一版 |
artifactSha256 | 模型制品指纹,与虹元模型台账一致 |
traceId | 追踪编号,贯穿智悟、虹元与业务平台 |
modelMs / fetchMs | 模型耗时与取图耗时 |
这些字段随裁定一起写回虹元。验收问"这条是谁判的、按哪版判的",答案在数据里,不在日志里。
与智悟的分工
| 事 | 谁做 |
|---|---|
| 从虹元取口径、字典、知识版本 | 智悟 |
| 看图、给结论与理由 | 蓝精灵 |
| 判定结果套响应规则、通知、派单 | 智悟 |
| 结果与追溯字段写回虹元 | 智悟 |
| 人工改判回流知识库 | 智悟与虹元 |
蓝精灵不直接面对终端用户,不存事实,不发通知。
规划中
以下能力在路线上,当前版本不承诺:
- 夜间异常光源、车辆事件、个人防护装备的照片判定科目
- 处置建议直接以 JSON 给出建议动作与责任归属,由智悟按授权推进
- 面向智悟智能体的工具调用能力