LLM输出幻觉风险自查清单
对外发布LLM生成内容前,按“来源可核实/事实核查/内部一致性/范围与不确定性/人工复核/输出格式”六大类逐项勾选检查项,自动计算完成率并判定“低/中/高”三级幻觉风险等级,关键项未完成直接判高风险。
免费在线工具
Loading…
使用说明
- 页面按类别展示所有检查项,标红「关键项」标签的是高权重项目。
- 逐项勾选你已经确认完成的检查内容(如“关键数字是否人工复核过”“是否有人工复核环节”等)。
- 点击「计算风险评分」,查看已勾选数量、整体完成率、以及最终判定的风险等级。
- 如果有关键项未勾选,下方会用红色列出具体缺失的关键项内容,需要补全后才能降低风险等级。
- 点击「加载示例(全部勾选)」可以看到全部通过时的低风险状态;点击「清空」可重新开始自查。
功能介绍
- 内置12项检查清单,分为来源可核实、事实核查、内部一致性、范围与不确定性、人工复核、输出格式六大类。
- 其中7项标记为「关键项」,权重更高:只要有任意一项关键项未勾选,风险等级直接判定为“高”,即使其他项目全部完成。
- 关键项全部完成但整体勾选率低于80%时判定为“中”风险;全部完成且勾选率≥80%时判定为“低”风险。
- 自动列出未完成的关键项具体内容,方便针对性补全,而不是笼统的一个分数。
使用场景
对外报告发布前自查
团队用LLM辅助撰写的市场分析报告、客户邮件等对外内容,发布前用这份清单过一遍,避免关键数字或引用出错。
AI客服话术审核
审核AI客服系统生成的标准回复话术模板时,用清单确认是否所有事实性内容都经过核实,降低误导用户的风险。
内容团队工作流规范化
把这份清单作为内容团队使用AI辅助写作的标准流程一环,统一发布前的自查标准,而不是依赖个人经验判断。
AI合规审计留痕
结合清单中的“审核人/审核时间记录”项,为AI生成内容的合规审核流程留下可追溯的自查记录。
常见问题
为什么关键项和普通项的权重不一样?
关键项(如“关键数字是否人工复核”“是否有人工复核环节”)对应的是幻觉一旦发生、后果最严重的风险点,即使其他项目都做到了,只要有一个关键项缺失,整体风险仍然判定为高。
勾选状态会被保存吗?
不会。这是纯前端的自查工具,勾选状态只存在于当前页面会话中,刷新页面会重置为未勾选状态,不涉及任何数据上传或存储。
这个工具能自动检测我的内容有没有幻觉吗?
不能。这是一份人工自查清单,帮你系统性地过一遍常见的幻觉风险点,具体的事实核查、来源验证仍需要人工完成,工具本身不分析你的实际内容。
风险等级“中”和“高”具体有什么区别?
“高”表示至少有一项关键风险点(如未做人工复核、关键数字未核实)尚未完成,属于不建议直接对外发布的状态;“中”表示所有关键项都已完成,但整体检查覆盖率还不够全面,建议尽量补全其余项目。