VOL. 06 / 编辑型法律 AI 情报本周信号已校对 · 06
← 返回首页
ARTICLE DOSSIERREF / 60D2DF9F
学术🌐 国际重要2026/06/18

类型化幻觉审计与校准多智能体辩论的法律AI框架

SOURCE / arXiv cs.CL · LegalHalluLens: Typed Hallucination Auditing and Calibrated Multi-Agent Debate for Trustworthy Legal AI

原文

LegalHalluLens: Typed Hallucination Auditing and Calibrated Multi-Agent Debate for Trustworthy Legal AI

完整原文

当前来源未提供可展示的完整正文,请打开原文链接查看。

归纳

arXiv:2606.18021 提出 LegalHalluLens 审计框架,包含类型化幻觉档案(基于CUAD数据集覆盖数值、时间、义务/权利、事实四类)、风险方向指数(RDI,将遗漏与虚构偏差转化为单一标量)和类型化辩论管道。在510份合同、249252条条款级别实例中,发现聚合指标掩盖了同一模型在义务/数值与时间类之间的约38-40个百分点差异,且两个52%错误率的系统可能呈现相反的RDI。辩论管道将虚假检测减少45%,各类别改进与诊断结果一致,以40亿参数模型匹配商业API性能。该框架支持方向感知的采购、问责和智能体设计。

点评

类型化审计揭示合同AI法律推理中义务/权利与数值类的差异化错误风险,可能误导采购决策与责任分配。

AI 生成 · 人工审核

法律视角点评

AI 生成 · 人工审核

核心关切

类型化审计揭示合同AI法律推理中义务/权利与数值类的差异化错误风险,可能误导采购决策与责任分配。

实务启示

中国法律人评估AI合同审查工具时,应要求供应商提供按义务、数值等类型细分的错误率与方向性指标,而非仅依赖整体准确率。

查看原文
类型化幻觉审计与校准多智能体辩论的法律AI框架