Lenz
Lenz 是一款审计级事实核查平台,旨在通过对抗性多模型验证流水线减少 AI 产品中的幻觉,为 AI 生成内容提供可靠的验证保障。
Lenz 是一款审计级事实核查平台,旨在通过对抗性多模型验证流水线减少 AI 产品中的幻觉,为 AI 生成内容提供可靠的验证保障。
产品用途与官方定位
Lenz 为 AI 产品团队和个人提供了一套工具,用于验证生成内容的准确性。通过采用包含多个模型和独立审核员的对抗性流水线,该平台旨在将 AI 输出锚定在可验证的来源中。
该平台既提供用于检查单个陈述的直接界面,也为开发人员提供 API,以便将事实核查功能集成到他们自己的工作流中。它支持多种用例,包括事件分类和发布前验证。
有官方来源支持的使用场景
团队在事件响应期间使用该平台验证主张,以确保信息的准确性。
开发人员将 API 集成到持续集成流水线中,在软件发布前执行自动化的运行时验证。
官网提供的使用流程
系统使用 /extract 原语从提供的文本中提取可验证的主张。
平台运行涉及多个模型和审核员的对抗性流水线,以评估所提取主张的有效性。
用户使用 /ask 原语,根据验证结果进行植根于事实的后续提问。
Lenz 平台的核心是其 multi-stage 验证流程。它不依赖于单一模型,而是在五个不同的阶段使用八个不同的模型来评估主张的真实性。
为了确保高质量的结果,该流程引入了对立面辩论并利用了三名独立审核员。这种方法旨在产生完整的引用轨迹,允许用户追踪判定背后的推理逻辑。
用自己的素材和工作流完成验证
核对了哪些信息以及核对时间
基于已核对产品资料的回答
Lenz 旨在为 AI 产品提供审计级的事实核查,通过将输出锚定在真实来源中,帮助检测并减少 AI 幻觉,提高内容的可靠性。
是的,该平台允许用户通过将单个陈述、链接或问题粘贴到界面中来验证它们,从而获得有据可查的判定结果和详细的推理过程。
根据文档,Lenz 可以在 Claude、Cursor、n8n 和 Zapier 中运行,并且它提供了一个 API,用于使用 OpenAPI 3.1 标准进行自定义集成。
该流程使用一个涉及五个阶段、八个模型的对抗性流水线,并结合了对立面辩论和三名独立审核员的审核,以生成详细的引用和判定。
该 API 包含四个原语:/extract 用于提取主张,/assess 用于多模型判定,/verify 用于完整的对抗性流水线,以及 /ask 用于基于事实的后续问答。