Lenz
Lenz는 적대적 다중 모델 검증 파이프라인을 통해 AI 제품의 환각 현상을 줄이도록 설계된 감사 등급의 팩트 체크 플랫폼입니다.
Lenz는 적대적 다중 모델 검증 파이프라인을 통해 AI 제품의 환각 현상을 줄이도록 설계된 감사 등급의 팩트 체크 플랫폼입니다.
제품의 기능과 공식 포지셔닝
Lenz는 AI 제품 팀과 개인이 생성된 콘텐츠의 정확성을 검증할 수 있는 도구 모음을 제공합니다. 여러 모델과 독립적인 검토자가 참여하는 적대적 파이프라인을 활용하여 AI 출력물을 검증 가능한 출처에 근거하게 합니다.
이 플랫폼은 개별 문장을 확인하기 위한 직접 인터페이스와 개발자가 자신의 워크플로우에 팩트 체크 기능을 통합할 수 있는 API를 모두 제공합니다. 인시던트 분류 및 출시 전 검증을 포함한 다양한 사용 사례를 지원합니다.
공식 출처로 확인된 활용 사례
팀은 인시던트 대응 중에 플랫폼을 사용하여 클레임을 검증하고 정확성을 보장합니다.
개발자는 소프트웨어 출시 전 자동화된 런타임 검증을 수행하기 위해 지속적 통합 파이프라인에 API를 통합합니다.
공식 문서에 안내된 사용 절차
시스템은 /extract 프리미티브를 사용하여 제공된 텍스트에서 검증 가능한 클레임을 추출합니다.
플랫폼은 추출된 클레임의 유효성을 평가하기 위해 여러 모델과 검토자가 참여하는 적대적 파이프라인을 실행합니다.
사용자는 /ask 프리미티브를 사용하여 검증 결과를 바탕으로 근거 있는 후속 질문을 수행합니다.
Lenz 플랫폼의 핵심은 다단계 검증 프로세스입니다. 단일 모델에 의존하는 대신, 5단계에 걸쳐 8개의 서로 다른 모델을 사용하여 클레임의 진실성을 평가합니다.
고품질 결과를 보장하기 위해 이 프로세스는 반대 측 토론을 포함하며 3명의 독립적인 검토자를 활용합니다. 이 방법론은 사용자가 판정 뒤의 추론을 추적할 수 있도록 전체 인용 경로를 생성하도록 설계되었습니다.
본인의 자료와 작업 흐름으로 직접 확인할 항목
확인한 출처와 확인 시점
출처를 확인한 제품 정보를 바탕으로 한 답변
Lenz는 AI 제품에 대한 감사 등급의 팩트 체크를 제공하여 출력을 실제 출처에 근거하게 함으로써 환각 현상을 탐지하고 줄이도록 설계되었습니다.
예, 플랫폼을 통해 사용자는 단일 문장, 링크 또는 질문을 인터페이스에 붙여넣어 출처가 명시된 판정과 추론 결과를 받을 수 있습니다.
Lenz는 Claude, Cursor, n8n 및 Zapier 내에서 실행되도록 문서화되어 있으며, OpenAPI 3.1을 사용하는 맞춤형 통합을 위한 API를 제공합니다.
이 프로세스는 5단계에 걸쳐 8개의 모델이 참여하는 적대적 파이프라인을 사용하며, 인용구를 생성하기 위해 반대 측 토론과 3명의 독립적인 검토자를 포함합니다.
API에는 클레임 추출을 위한 /extract, 다중 모델 판정을 위한 /assess, 전체 적대적 파이프라인을 위한 /verify, 근거 기반 후속 Q&A를 위한 /ask의 네 가지 프리미티브가 포함됩니다.