Invofox Self Serve
Invofox Self Serve는 PDF와 이미지를 구조화된 JSON 및 Markdown으로 파싱하는 자동화된 문서 처리 API로, 문서 분류, 표 추출, 무저장 규정 준수 기능을 제공합니다.
Invofox Self Serve는 PDF와 이미지를 구조화된 JSON 및 Markdown으로 파싱하는 자동화된 문서 처리 API로, 문서 분류, 표 추출, 무저장 규정 준수 기능을 제공합니다.
제품의 기능과 공식 포지셔닝
Invofox는 비정형 PDF, 스캔 페이지, 이미지를 정규화된 JSON 데이터 세트 및 다운스트림 LLM과 데이터베이스 애플리케이션용 Markdown으로 변환하도록 설계된 통합 문서 추출 API를 제공합니다.
이 시스템은 문서 기울기 보정, 이중 패스 OCR, 문서 분할, 분류, 표 데이터 대조 검증, 자동 신뢰도 점수 산출을 포함한 전체 데이터 수집 라이프사이클을 처리합니다.
공식 출처로 확인된 활용 사례
공급업체 인보이스에서 공급업체 상세 정보, 사업자 등록 번호, 날짜, 품목별 합계를 구조화된 JSON 페이로드로 추출합니다.
모기지 신청 양식 및 대출 마감 명세서(Closing Disclosures)에서 대출자 정보, 대출 조건, 정산 금액을 파싱합니다.
은행 거래내역서나 급여명세서 등 다양한 파일이 혼합되어 일괄 업로드된 PDF를 분류된 개별 레코드로 자동 분리합니다.
표준 임직원 급여명세서에서 고용주 데이터, 사원 식별 번호, 총 보수 금액을 정확하게 추출합니다.
공식 문서에 안내된 사용 절차
계정을 생성하고 서비스 연동에 필요한 API 키를 발급받습니다.
필요한 표준 문서 모델을 선택하거나 전용 맞춤형 스키마를 구성합니다.
추출 엔드포인트로 POST 요청을 보내 처리할 문서를 전송합니다.
검증 및 스키마 매핑이 완료된 JSON 또는 Markdown 출력을 직접 수신하거나 웹훅을 통해 전달받습니다.
Invofox는 순차적인 기술 파이프라인을 통해 비정형 문서 업로드를 처리합니다. REST API 엔드포인트를 통해 파일이 수신되면, 무결성 검사를 통해 암호로 보호되었거나 손상된 파일을 선별한 후 기울기 보정, 노이즈 제거, 선명화 처리를 위한 전처리 모듈로 라우팅합니다.
텍스트와 구조적 요소는 텍스트를 전사하면서 레이아웃 공간 정보를 분리하는 이중 패스 OCR 시스템을 통해 해석됩니다. 다중 페이지 배치는 자동 페이지 분할기를 통해 분리된 후 분류 모델이 문서 유형을 분류합니다. 추출된 표, 통화, 날짜는 정규화되고 비즈니스 규칙과 교차 검증된 후 신뢰도 점수 및 영역 출처 정보와 함께 웹훅 또는 폴링을 통해 반환됩니다.
본인의 자료와 작업 흐름으로 직접 확인할 항목
확인한 출처와 확인 시점
출처를 확인한 제품 정보를 바탕으로 한 답변
Invofox는 인보이스, 영수증, 납품서, 구매 주문서, 급여명세서, 은행 거래내역서, 공과금 청구서, 신분증, 계약서, 세무 양식, 대출 마감 명세서와 같은 미국 모기지 양식을 기본적으로 지원합니다.
사용자는 피드백 엔드포인트를 통해 수정 사항을 제출할 수 있으며, 시스템은 파이프라인 구성을 업데이트하여 향후 문서에서 동일한 오류가 반복해서 발생하는 것을 줄이도록 지원합니다.
데이터 처리는 기본적으로 유럽 연합(EU) 내에서 수행되며, 요청 시 미국 내 처리 옵션도 제공됩니다. Scale 및 Enterprise 요금제에서는 무저장 모드를 활성화할 수 있으며, 온프레미스 배포는 Enterprise 계약에 한해 지원됩니다.
해당 플랫폼은 데이터 추출을 위해 PDF 파일, 스캔된 문서, PNG 및 JPG를 포함한 다양한 이미지 형식을 입력 형식으로 지원합니다.
플랫폼은 영어, 스페인어, 포르투갈어, 프랑스어, 이탈리아어, 독일어 등 라틴 문자 기반 언어를 기본적으로 지원하며, 비라틴 문자의 경우 별도의 구성 작업 기간이 필요합니다.