문서를 선택하세요
이미지나 PDF 하나를 업로드합니다.
ATPIA DOCUMENT LAB RESEARCH BETA
복잡한 문서를 구조화된 데이터로 변환합니다
PaddleOCR-VL 1.6을 이용해 이미지와 PDF의 본문·표·수식·레이아웃을 분석하고 Markdown과 JSON으로 변환합니다.
본 서비스는 성능 검증을 위한 연구용 베타입니다. 인식 결과에는 누락·오인식·환각이 포함될 수 있으므로 법률·행정·의료·재무 문서에 그대로 사용하지 마십시오.
01 / DOCUMENT INPUT
추가 전처리 모델은 현재 서버에 설치되지 않아 선택할 수 없습니다. Markdown·JSON·일반 텍스트를 모두 제공합니다.
업로드한 문서는 인식 처리 목적으로만 사용하며 학습 데이터로 사용하지 않습니다. 원본과 결과는 최대 24시간 후 자동 삭제됩니다. 민감한 개인정보가 포함된 문서는 업로드하지 마십시오.
같은 브라우저에서 최대 24시간 동안 조회할 수 있습니다.
EXPLORE / LOCAL SAMPLES
모든 예제는 검증용 합성 문서입니다. 고문서풍 예제는 실제 사료가 아니며 역사적 판독 정확도를 보증하지 않습니다.
HOW IT WORKS
이미지나 PDF 하나를 업로드합니다.
단일 GPU가 영역을 구분하고 VLM으로 인식합니다.
원본과 결과를 비교하고 필요한 형식으로 저장합니다.
CAPABILITIES
USE CASES
FILE GUIDE
PDF, PNG, JPG, JPEG, BMP, TIFF
이미지 최대 10MB · PDF 최대 25MB / 20페이지. 암호화·손상된 PDF와 여러 프레임의 TIFF는 지원하지 않습니다.
OPEN SOURCE / INDEPENDENT SERVICE
본 서비스는 ATPIA가 PaddleOCR 오픈소스를 이용해 구축한 독립적인 연구용 서비스이며 Baidu 또는 PaddlePaddle의 공식 온라인 서비스가 아닙니다.
업로드한 문서는 문서 인식 처리 목적으로만 사용되며 학습 데이터로 사용되지 않습니다. 원본과 결과는 최대 24시간 후 자동 삭제됩니다. 주민등록번호, 금융정보, 의료정보 등 민감한 개인정보가 포함된 문서는 업로드하지 마십시오.
실패 작업의 임시파일은 즉시 또는 1시간 이내 삭제합니다. 결과 화면에서 직접 삭제할 수 있으며, 삭제된 작업은 복구할 수 없습니다. 간헐적인 embedding 지연으로 시간 초과가 발생할 수 있습니다.