AATPIAPaddleOCR-VL
점검 중

ATPIA DOCUMENT LAB RESEARCH BETA

문서의 복잡함을,
데이터의 가능성으로.

복잡한 문서를 구조화된 데이터로 변환합니다

PaddleOCR-VL 1.6을 이용해 이미지와 PDF의 본문·표·수식·레이아웃을 분석하고 Markdown과 JSON으로 변환합니다.

PaddleOCR-VL 1.6PP-DocLayoutV3GPU Accelerated109 Languages
Research Beta

본 서비스는 성능 검증을 위한 연구용 베타입니다. 인식 결과에는 누락·오인식·환각이 포함될 수 있으므로 법률·행정·의료·재무 문서에 그대로 사용하지 마십시오.

01 / DOCUMENT INPUT

문서를 올려 시작하세요

한 번에 한 문서 · GPU 단일 처리
PaddleOCR-VL 1.6 고정
GPU 로컬 처리
고급 옵션 · 페이지 범위와 전처리

추가 전처리 모델은 현재 서버에 설치되지 않아 선택할 수 없습니다. Markdown·JSON·일반 텍스트를 모두 제공합니다.

업로드한 문서는 인식 처리 목적으로만 사용하며 학습 데이터로 사용하지 않습니다. 원본과 결과는 최대 24시간 후 자동 삭제됩니다. 민감한 개인정보가 포함된 문서는 업로드하지 마십시오.

이전 작업 다시 열기

같은 브라우저에서 최대 24시간 동안 조회할 수 있습니다.

EXPLORE / LOCAL SAMPLES

다양한 문서로 살펴보세요

ATPIA 자체 제작 · 외부 전송 없음

모든 예제는 검증용 합성 문서입니다. 고문서풍 예제는 실제 사료가 아니며 역사적 판독 정확도를 보증하지 않습니다.

HOW IT WORKS

업로드에서 구조화까지, 하나의 흐름

01

문서를 선택하세요

이미지나 PDF 하나를 업로드합니다.

02

레이아웃을 분석합니다

단일 GPU가 영역을 구분하고 VLM으로 인식합니다.

03

결과를 검토하세요

원본과 결과를 비교하고 필요한 형식으로 저장합니다.

CAPABILITIES

문서 속 정보를 연결합니다

  • 다국어 문서 인식
  • 복합 레이아웃 분석
  • 표·수식·도장 인식 기술
  • PDF → Markdown 변환
  • JSON 구조화 결과
  • GPU 기반 로컬 처리

USE CASES

연구에서 새로운 활용으로

  • 종이문서 전자화
  • 연구논문 구조화
  • 표·수식 추출
  • 고문서 기초 판독
  • 기업문서 검색 전처리
  • RAG용 문서 변환

FILE GUIDE

지원 형식과 제한

PDF, PNG, JPG, JPEG, BMP, TIFF

이미지 최대 10MB · PDF 최대 25MB / 20페이지. 암호화·손상된 PDF와 여러 프레임의 TIFF는 지원하지 않습니다.

OPEN SOURCE / INDEPENDENT SERVICE

기술을 투명하게, 결과는 신중하게.

본 서비스는 ATPIA가 PaddleOCR 오픈소스를 이용해 구축한 독립적인 연구용 서비스이며 Baidu 또는 PaddlePaddle의 공식 온라인 서비스가 아닙니다.

Pipeline
PaddleOCR-VL 1.6
Layout
PP-DocLayoutV3
VLM
PaddleOCR-VL-1.6-0.9B
Engine
PaddlePaddle 3.3.0
GPU
NVIDIA RTX 3060

개인정보·보관정책

업로드한 문서는 문서 인식 처리 목적으로만 사용되며 학습 데이터로 사용되지 않습니다. 원본과 결과는 최대 24시간 후 자동 삭제됩니다. 주민등록번호, 금융정보, 의료정보 등 민감한 개인정보가 포함된 문서는 업로드하지 마십시오.

실패 작업의 임시파일은 즉시 또는 1시간 이내 삭제합니다. 결과 화면에서 직접 삭제할 수 있으며, 삭제된 작업은 복구할 수 없습니다. 간헐적인 embedding 지연으로 시간 초과가 발생할 수 있습니다.