AI 뉴스로 돌아가기

문서의 경계를 읽는다…ATPIA, 범용 문서인식 새 브랜드 ‘ALLREAD’ 공개

allread.atpia.com 공개 베타 홈페이지 오픈… 이미지·스캔 PDF GPU E2E 검증을 넘어 고문서·표·다단 문서까지 단계적 확장

관리자2026.09.1695
문서의 경계를 읽는다…ATPIA, 범용 문서인식 새 브랜드 ‘ALLREAD’ 공개

ATPIA ALLREAD

“문서 형식과 시대의 경계를 넘어, 사람이 읽는 문서를 AI가 이해 가능한 데이터로 바꾼다.”

현재 ALLREAD는 공개 소개·인증·이용 안내가 가능한 베타 홈페이지를 열었으며, 실제 문서 분석 접수는 운영·실문서 Gate를 마친 뒤 단계적으로 개방할 예정이다.

AI 벤처기업 ATPIA가 자체 범용 문서인식(Universal Document Recognition) 프로젝트의 새 서비스 브랜드 ‘ATPIA ALLREAD’를 공개하고, 전용 홈페이지 allread.atpia.com을 열었다. 이번 공개는 단순한 OCR 데모를 넘어, 문서 업로드부터 GPU 기반 인식, 검토, 결과 내보내기, 삭제와 운영 복구까지 이어지는 실제 서비스 흐름을 단계적으로 검증해 온 개발 성과를 하나의 브랜드 아래 묶었다는 데 의미가 있다.

ATPIA는 ALLREAD를 “무엇이든 읽는다”는 이름 그대로, 인쇄문서와 스캔 문서, 복합 레이아웃, 표·다단 문서, 장기적으로는 한문 고문서와 같은 난도가 높은 자료까지 포괄하는 범용 문서인식 플랫폼으로 발전시킨다는 구상이다. 다만 현재 공개 버전은 기술 검증 단계의 베타로, 지원 범위와 운영 Gate를 구분해 단계적으로 확대한다.


1. ‘Universal Document Recognition’을 ‘ATPIA ALLREAD’로

ALLREAD는 ATPIA가 개발해 온 Universal Document Recognition의 서비스 브랜드다. 기존 OCR이 문자 영역을 찾아 글자를 텍스트로 바꾸는 기능에 집중했다면, ATPIA가 지향하는 범용 문서인식은 문서의 구조와 처리 흐름까지 함께 다루는 방향으로 확장된다. “문서를 읽는 모델”에서 “문서를 안전하게 처리하고 결과를 검토·활용할 수 있는 서비스”로 옮겨가는 것이 이번 개발의 핵심이다.

새 도메인으로의 브랜드 전환도 운영 수준에서 검증됐다. 기존 allocr 주소의 GET/HEAD 요청은 경로와 query를 보존해 ALLREAD 도메인으로 301 이동하도록 구성했고, credential 전달 위험이 있는 변경 요청은 차단했다. 공개 페이지는 HTTPS, 반응형 화면, 인증, 이용·보관 안내, robots·sitemap 등 기본 서비스 요건을 갖췄다.


현재 공개 상태 한눈에 보기

항목

현재 상태

의미

공개 홈페이지

PASS

https://allread.atpia.com HTTPS 공개

베타 입장 인증

PASS

DEMO 인증·세션·소유권 경계 검증

실제 분석 접수

CLOSED

운영·실문서 Gate 완료 전까지 서버에서 접수 차단

정량 품질

NOT MEASURED

잠금 실문서 Gold 확보 후 CER/WER 등 평가 예정

Production

NOT READY

현재는 연구·검증 중심의 제한형 베타 단계


2. 데모를 넘어 운영형 문서인식으로 — Phase 27 R3.8의 의미

최근 Phase 27 R3.8에서는 공유 GPU 엔진 보호정책을 실제 운영 프로세스에 반영하고, 서비스 중 발견된 idle watchdog 오판정과 CUDA 모듈 로딩 정체를 추적·수정했다. 특히 정상 입력이 VLM_RECOGNITION 구간에서 장시간 정체되는 현상을 native stack 수준에서 진단한 뒤, CUDA_MODULE_LOADING=EAGER 설정을 적용해 엔진을 통제 복구하고 동일 입력을 다시 시험했다.

그 결과 최종 EAGER 복구 후 동일한 합성 이미지 1페이지와 스캔 PDF 2페이지가 정상 완료됐다. 전체 R3.8 실행에서는 서로 다른 실제 요청 5건 가운데 4건(6페이지)이 완료되고 1건(1페이지)은 timeout으로 남겨졌다. ATPIA는 이 실패 이력을 숨기지 않고 보존함으로써, 단순 성공 화면이 아니라 장애 원인·복구·재검증까지 포함하는 운영형 개발 프로세스를 구축하고 있다.


4/5

실제 요청 완료

6p

정상 처리 페이지

2건

최종 EAGER GPU E2E

REVIEW

자동확정 비활성


※ 위 수치는 R3.8 실행량 회계로, 고유 Gold 페이지 수나 정량 인식률을 뜻하지 않는다. 실문서 CER/WER·구조 정확도는 아직 정식 측정 전이다.

3. ALLREAD가 지향하는 차별점 — 모델보다 ‘전체 흐름’을 본다

● 범용 처리 아키텍처 인증된 업로드 → 비동기 job/Worker → VLProcessor → GPU engine → raw/normalized → 사람 검토(REVIEW_REQUIRED) → JSON export → 삭제의 흐름을 하나의 서비스 수명주기로 관리한다.

● 운영 안전성 공개 runtime과 평가 runtime·DB·storage를 분리하고, 공유 엔진의 writer·generation·drain 상태를 관리한다. 장애가 나면 무조건 재시작하는 방식보다 상태 보존과 안전 복구를 우선한다.

● 데이터 삭제와 추적성 시험 문서에 대해 deletion receipt, 입력·결과 파일 부재, cleanup 완료를 확인했으며 provenance에 모델·버전·GPU·source hash 등 실행 맥락을 남긴다.

● 사람 검토 중심 정책 AUTO_ACCEPT를 비활성화하고 Historical 영역은 EXPERIMENTAL + REVIEW_REQUIRED로 유지한다. 아직 정량 근거가 충분하지 않은 영역을 자동확정 서비스로 포장하지 않는다.

● 확장 가능한 문서 유형 현재 공개 후보 상한은 PNG/PDF 중심이지만, 향후 일반 인쇄물·열화 스캔·업무 혼합 문서·표·다단·회전/혼합 입력과 고문서까지 검증 범위를 넓혀갈 계획이다.

4. 공개 베타 홈페이지: 열었지만, 분석 접수는 서두르지 않는다

ALLREAD 공개 홈페이지는 이미 HTTPS로 서비스되고 있으며, 브랜드 로고·대표 이미지·슬로건, 지원 상태표, 신청 안내, 로그인과 이용·보관 정책을 제공한다. 후속 브랜딩 검증에서는 보안 단위시험 23건과 실제 HTTPS 26개 체크가 통과했고, 데스크톱·모바일 화면 및 로그인·접수 차단도 확인됐다.

다만 “홈페이지가 공개됐다”는 사실과 “누구나 문서를 업로드해 분석할 수 있다”는 것은 다르다. 현재 G-PUBLIC와 G-AUTH는 PASS지만 G-FLOW·G-STABILITY는 PARTIAL, G-OPS는 BLOCKED 상태다. 따라서 공개 페이지는 베타 준비 중으로 안내하고 실제 업로드는 서버에서 거부한다. ATPIA는 이 경계를 명확히 공개함으로써 기술 홍보보다 검증 가능한 서비스 신뢰를 우선한다.

5. ATPIA 홈페이지 전반에서 ALLREAD를 핵심 포트폴리오로

ATPIA는 ALLREAD 공개를 계기로 회사 홈페이지의 Company, Technology, Products, R&D, IR 영역에서 범용 문서인식 개발 성과를 하나의 스토리로 연결할 계획이다. ALLREAD는 단독 OCR 제품이 아니라 ATPIA의 문서 AI·로컬 AI·업무 자동화 전략을 보여주는 대표 포트폴리오로 배치된다.


홈페이지 영역

ALLREAD 반영 메시지

Company

“문서를 데이터로 바꾸고, 데이터를 업무 지능으로 연결하는 AI 기업”이라는 회사 정체성과 ALLREAD의 개발 철학을 연결한다.

Technology

PaddleOCR-VL v1.6, PP-DocLayoutV3, GPU Worker/engine, provenance, review workflow, shared-engine 보호 등 실제 기술 스택과 운영 기술을 소개한다.

Products

ATPIA ALLREAD를 Universal Document Recognition의 공식 제품 브랜드로 노출하고, 현재 Beta/Research 상태와 지원 범위를 함께 표시한다.

R&D

Historical EXPERIMENTAL, 일반 실문서 Gold 구축, 표·다단·회전/혼합 입력, 장기 안정성·품질평가 등 다음 연구 Gate를 투명하게 공개한다.

IR

단순 모델 호출이 아니라 문서 처리의 전체 수명주기와 운영환경에서의 통제·복구 가능성을 개발 자산으로 설명하되, Production Ready나 정량 정확도를 선행 주장하지 않는다.


6. 다음 Gate — “실제 문서에서 얼마나 잘 읽는가”를 숫자로 증명하는 단계

ALLREAD의 다음 과제는 기능 추가보다 실문서 검증의 밀도를 높이는 것이다. 현재 일반 실문서 확보·Gold draft·독립검수·잠금 완료 수량은 모두 0으로 관리되고 있다. 기존 합성 Gold 20페이지와 일본 kindai layout pair 12개는 기능 시험·layout 연구자료로 별도 관리되며, 일반 한국어 실문서 Gold에 합산하지 않는다.

향후에는 권리가 확인된 일반 인쇄물, 열화 스캔, 업무 혼합 문서, 표·다단 입력을 확보해 독립 전사·구조 정답을 만들고, 출처 단위로 DEV/EVAL을 분리한 뒤 CER/WER와 구조 정확도, 운영성능을 정식 평가한다. 동시에 처리 중 사용자 취소·삭제, polling 재조회, 장기 유휴·반복 안정성, 경보 수신과 pending-writer 복원까지 확인해야 한다.


“ALLREAD의 목표는 OCR 한 번의 성공이 아니라,

다양한 문서를 안전하게 읽고 검토 가능한 결과로 연결하는 문서 AI 인프라다.”


7. ATPIA의 문서 AI 포트폴리오, 하나의 이름으로 모인다

ATPIA는 그동안 한자·고문서 인식, PaddleOCR-VL 기반 문서분석, 범용 문서인식 아키텍처와 운영 안정성 검증을 병행해 왔다. ALLREAD는 이 개발 흐름을 사용자 관점에서 하나의 제품 언어로 묶는 브랜드다. 앞으로 ATPIA는 “읽기–구조화–검토–활용”으로 이어지는 문서 AI 체계를 고도화하고, 검증된 범위부터 순차적으로 공개해 나갈 계획이다.

이번 allread.atpia.com 공개는 완성 선언이 아니라, 개발 성과를 실제 서비스 구조 위에서 검증하고 외부에 투명하게 공개하는 출발점이다. ATPIA는 기술적 성공뿐 아니라 실패 기록, 운영 한계, 다음 Gate까지 함께 공개하며 ALLREAD를 신뢰할 수 있는 범용 문서인식 플랫폼으로 발전시킨다는 방침이다.


서비스 브랜드

ATPIA ALLREAD

공개 주소

https://allread.atpia.com

현재 단계

Public Beta Website / Analysis Intake Closed / Production Not Ready

핵심 정책

AUTO_ACCEPT Disabled · Historical Experimental + Review Required