AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

Jina가 DeepSeek-OCR을 개조하여 자체 테스트한 14개 모델 중 페이지 처리량 1위를 차지했다

동찰 Beating AI 속보, Jina AI가 문서 파싱 모델 jina-ocr-v1을 발표했으며, PDF, 스캔본, 표, 차트를 바로 Markdown으로 변환할 수 있다. 이 모델은 DeepSeek-OCR을 기반으로 후속 학습되었고, 약 34억 총 파라미터, 디코딩 시 토큰당 약 5.7억 파라미터가 활성화되는 MoE 아키텍처를 그대로 따르며, FastMTP 추측 디코딩을 추가했다.


Jina 자체 테스트에서 jina-ocr-v1은 OmniDocBench v1.6에서 91.14점을 기록해 DeepSeek-OCR-2보다 0.89점 높았고, olmOCR-Bench에서는 83.4점을 기록해 실제 기반이 된 DeepSeek-OCR 베이스 모델보다 7.4점 높았다.


처리량은 Jina의 주요 판매 포인트 중 하나다. 단일 A100, 동시성 32에서 초당 2.57페이지를 달성해 Jina가 테스트한 14개 시스템 중 가장 높았으며, DeepSeek-OCR의 초당 2.10페이지보다 약 22% 높았다.


모델 가중치는 이미 Hugging Face에 공개되었으며, CC BY-NC 4.0 라이선스를 적용해 상업적 사용은 Jina에 문의해야 한다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료