Selon MarkTechPost, Jina AI a publié jina-ocr-v1 —, un parseur visuel de documents qui convertit les fichiers PDF, les scans, les tableaux, les graphiques et les factures en Markdown. Le modèle utilise une architecture MoE avec 3,4 milliards de paramètres, dont environ 570 millions actifs à chaque jeton.

Le mécanisme FastMTP intégré génère trois jetons brouillons par étape, tout en maintenant une sortie sans perte annoncée. Le synopsis indique également des résultats de 91,14 points dans OmniDocBench v1.6 et de 83,4 dans olmOCR-Bench, ainsi qu’une vitesse de 2,57 pages par seconde sur un seul A100.

Les poids du modèle sont publiés sur Hugging Face sous licence CC BY-NC 4.0; l’accès à la version publiée est fourni via Jina Reader. L’importance de cette sortie réside dans l’effort visant à concilier le traitement de documents complexes et une utilisation computatrice plus économique, mais une vérification indépendante des chiffres dans les matériaux fournis fait encore défaut.