Jina AI випустила модель розпізнавання документів jina-ocr-v1 для бюджетних GPU
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Компанія Jina AI, підрозділ Elastic, представила відкриту модель jina-ocr-v1 для перетворення сканів, таблиць і рахунків у Markdown. Модель має 3,4 млрд параметрів і вбудоване спекулятивне декодування, що дозволяє їй ефективно працювати на недорогих GPU на кшталт NVIDIA L4. За даними розробників, вона показує 91,14 бала на бенчмарку OmniDocBench v1.6 і обробляє до 2,57 сторінки за секунду на GPU A100 — найшвидший результат серед 14 протестованих систем. Ліцензія CC BY-NC 4.0 дозволяє некомерційне використання, для комерційного потрібне окреме звернення до Jina AI.
Мовою оригіналу · EN
Jina AI, part of Elastic, released jina-ocr-v1, an open-weight 3.4B document parsing model with built-in speculative decoding designed to run on low-budget GPUs like the NVIDIA L4. It scores 91.14 on…
Читати оригінал на MarkTechPost →
Чому в стрічці: Реліз OCR-моделі — рутинна продуктова новина в AI, не пріоритетний напрямок governance/safety.