Reka представила Rho-1 — 19-мільярдну мультимодальну модель для тексту, відео та дій робота

Reka Releases Rho-1: A 19B Omni-Reasoning Model That Understands, Generates Video and Outputs Robot Actions in One

Компанія Reka випустила дослідницьку версію моделі Rho-1 на 19 млрд параметрів, яка в єдиній нейромережі розуміє й генерує текст, зображення та відео, а також видає команди для керування роботом. Розробники представляють її як заміну конвеєрів із кількох спеціалізованих моделей, оскільки всі дані обробляються в одному контекстному вікні з двома потоками уваги. За даними компанії, дистильована версія скорочує час генерації короткого відеоролика до приблизно однієї секунди. Модель доступна лише як дослідницький препринт без публічних ваг чи API.

Мовою оригіналу · EN

Reka releases Rho-1, a 19B omni-reasoning model that understands and generates text, video and robot actions in one network.

Читати оригінал на MarkTechPost →

Чому в стрічці: Новий мультимодальний AI-реліз цікавить читача, хоч це не топ-лабораторія (Anthropic/OpenAI) і не гучний скандал.

← Назад до стрічки