Модель A-Vibe стала лидером российского бенчмарка MERA, демонстрируя превосходство в обработке языка

Модель A-Vibe стала лидером российского бенчмарка MERA, демонстрируя превосходство в обработке языка.

Языковая модель A — Vibe, разработанная компанией «Авито», заняла лидирующую позицию в российском бенчмарке MERA среди легковесных моделей с числом параметров до 10 миллиардов, сообщает пресс-служба фирмы. Сейчас технология A — Vibe уже интегрирована в различные сервисы «Авито» — например, она помогает продавцам создавать эффективные описания товаров и ускоряет процесс заключения сделок в мессенджере.

В планах компании до конца текущего года внедрить еще 20 новых сценариев применения, а позже возможно открыть исходный код модели для широкой аудитории. Победа на MERA демонстрирует, что тщательно оптимизированная архитектура в сочетании с качественными данными способны обеспечить высокие показатели даже при сравнительно небольшом размере модели.

A — Vibe создавалась с акцентом на оптимальный баланс между качеством, скоростью работы и расходом ресурсов. Благодаря этому модель способна быстро обрабатывать запросы, даже в периоды пиковых нагрузок, а также легко масштабируется под всю пользовательскую базу платформы.

Выбор небольшой модели, адаптированной под конкретные задачи «Авито», позволяет обеспечивать эффективность вложений: планируется инвестиция порядка 12 млрд рублей в GenAI, при этом ожидаемый доход по прогнозам превысит 21 млрд к 2028 году», — приводит пресс-служба слова старшего директора по данным и аналитике Андрея Рыбинцева. Тестирование включало задачи различной сложности — от базового анализа текста до сложных лингвистических исследований с глубоким учетом контекста.

Команда «Авито» разработала собственные генеративные модели A — Vibe и A — Vision, начав обучение с открытой модели, которая, однако, имела ограничения в понимании русского языка.

Обучение модели проводилось на корпусе более чем 100 языков, где доля русского составляла менее 1%, из-за чего качество обработки и генерации текста на русском языке оставляло желать лучшего.

Чтобы исправить это, разработчики переработали модель, заменив стандартный токенизатор на собственный, оптимизированный для работы с русским языком. Теперь модель обрабатывает русский текст примерно вдвое быстрее оригинала, а качество понимания и генерации существенно улучшено, отмечают специалисты «Авито».

При этом A — Vibe способна одновременно обрабатывать до 32 тысяч текстовых токенов. «Мы рассматриваем возможность сделать модель общедоступной, что станет нашим вкладом в развитие отечественного ИИ-рынка.

Это откроет перед малым бизнесом доступ к передовым технологиям без крупных затрат, поможет образовательным учреждениям создавать практические приложения, а независимым разработчикам – строить современные сервисы на базе национальных технологий. Кроме того, это даст нам возможность получить важную обратную связь и улучшить наши разработки», — комментирует руководитель разработки больших языковых моделей «Авито» Анастасия Рысьмятова.

Оставить комментарий