Яндекс представил Alice AI Foundation LLM – новую большую языковую модель, которую на этот раз, как заявляется, полностью обучал самостоятельно, не беря чужую модель за отправную точку. В ней 80 миллиардов параметров, а для обучения использовали массив данных объёмом больше 18 триллионов токенов. Для Яндекса это довольно важный релиз, ведь предыдущую Alice AI LLM Яндекс создавал на базе китайской Qwen (за что компанию даже публично попрекал Греф). Теперь прежнего повода для уколов нет – полный цикл создания большой модели Яндекс прошёл сам. Правда, на смену старым поводам родились новые.
Революции не случилось, да и вряд ли она планировалась. Новая модель получилась сравнительно компактной и экономной: при работе она задействует небольшую часть своих параметров и потому требует заметно меньше вычислений, чем крупнейшие российские и зарубежные конкуренты. Фундаментально новых идей при её разработке Яндекс не изобрёл – в основе лежат подходы других разработчиков, которые компания собрала вместе, адаптировала под свои данные и дополнила собственными инженерными решениями.
Алиса станет умнее? Судить сложно, но вряд ли что-то изменится сейчас: Alice AI Foundation – пока не готовая пользовательская модель: её ещё предстоит подготовить для диалогов, режима рассуждений и работы с инструментами. Яндекс говорит, что на её основе будут строиться будущие возможности Алисы. Насколько будущие – пока можно только гадать.
Нынешняя же Алиса продолжает работать на прежнем семействе моделей, а новая версия в продукт пока не встроена. То есть после полугода работы Яндекс доказал главным образом сам факт, что способен самостоятельно обучить большую модель. Необычное решение на фоне привычных ИИ-релизов, когда новую модель встраивают в продукт и дают попробовать пользователям. Складывается ощущение, что сейчас Яндексу было важнее не показать готовый продукт, а продемонстрировать сам факт существования собственной большой LLM.