Большие ИИ-модели стали уступать в бизнес-эффективности качественным маленьким Современные ускоренные и экономичные Flash-модели, разработанные специально для ускоренной обработки больших объемов данных, способны кратно снизить стоимость запроса, сообщил в интервью «Ведомостям» генеральный директор Yandex Cloud Григорий Атрепьев. Так, средняя цена 5000 токенов в Alice AI LLM Flash достигает 0,425 руб., а для модели предыдущего поколения YandexGPT 5 Pro аналогичный запрос обходился в 6 руб – при сопоставимом количестве параметров моделей цена запроса снизилась в 14 раз. Поскольку российские решения уже не уступают в эффективности многим иностранным, это позволяет снизить возможную зависимость отечественного ИИ от опенсорс-моделей китайских разработчиков. Компактность стала сильной стороной ещё одной модели Яндекса, которую компания выложила в открытый доступ: суверенное претрейн-решение Alice AI Foundation LLM имеет в разы меньше параметров, чем зарубежные аналоги, при этом показывает сопоставимые результаты на задачах по математике и программированию.
Яндекс представил более эффективные и экономичные нейросети, снижающие стоимость запросов в 14 раз
Похожие посты
- 👎 163
- 😁 32
- ❤ 18
- 🕊 8
- 🤣 33
- 👍 28
- ❤ 13
- 🔥 6
- 🤔 1
- 😐 1
- ❤ 3