Китайские разработчики создали технологию Unimate для генерации 3D-анимации по текстовому описанию

ТЕХНО: Яндекс про технологии@techno_yandexТехнологии и IT30 сентября 2026, 10:35
  • Фото поста канала ТЕХНО: Яндекс про технологии

👀 ИИ научится воспринимать мир как человек? Сначала каждая ИИ-модель работала с одним типом данных, например текстами или изображениями. Потом их объединили в VLM — к языковой модели подключили визуальную через программный адаптер. А пару лет назад появился тренд на омни-модели, которые понимают разные типы данных без адаптеров. Алексей Григорьев, руководитель команды алайнмента VLM, считает, что это может привести к скачку в развитии ИИ. Омни-модель (от лат. omnis — «всё») — это нейросеть, которую с самого начала учат работать и с текстами, и с изображениями. Создавать такие нейросети сложно, но «растить» одну модель вместо нескольких гораздо эффективнее. Сервисы на базе омни-моделей работают лучше, так как «под капотом» не нужно переключаться между нейросетями. Самое интересное в омни-моделях — синергия: улучшение одной из модальностей улучшает и другую. Именно так случилось во время обучения омни-модели Alice AI на текстовых данных: она стала лучше обрабатывать и картинки тоже. Омни-модели улавливают связи между изображениями и текстом (например, пишут стихи по фотографии) и за счёт этого оказываются ближе к целостному восприятию мира, свойственному людям. У омни-моделей даже могут появиться эмерджентные свойства — способности, которые не закладывали при разработке. Например, они могут научиться понимать физику реального мира. Сейчас инженеры работают над тем, чтобы сбалансировать качество текстовой и визуальной выдачи внутри одной омни-модели. А в будущем разные модальности окончательно сольются в единую эффективную систему. Подписывайтесь 👉 @techno_yandex

  • 25
  • 10
  • 3
  • 3
  • 3
  • 1
  • 1

Похожие посты

Техномотель @technomotelТехнологии и IT30 сентября 2026
Китайские разработчики создали технологию Unimate для генерации 3D-анимации по текстовому описанию

Художники-аниматоры идут НА ЗАВОД — китайцы дропнули модель для анимации 3D-модель через текст. Технологию назвали Unimate, и она может сделать мультипликацию доступной для всех. Нейронке нужно скормить модельку персонажа, а она сгенерирует анимацию по описанию с учётом строения его скелета. Unimate сама учитывает связи между суставами, исходную позу и расстояние вдоль цепочек костей. Благодаря этому модель получается универсальной, и её не надо учить анимации каждого типа персонажа с нуля. Ч...

  • 111
  • 54
  • 28
  • 23
  • 8
  • 7
Технотренды@techno_mediaТехнологии и ITвчера
Китайские разработчики создали технологию Unimate для генерации 3D-анимации по текстовому описанию

Китайские разрабы выкатили ИМБУ — показали Unimate, которая умеет оживлять 3D-персонажей по текстовому описанию. Нейронке достаточно дать готовую модельку и написать, какое движение нужно получить. Она сама учитывает скелет персонажа, суставы, исходную позу и пропорции костей. За счет этого одну систему можно использовать для разных персонажей без отдельного обучения под каждую модель. Художники-аниматоры напряглись. 📲 Технотренды

  • 15
  • 2
Доктор GPT@doktorgptТехнологии и ITвчера
Китайские разработчики создали технологию Unimate для генерации 3D-анимации по текстовому описанию

🔥Художники-аниматоры идут НА ЗАВОД - китайцы дропнули модель для анимации 3D-модель через текст. Технологию назвали Unimate, и она может сделать мультипликацию доступной для всех. Нейронке нужно скормить модельку персонажа, а она сгенерирует анимацию по описанию с учётом строения его скелета. Unimate сама учитывает связи между суставами, исходную позу и расстояние вдоль цепочек костей. Благодаря этому модель получается универсальной, и её не надо учить анимации каждого типа персонажа с нуля. ...

  • 16
  • 6
  • 3