Kimodo от Nvidia позволяет создавать 3D-анимацию по текстовым командам с точным контролем ключевых поз и движений, значительно упрощая и ускоряя процесс анимации для игр, кино и робототехники. Модель готова к коммерческому использованию и интеграции в рабочие процессы, но пока ограничена по типам скелетов и требует адаптации для нестандартных персонажей.
Kimodo: генерация 3D-движений для людей и роботов через текст и кинематические ограничения
полный разбор ролика · 5 глав ↓
Введение и проблема
Создание реалистичной 3D-анимации остаётся сложной и дорогой задачей из-за ручной работы и ограничений моукапа.
Обычные методы либо требуют много времени, либо плохо переносятся на нестандартных персонажей.
Что такое Kimodo
Kimodo — это кинематическая диффузионная модель, генерирующая движение по текстовым командам с возможностью задавать точные ключевые условия.
Инструмент сразу готов к коммерческому использованию и даёт художникам контроль над результатом.
Как работает Kimodo
Пишем текстовую команду, задаём якоря (например, позицию руки в конкретном кадре), модель автоматически генерирует промежуточные движения.
Можно задавать целые позы, траектории и фиксировать объекты в руках персонажа для точного контроля.
Данные и модели
В основе лежит 700 часов лицензированных движений, что гарантирует легальное коммерческое использование.
Доступны модели для человеческого скелета Soma и робота Unit 3 G1, модель SMPLX пока только для исследований.
Применение и интерфейсы
Kimodo применим в играх, кино, робототехнике и для генерации синтетических данных.
Есть CLI для интеграции в автоматизированные пайплайны и визуальный редактор для художников.