Как делать ролики с ИИ-аватаром: Kling + ElevenLabs + CapCut
Весь ролик с говорящим аватаром собирается из трёх инструментов без съёмок и монтажёра.
Ключевой момент, с которого всё начинается: сначала озвучка, потом видео. Kling анимирует губы аватара под уже готовую аудиодорожку, поэтому порядок шагов именно такой.
Шаг 1. Озвучка в ElevenLabs
В разделе Voice Cloning записываете 1–2 минуты своего голоса без фонового шума и получаете клон. Дальше пишете сценарий ролика, вставляете текст и скачиваете готовое mp3. Модель ставит паузы по знакам препинания, поэтому короткие предложения с расставленными запятыми и точками звучат естественнее всего.
Шаг 2. Аватар в Kling
Генерируете изображение персонажа детальным промптом: внешность, одежда, фон, стиль realistic photo. Кадр лучше делать по пояс и с руками — анимация получается живее. Сохраните промпт и итоговую картинку: аватар должен оставаться одинаковым во всех роликах.
Шаг 3. Липсинк и Motion Control в Kling
Это главный этап. В функцию аватара загружаете картинку персонажа и аудио из ElevenLabs — Kling сам анимирует губы под дорожку, и аватар говорит вашим голосом, попадая в слова. Движения и жесты добавляются через Motion Control: можно загрузить референс-видео, где вы сами жестикулируете на камеру, и аватар повторит движения. Длинную озвучку удобнее разрезать на куски и генерировать по частям.
Шаг 4. Монтаж в CapCut
Клипы из Kling уже содержат звук, поэтому синхронизировать ничего не нужно — остаётся склеить куски
Весь ролик с говорящим аватаром собирается из трёх инструментов без съёмок и монтажёра.
Ключевой момент, с которого всё начинается: сначала озвучка, потом видео. Kling анимирует губы аватара под уже готовую аудиодорожку, поэтому порядок шагов именно такой.
Шаг 1. Озвучка в ElevenLabs
В разделе Voice Cloning записываете 1–2 минуты своего голоса без фонового шума и получаете клон. Дальше пишете сценарий ролика, вставляете текст и скачиваете готовое mp3. Модель ставит паузы по знакам препинания, поэтому короткие предложения с расставленными запятыми и точками звучат естественнее всего.
Шаг 2. Аватар в Kling
Генерируете изображение персонажа детальным промптом: внешность, одежда, фон, стиль realistic photo. Кадр лучше делать по пояс и с руками — анимация получается живее. Сохраните промпт и итоговую картинку: аватар должен оставаться одинаковым во всех роликах.
Шаг 3. Липсинк и Motion Control в Kling
Это главный этап. В функцию аватара загружаете картинку персонажа и аудио из ElevenLabs — Kling сам анимирует губы под дорожку, и аватар говорит вашим голосом, попадая в слова. Движения и жесты добавляются через Motion Control: можно загрузить референс-видео, где вы сами жестикулируете на камеру, и аватар повторит движения. Длинную озвучку удобнее разрезать на куски и генерировать по частям.
Шаг 4. Монтаж в CapCut
Клипы из Kling уже содержат звук, поэтому синхронизировать ничего не нужно — остаётся склеить куски