Говорящие открытки

Говорящее фото: открытка, где бабушка поздравляет сама

Говорящая открытка - это фото близкого человека, который вслух произносит Ваше поздравление: до 15 секунд речи, губы двигаются в такт словам. Kling AI Avatar v2 от Kuaishou оживляет лицо и голову, OmniHuman 1.5 от ByteDance - человека целиком. Голоса - от ElevenLabs, а можно взять и Ваш собственный.

  • 71-200 кр. за секунду речи
  • до 15 с речи

Обновлено 29.09.2026

Бабушка за семь секунд, дедушка по-русски

Бабушка поздравляет самаKling AI Avatar v2 · 1 photo · voice Ava
Запрос

Happy birthday! I wish I could hug you today - this is the next best thing.

Дедушка говорит по-русскиOmniHuman 1.5 · 1 photo · voice Ari · Russian
Запрос

С Днём Рождения! Жаль, что не могу обнять тебя сегодня, но вот моё поздравление.

Сначала открытка, потом «Пусть заговорят»

  1. 1

    Сделайте открытку с фото

    Напишите агенту в чате что-то вроде «Говорящая открытка к восьмому Дню Рождения Вани от бабушки Инны» и добавьте её фото, когда он попросит, - JPG, PNG или WebP до 10 МБ. Сначала агент сделает открытку с фото. Или сделайте её сами в режиме «Стандарт»: портрет у окна или сцену «Длинный стол в саду».

  2. 2

    Нажмите «Пусть заговорят»

    Под готовой открыткой нажмите «Пусть заговорят». Агент напишет короткую версию поздравления для голоса - поправьте её или впишите свою, а счётчик покажет, сколько примерно секунд она займёт. Выберите голос. Если текст не помещается в 15 секунд, приложение скажет об этом ещё до запуска.

  3. 3

    Выберите качество и запустите

    В поле «Качество» вариант «Стандарт» - это Kling AI Avatar v2, он двигает лицо и голову; «Максимум» - это OmniHuman 1.5, он оживляет человека целиком, и можно нажать на лицо того, кто говорит. Цена написана на кнопке, и до нажатия ничего не списывается. Готовую открытку отправьте по email, SMS или в популярный мессенджер.

Сделать говорящее фото

Три первых сообщения, с которых начинается говорящая открытка

Говорящая открытка к восьмому Дню Рождения внука Лёвы, от меня: портрет у кухонного окна в мягком утреннем свете, я смотрю в камеру и улыбаюсь, на подоконнике маленький торт с восемью свечами. Хочу сказать: «С Днём Рождения, Лёва! Тебе уже восемь, и ты выше кухонного стола. Оставь мне кусок торта, я приеду в июле».
Одно сообщение делает оба шага: агент сначала сделает открытку, а потом напишет фразу для голоса на основе Вашей. Одно лицо, повёрнутое к камере, и ровный свет - лёгкий случай для Kling AI Avatar v2.
Взять этот запрос
Открытка с дедушкой Мишей к шестому Дню Рождения моей дочки Маши: по плечи, в его столярной мастерской, в солнечном луче кружится древесная пыль, он улыбается в камеру и держит деревянную лошадку, которую сам для неё выстругал.
Лошадка даёт ему тему для разговора, и в его фразе можно о ней вспомнить. Он держит её на уровне груди, так что рот остаётся на виду, а это как раз то, что нужно Kling AI Avatar v2.
Взять этот запрос
Открытка с моим фото ко Дню Рождения Даши, пока она в командировке: по плечи, на нашем балконе в сумерках, в руках капкейк с одной свечой, за спиной мягко светится город, я смотрю в камеру.
По плечи, одна свеча, рот ничем не закрыт. На платном тарифе скажите это своим голосом, а на любом другом пусть прочтёт один из голосов каталога.
Взять этот запрос

«Стандарт» или «Максимум»: сколько в кадре движется

Оба движка получают от нас одно и то же: открытку и голос, уже записанный и обрезанный ровно до оплаченных секунд. Разница в том, какая часть картинки оживает. Kling AI Avatar v2 от Kuaishou работает с лицом и головой: губы следуют за словами, голова двигается вместе с ними, а всё остальное остаётся как было, от одежды до комнаты за спиной. Для портрета одного человека это обычно именно то, что нужно, и секунда стоит дешевле. Бабушка на этой странице сделана как раз так.

OmniHuman 1.5 от ByteDance видит на фото целого человека: голова, лицо и плечи двигаются в ритме голоса, так что на снимке по пояс или с поднятым бокалом ему есть что оживить, кроме губ. Дедушка, который поздравляет по-русски голосом Ari в примере выше, сделан на нём из одного портрета. Он же решает задачу группового фото: переключите качество на «Максимум», нажмите на лицо того, кто должен говорить, - скажем, дедушки, который благодарит всех, - и заговорит именно он, а остальные останутся в кадре и будут слушать. Если не нажать, говорящего выберет модель: для портрета это нормально, для компании - лотерея, поэтому не растягивайте стол, ведь в крошечное лицо на дальнем конце трудно попасть пальцем. Секунда у OmniHuman дороже, поэтому на каждый день обычно берут Kling AI Avatar v2.

Рот на виду, лицо к камере

Говорит то лицо, которое на открытке, поэтому сходство начинается с неё. Лучшее сходство даёт GPT Image 2.5 Flare - именно её «Авто» выбирает для картинок, - а надёжнее всего лица сохраняются на открытках, где не больше четырёх человек. Для говорящей части помогают простые вещи: лицо повёрнуто к камере, рот виден, а не закрыт чашкой или рукой, свет ровный, и лицо занимает заметную часть кадра. OmniHuman 1.5 любит, когда в кадре видны ещё и плечи. Один человек на портрете - лёгкий случай. Крошечное лицо посреди широкого пейзажа - трудный.

Если единственное фото - общий снимок с другого конца сада, сначала сделайте новую открытку, где лицо крупнее, и пусть говорит уже она. Раздел «Люди» экономит шаг: если бабушка сохранена там с фото, агент уже знает её лицо и не спросит снова.

Что помещается в пятнадцать секунд речи

Пятнадцать секунд - это тост, а не письмо: имя, одна настоящая деталь, одно пожелание. Реплика бабушки на этой странице длится 7 секунд, так что в предел помещается примерно две такие. Голос делает паузы на точках, и предложение на три строки выходит одним длинным выдохом. «С Днём Рождения моего замечательного внука, желаю тебе всего самого наилучшего в этот особенный день, пусть сбудутся все твои мечты» говорит меньше, чем «С Днём Рождения, Ваня. Уже восемь, а я всё ещё жду реванша в шашки. В воскресенье привезу торт».

Называйте людей так, как их зовут дома: бабуля, деда, Лёвушка. Фразы на иврите и арабском делайте чуть короче: в 15 секунд на этих языках помещается меньше букв. Ремарки вроде [смеётся] не пишите: всё, что стоит в квадратных скобках, приложение убирает, прежде чем голос прочтёт текст. Лучшие слова обычно у самого человека с фото: позвоните бабушке, спросите, что бы она сказала, и запишите это её словами. Потом прочитайте фразу вслух один раз: если Вы на ней спотыкаетесь, то и в устах человека с фото она прозвучит натянуто.

Голос выбирайте под того, кто будет слушать, а не под себя: для бабушки или дедушки - неторопливый тёплый, для шестилетки - звонкий. У каждого голоса каталога есть образец, так что выбирайте на слух, а не по имени. И одно правило не про технику: берите фото людей, которые обрадуются, увидев себя говорящими, и слова, которые они сказали бы сами. Вложите дедушке в уста фразу, которую он никогда бы не произнёс, и семья заметит это раньше, чем задуют свечи.

Для тех, кто не может прийти

Чаще всего говорящая открытка заменяет того, кого нет рядом. В этот день бабушку и внука разделяют два перелёта, и её портрет поздравляет его с телефона, прислонённого к торту. Если у неё свой аккаунт на платном тарифе, она один раз записывает голос, и тогда это по-настоящему говорит она.

Расстояние - не единственная причина. Снять себя со словами «С Днём Рождения» - это десяток дублей, и в самом удачном обязательно окажется Ваш палец, а здесь Вы берёте фото, которое Вам уже нравится, и пишете две фразы. Из-за часовых поясов звонить в День Рождения неудобно, так что открытка с Вашим лицом, а на платном тарифе и с Вашим голосом, может подождать: запланируйте её на их утро, а не на Ваше.

Важен и язык. Внуки отвечают на иврите, а бабушка до сих пор думает по-русски. Напишите её фразу по-русски, так, как сказала бы она сама, и её фото произнесёт это по-русски: голос читает на том языке, на котором написан текст.

Лучше видео, голос или песня

Говорящая открытка - это один человек, несколько фраз и взгляд в камеру. Застолья тут не будет. Если хочется, чтобы весь стол поднял бокалы, со звоном и смехом, нужно видео. Kling 3.0 превратила нашу открытку с длинным столом в саду именно в такой пятисекундный ролик, вместе со звуком. Veo 3.1 создаёт голоса и пение в той же генерации - на её странице семья допевает Happy Birthday, а мама задувает свечи. MiniMax H3 оживляет все видеосцены нашего каталога, и из этих трёх она самая выгодная.

Если важен голос, а лицо не так важно, отправьте голосовое поздравление: те же восемь голосов или Ваш, без картинки, которую надо оживлять, и дешевле. Если слова хочется спеть, Lyria 3.5 споёт утверждённый Вами текст - на русском, английском, иврите, арабском и других языках.

Два движка для говорящих фото, цена за секунду

Оба произносят одну и ту же фразу одним и тем же голосом, до 15 секунд. Берите Kling AI Avatar v2 для одного лица на портрете - секунда у него дешевле. Берите OmniHuman 1.5, когда должен двигаться весь человек или когда на групповом фото нужно выбрать, кто говорит.

МодельСильная сторонаДлинаКачествоЦена
Kling AI Avatar v2KuaishouЛицо и голова двигаются в такт словамдо 15 с речи71 кр. за секунду речи + голос
OmniHuman 1.5ByteDanceОживает весь человекдо 15 с речи720p200 кр. за секунду речи + голос

Цены в кредитах, и цена всегда видна на кнопке до нажатия. Тарифы

Смотрите также

Говорящее фото: о чём спрашивают перед первой открыткой

Сделайте открытку с фото этого человека, а затем нажмите «Пусть заговорят» под готовой открыткой. Поправьте короткую фразу, которую набросает агент, выберите голос и качество и нажмите кнопку с ценой. Открытка вернётся видео, где этот человек произносит Ваши слова, а губы двигаются в такт голосу.

Бабушкин портрет, бабушкины слова

Одно фото, две-три фразы и голос - и открытка с Днём Рождения поздравит вслух.

Сделать говорящее фото

Поздравления на любой случай