Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

Техномотель @technomotelТехнологии и IT23 сентября 2026, 19:16

Вы НЕ ПОЙМЁТЕ, что с вами говорит ИИ — Гугл дропнул самую мощную нейронку для генерации голоса. Что может Gemini 3.8 Flash TTS: · Создаёт голос по текстовому описанию; · Владеет сотней языков и диалектов; · Имеет 2000+ готовых голосов с региональными вариантами; · Точно клонирует голос по 30-секундной записи — скамеры ликуют; · Отыгрывает роли — пишем сценарий, модель читает с выражением. · Держит голос стабильным часами; · Естественно смеётся, вздыхает и перебивает. Скоро обещают ремиксы голоса в плане тембра, высоты, темпа и акцента. Доступно уже сегодня. Пробуем в API Gemini и Google AI Studio 🎤

  • 92
  • 29
  • 17
  • 10
  • 8
  • 2
  • 2

Похожие посты

Бэкдор@whackdoorТехнологии и IT13 часов назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

Google выпустил две лучшие в мире нейронки для генерации речи — Gemini 3.8 Flash TTS и её младший брат Flash-Lite знают больше 1️⃣0️⃣0️⃣ языков и диалектов. • Внутри — 2000 разных голосов на выбор с акцентами и эмоциями. • Можно сгенерировать свой голос и сразу отредактировать под свои нужды. • Голос не меняет даже по ходу зачитывания самых больших файлов. • Смех, охи, вздохи, целые диалоги с разными участниками — новый голос от Google может всё! Делаем озвучку в AI Studio — здесь. 👍 Бэкдор

  • 114
  • 34
  • 2
Не баг, а фича@bugnotfeatureТехнологии и IT15 часов назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

⚡️ Мощнейшие нейронки для генерации голоса выкатила Google — это Gemini 3.8 Flash TTS и её дешёвая версия Flash-Lite TTS. Обе уже держат топ по бенчам: 🔅 Знают больше 1️⃣0️⃣0️⃣ языков и диалектов, в том числе русский; 🔅 Имеют больше 2000 голосов с различными акцентами; 🔅 Повторят ЛЮБОЙ голос по 30-секундной записи речи; 🔅 Можно сгенерить новый голос по текстовому промпту и даже редачить его; 🔅 Голос не меняется несколько часов аудио; 🔅 Можно добавлять реалистичный смех, вздохи и перебиван...

  • 34
  • 19
  • 5
  • 4
  • 1
  • 1
Провод@provodТехнологии и IT14 часов назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

⚡️ Настоящих монстров для генерации голоса дропнула Google — свежая Gemini 3.8 Flash TTS и дешёвая версия Flash-Lite TTS уже разорвали все бенчмарки. По порядку: • Знают больше 1️⃣0️⃣0️⃣ языков и диалектов, русский, естественно, на месте; • 2000 голосов на выбор с разными акцентами; • Можно сгенерить голос по текстовому промпту и сразу же его отредачить; • Голос не меняется и не глючит даже на больших файлах; • Можно добавить смех, вздохи или создать целый диалог с несколькими участниками. Бе...

  • 44
  • 14
  • 4
  • 3
  • 3
GPT4Telegram | AI Community @gpt4telegramТехнологии и IT6 часов назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

👨 You Can Now Create "Live" AI Avatars With Gemini You can create companions based on real people or illustrated characters. The AI double will answer questions in real time, speaking in 97 languages. For now, the feature is available only to enterprise customers.

  • 114
  • 100
  • 95
  • 89
CodeCamp@codecampТехнологии и ITвчера
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

Google тоже выпустила SOTA модели — правда, пока что для перевода текста в речь 🔈 Компания представила сразу две модели. Главное: — Gemini 3.8 Flash TTS, старшая модель, которая умеет создавать голоса с нуля по текстовому описанию и отдельно управлять каждой репликой, включая темп, интонацию и манеру речи. Сами Google пишут, что она идеальна для озвучки персонажей в играх и аудиокниг. — Gemini 3.8 Flash-Lite TTS, более быстрая и дешёвая версия для массовой озвучки, аудиоконтента и голосовых а...

  • 47
  • 24
  • 5
  • 4
Технолавка@technolavkaЮмор и развлечениявчера
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

⚙️ Google представили ДВЕ новые модели для генерации речи — Gemini 3.8 Flash TTS и Flash-Lite TTS. Теперь нейронка умеет не просто читать текст, а буквально отыгрывать его как актёр: 🟢 создаёт голос по текстовому описанию и управляет интонацией, темпом и манерой речи; 🟢 поддерживает 100+ языков и диалектов; 🟢 даёт доступ к более чем двум тысячам готовым голосам; 🟢 клонирует голос всего по 30 секундам записи; 🟢 умеет озвучивать диалоги нескольких персонажей — со смехом, вздохами и перебива...

  • 21
  • 1
LOLZTEAM@lolz_legalТехнологии и IT12 часов назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

🗣 Google выкатила мощнейшие нейросети для генерации голоса – Gemini 3.8 Flash TTS и Flash-Lite TTS Обе модели уже возглавляют топы по бенчмаркам качества озвучки. ➖ Поддерживают больше 100 языков и диалектов, включая русский; ➖ В арсенале свыше 2000 голосов с разными акцентами; ➖ Способны воспроизвести любой голос всего по 30-секундной записи речи; ➖ Можно сгенерировать новый голос по текстовому описанию и редактировать его; ➖ Голос остается стабильным на протяжении нескольких часов аудио; ➖ ...

  • 10
  • 4
Джейпег Малевича@malepegТехнологии и ITвчера
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

🤍 Google дропнули сразу две новые модели для генерации речи — Gemini 3.8 Flash TTS и более дешёвую Flash-Lite TTS. Главные возможности: • создают голос по текстовому описанию и позволяют управлять интонацией, темпом и манерой речи; • поддерживают 100+ языков и диалектов; • предлагают более 2000 готовых голосов; • умеют клонировать голос всего по 30-секундной записи; • могут озвучивать диалоги с несколькими персонажами, включая смех, вздохи и перебивания. Пробуем в API Gemini и Google AI Stud...

  • 11
  • 6
  • 3
  • 2
Креатив на сдачу@creochЮмор и развлечения16 часов назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

Google выпустила две новые TTS‑модели Gemini 3.8 Flash и более дешёвую Flash-Lite. Они создают голос по текстовому описанию, позволяют управлять интонацией и темпом и уже доступны в API Gemini и Google AI Studio. Модели умеют клонировать голос по 30-секундной записи и озвучивать диалоги с несколькими персонажами — со смехом, вздохами и перебиваниями, как в живом разговоре. Пощупать всё это можно прямо у Google — детали тут.

  • 3
Нифёдов [Nifed Alerts]@nifed_alertsАрмия и СВО3 часа назад
Google представила новые модели Gemini для генерации речи с поддержкой множества языков и голосов

А если у меня установлены GPT, DeepSeek и Gemini - меня можно считать Суперинтеллектуалом?

  • 17
  • 5
  • 2
  • 1
  • 1