Google выпустила две новые TTS‑модели Gemini 3.8 Flash и более дешёвую Flash-Lite. Они создают голос по текстовому описанию, позволяют управлять интонацией и темпом и уже доступны в API Gemini и Google AI Studio. Модели умеют клонировать голос по 30-секундной записи и озвучивать диалоги с несколькими персонажами — со смехом, вздохами и перебиваниями, как в живом разговоре. Пощупать всё это можно прямо у Google — детали тут.
- 3