MXStat
MXStat
Введите текст для поиска
Расширенный поиск каналов
  • Вход на сайт
  • Каталог
    Каталог каналов Региональные подборки Поиск каналов
    Добавить канал
  • Рейтинги
    Рейтинг каналов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Max
Нейросети | AI-агентура | Claude Code

24 Sep, 09:13

Открыть в Max Поделиться

🔊 Gemini 3.8 TTS: голос с нуля по текстовому промпту, час звука — $0,81

Google выпустила две новые модели синтеза речи — Gemini 3.8 Flash TTS и Flash-Lite TTS. Flash TTS создаёт голоса «с чистого листа»: задаёшь роль, акцент и характер голоса текстовым промптом на более чем 100 языках и диалектах, без выбора из готовой библиотеки.

Репликация голоса работает по 30-секундному образцу, но требует голосового подтверждения согласия от владельца голоса. Готовое аудио маркируется водяным знаком SynthID и снабжается C2PA-удостоверением.

По заявлению Google, Flash TTS заняла 1-е место в Voice Design Benchmark Hume AI (71.4 балла) и в моделировании акцентов (60.8). Функция Voice Remixing — тонкая настройка тембра и темпа готовых голосов — анонсирована, но пока не работает.

Flash TTS доступна в Gemini API, Google AI Studio и Gemini Notebook, Flash-Lite TTS — там же плюс в Google Vids. Доступ через Gemini Enterprise появится позже у обеих моделей. По данным одного источника (the-decoder), до конца 2026 года час вывода стоит $0,81 для Flash TTS и $0,54 для Flash-Lite, с 1 января 2027 — $1,62 и $1,08; расчёт идёт из 25 аудиотокенов на секунду звука.

https://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech/

💬 MAX

#новости #gemini #автоматизация

259
Каталог
Каталог каналов Подборки каналов Поиск каналов Добавить канал
Рейтинги
Рейтинг каналов Max
Контакты
Написать в Max Написать в Telegram Написать на почту
Всякая всячина
Пользовательское соглашение Политика конфиденциальности
Наши каналы
MXStat в Telegram MXStat в Max
Наши боты
MXAuthBot MXAnalyticsBot
Made by TGStat