Рекламный контент о навыках и LinkedIn
🧠 Нейросети и Технологии. Подписаться
Читать далее →
🤖 NVIDIA выпустила Audio Flamingo Next
Audio Flamingo Next (AF-Next) — открытая аудио-языковая модель, обученная на 1 млн часов аудио и 108 млн примеров. Модель генерирует детальн…
Читать далее →
🤖 Google DeepMind выпустил Gemini 3.
🤖 Google DeepMind выпустил Gemini 3.1 Flash TTS — самую управляемую модель генерации речи с Audio Tags.
Новая система позволяет режиссировать озвучку через текстовые команды прямо в промпте. Можно управлять стилем голоса, подачей и темпом речи.
Ключевые характеристики:
- Более естественное звучание речи
- Поддержка 70+ языков (русский, японский, немецкий и др.)
- Все выходные аудио маркируются SynthID (цифровой водяной знак)
Метрики:
На бенчмарке Artificial Analysis TTS Arena модель заняла 2-е место с Elo-рейтингом 1211 — сразу за Inworld TTS 1.5 Max (1215) и выше ElevenLabs v3 (1179).
Доступность:
- Preview через Gemini API и Google AI Studio
- Бизнесу — через Vertex AI
- Всем пользователям — скоро появится в Google Vids
🧠 Нейросети и Технологии. Подписаться
🤖 AI Daily Digest — 16 апреля 2026
🌐 Мировые новости
⚖️ ИИ-чат в суде: ваши диалоги могут быть уликой
Суд США постановил, что конфиденциальные переговоры с ИИ-юристом не защищены…
Читать далее →
🤖 NVIDIA выпустила Lyra 2.0: 3D-миры из одной фотографии
NVIDIA опубликовала веса и код Lyra 2.0 - системы, которая принимает изображение, генерирует видео с управляемой траектори…
Читать далее →