Аудио и речь
23 июня 2026
Meta представила SAM Audio: модель для разделения звука по запросу
Р
Редакция New-ZZZ
AI at Meta Blog · 1 месяц назад
Компания представила SAM Audio — первую унифицированную мультимодальную модель для разделения звука. Эта модель позволяет легко изолировать любой звук из сложной аудиозаписи, используя интуитивные запросы (промпты), будь то текст, визуальные подсказки или временные метки. В основе SAM Audio лежит технический движок PE-AV, который обеспечивает передовую производительность, делая аудиосегментацию доступной, как сегментация объектов в изображениях.
Почему это важно
- —Это первый унифицированный подход к аудиосегментации, который работает по принципу мультимодальных запросов (текст, видео, время).
- —Модель позволяет пользователям изолировать конкретные звуки (например, гитару или шум транспорта) из сложной записи одним кликом, как это происходит в реальной жизни.
- —Компания также представила новые инструменты, включая бенчмарк SAM Audio-Bench и автоматический оценщик SAM Audio Judge.
Ключевые факты
- SAM Audio — это унифицированная мультимодальная модель для разделения звука.
- Модель использует интуитивные запросы (промпты): текст, визуальные подсказки или временные метки.
- В основе лежит технический движок PE-AV, который обеспечивает высокую производительность.
- Представлены новые инструменты: бенчмарк SAM Audio-Bench и автоматический оценщик SAM Audio Judge.
Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.