New-ZZZ
RU / EN
Аудио и речь 23 июня 2026

Meta представила SAM Audio: модель для разделения звука по запросу

Р
Редакция New-ZZZ
AI at Meta Blog · 1 месяц назад

Компания представила SAM Audio — первую унифицированную мультимодальную модель для разделения звука. Эта модель позволяет легко изолировать любой звук из сложной аудиозаписи, используя интуитивные запросы (промпты), будь то текст, визуальные подсказки или временные метки. В основе SAM Audio лежит технический движок PE-AV, который обеспечивает передовую производительность, делая аудиосегментацию доступной, как сегментация объектов в изображениях.

Почему это важно

  • Это первый унифицированный подход к аудиосегментации, который работает по принципу мультимодальных запросов (текст, видео, время).
  • Модель позволяет пользователям изолировать конкретные звуки (например, гитару или шум транспорта) из сложной записи одним кликом, как это происходит в реальной жизни.
  • Компания также представила новые инструменты, включая бенчмарк SAM Audio-Bench и автоматический оценщик SAM Audio Judge.

Ключевые факты

  • SAM Audio — это унифицированная мультимодальная модель для разделения звука.
  • Модель использует интуитивные запросы (промпты): текст, визуальные подсказки или временные метки.
  • В основе лежит технический движок PE-AV, который обеспечивает высокую производительность.
  • Представлены новые инструменты: бенчмарк SAM Audio-Bench и автоматический оценщик SAM Audio Judge.
Читать первоисточник

Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.

/ похожие материалы