Pika запускает четыре более доступные генеративные аудиомодели
Pika Labs представила четыре базовые модели генеративного аудио, охватывающие создание саундтреков, музыки, звуковых эффектов и речи. Pika Soundtrack может создавать аудио на основе видео, а остальные модели предназначены для более специализированных задач генерации звука.
Компания утверждает, что усовершенствования в обучении моделей и инференсе сделали эти инструменты до 20 раз дешевле конкурирующих аудиомоделей. Она также заявляет, что Pika Soundtrack вдвое экономичнее Hunyuan Foley, которую называет единственной сопоставимой моделью преобразования видео в аудио.
Pika Soundtrack, Pika Music, Pika SFX и Pika Speech первоначально доступны исключительно через Pika API Club.
Почему это важно
- —Снижение стоимости генерации может сделать передовые аудиоинструменты доступными большему числу разработчиков и создателей медиаконтента.
- —Семейство моделей объединяет генерацию аудио из видео, музыки, звуковых эффектов и речи в рамках единого API.
- —Более эффективные обучение и инференс могут усилить ценовую конкуренцию в сфере генеративных медиа.
Ключевые факты
- Pika Audio включает четыре базовые модели для создания саундтреков, музыки, звуковых эффектов и речи.
- Pika утверждает, что использование этих моделей может обходиться в 20 раз дешевле по сравнению с другими аудиомоделями на рынке.
- По данным компании, Pika Soundtrack вдвое экономичнее Hunyuan Foley.
- Изначально модели доступны исключительно через Pika API Club.
Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.