ByteDance lanza Seed Audio 1.0: genera diálogos y efectos de sonido a partir de un único prompt
Según Beating, Seed Audio 1.0 de ByteDance se lanzó el 22 de julio y permite generar diálogo, efectos de sonido y audio ambiental con una precisión de temporización de 100 ms mediante un único prompt. El modelo admite entradas de texto y audio de referencia; puede producir aproximadamente dos minutos de audio por generación con capacidad ampliada, y mantiene voces de personajes consistentes en todas las salidas. El audio muestra más de un 90% de usabilidad en la mayoría de los escenarios, con un
GateNews·Hace22m
