El lanzamiento de Qwen de Alibaba presenta Qwen-Audio-3.0-TTS con una versión Flash de 300 ms para una interacción en tiempo real

BABA-1,50%
Qwen de Alibaba lanzó Qwen-Audio-3.0-TTS, un modelo de síntesis de voz que admite instrucciones naturales en lenguaje libre. El modelo incluye una versión Flash para la interacción en tiempo real con una latencia de 300 ms en el primer paquete, y una versión Plus para una generación de alta calidad.
Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios