Narración
Genere narraciones claras para demostraciones de productos, explicadores y flujos de soporte.
Modelos de audio
Explore Qwen Audio 3.0, LiveTranslate, Fun ASR, CosyVoice, música y rutas Omni Qwen para síntesis, transcripción, traducción y flujos de trabajo en tiempo real de audio.
Flujos de trabajo de audio
Las previas solo con ejemplo muestran los flujos de trabajo que pueden soportar estas rutas de Alibaba.
Genere narraciones claras para demostraciones de productos, explicadores y flujos de soporte.
Cree bucles ligeros, ambientes de interfaz y fondos de campaña.
Convierta llamadas, entrevistas y narraciones de demostración en flujos de trabajo de texto buscable.
10 rutas
Rutas de audio, como voz, música y audio multimodal, con configuraciones, estimaciones y caminos de acceso a Alibaba Cloud.
Alibaba Cloud
CosyVoice V3.5 Plus es la ruta de texto a voz de Alibaba para salida de voz generada. Nfero lo presenta como parte de la pila de audio junto con ASR, música y modelos Qwen Omni.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Fun ASR es la ruta de reconocimiento de voz de Alibaba para convertir audio en texto. Nfero lo conecta a transcripción, comprensión de audio, RAG y planificación de flujo de trabajo de agentes.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Fun ASR Flash 2026-06-15 es la versión actual de reconocimiento no en tiempo real de Alibaba para archivos de audio multilingües. Nfero registra el ID exacto del modelo y la ruta oficial de acceso para la planificación de implementación.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Fun ASR Realtime es la opción recomendada por Alibaba para el reconocimiento de voz multilingüe continuo y los dialectos compatibles. Nfero documenta el camino de planificación mientras que la transcripción pública permanece deshabilitada.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Fun Music V1 es la ruta de generación de música con texto de Alibaba en el catálogo de audio de Nfero. Está posicionada para exploración creativa, generación de ideas musicales y planificación de flujos de trabajo de audio.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Qwen Audio 3.0 TTS Flash es el camino de síntesis de voz de baja latencia para flujos de trabajo interactivos de voz y clonación de voz. Alibaba informa que el tiempo hasta el primer audio es inferior a 200 ms bajo condiciones compatibles.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Qwen Audio 3.0 TTS Plus es el camino de síntesis de voz de alta calidad para salida profesional de voz y entrega controlada por instrucciones. Nfero documenta su acceso internacional y base de precios sin revelar síntesis pública no verificada.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Qwen3.5 LiveTranslate Flash en tiempo real combina contexto de audio y video para traducción multilingüe, con latencia tan baja como 2,8 segundos bajo condiciones compatibles. Nfero documenta la ruta sin reclamar acceso público.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Qwen3.5 Omni Plus es el camino multimodal de Alibaba para combinar comprensión o generación de texto, imagen, audio y video. Nfero lo coloca en la superficie más amplia de Omni y planificación de agentes.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Alibaba Cloud
Qwen3.5 Omni Plus Realtime es la ruta de Omni de baja latencia para experiencias multimodales interactivas. Nfero lo utiliza para planificar flujos de trabajo en tiempo real, audio y de agentes de Alibaba.
Mejor para: Voz, transcripción y flujos de trabajo de audio
Prueba de código abierto
Qwen3-TTS, Qwen3-ASR y Qwen3-Omni hacen más fáciles para los compradores entender los flujos de trabajo de audio y multimodalidad de Alibaba.