Configuración de privacidad

Aviso de privacidad y GDPR

Nfero usa almacenamiento esencial para las preferencias de idioma y los controles de acceso a las demos. Con su consentimiento, Google Analytics y los eventos de uso ligeros ayudan a mejorar las demos de modelos y las rutas de suscripción externas. Los prompts de demos en vivo pueden enviarse a endpoints de modelos alojados por Alibaba y configurados.

Flujos de trabajo de audio

Comprensión de voz, música y discurso.

Las previas solo con ejemplo muestran los flujos de trabajo que pueden soportar estas rutas de Alibaba.

Texto a voz

Narración

Genere narraciones claras para demostraciones de productos, explicadores y flujos de soporte.

Texto a música

Fondo musical

Cree bucles ligeros, ambientes de interfaz y fondos de campaña.

Voz a texto

Transcripción

Convierta llamadas, entrevistas y narraciones de demostración en flujos de trabajo de texto buscable.

10 rutas

Catálogo de modelos de audio

Rutas de audio, como voz, música y audio multimodal, con configuraciones, estimaciones y caminos de acceso a Alibaba Cloud.

Alibaba Cloud

CosyVoice V3.5 Plus

Vista previa de demostración

CosyVoice V3.5 Plus es la ruta de texto a voz de Alibaba para salida de voz generada. Nfero lo presenta como parte de la pila de audio junto con ASR, música y modelos Qwen Omni.

Mejor para: Voz, transcripción y flujos de trabajo de audio

CosyVoiceTexto a vozAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor

Alibaba Cloud

Fun ASR

Vista previa de demostración

Fun ASR es la ruta de reconocimiento de voz de Alibaba para convertir audio en texto. Nfero lo conecta a transcripción, comprensión de audio, RAG y planificación de flujo de trabajo de agentes.

Mejor para: Voz, transcripción y flujos de trabajo de audio

FunVoz a textoAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor
Vista previa de demostración

Fun ASR Flash 2026-06-15 es la versión actual de reconocimiento no en tiempo real de Alibaba para archivos de audio multilingües. Nfero registra el ID exacto del modelo y la ruta oficial de acceso para la planificación de implementación.

Mejor para: Voz, transcripción y flujos de trabajo de audio

Fun ASRVoz a textoAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor

Alibaba Cloud

Fun ASR Realtime

Vista previa de demostración

Fun ASR Realtime es la opción recomendada por Alibaba para el reconocimiento de voz multilingüe continuo y los dialectos compatibles. Nfero documenta el camino de planificación mientras que la transcripción pública permanece deshabilitada.

Mejor para: Voz, transcripción y flujos de trabajo de audio

Fun ASRVoz a textoAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor

Alibaba Cloud

Fun Music V1

Vista previa de demostración

Fun Music V1 es la ruta de generación de música con texto de Alibaba en el catálogo de audio de Nfero. Está posicionada para exploración creativa, generación de ideas musicales y planificación de flujos de trabajo de audio.

Mejor para: Voz, transcripción y flujos de trabajo de audio

FunGeneración de audioAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor
Vista previa de demostración

Qwen Audio 3.0 TTS Flash es el camino de síntesis de voz de baja latencia para flujos de trabajo interactivos de voz y clonación de voz. Alibaba informa que el tiempo hasta el primer audio es inferior a 200 ms bajo condiciones compatibles.

Mejor para: Voz, transcripción y flujos de trabajo de audio

Qwen AudioTexto a vozAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor
Vista previa de demostración

Qwen Audio 3.0 TTS Plus es el camino de síntesis de voz de alta calidad para salida profesional de voz y entrega controlada por instrucciones. Nfero documenta su acceso internacional y base de precios sin revelar síntesis pública no verificada.

Mejor para: Voz, transcripción y flujos de trabajo de audio

Qwen AudioTexto a vozAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor
Vista previa de demostración

Qwen3.5 LiveTranslate Flash en tiempo real combina contexto de audio y video para traducción multilingüe, con latencia tan baja como 2,8 segundos bajo condiciones compatibles. Nfero documenta la ruta sin reclamar acceso público.

Mejor para: Voz, transcripción y flujos de trabajo de audio

QwenVoz a vozAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor

Alibaba Cloud

Qwen3.5 Omni Plus

Vista previa de demostración

Qwen3.5 Omni Plus es el camino multimodal de Alibaba para combinar comprensión o generación de texto, imagen, audio y video. Nfero lo coloca en la superficie más amplia de Omni y planificación de agentes.

Mejor para: Voz, transcripción y flujos de trabajo de audio

QwenOmniAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor
Vista previa de demostración

Qwen3.5 Omni Plus Realtime es la ruta de Omni de baja latencia para experiencias multimodales interactivas. Nfero lo utiliza para planificar flujos de trabajo en tiempo real, audio y de agentes de Alibaba.

Mejor para: Voz, transcripción y flujos de trabajo de audio

QwenOmniAplican términos
Disponibilidad
Guía y ejemplos
Demo estándar estimada
Confirme con el proveedor

Prueba de código abierto

Conecte los proyectos de voz de Qwen a demostraciones de audio.

Qwen3-TTS, Qwen3-ASR y Qwen3-Omni hacen más fáciles para los compradores entender los flujos de trabajo de audio y multimodalidad de Alibaba.

Fuente abierta