Narração
Gere narração clara para demonstrações de produtos, explicadores e fluxos de suporte.
Modelos de áudio
Explore Qwen Audio 3.0, LiveTranslate, Fun ASR, CosyVoice, música e rotas Omni Qwen para síntese, transcrição, tradução e fluxos de trabalho de áudio em tempo real.
Fluxos de trabalho de áudio
Prévias apenas com exemplos mostram os fluxos de trabalho que essas rotas da Alibaba podem suportar.
Gere narração clara para demonstrações de produtos, explicadores e fluxos de suporte.
Crie loops leves para lançamentos, ambientes de interface e fundos de campanha.
Converta ligações, entrevistas e narração de demonstrações em fluxos de trabalho de texto pesquisável.
10 rotas
Rotas de áudio, música e multimídia com configurações, estimativas e caminhos de acesso à Alibaba Cloud.
Alibaba Cloud
O CosyVoice V3.5 Plus é a rota de texto para fala da Alibaba para saída de voz gerada. A Nfero o apresenta como parte da pilha de áudio junto com ASR, música e modelos Qwen Omni.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
O Fun ASR é a rota de reconhecimento de fala da Alibaba para transformar áudio em texto. A Nfero o conecta à transcrição, compreensão de áudio, RAG e planejamento de fluxos de trabalho de agentes.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
Fun ASR Flash 2026-06-15 é o snapshot atual da Alibaba para reconhecimento não em tempo real de arquivos de áudio multilíngues. Nfero registra o ID exato do modelo e o caminho oficial de acesso para planejamento de implementação.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
Fun ASR Realtime é a rota recomendada pela Alibaba para reconhecimento contínuo de fala multilíngue e dialetos suportados. Nfero documenta o caminho de planejamento enquanto a transcrição pública permanece desativada.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
Fun Music V1 é a rota de texto para música da Alibaba no catálogo de áudio Nfero. É posicionada para exploração criativa, geração de ideias musicais e planejamento de fluxos de trabalho de áudio.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
Qwen Audio 3.0 TTS Flash é o caminho para síntese de fala com baixa latência em fluxos de trabalho interativos de fala e clonagem de voz. A Alibaba relata tempo até o primeiro áudio abaixo de 200 ms sob condições suportadas.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
Qwen Audio 3.0 TTS Plus é o caminho para síntese de fala de alta qualidade para saída de voz profissional e entrega controlada por instruções. Nfero documenta seu acesso internacional e base de preço sem expor síntese pública não verificada.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
O Qwen3.5 LiveTranslate Flash Realtime combina contexto de áudio e visual para tradução multilíngue, com latência tão baixa quanto 2,8 segundos sob condições suportadas. Nfero documenta o caminho sem reivindicar acesso público.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
O Qwen3.5 Omni Plus é o caminho multimodal da Alibaba para combinar compreensão ou geração de texto, imagem, áudio e vídeo. O Nfero o coloca na superfície mais ampla de Omni e planejamento de agentes.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Alibaba Cloud
O Qwen3.5 Omni Plus Realtime é a rota Omni de baixa latência para experiências multimodais interativas. O Nfero o usa para planejar fluxos de trabalho em tempo real, áudio e voltados para agentes da Alibaba.
Melhor para: Voz, transcrição e fluxos de trabalho de áudio
Prova de código aberto
Qwen3-TTS, Qwen3-ASR e Qwen3-Omni tornam os fluxos de trabalho de áudio e multimídia da Alibaba mais fáceis de entender para os compradores.