Narrazione
Genera una narrazione chiara per demo di prodotti, spiegazioni e flussi di supporto.
Modelli audio
Esplora Qwen Audio 3.0, LiveTranslate, Fun ASR, CosyVoice, musica e Qwen Omni percorsi per sintesi, trascrizione, traduzione e workflow audio in tempo reale.
Flussi di lavoro audio
Anteprime solo per esempio mostrano i workflow che queste route di Alibaba possono supportare.
Genera una narrazione chiara per demo di prodotti, spiegazioni e flussi di supporto.
Crea loop di lancio leggeri, ambienti di interfaccia e basi sonore per campagne.
Trasforma chiamate, interviste e narrazioni di demo in workflow di testo cercabile.
10 percorsi
Rotte audio, musicali e multimodali con impostazioni, stime e percorsi di accesso ad Alibaba Cloud.
Alibaba Cloud
CosyVoice V3.5 Plus è il percorso di sintesi vocale di Alibaba per l'output vocale generato. Nfero lo presenta come parte dello stack audio insieme a ASR, musica e modelli Qwen Omni.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Fun ASR è il percorso di riconoscimento vocale di Alibaba per trasformare l'audio in testo. Nfero lo collega a trascrizione, comprensione audio, RAG e pianificazione di workflow per agenti.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Fun ASR Flash 2026-06-15 è la versione attuale di riconoscimento non in tempo reale di Alibaba per file audio multilingue. Nfero registra l'ID esatto del modello e il percorso ufficiale di accesso per la pianificazione della realizzazione.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Fun ASR Realtime è il percorso consigliato da Alibaba per il riconoscimento vocale multilingue continuo e i dialetti supportati. Nfero documenta il percorso di pianificazione mentre la trascrizione pubblica rimane disabilitata.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Fun Music V1 è il percorso di generazione musicale testo-generata di Alibaba nella catalogo audio Nfero. È posizionato per l'esplorazione creativa, l'ideazione musicale e la pianificazione dei flussi di lavoro audio.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Qwen Audio 3.0 TTS Flash è il percorso di sintesi vocale a bassa latenza per flussi di lavoro interattivi e di clonazione vocale. Alibaba segnala un tempo per la prima audio inferiore a 200 ms sotto condizioni supportate.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Qwen Audio 3.0 TTS Plus è il percorso di sintesi vocale ad alta qualità per output vocale professionale e consegna controllata dalle istruzioni. Nfero documenta l'accesso internazionale e la base dei prezzi elencati senza rivelare sintesi non verificate pubbliche.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Qwen3.5 LiveTranslate Flash Realtime combina contesto audio e visivo per la traduzione multilingue, con una latenza fino a 2,8 secondi sotto condizioni supportate. Nfero documenta il percorso senza affermare l'accesso pubblico.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Qwen3.5 Omni Plus è il percorso multimodale di Alibaba per combinare comprensione o generazione di testo, immagini, audio e video. Nfero lo colloca nella superficie più ampia di Omni e pianificazione degli agenti.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Alibaba Cloud
Qwen3.5 Omni Plus Realtime è il percorso Omni a bassa latenza per esperienze multimodali interattive. Nfero lo utilizza per la pianificazione in tempo reale, audio e flussi di lavoro rivolti agli agenti di Alibaba.
Adatto a: Parola, trascrizione e flussi di lavoro audio
Prova open source
Qwen3-TTS, Qwen3-ASR e Qwen3-Omni rendono più semplice per gli acquirenti comprendere i flussi di lavoro audio e multimodali di Alibaba.