การตั้งค่าความเป็นส่วนตัว

ประกาศความเป็นส่วนตัวและ GDPR

Nfero ใช้พื้นที่จัดเก็บที่จำเป็นสำหรับการตั้งค่าภาษาและการควบคุมการเข้าถึงเดโม เมื่อคุณยินยอม Google Analytics และเหตุการณ์การใช้งานแบบเบาจะช่วยปรับปรุงเดโมโมเดลและเส้นทางการสมัครสมาชิกภายนอก พรอมป์เดโมสดอาจถูกส่งไปยังเอนด์พอยต์โมเดลที่ Alibaba โฮสต์และกำหนดค่าไว้

กระบวนการทำงานด้านเสียง

การเข้าใจเสียง พูด และดนตรี

ตัวอย่างการดูเพียงอย่างเดียวแสดงถึงกระบวนการทำงานที่เส้นทางอัลิบาบาเหล่านี้สามารถสนับสนุนได้

ข้อความสู่เสียงพูด

การบรรยายเสียง

สร้างการบรรยายที่ชัดเจนสำหรับการสาธิตผลิตภัณฑ์ วิดีโออธิบาย และกระบวนการสนับสนุน

ข้อความสู่เพลง

เสียงพื้นหลัง

สร้างวงเล่นที่มีน้ำหนักเบา บรรยากาศของอินเทอร์เฟซ และเสียงพื้นหลังสำหรับแคมเปญ

เสียงสู่ข้อความ

การจดบันทึกเสียง

แปลงการสนทนา บทสัมภาษณ์ และการบรรยายตัวอย่างให้กลายเป็นงานจัดการข้อความที่ค้นหาได้

10 เส้นทาง

แคตตาล็อกโมเดลเสียง

เส้นทางเสียง ดนตรี และเสียงหลายสื่อพร้อมการตั้งค่า การประมาณ และเส้นทางการเข้าถึง Alibaba Cloud

Alibaba Cloud

CosyVoice V3.5 Plus

แบบจำลองแสดงผล

CosyVoice V3.5 Plus เป็นเส้นทางการแปลงข้อความเป็นเสียงของ Alibaba สำหรับผลลัพธ์เสียงที่ถูกสร้างขึ้น Nfero นำเสนอโมเดลนี้เป็นส่วนหนึ่งของระบบเสียงพร้อมโมเดล ASR, เพลง และ Qwen Omni

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

CosyVoiceข้อความเป็นเสียงพูดมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ

Alibaba Cloud

Fun ASR

แบบจำลองแสดงผล

Fun ASR เป็นเส้นทางการรู้จำเสียงของ Alibaba สำหรับการแปลงเสียงเป็นข้อความ Nfero เชื่อมต่อโมเดลนี้กับงานจดบันทึกเสียง การทำความเข้าใจเสียง RAG และการวางแผนกระบวนการทำงานของเอเจนต์

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Funเสียงพูดเป็นข้อความมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ
แบบจำลองแสดงผล

Fun ASR Flash 2026-06-15 เป็นสแนปช็อตการรู้จำเสียงแบบไม่เรียลไทม์ในปัจจุบันของ Alibaba สำหรับไฟล์เสียงหลายภาษา Nfero บันทึก ID โมเดลที่แม่นยำและเส้นทางการเข้าถึงอย่างเป็นทางการสำหรับการวางแผนการดำเนินงาน

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Fun ASRเสียงพูดเป็นข้อความมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ

Alibaba Cloud

Fun ASR Realtime

แบบจำลองแสดงผล

Fun ASR Realtime เป็นเส้นทางที่แนะนำของ Alibaba สำหรับการรู้จำเสียงหลายภาษาแบบต่อเนื่องและการสนับสนุนภาษาพูดเฉพาะถิ่น Nfero จัดทำแผนผังการวางแผน ในขณะที่การจดบันทึกสาธารณะยังไม่เปิดใช้งาน

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Fun ASRเสียงพูดเป็นข้อความมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ

Alibaba Cloud

Fun Music V1

แบบจำลองแสดงผล

Fun Music V1 เป็นเส้นทางการสร้างเพลงจากข้อความในไลบรารีเสียง Nfero มีจุดประสงค์เพื่อการสำรวจเชิงสร้างสรรค์ การคิดค้นเพลง และการวางแผนกระบวนการทำงานด้านเสียง

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Funการสร้างเสียงพูดมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ
แบบจำลองแสดงผล

Qwen Audio 3.0 TTS Flash เป็นเส้นทางการสร้างเสียงพูดแบบต่ำความล่าช้าสำหรับงานที่เกี่ยวข้องกับเสียงพูดและการจำลองเสียงพูด Alibaba รายงานเวลาถึงเสียงแรกต่ำกว่า 200 มิลลิวินาทีภายใต้เงื่อนไขที่รองรับ

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Qwen Audioข้อความเป็นเสียงพูดมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ
แบบจำลองแสดงผล

Qwen Audio 3.0 TTS Plus เป็นเส้นทางการสร้างเสียงพูดคุณภาพสูงสำหรับผลลัพธ์เสียงพูดมืออาชีพและบริการที่ควบคุมด้วยคำสั่ง Nfero จัดทำเอกสารการเข้าถึงระดับนานาชาติและฐานราคาขาย โดยไม่เปิดเผยการสร้างเสียงที่ยังไม่ได้รับการตรวจสอบ

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Qwen Audioข้อความเป็นเสียงพูดมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ
แบบจำลองแสดงผล

Qwen3.5 LiveTranslate Flash Realtime รวมการตั้งค่าเสียงและภาพเพื่อการแปลหลายภาษา โดยมีความล่าช้าต่ำสุดที่ 2.8 วินาทีภายใต้เงื่อนไขที่รองรับ Nfero จัดทำเส้นทางโดยไม่กล่าวอ้างการเข้าถึงสาธารณะ

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Qwenเสียงพูดเป็นเสียงพูดมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ

Alibaba Cloud

Qwen3.5 Omni Plus

แบบจำลองแสดงผล

Qwen3.5 Omni Plus เป็นเส้นทางหลายมิติของ Alibaba สำหรับการรวมการเข้าใจหรือการสร้างข้อความ ภาพ เสียง และวิดีโอ Nfero จัดวางโมเดลนี้ในพื้นที่ Omni และการวางแผนตัวช่วยที่กว้างขึ้น

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Qwenโอมนิมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ
แบบจำลองแสดงผล

Qwen3.5 Omni Plus Realtime เป็นเส้นทาง Omni ที่มีความล่าช้าต่ำสำหรับประสบการณ์มัลติมีเดียที่มีปฏิสัมพันธ์ Nfero ใช้เพื่อวางแผนกระบวนการทำงานแบบเรียลไทม์ เสียง และที่เกี่ยวข้องกับ Alibaba

เหมาะสำหรับ: เสียง การจดบันทึกเสียง และกระบวนการทำงานด้านเสียง

Qwenโอมนิมีข้อกำหนด
การพร้อมใช้งาน
แนวทางและตัวอย่าง
ค่าใช้จ่ายในการสาธิตมาตรฐานประมาณ
ยืนยันกับผู้ให้บริการ

หลักฐานโอเพนซอร์ส

เชื่อมต่อโปรเจกต์การพูดของ Qwen กับตัวอย่างเสียง

Qwen3-TTS, Qwen3-ASR และ Qwen3-Omni ช่วยให้ผู้ซื้อเข้าใจกระบวนการทำงานด้านเสียงและมัลติมีเดียของ Alibaba ได้ง่ายขึ้น

แหล่งโค้ดที่เปิดเผย