Skip to content

Speech & Audio

Alibaba Cloud Model Studio reference, section: Speech & Audio. 31 pages.

flowchart LR
  S["Speech Audio"]
  S --> p0["Audio"]
  S --> p1["Audio file recognition - Qwen"]
  S --> p2["Build Custom Voice Apps with CosyVoice Cloning"]
  S --> p3["Build Real-Time Speech Recognition with Parafo"]
  S --> p4["Build Real-Time Speech Recognition with WebSoc"]
  S --> p5["Call Qwen-TTS Speech Synthesis API with Code E"]
  S --> p6["Custom hotwords for speech recognition"]
  S --> p7["Fun-ASR Async Audio Transcription API Specs Pa"]
  S --> p8["Implement Intent Recognition for Smart Tool Se"]
  S --> p9["Integrate Qwen-ASR with OpenAI DashScope for S"]
  S --> more["plus 21 more"]