Appearance
Speech & Audio
Alibaba Cloud Model Studio reference, section: Speech & Audio. 31 pages.
flowchart LR S["Speech Audio"] S --> p0["Audio"] S --> p1["Audio file recognition - Qwen"] S --> p2["Build Custom Voice Apps with CosyVoice Cloning"] S --> p3["Build Real-Time Speech Recognition with Parafo"] S --> p4["Build Real-Time Speech Recognition with WebSoc"] S --> p5["Call Qwen-TTS Speech Synthesis API with Code E"] S --> p6["Custom hotwords for speech recognition"] S --> p7["Fun-ASR Async Audio Transcription API Specs Pa"] S --> p8["Implement Intent Recognition for Smart Tool Se"] S --> p9["Integrate Qwen-ASR with OpenAI DashScope for S"] S --> more["plus 21 more"]
- Audio
- Audio file recognition - Qwen
- Build Custom Voice Apps with CosyVoice Cloning API - Model Studio - Alibaba Cloud - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Center
- Build Real-Time Speech Recognition with Paraformer Java SDK
- Build Real-Time Speech Recognition with WebSocket & DashScope SDK - Alibaba Cloud Model Studio - Alibaba Cloud - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Center
- Call Qwen-TTS Speech Synthesis API with Code Examples - Model Studio - Alibaba Cloud
- Custom hotwords for speech recognition
- Fun-ASR Async Audio Transcription API Specs & Parameters
- Implement Intent Recognition for Smart Tool Selection - Model Studio - Alibaba Cloud
- Integrate Qwen-ASR with OpenAI & DashScope for Speech Recognition
- Integrate Qwen3-Omni-Captioner API for Automated Audio Captioning - Alibaba Cloud Model Studio - Alibaba Cloud
- Non-real-time speech synthesis
- Paraformer recording file recognition API reference
- Real-time speech synthesis - CosyVoice/Sambert -
- Real-time speech synthesis - Qwen TTS, CosyVoice streaming
- Speech Recognition API Overview - Model Studio - Alibaba Cloud
- Speech synthesis models - TTS, voice cloning, voice design
- Speech-to-speech
- Speech-to-text models for real-time and file transcription
- SSML speech synthesis markup, LaTeX formula reading, CosyVoice - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Center
- Submit & Query Audio Recognition Tasks via Paraformer RESTful API
- Submit Async Transcription Tasks via Fun-ASR Java SDK
- Transcribe Audio Files Async with Paraformer Java SDK - Model Studio - Alibaba Cloud
- Transcribe Audio Files with Fun-ASR RESTful API
- Transcribe Audio Files with FunASR Python SDK
- Transcribe Recorded Audio with Paraformer Python SDK - Model Studio - Alibaba Cloud
- Translate Multimedia Files in 18 Languages with Qwen3-LiveTranslate-Flash - Alibaba Cloud Model Studio - Alibaba Cloud
- Voice cloning
- Voice Design - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Center
- Voices supported by non-real-time (Qwen-Omni) and real-time (Qwen-Omni-Realtime) models
- 千问声音复刻API参考 - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Center