AI-translated from English; not yet reviewed by a fluent editor.
# Qwen Audio 3.1 விரிவான குரல் மாடல் தொகுப்பை அறிமுகப்படுத்துகிறது. 95% விலைக் குறைப்புக்குப் பின்னுள்ள சூழல் அவசியம்
> Qwen Audio 3.1 ஒலி உருவாக்கத்தையும் புரிதலையும் சேர்க்கிறது. அதன் API ஆவணங்கள் முழுமையற்றவை; கட்டண அலகுகள் மாறுவதால் ASR-இல் விளம்பரப்படுத்தப்படும் சேமிப்பைக் கணக்கிடுவது சிக்கலாகிறது.
By BIG CHANGE Editorial
Published: 2026-09-23T15:40:58.970Z
Updated: 2026-09-23T15:40:58.970Z
Canonical: https://bigchange.ai/blog/qwen-audio-3-1-models-api-pricing

AI-generated conceptual illustration by BIG CHANGE.
Alibaba-வின் Qwen குழு, உரைமாற்றம், பேச்சு உருவாக்கம், நேரடிக் குரல் உரையாடல் ஆகியவற்றை உள்ளடக்கிய ஐந்து Qwen Audio 3.1 மாடல்களை அறிமுகப்படுத்தியுள்ளது. ASR, TTS-Next, Realtime Plus ஆகியவற்றுக்கு ஆவணப்படுத்தப்பட்ட ஹோஸ்ட் செய்யப்பட்ட endpoint-கள் உள்ளன. TTS Flash-க்கு வெளியிடப்பட்ட மாடல் ID-யும் விலையும் உள்ளன; ஆனால் ஒருங்கிணைப்பு ஆவணங்கள் குறைவாக முழுமையடைந்துள்ளன. BIG CHANGE ஆய்வு செய்த பொது டெவலப்பர் ஆவணங்களில் ASR-Next-க்கு மாடல் ID, பிராந்தியம் அல்லது விலை இல்லை.
[The Decoder செய்தி வெளியிட்டது](https://the-decoder.com/alibaba-launches-qwen-audio-3-1-with-five-new-models-and-slashes-ai-audio-prices-by-up-to-95-percent) Qwen கூறியுள்ள உரையிலிருந்து பேச்சாக மாற்றுவதில் சுமார் 70%, நேரடி ஆடியோவில் 85%, பேச்சறிதலில் அதிகபட்சம் 95% வரையிலான விலைக் குறைப்புகளைப் பற்றி. அந்த எண்களைச் சரிபார்க்கும்போது கட்டண அலகுகளையும் கணக்கில் கொள்ள வேண்டும்.
## முக்கிய மாற்றம்
- **என்ன மாறியது:** Qwen இப்போது உரைமாற்றம், பேச்சு உருவாக்கம், ஒலிச் சூழல் உருவாக்கம், நேரடி உரையாடல் வரை ஒரே ஹோஸ்ட் செய்யப்பட்ட குடும்பத்தில் குரல் தயாரிப்பின் பல அம்சங்களை வழங்குகிறது. அதன் ஐந்து கூறுகளுக்கும் டெவலப்பர் அணுகல் ஒரே அளவு முழுமையாக இல்லை.
- **இது ஏன் முக்கியம்:** உரைமாற்றம் அல்லது குரல் சேவைகளுக்கான செலவைத் திட்டமிடும் டெவலப்பர்களுக்கு, ஒவ்வொரு endpoint-ஐயும் விலை நிர்ணயிக்க ஆடியோவின் நிமிட அளவு மட்டும் போதாது. Token அடிப்படையிலான ASR கட்டணம், உள்வரும் ஆடியோவையும் அதிலிருந்து கிடைக்கும் உரையையும் சேர்த்துக் கணக்கிடுகிறது; நேரடி உரையாடலில் தனித்தனியாக விலை நிர்ணயிக்கப்படும் நான்கு stream-கள் உள்ளன.
- **எதைக் கவனிக்க வேண்டும்:** ASR-Next அணுகலுடன், சுயாதீன மொழி மற்றும் தாமதச் சோதனைகள் பயனுள்ள சேமிப்பை உறுதிப்படுத்துகிறதா என்பதையும் கவனியுங்கள். அவை உறுதிப்படுத்தினால், குரல் முகவர், உரைமாற்றம், டப்பிங் சேவை வழங்குநர்கள் அந்தச் சேமிப்பை வாடிக்கையாளர் விலைகளிலும் வழங்குகிறார்களா, போட்டி பேச்சு API-களும் இதைப் பின்பற்றுகிறதா என்பதே அடுத்த பெரிய கேள்வி.
## ஐந்து மாடல்களின் ஒப்பீடு
| அறிவிக்கப்பட்ட மாடல் | நோக்கமிடப்பட்ட பயன்பாடு | செப்டம்பர் 23 அன்று ஆவணப்படுத்தப்பட்ட அணுகல் | விலையும் நடைமுறை வரம்பும் |
| --- | --- | --- | --- |
| **Qwen Audio 3.1 ASR** | தொடர்நிலை, கோப்பு, குறு வடிவ உரைமாற்றம்; கோப்பு மற்றும் குறு வடிவ endpoint-களில் விருப்பப் பேச்சாளர் பிரித்தறிதல் | சிங்கப்பூர் மற்றும் பெய்ஜிங்கில் ஹோஸ்ட் செய்யப்பட்ட WebSocket அல்லது HTTP API-கள். [சர்வதேச வழிகாட்டி ](https://docs.qwencloud.com/developer-guides/speech/speech-to-text-models)30 மொழிகளையும் சீன மொழியின் 10 வட்டாரப் பேச்சு வகைகளையும் பட்டியலிடுகிறது. | சிங்கப்பூரில் கோப்பு/குறு வடிவ உரைமாற்றத்துக்கு, **ஒரு மில்லியன் உள்வரும் ஆடியோ token-களுக்கு $0.15 + ஒரு மில்லியன் வெளியேறும் உரை token-களுக்கு $0.47** என்ற விலையிலிருந்து, **$0.93 + $0.70** வரை, தொடர்நிலை/செய்தி அனுப்பலுக்கு. கோப்பு உரைமாற்றம் 12 மணிநேரம்/2 GB வரை அனுமதிக்கிறது; குறு வடிவம் 5 நிமிடங்கள்/2 GB வரை. |
| **Qwen Audio 3.1 ASR-Next** | பேச்சாளரைக் கண்டறிந்து நேரமுத்திரையிடுதல்; உணர்ச்சி, சுற்றுப்புற நிகழ்வுகள், இயந்திர ஒலிகள் ஆகியவற்றை அடையாளம் காணுதல் | Qwen இதை அறிவித்துள்ளது; ஆனால் தற்போதைய Model Studio மற்றும் QwenCloud ஆவணங்களில் பொது API மாடல் ID, பிராந்தியம், கட்டணம் அல்லது வரம்பு எதுவும் கிடைக்கவில்லை. | **பொதுவில் ஆவணப்படுத்தப்படவில்லை** |
| **Qwen Audio 3.1 TTS** | பல மொழிப் பேச்சு, மொழிகளுக்கிடையிலான குரல் பரிமாற்றம், பேச்சு வெளிப்பாட்டை prompt மூலம் கட்டுப்படுத்துதல் | `qwen-audio-3.1-tts-flash` என்பது Alibaba-வின் விலை அறிவிப்பில் இடம்பெறுகிறது. ஆய்வு செய்த [குரல் நகலாக்க API ](https://www.alibabacloud.com/help/en/model-studio/voice-clone-design-http-api)இன்னும் 3.0 TTS Flash-ஐக் குறிப்பிடுகிறது. | சிங்கப்பூர்: **ஒரு மில்லியன் உள்வரும் உரை token-களுக்கு $0.23 + ஒரு மில்லியன் வெளியேறும் ஆடியோ token-களுக்கு $1.87**. ஆய்வு செய்த 3.1 ஆவணங்களில் தற்போதைய பொது வரம்புகள் குறிப்பிடப்படவில்லை. |
| **Qwen Audio 3.1 TTS-Next** | பேச்சு, ஒலி விளைவுகள், பின்னணி ஆடியோ ஆகியவற்றை ஒருங்கிணைத்து உருவாக்குதல் | பெய்ஜிங்கில் ஹோஸ்ட் செய்யப்பட்ட, தொடர்நிலை ஆதரவில்லாத HTTPS API; சீனம் மற்றும் ஆங்கிலத்துக்கான ஆவணம் உள்ளது | **உள்வரும் ஒரு மில்லியன் token-களுக்கு $0.848 + வெளியேறும் ஒரு மில்லியன் token-களுக்கு $1.696**. உள்ளீடு 3,000 எழுத்துகள் வரை; podcast வெளியீடு நான்கு நிமிடங்கள் வரை, மற்றவை இரண்டு நிமிடங்கள் வரை. |
| **Qwen Audio 3.1 Realtime Plus** | இடையூறு செய்யவும் கருவிகளை அழைக்கவும் கூடிய முழு இருதிசைக் குரல் உரையாடல் | சிங்கப்பூர் மற்றும் பெய்ஜிங்கில் ஹோஸ்ட் செய்யப்பட்ட WebSocket API. [வழிகாட்டி ](https://docs.qwencloud.com/developer-guides/speech/qwen-audio-realtime)11 மொழிகளைப் பட்டியலிடுகிறது. | சிங்கப்பூர்: **உள்வரும் உரையின் ஒரு மில்லியன் token-களுக்கு $0.80, உள்வரும் ஆடியோவுக்கு $6.40, வெளியேறும் உரைக்கு $6.40, வெளியேறும் ஆடியோவுக்கு $24**. இது 50 ஆடியோ உரையாடல் திருப்பங்கள் அல்லது 300 விநாடி ஆடியோ வரலாறு வரை வைத்திருக்கும். |
இவை ஹோஸ்ட் செய்யப்பட்ட API தயாரிப்புகள். பதிவிறக்கக்கூடிய 3.1 மாடல் எடைகளையோ அவற்றுக்கான உரிமத்தையோ BIG CHANGE கண்டறியவில்லை. QwenAudio-வின் GitHub களஞ்சியத்தில் உள்ள MIT உரிமம் திட்ட இணையதளத்துக்குப் பொருந்தும்; அதை மாடல்களுக்கான உரிமமாகப் புரிந்துகொள்ளக் கூடாது.
மொழிகளின் எண்ணிக்கையும் எந்த ஆவணத்தைப் பார்க்கிறீர்கள் என்பதைப் பொறுத்தது. Qwen-இன் [சரிபார்க்கப்பட்ட வெளியீட்டுப் பதிவு ](https://www.sina.cn/news/detail/5346330620985983.html)ASR 30 மொழிகளையும் 16 சீன வட்டாரப் பேச்சு வகைகளையும் ஆதரிக்கிறது என்கிறது; சர்வதேச API வழிகாட்டி 30 மொழிகளையும் 10 வட்டாரப் பேச்சு வகைகளையும் பட்டியலிடுகிறது. டெவலப்பர்கள் தாங்கள் உண்மையில் அழைக்கக்கூடிய endpoint-க்கான பட்டியலையே பயன்படுத்த வேண்டும்.
## 95% குறைப்பு என்ற கூற்று பொது விலை அட்டவணையுடன் பொருந்தவில்லை
Alibaba-வின் [விலை மாற்ற அறிவிப்பு ](https://www.alibabacloud.com/en/notice/model_studio_price_reduction_notice_for_selected_audio_models_891?_p_lc=1)செப்டம்பர் 22 அன்று நடைமுறைக்கு வந்தது. அதில் துல்லியமாக ஒப்பிடப்படுவது `qwen-audio-3.0-realtime-flash`, புதிய 3.1 Realtime Plus அல்ல. சிங்கப்பூர் விலைக் குறைப்புகள் (பழைய விலை − புதிய விலை) / பழைய விலை என்ற கணக்கில் பெறப்பட்டவை:
| Realtime Flash தொடர்நிலை | முன்பு (USD) | பிறகு (USD) | குறைப்பு |
| --- | --- | --- | --- |
| ஒரு மில்லியன் token-க்கு உள்வரும் உரை | $0.45 | $0.23 | 48.89% |
| ஒரு மில்லியன் token-க்கு உள்வரும் ஆடியோ | $4.50 | $0.93 | 79.33% |
| ஒரு மில்லியன் token-க்கு வெளியேறும் உரை | $4.50 | $0.70 | 84.44% |
| ஒரு மில்லியன் token-க்கு வெளியேறும் வெளியீடு (உரை + ஆடியோ) | $15.00 | $1.87 | **87.53%** |
அதே அறிவிப்பு, 3.1 TTS Flash விலையை 10,000 எழுத்துகளுக்கு $0.15 என்ற முறையிலிருந்து தனித்த உள்வரும் மற்றும் வெளியேறும் token விலைகளாக மாற்றுகிறது. [தற்போதைய விலைப் பக்கம் ](https://www.alibabacloud.com/help/en/model-studio/model-pricing)3.1 ASR-க்கும் உள்வரும் மற்றும் வெளியேறும் token அடிப்படையிலான விலையைப் பட்டியலிடுகிறது; 3.0 ASR-க்கு ஒவ்வொரு ஆடியோ விநாடிக்கும் கட்டணம், வெளியீட்டுக்கு இலவசம். இந்த விலை ஜோடிகளில் எதற்கும் சதவீதம் கணக்கிடுவது உரை, ஆடியோ நீளம், token பிரிப்பு ஆகியவற்றைப் பொறுத்தது. ஆகவே, இங்கு ஆய்வு செய்த பொது அட்டவணைகள் துல்லியமான 95% ASR விலைக் குறைப்பை உறுதிப்படுத்தவில்லை.
## சுயாதீனச் சான்றுகள் இன்னும் Qwen 3.0-ஐப் பற்றியவையே
வெளியீட்டு நாளில் ஆய்வு செய்த ஆதாரங்களில் ஐந்து 3.1 மாடல்களுக்கான சுயாதீனச் சோதனை எதுவும் இல்லை. Qwen-இன் சொந்த [ASR திட்டப் பக்கம் ](https://github.com/QwenAudio/QwenAudio.github.io/blob/4b61d6f5855d8bf1b8747895a3c54565be565ae9/qwen-audio-3.1-asr/README.md)தரநிலைச் சோதனை முடிவுகளை வெளியிடுகிறது; ஆனால் அவை சுயாதீனமாக மீண்டும் சோதிக்கப்படவில்லை என்று கூறுகிறது.
Artificial Analysis தரவரிசையில் [Qwen Audio 3.0 TTS Plus ](https://artificialanalysis.ai/text-to-speech/leaderboard/provider-voice)வழங்குநர் குரல் அரங்கில் (அனைத்து உச்சரிப்புகள் மற்றும் பிரிவுகள்) 1,259 Elo மதிப்புடன் இரண்டாவது இடத்தில் உள்ளது; 95% நம்பக இடைவெளி ±17, குருட்டு ஒப்பீட்டு மாதிரிகள் 1,447. தனியான [பேச்சு முகவர் அரங்கில் ](https://artificialanalysis.ai/articles/announcing-the-speech-agent-arena)Qwen Audio 3.0 Realtime Plus 699 preference Elo பெற்றது; முதல் ஆடியோவுக்கான நேரம் 1.54 விநாடிகள். அங்கு பங்கேற்பாளர்கள் ஒதுக்கப்பட்ட சூழல்களில் நேரடி உரையாடல்களின் போது மறைக்கப்பட்ட மாடல்களை ஒப்பிடுகிறார்கள்.
## Sources
- [Qwen ஐந்து புதிய மாடல்களுடன் Qwen Audio 3.1-ஐ அறிமுகப்படுத்துகிறது](https://the-decoder.com/alibaba-launches-qwen-audio-3-1-with-five-new-models-and-slashes-ai-audio-prices-by-up-to-95-percent) — ஐந்து மாடல் வெளியீட்டைச் சுருக்கி, TTS, நேரடி ஆடியோ, ASR விலைக் குறைப்புகள் தோராயமாக இவ்வளவு என Qwen கூறியதாகப் பதிவு செய்யும் கண்டறிதல் அறிக்கை. BIG CHANGE விலைகளை Alibaba-வின் சொந்த அட்டவணைகளுடன் சரிபார்த்தது.
- [Qwen Audio 3.1 வெளியீட்டுப் பதிவு](https://www.sina.cn/news/detail/5346330620985983.html) — ஐந்து மாடல்களையும் அவற்றின் நோக்கமிட்ட திறன்களையும் குறிப்பிடும் சரிபார்க்கப்பட்ட Qwen கணக்கின் பதிவு. திறன் மற்றும் வேகம் குறித்த கூற்றுகள் நிறுவனத்தின் சொந்தக் கூற்றுகளாகவே உள்ளன.
- [தேர்ந்தெடுக்கப்பட்ட ஆடியோ மாடல்களுக்கான Model Studio விலைக் குறைப்பு அறிவிப்பு](https://www.alibabacloud.com/en/notice/model_studio_price_reduction_notice_for_selected_audio_models_891?_p_lc=1) — 3.0 Realtime Flash-க்கான சிங்கப்பூர் பழைய மற்றும் புதிய விலைகளையும், 3.1 TTS Flash-இல் கட்டண அலகு மாறியதையும் காட்டும் செப்டம்பர் 22-ஆம் தேதியிட்ட அதிகாரப்பூர்வ விலை அறிவிப்பு.
- [Model Studio மாடல் விலைகள்](https://www.alibabacloud.com/help/en/model-studio/model-pricing) — 3.1 ASR மற்றும் Realtime Plus உட்பட, மாடல், ஊடக வகை, பிராந்தியம் வாரியான தற்போதைய அதிகாரப்பூர்வ விலைகள்.
- [QwenCloud பேச்சிலிருந்து உரை மாடல்கள்](https://docs.qwencloud.com/developer-guides/speech/speech-to-text-models) — தற்போதைய ASR endpoint ID-கள், அணுகல் முறைகள், மொழிப் பட்டியல்கள், பேச்சாளர் பிரித்தறிதல் ஆதரவு, கால வரம்புகள்.
- [QwenCloud Realtime Audio Chat](https://docs.qwencloud.com/developer-guides/speech/qwen-audio-realtime) — தற்போதைய 3.1 Realtime Plus WebSocket எடுத்துக்காட்டு, குரல் மற்றும் மொழி ஆதரவு, சேமிக்கப்படும் உரையாடல் வரம்புகள்.
- [Qwen Audio 3.1 TTS-Next](https://www.alibabacloud.com/help/en/model-studio/qwen-audio-3-1-tts-next) — பெய்ஜிங்கில் மட்டுமே கிடைக்கும் API, விலைகள், மொழிகள், உள்ளீட்டு நீளம், வெளியீட்டு கால வரம்புகள் பற்றிய அதிகாரப்பூர்வ தகவல்.
- [Qwen Audio 3.1 ASR திட்டப் பக்கம்](https://github.com/QwenAudio/QwenAudio.github.io/blob/4b61d6f5855d8bf1b8747895a3c54565be565ae9/qwen-audio-3.1-asr/README.md) — ASR மற்றும் ASR-Next திறன்கள், நிறுவனமே வெளியிட்ட தரநிலை முடிவுகள் ஆகியவற்றைக் கொண்ட மாற்றமில்லா Qwen திட்டப் பக்கம்; அந்த முடிவுகள் சுயாதீனமாக மீண்டும் உருவாக்கப்படவில்லை என்றும் குறிப்பிடுகிறது.
- [Artificial Analysis உரையிலிருந்து பேச்சு தரவரிசை](https://artificialanalysis.ai/text-to-speech/leaderboard/provider-voice) — முந்தைய Qwen Audio 3.0 TTS Plus மாடலுக்கான குருட்டு விருப்பத் தேர்வு முடிவு; மாதிரி எண்ணிக்கையும் நம்பக இடைவெளியும் உட்பட.
- [Artificial Analysis Speech Agent Arena](https://artificialanalysis.ai/articles/announcing-the-speech-agent-arena) — Qwen Audio 3.0 Realtime Plus-க்கான தனி விருப்ப மதிப்பீடும் முதல் ஆடியோவுக்கான நேர முடிவும்; இது 3.1 மதிப்பீடு அல்ல.
- [குரல் நகலாக்க HTTP API குறிப்பு](https://www.alibabacloud.com/help/en/model-studio/voice-clone-design-http-api) — தற்போதைய இலக்கு மாடல் எடுத்துக்காட்டுகள் 3.0 TTS Flash-ஐக் குறிப்பிடுகின்றன. அவை 3.1 உரையாக்கத்துக்கான ஒருங்கிணைப்பு வழியைத் தனியாக உறுதிப்படுத்தவில்லை.
BIG CHANGE செய்திமடல்
பெரிய பார்வை. உங்கள் வேகத்தில்.
AI மற்றும் ரோபாட்டிக்ஸ் பற்றிய சமீபத்திய செய்திகள், கவனிக்க வேண்டிய மாற்றங்கள், பயன்படுத்தக்கூடிய நடைமுறைக் கருத்துகள். தினசரி விளக்கக் குறிப்பு, வாராந்திரத் தொகுப்பு அல்லது மாதாந்திரப் பார்வையைத் தேர்ந்தெடுக்கவும்.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
உங்கள் தனியுரிமை, உங்கள் தேர்வு.
அத்தியாவசிய சேமிப்பு தளத்தின் பாதுகாப்புக்கு உதவுவதுடன் உங்கள் தேர்வுகளையும் நினைவில் வைக்கிறது. நீங்கள் அனுமதிக்கும் வரை விருப்ப Google Analytics முடக்கப்பட்டிருக்கும். அத்தியாவசியச் சேமிப்பை மட்டும் பயன்படுத்தி ஒவ்வொரு கதையையும் படிக்கலாம். தனியுரிமை விவரங்கள்