
छोटी क्लिप और लंबी रिकॉर्डिंग के लिए स्पीच-टू-टेक्स्ट, वाक्य खंडों, शब्द टाइमस्टैम्प और बहुभाषी और चीनी बोली पहचान के साथ।
छोटी क्लिप और लंबी रिकॉर्डिंग के लिए स्पीच-टू-टेक्स्ट, वाक्य खंडों, शब्द टाइमस्टैम्प और बहुभाषी और चीनी बोली पहचान के साथ।
कोई फ़ाइल अपलोड करें या ऑडियो URL पास करें. भाषा का अपने आप पता चल जाता है.
इस नाम से भी जाना जाता है Qwen Audio ASR, Alibaba Cloud Qwen Audio 3.1 ASR
qwen-audio-3-1-asr/v1/audio/transcriptionsqwen-audio-3.1-asralibaba/qwen-audio-3-1-asrEmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Qwen Audio 3.1 ASR POST /v1/audio/transcriptions से चलता है। request तुरंत job_id देती है; job पूरा होने तक GET /v1/jobs/{job_id} को poll करें और परिणाम से आउटपुट URLs पढ़ें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)ऑडियो भेजना सामान्य ऑडियो प्रारूपों में audio_url या audio_base64 के साथ मल्टीपार्ट file या JSON के रूप में एक फ़ाइल भेजें। छोटी क्लिप और लंबी रिकॉर्डिंग दोनों स्वीकार किए जाते हैं। परिणाम प्राप्त करना अनुरोध तुरंत एक job_id और एक poll_url लौटाता है। पोल GET /v1/jobs/<job-id> जब तक status completed न हो जाए। छोटी क्लिप सेकंड में समाप्त हो जाती हैं; लंबी रिकॉर्डिंग में अधिक समय लगता है। क्या वापस आता है पूर्ण कार्य के result में text के रूप में पूर्ण प्रतिलेख, प्रारंभ और समाप्ति समय के साथ वाक्य खंड और शब्द टाइमस्टैम्प होते हैं। चीनी बोलियों सहित भाषा का स्वचालित रूप से पता लगाया जाता है। बिलिंग इनपुट और आउटपुट टोकन की कीमत प्रति 1M है, और प्रत्येक अनुरोध को मॉडल रिपोर्ट के उपयोग से बिल किया जाता है।
EmpirioLabs पर Qwen Audio 3.1 ASR का बिल उपयोग के अनुसार बनता है: इनपुट $0.30 प्रति 1M ऑडियो इनपुट टोकन; उत्पादन $0.94 प्रति 1M जेनरेट किए गए टोकन। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Qwen Audio 3.1 ASR api.empiriolabs.ai पर POST /v1/audio/transcriptions के ज़रिए मिलता है, मानक Bearer टोकन प्रमाणीकरण के साथ।
हां। EmpirioLabs playground ब्राउज़र में Qwen Audio 3.1 ASR को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।