
تحويل الكلام إلى نص للمقاطع القصيرة والتسجيلات الطويلة، مع مقاطع جمل، وطوابع زمنية للكلمات، وتعرف باللهجات متعددة اللغات والصينية.
تحويل الكلام إلى نص للمقاطع القصيرة والتسجيلات الطويلة، مع مقاطع جمل، وطوابع زمنية للكلمات، وتعرف باللهجات متعددة اللغات والصينية.
رفع ملف أو مرر رابط صوتي. يتم اكتشاف اللغة تلقائيا.
يعرف أيضا باسم Qwen Audio ASR, Alibaba Cloud Qwen Audio 3.1 ASR
qwen-audio-3-1-asr/v1/audio/transcriptionsqwen-audio-3.1-asralibaba/qwen-audio-3-1-asrأسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل Qwen Audio 3.1 ASR عبر POST /v1/audio/transcriptions. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)إرسال الصوت إرسال ملف كfile متعدد الأجزاء، أو JSON مع audio_url أو audio_base64، بصيغ صوتية شائعة. يتم قبول المقاطع القصيرة والتسجيلات الطويلة. الحصول على النتيجة يعيد الطلب job_id وpoll_url فورا. استطلاع GET /v1/jobs/<job-id> حتى يصبح status completed. تنتهي المقاطع القصيرة في ثوان؛ التسجيلات الطويلة تستغرق وقتا أطول. ما يعود result المهمة المكتملة تحتوي على النص الكامل كtext، ومقاطع جمل بأوقات البداية والنهاية، وطوابع زمنية للكلمات. يتم اكتشاف اللغة تلقائيا، بما في ذلك اللهجات الصينية. الفوترة يتم تسعير رموز الإدخال والإخراج لكل مليون سنة، ويتم احتساب كل طلب من الاستخدام الذي يبلغ عنه النموذج.
على EmpirioLabs، تتم فوترة Qwen Audio 3.1 ASR حسب الاستخدام: المدخلات $0.30 لكل 1M رموز إدخال صوت; الإنتاج $0.94 لكل مليون رمز مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Qwen Audio 3.1 ASR عبر POST /v1/audio/transcriptions على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Qwen Audio 3.1 ASR في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.