
يتم ضبط النسخ لإرسال الرسائل الصوتية ومدخلات الصوت عبر مقبس، ويعيد كل نطق كنص كامل واحد عندما يتوقف المتحدث.
يتم ضبط النسخ لإرسال الرسائل الصوتية ومدخلات الصوت عبر مقبس، ويعيد كل نطق كنص كامل واحد عندما يتوقف المتحدث.
بث صوت pcm16 بتردد 16 كيلوهرتز عبر المقبس. يتم إرجاع كل نطق كاملا عندما يتوقف السماعة مؤقتا.
يعرف أيضا باسم Qwen Audio ASR Message, Alibaba Cloud Qwen Audio 3.1 ASR Message
qwen-audio-3-1-asr-message/v1/realtimeqwen-audio-3.1-asr-messagealibaba/qwen-audio-3-1-asr-messageأسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
ينسخ Qwen Audio 3.1 ASR Message تدفقًا صوتيًا مباشرًا عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-message، وليس عبر نقاط نهاية HTTP. اتصل باستخدام معرف النموذج qwen-audio-3-1-asr-message وأرسل مفتاح EmpirioLabs API في ترويسة Authorization: Bearer أثناء المصافحة. أضف صوت PCM 16-بت مرمّزًا بـ base64 واقرأ أحداث النسخ بينما لا يزال المتحدث يتكلم. لا يستطيع المتصفح ضبط الترويسات على WebSocket، لذا افتح هذا الاتصال من خادمك ومرّر الصوت إلى المتصفح عبر مقبسك الخاص. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-message",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
async for raw in ws:
event = json.loads(raw)
if event["type"].endswith("input_audio_transcription.delta"):
# "text" is settled transcript; "stash" is still in progress.
if event.get("text"):
print(event["text"], end="", flush=True)
asyncio.run(main())معلمات الطلب التي تدعمها واجهة Qwen Audio 3.1 ASR Message API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| input_audio_format | enum | pcm16 | pcm16 | ترميز الصوت الذي ترفقه إلى مخزن الإدخال: base64 PCM 16-بت، أحادي، عند 16 كيلوهرتز. |
الاتصال نسخ رسالة صوتية عبر WebSocket عند wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-message، يتم التحقق منه برأس حامل التفويض العادي. إرسال الصوت بث صوت 16 كيلوهرتز مونو pcm16 مع input_audio_buffer.append. كشف نشاط الصوت يحدد مكان انتهاء كل نطق، لذلك لا يوجد التزام للإرسال. ما يعود كل نطق يصل كاملا، كحدث conversation.item.input_audio_transcription.completed واحد بمجرد توقف المتحدث. هذا النموذج لا يرسل نتائج جزئية أثناء حديث المتحدث؛ للترجمة الحية، استخدم qwen-audio-3-1-asr-stream. الفوترة يتم تسعير رموز الإدخال والإخراج لكل مليون سنة، ويتم احتساب كل نطق مكتمل بمفعله من الاستخدام الذي يبلغ عنه النموذج.
على EmpirioLabs، تتم فوترة Qwen Audio 3.1 ASR Message حسب الاستخدام: المدخلات $1.86 لكل 1M رموز إدخال صوت; الإنتاج $1.40 لكل مليون رمز مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Qwen Audio 3.1 ASR Message عبر WEBSOCKET /v1/realtime على api.empiriolabs.ai مع مصادقة Bearer القياسية.
افتح ملعب EmpirioLabs واضغط Start session لتجربته في المتصفح. يعمل Qwen Audio 3.1 ASR Message عبر WebSocket بدلاً من طلب واستجابة، لذا ابدأ من دليل البدء السريع للصوت الفوري عند الدمج. اتصل من خادمك باستخدام مفتاح EmpirioLabs API ومعرف النموذج qwen-audio-3-1-asr-message، ثم مرّر الصوت في الاتجاهين.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.