
نسخ مباشر عبر مقبس، يبث كلمات جزئية بينما يتحدث المتحدث وجملة ثابتة في كل توقف، بسعر لكل رمز.
نسخ مباشر عبر مقبس، يبث كلمات جزئية بينما يتحدث المتحدث وجملة ثابتة في كل توقف، بسعر لكل رمز.
قم ببث صوت pcm16 بتردد 16 كيلوهرتز عبر المقبس. تظهر النتائج الجزئية أثناء حديث السماعة.
يعرف أيضا باسم Qwen Audio ASR Stream, Alibaba Cloud Qwen Audio 3.1 ASR Stream
qwen-audio-3-1-asr-stream/v1/realtimeqwen-audio-3.1-asr-streamalibaba/qwen-audio-3-1-asr-streamأسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
ينسخ Qwen Audio 3.1 ASR Stream تدفقًا صوتيًا مباشرًا عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-stream، وليس عبر نقاط نهاية HTTP. اتصل باستخدام معرف النموذج qwen-audio-3-1-asr-stream وأرسل مفتاح EmpirioLabs API في ترويسة Authorization: Bearer أثناء المصافحة. أضف صوت PCM 16-بت مرمّزًا بـ base64 واقرأ أحداث النسخ بينما لا يزال المتحدث يتكلم. لا يستطيع المتصفح ضبط الترويسات على WebSocket، لذا افتح هذا الاتصال من خادمك ومرّر الصوت إلى المتصفح عبر مقبسك الخاص. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-stream",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
async for raw in ws:
event = json.loads(raw)
if event["type"].endswith("input_audio_transcription.delta"):
# "text" is settled transcript; "stash" is still in progress.
if event.get("text"):
print(event["text"], end="", flush=True)
asyncio.run(main())معلمات الطلب التي تدعمها واجهة Qwen Audio 3.1 ASR Stream API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| input_audio_format | enum | pcm16 | pcm16 | ترميز الصوت الذي ترفقه إلى مخزن الإدخال: base64 PCM 16-بت، أحادي، عند 16 كيلوهرتز. |
الاتصال النسخة الحية عبر WebSocket عند wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-stream، تم التحقق منه برأس حامل التفويض العادي. إرسال الصوت بث صوت 16 كيلوهرتز مونو PCM16 مع input_audio_buffer.append. كشف نشاط الصوت يحدد أين تنتهي كل جملة، لذلك لا يوجد التزام للإرسال. ما يعود الأحداث conversation.item.input_audio_transcription.delta يحمل الجملة حتى الآن بينما لا يزال المتحدث يتحدث، وتحمل conversation.item.input_audio_transcription.completed الجملة المحسومة عند كل توقف. الفوترة يتم تسعير رموز الإدخال والإخراج لكل مليون وحدة، وكل جملة مكتملة تتم فوترتها بمفردها من الاستخدام الذي يبلغ عنه النموذج.
على EmpirioLabs، تتم فوترة Qwen Audio 3.1 ASR Stream حسب الاستخدام: المدخلات $1.86 لكل 1M رموز إدخال صوت; الإنتاج $1.40 لكل مليون رمز مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Qwen Audio 3.1 ASR Stream عبر WEBSOCKET /v1/realtime على api.empiriolabs.ai مع مصادقة Bearer القياسية.
افتح ملعب EmpirioLabs واضغط Start session لتجربته في المتصفح. يعمل Qwen Audio 3.1 ASR Stream عبر WebSocket بدلاً من طلب واستجابة، لذا ابدأ من دليل البدء السريع للصوت الفوري عند الدمج. اتصل من خادمك باستخدام مفتاح EmpirioLabs API ومعرف النموذج qwen-audio-3-1-asr-stream، ثم مرّر الصوت في الاتجاهين.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.