Qwen Audio 3.1 ASR Message واجهة برمجة التطبيقات

يتم ضبط النسخ لإرسال الرسائل الصوتية ومدخلات الصوت عبر مقبس، ويعيد كل نطق كنص كامل واحد عندما يتوقف المتحدث.

Alibaba Cloudالنسختاريخ الإصدار 21 سبتمبر 2026Singaporeنقطة نهاية مملوكةجديد

حول Qwen Audio 3.1 ASR Message

يتم ضبط النسخ لإرسال الرسائل الصوتية ومدخلات الصوت عبر مقبس، ويعيد كل نطق كنص كامل واحد عندما يتوقف المتحدث.

بث صوت pcm16 بتردد 16 كيلوهرتز عبر المقبس. يتم إرجاع كل نطق كاملا عندما يتوقف السماعة مؤقتا.

يعرف أيضا باسم Qwen Audio ASR Message, Alibaba Cloud Qwen Audio 3.1 ASR Message

transcriptionspeech to textrealtimemultilingual

مواصفات Qwen Audio 3.1 ASR Message

معرّف النموذج
qwen-audio-3-1-asr-message
المطور
Alibaba Cloud
الفئة
النسخ
تاريخ الإصدار
21 سبتمبر 2026
الإدخال
صوت
الإخراج
نص
المنطقة
Singapore
نقاط النهاية
WEBSOCKET/v1/realtime
معرّفات نموذج بديلة
qwen-audio-3.1-asr-messagealibaba/qwen-audio-3-1-asr-message

أسعار واجهة Qwen Audio 3.1 ASR Message API

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
المدخلات
لكل 1M رموز إدخال صوت
$1.86
الإنتاج
لكل مليون رمز مولد
$1.40
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة Qwen Audio 3.1 ASR Message API

ينسخ Qwen Audio 3.1 ASR Message تدفقًا صوتيًا مباشرًا عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-message، وليس عبر نقاط نهاية HTTP. اتصل باستخدام معرف النموذج qwen-audio-3-1-asr-message وأرسل مفتاح EmpirioLabs API في ترويسة Authorization: Bearer أثناء المصافحة. أضف صوت PCM 16-بت مرمّزًا بـ base64 واقرأ أحداث النسخ بينما لا يزال المتحدث يتكلم. لا يستطيع المتصفح ضبط الترويسات على WebSocket، لذا افتح هذا الاتصال من خادمك ومرّر الصوت إلى المتصفح عبر مقبسك الخاص. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

Python (websockets)
import asyncio, json, os, websockets

async def main():
    async with websockets.connect(
        "wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-message",
        additional_headers=[
            ("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
        ],
        max_size=None,
    ) as ws:
        print(json.loads(await ws.recv())["type"])  # session.created

        import base64

        # 16-bit PCM microphone audio, base64 encoded, in small chunks.
        for chunk in read_microphone_chunks():
            await ws.send(json.dumps({
                "type": "input_audio_buffer.append",
                "audio": base64.b64encode(chunk).decode(),
            }))

        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))

        async for raw in ws:
            event = json.loads(raw)
            if event["type"].endswith("input_audio_transcription.delta"):
                # "text" is settled transcript; "stash" is still in progress.
                if event.get("text"):
                    print(event["text"], end="", flush=True)

asyncio.run(main())
المرجع الكامل لواجهة Qwen Audio 3.1 ASR Message API

معلمات واجهة Qwen Audio 3.1 ASR Message API

معلمات الطلب التي تدعمها واجهة Qwen Audio 3.1 ASR Message API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
input_audio_formatenumpcm16pcm16ترميز الصوت الذي ترفقه إلى مخزن الإدخال: base64 PCM 16-بت، أحادي، عند 16 كيلوهرتز.

معلومات مفيدة

الاتصال نسخ رسالة صوتية عبر WebSocket عند wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-message، يتم التحقق منه برأس حامل التفويض العادي. إرسال الصوت بث صوت 16 كيلوهرتز مونو pcm16 مع input_audio_buffer.append. كشف نشاط الصوت يحدد مكان انتهاء كل نطق، لذلك لا يوجد التزام للإرسال. ما يعود كل نطق يصل كاملا، كحدث conversation.item.input_audio_transcription.completed واحد بمجرد توقف المتحدث. هذا النموذج لا يرسل نتائج جزئية أثناء حديث المتحدث؛ للترجمة الحية، استخدم qwen-audio-3-1-asr-stream. الفوترة يتم تسعير رموز الإدخال والإخراج لكل مليون سنة، ويتم احتساب كل نطق مكتمل بمفعله من الاستخدام الذي يبلغ عنه النموذج.

واجهة Qwen Audio 3.1 ASR Message API: أسئلة شائعة

كم تكلف واجهة Qwen Audio 3.1 ASR Message API؟

على EmpirioLabs، تتم فوترة Qwen Audio 3.1 ASR Message حسب الاستخدام: المدخلات $1.86 لكل 1M رموز إدخال صوت; الإنتاج $1.40 لكل مليون رمز مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

أي نقطة نهاية يستخدم Qwen Audio 3.1 ASR Message؟

يُقدَّم Qwen Audio 3.1 ASR Message عبر WEBSOCKET /v1/realtime على api.empiriolabs.ai مع مصادقة Bearer القياسية.

هل يمكنني تجربة Qwen Audio 3.1 ASR Message في المتصفح قبل الدمج؟

افتح ملعب EmpirioLabs واضغط Start session لتجربته في المتصفح. يعمل Qwen Audio 3.1 ASR Message عبر WebSocket بدلاً من طلب واستجابة، لذا ابدأ من دليل البدء السريع للصوت الفوري عند الدمج. اتصل من خادمك باستخدام مفتاح EmpirioLabs API ومعرف النموذج qwen-audio-3-1-asr-message، ثم مرّر الصوت في الاتجاهين.

كيف أحصل على مفتاح API لنموذج Qwen Audio 3.1 ASR Message؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.