Qwen Audio 3.1 ASR Stream واجهة برمجة التطبيقات

نسخ مباشر عبر مقبس، يبث كلمات جزئية بينما يتحدث المتحدث وجملة ثابتة في كل توقف، بسعر لكل رمز.

Alibaba CloudالنسخSingaporeنقطة نهاية مملوكةجديد

حول Qwen Audio 3.1 ASR Stream

نسخ مباشر عبر مقبس، يبث كلمات جزئية بينما يتحدث المتحدث وجملة ثابتة في كل توقف، بسعر لكل رمز.

قم ببث صوت pcm16 بتردد 16 كيلوهرتز عبر المقبس. تظهر النتائج الجزئية أثناء حديث السماعة.

يعرف أيضا باسم Qwen Audio ASR Stream, Alibaba Cloud Qwen Audio 3.1 ASR Stream

transcriptionspeech to textrealtimestreaming asrmultilingual

مواصفات Qwen Audio 3.1 ASR Stream

معرّف النموذج
qwen-audio-3-1-asr-stream
المطور
Alibaba Cloud
الفئة
النسخ
تاريخ الإصدار
-
الإدخال
صوت
الإخراج
نص
المنطقة
Singapore
نقاط النهاية
WEBSOCKET/v1/realtime
معرّفات نموذج بديلة
qwen-audio-3.1-asr-streamalibaba/qwen-audio-3-1-asr-stream

أسعار واجهة Qwen Audio 3.1 ASR Stream API

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
المدخلات
لكل 1M رموز إدخال صوت
$1.86
الإنتاج
لكل مليون رمز مولد
$1.40
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة Qwen Audio 3.1 ASR Stream API

ينسخ Qwen Audio 3.1 ASR Stream تدفقًا صوتيًا مباشرًا عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-stream، وليس عبر نقاط نهاية HTTP. اتصل باستخدام معرف النموذج qwen-audio-3-1-asr-stream وأرسل مفتاح EmpirioLabs API في ترويسة Authorization: Bearer أثناء المصافحة. أضف صوت PCM 16-بت مرمّزًا بـ base64 واقرأ أحداث النسخ بينما لا يزال المتحدث يتكلم. لا يستطيع المتصفح ضبط الترويسات على WebSocket، لذا افتح هذا الاتصال من خادمك ومرّر الصوت إلى المتصفح عبر مقبسك الخاص. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

Python (websockets)
import asyncio, json, os, websockets

async def main():
    async with websockets.connect(
        "wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-stream",
        additional_headers=[
            ("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
        ],
        max_size=None,
    ) as ws:
        print(json.loads(await ws.recv())["type"])  # session.created

        import base64

        # 16-bit PCM microphone audio, base64 encoded, in small chunks.
        for chunk in read_microphone_chunks():
            await ws.send(json.dumps({
                "type": "input_audio_buffer.append",
                "audio": base64.b64encode(chunk).decode(),
            }))

        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))

        async for raw in ws:
            event = json.loads(raw)
            if event["type"].endswith("input_audio_transcription.delta"):
                # "text" is settled transcript; "stash" is still in progress.
                if event.get("text"):
                    print(event["text"], end="", flush=True)

asyncio.run(main())
المرجع الكامل لواجهة Qwen Audio 3.1 ASR Stream API

معلمات واجهة Qwen Audio 3.1 ASR Stream API

معلمات الطلب التي تدعمها واجهة Qwen Audio 3.1 ASR Stream API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
input_audio_formatenumpcm16pcm16ترميز الصوت الذي ترفقه إلى مخزن الإدخال: base64 PCM 16-بت، أحادي، عند 16 كيلوهرتز.

معلومات مفيدة

الاتصال النسخة الحية عبر WebSocket عند wss://api.empiriolabs.ai/v1/realtime?model=qwen-audio-3-1-asr-stream، تم التحقق منه برأس حامل التفويض العادي. إرسال الصوت بث صوت 16 كيلوهرتز مونو PCM16 مع input_audio_buffer.append. كشف نشاط الصوت يحدد أين تنتهي كل جملة، لذلك لا يوجد التزام للإرسال. ما يعود الأحداث conversation.item.input_audio_transcription.delta يحمل الجملة حتى الآن بينما لا يزال المتحدث يتحدث، وتحمل conversation.item.input_audio_transcription.completed الجملة المحسومة عند كل توقف. الفوترة يتم تسعير رموز الإدخال والإخراج لكل مليون وحدة، وكل جملة مكتملة تتم فوترتها بمفردها من الاستخدام الذي يبلغ عنه النموذج.

واجهة Qwen Audio 3.1 ASR Stream API: أسئلة شائعة

كم تكلف واجهة Qwen Audio 3.1 ASR Stream API؟

على EmpirioLabs، تتم فوترة Qwen Audio 3.1 ASR Stream حسب الاستخدام: المدخلات $1.86 لكل 1M رموز إدخال صوت; الإنتاج $1.40 لكل مليون رمز مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

أي نقطة نهاية يستخدم Qwen Audio 3.1 ASR Stream؟

يُقدَّم Qwen Audio 3.1 ASR Stream عبر WEBSOCKET /v1/realtime على api.empiriolabs.ai مع مصادقة Bearer القياسية.

هل يمكنني تجربة Qwen Audio 3.1 ASR Stream في المتصفح قبل الدمج؟

افتح ملعب EmpirioLabs واضغط Start session لتجربته في المتصفح. يعمل Qwen Audio 3.1 ASR Stream عبر WebSocket بدلاً من طلب واستجابة، لذا ابدأ من دليل البدء السريع للصوت الفوري عند الدمج. اتصل من خادمك باستخدام مفتاح EmpirioLabs API ومعرف النموذج qwen-audio-3-1-asr-stream، ثم مرّر الصوت في الاتجاهين.

كيف أحصل على مفتاح API لنموذج Qwen Audio 3.1 ASR Stream؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.