StepAudio 2.5 ASR Stream واجهة برمجة التطبيقات

النسخ المباشر عبر مقبس الصورة، يعيد نتائج جزئية أثناء حديث المتحدث، مع تمييز كشف نشاط الصوت لكل جملة.

StepFunالنسختاريخ الإصدار 16 يوليو 2026Internationalنقطة نهاية مملوكةجديد

حول StepAudio 2.5 ASR Stream

النسخ المباشر عبر مقبس الصورة، يعيد نتائج جزئية أثناء حديث المتحدث، مع تمييز كشف نشاط الصوت لكل جملة.

EmpirioLabs يعرض نقطة النهاية القياسية /v1/audio/transcriptions ويعيد النص النهائي بصيغة استجابة النسخ العادية.

يعرف أيضا باسم StepAudio ASR Stream, StepFun StepAudio 2.5 ASR Stream

transcriptionspeech to textrealtimestreaming asr

مواصفات StepAudio 2.5 ASR Stream

معرّف النموذج
stepaudio-2-5-asr-stream
المطور
StepFun
الفئة
النسخ
تاريخ الإصدار
16 يوليو 2026
الإدخال
صوت
الإخراج
نص
المنطقة
International
نقاط النهاية
WEBSOCKET/v1/realtime
معرّفات نموذج بديلة
stepaudio-2.5-asr-streamstepfun/stepaudio-2-5-asr-stream

أسعار واجهة StepAudio 2.5 ASR Stream API

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
النسخ
لكل ساعة صوتية
$0.18
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة StepAudio 2.5 ASR Stream API

ينسخ StepAudio 2.5 ASR Stream تدفقًا صوتيًا مباشرًا عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=stepaudio-2-5-asr-stream، وليس عبر نقاط نهاية HTTP. اتصل باستخدام معرف النموذج stepaudio-2-5-asr-stream وأرسل مفتاح EmpirioLabs API في ترويسة Authorization: Bearer أثناء المصافحة. أضف صوت PCM 16-بت مرمّزًا بـ base64 واقرأ أحداث النسخ بينما لا يزال المتحدث يتكلم. لا يستطيع المتصفح ضبط الترويسات على WebSocket، لذا افتح هذا الاتصال من خادمك ومرّر الصوت إلى المتصفح عبر مقبسك الخاص. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

Python (websockets)
import asyncio, json, os, websockets

async def main():
    async with websockets.connect(
        "wss://api.empiriolabs.ai/v1/realtime?model=stepaudio-2-5-asr-stream",
        additional_headers=[
            ("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
        ],
        max_size=None,
    ) as ws:
        print(json.loads(await ws.recv())["type"])  # session.created

        import base64

        # 16-bit PCM microphone audio, base64 encoded, in small chunks.
        for chunk in read_microphone_chunks():
            await ws.send(json.dumps({
                "type": "input_audio_buffer.append",
                "audio": base64.b64encode(chunk).decode(),
            }))

        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))

        async for raw in ws:
            event = json.loads(raw)
            if event["type"].endswith("input_audio_transcription.delta"):
                # "text" is settled transcript; "stash" is still in progress.
                if event.get("text"):
                    print(event["text"], end="", flush=True)

asyncio.run(main())
المرجع الكامل لواجهة StepAudio 2.5 ASR Stream API

معلمات واجهة StepAudio 2.5 ASR Stream API

معلمات الطلب التي تدعمها واجهة StepAudio 2.5 ASR Stream API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
input_audio_formatenumpcm16pcm16Encoding of the audio you append to the input buffer: base64 16-bit PCM.
languagestring--Optional language hint. Omit to let the model detect it.

معلومات مفيدة

النسخ المباشر عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=stepaudio-2-5-asr-stream، وتم التحقق منه باستخدام رأس حامل التفويض العادي. قم ببث صوت pcm16 على تردد 16 كيلوهرتز مع input_audio_buffer.append واقرأ النتائج الجزئية بينما لا يزال المتحدث يتحدث، مع تحديد مكان انتهاء كل جملة بكشف نشاط الصوت على جانب الخادم. استخدم هذا للترجمة الحية وإدخال الصوت؛ للتسجيل النهائي، يعيد POST /v1/audio/transcriptions النص الكامل في مكالمة واحدة. تتبع الفوترة مدة الصوت الذي تبثه، وتسويه عند إغلاق الجلسة.

واجهة StepAudio 2.5 ASR Stream API: أسئلة شائعة

كم تكلف واجهة StepAudio 2.5 ASR Stream API؟

على EmpirioLabs، تتم فوترة StepAudio 2.5 ASR Stream حسب الاستخدام: النسخ $0.18 لكل ساعة صوتية. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

أي نقطة نهاية يستخدم StepAudio 2.5 ASR Stream؟

يُقدَّم StepAudio 2.5 ASR Stream عبر WEBSOCKET /v1/realtime على api.empiriolabs.ai مع مصادقة Bearer القياسية.

هل يمكنني تجربة StepAudio 2.5 ASR Stream في المتصفح قبل الدمج؟

يعمل StepAudio 2.5 ASR Stream عبر WebSocket بدلاً من طلب واستجابة، لذا ابدأ من دليل البدء السريع للصوت الفوري. اتصل من خادمك باستخدام مفتاح EmpirioLabs API ومعرف النموذج stepaudio-2-5-asr-stream، ثم مرّر الصوت في الاتجاهين.

كيف أحصل على مفتاح API لنموذج StepAudio 2.5 ASR Stream؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.