
WebSocket을 통한 동시 음성 번역. 목표 언어를 설정한 후 말합니다; 모델은 해당 언어로 텍스트와 오디오로 응답합니다.
WebSocket을 통한 동시 음성 번역. 목표 언어를 설정한 후 말합니다; 모델은 해당 언어로 텍스트와 오디오로 응답합니다.
세션은 요청 매개변수가 아닌 소켓을 통한 세션 업데이트 이벤트로 구성됩니다. 대상 언어가 필요합니다. 텍스트 토큰과 오디오 토큰은 별도의 요금으로 청구됩니다.
다른 이름 Alibaba Cloud Qwen3.8 LiveTranslate Flash Realtime
qwen3-8-livetranslate-flash-realtime/v1/realtimeqwen3.8-livetranslate-flash-realtimealibaba/qwen3-8-livetranslate-flash-realtimeEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Qwen3.8 LiveTranslate Flash Realtime 은(는) HTTP 엔드포인트가 아니라 wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime 의 WebSocket에서 실시간 음성 번역을 합니다. 모델 ID qwen3-8-livetranslate-flash-realtime 로 연결하고 핸드셰이크 시 EmpirioLabs API 키를 Authorization: Bearer 헤더로 보내세요. 오디오를 보내기 전에 session.update 로 대상 언어를 설정하세요. 오디오는 base64 16비트 PCM으로 양방향 전송됩니다. 브라우저는 WebSocket에 헤더를 설정할 수 없으므로 이 연결은 서버에서 열고 오디오는 자체 소켓으로 브라우저에 중계하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
await ws.send(json.dumps({
"type": "session.update",
"session": {
"voice": "Tina",
"translation": {"language": "en"},
"modalities": ["text", "audio"],
},
}))
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
async for raw in ws:
event = json.loads(raw)
if event["type"] == "response.audio.delta":
... # base64 audio chunk, append to your playback buffer
elif event["type"] in ("response.audio_transcript.text", "response.text.text"):
print(event.get("text") or "")
elif event["type"] == "response.done":
break
asyncio.run(main())EmpirioLabs에서 Qwen3.8 LiveTranslate Flash Realtime API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| voice | enum | Tina | Tina, Serena, Ethan, Cindy | 번역된 오디오를 위한 음성 음성. 모델이 오디오를 생성하기 전에 session.update로 설정하세요. |
| target_language | enum | en | zh, en, ar, de, fr, es, pt, id, it, ko, ru, th, vi, ja, tr, h... | 모델이 번역하는 언어. 필수입니다. 오디오를 보내기 전에 session.update로 설정하세요. |
| source_language | enum | auto | auto, zh, en, ar, de, fr, es, pt, id, it, ko, ru, th, vi, ja,... | 말하는 언어가 문제입니다. 자동 모드는 그대로 두어 모델이 감지하도록 하세요. |
| modalities | string | ["text","audio"] | - | 모델이 한 턴 동안 어떤 출력 유형을 반환하는지 확인하세요. 텍스트 전용 번역을 위해 오디오를 빼세요. |
| input_audio_format | enum | pcm | pcm | 입력 버퍼에 추가하는 오디오의 인코딩: base64 16비트 PCM. |
| output_audio_format | enum | pcm | pcm | 모델이 스트리밍하는 오디오 인코딩: base64 16비트 PCM. |
wss@api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime에서 WebSocket을 통한 음성 번역이 가능하며, 일반 Authorization Bearer 헤더로 인증됩니다. 오디오를 보내기 전에 session.update로 대상 언어를 설정하세요. 이 모델이 허용하는 음성 대신 사용하거나 기본 Tina를 그대로 두세요. 오디오 토큰과 텍스트 토큰은 별도로 가격이 책정되며, 완료된 턴마다 모델이 보고한 사용량에 따라 별도로 청구됩니다.
EmpirioLabs에서 Qwen3.8 LiveTranslate Flash Realtime은(는) 종량제로 청구됩니다: 입력: 오디오 $15.00 1M 오디오 입력 토큰당; 입력 $1.10 1M 프롬프트 토큰당; 제품정보 $40.00 생성된 토큰 1M 단위; 출력: 오디오 $60.00 생성된 1M 오디오 토큰당. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Qwen3.8 LiveTranslate Flash Realtime은(는) 53K 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 4,096 출력 토큰).
Qwen3.8 LiveTranslate Flash Realtime은(는) api.empiriolabs.ai의 WEBSOCKET /v1/realtime를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.
EmpirioLabs 플레이그라운드 를 열고 Start session 을 누르면 브라우저에서 바로 사용해 볼 수 있습니다. Qwen3.8 LiveTranslate Flash Realtime 은(는) 요청과 응답이 아니라 WebSocket으로 동작하므로 직접 연동할 때는 실시간 음성 퀵스타트 부터 시작하세요. EmpirioLabs API 키와 모델 ID qwen3-8-livetranslate-flash-realtime 로 서버에서 연결한 뒤 오디오를 양방향으로 스트리밍하면 됩니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.