Gemini 3.5 Live Translate — ترجمة صوتية حية
Model: gemini-3.5-live-translate-preview (version 3.5-live-translate-06-2026)
Method: bidiGenerateContent فقط — WebSocket Live API (ليس REST عادياً).
Limits: 16,384 in / 32,768 out.
فُعّل: 2026-06-13 (مرصود حياً عبر /v1/models).
ما يفعله
ترجمة فورية للكلام المنطوق ثنائية الاتجاه (صوت↔صوت/نص) بزمن استجابة منخفض — مناسب للمكالمات والاجتماعات المباشرة. عربي ↔ إنجليزي/تركي/فرنسي/...التشغيل (WebSocket Live API)
python
يحتاج google-genai SDK + جلسة live
from google import genai
import os
client = genai.Client(api_key=os.environ.get('GEMINI_API_KEY') or os.environ['GOOGLE_API_KEY'])
async live session:
async with client.aio.live.connect(model='gemini-3.5-live-translate-preview', config={...}) as session:
await session.send_realtime_input(audio=...)
async for resp in session.receive(): ...
Endpoint: wss://generativelanguage.googleapis.com/ws/...BidiGenerateContent?key=$GEMINI_API_KEY
ملاحظات
- preview — قد تتغير الواجهة. تحقق من
/v1beta/models/gemini-3.5-live-translate-previewقبل الإنتاج. - للترجمة النصية العادية (غير الحية): استخدم
skills/translate/(4-tier). - بديل OpenAI للترجمة الصوتية الحية:
gpt-realtime-translate(realtime API).