🎤 مقارنة ثلاثية لأنظمة الصوت
Google Web Speech vs Gemini Blob vs Deepgram Nova-2 Streaming
Google Web Speech
1SpeechRecognition.start()
2Mic → Google Servers (hidden WS)
3onresult → interim + final text
4Blocked in iframe ❌
Gemini Blob (Legacy)
1MediaRecorder.start()
2Stop → Blob → Base64
3HTTP POST → transcribeAudio
4Gemini Flash → text (3-8s)
Deepgram Nova-2 (NEW)
1getDeepgramToken → temp key
2WebSocket → api.deepgram.com
3PCM16 chunks every 250ms
4Interim + Final in < 300ms ⚡
Google Web Speech
SpeechRecognition API
نتائج فورية
مجاني
iframe/sandbox
كل المتصفحات
Gemini Blob (Legacy)
MediaRecorder + Gemini Flash
يعمل في كل بيئة
كل المتصفحات
نتائج فورية
سرعة (3-8 ثواني)
Deepgram Nova-2 ⚡
WebSocket Streaming
نتائج فورية ⚡
يعمل في كل بيئة
كل المتصفحات
Smart Format
📊 مقارنة ثلاثية مفصلة
المعيار
🌐 Google
🤖 Gemini
⚡ Deepgram
المعالجة
فورية
بعد التسجيل
فورية (WebSocket)
زمن أول كلمة
< 300ms
3-8 ثواني
< 300ms
نتائج مؤقتة
✅
❌
✅
يعمل في iframe
❌
✅
✅
دعم المتصفحات
Chrome فقط
الكل
الكل
الدقة
عالية
عالية
عالية جداً (Nova-2)
اللغات
100+
100+
30+ (EN/AR/PL ✅)
التكلفة
مجاني
رصيد Base44
$0.0043/دقيقة
الموثوقية
❌ sandbox
✅ 100%
✅ 100%
Smart Format
❌
❌
✅ علامات + أرقام
الحكم النهائي — 2026
Google Web Speech: مجاني وسريع لكن ❌ لا يعمل في iframe. مرفوض.
Gemini Blob (Legacy): موثوق لكن بطيء (3-8 ثواني). احتياطي فقط.
Deepgram Nova-2: ⚡ نتائج فورية + يعمل في كل مكان + دقة عالية.
✅ الفائز: Deepgram Nova-2 Streaming — أفضل توازن بين السرعة والموثوقية والدقة
Gemini Blob يبقى كـ fallback تلقائي إذا فشل WebSocket