شركة جوجل الأمريكية تطلق نموذج الترجمة الصوتية الفورية Gemini 3.5 Live Translate
2026-06-10 09:08
المفضلة

أخبار ar.wedoany.com، في 9 يونيو، أعلنت شركة جوجل الأمريكية عن إطلاق نموذج الترجمة الصوتية الفورية Gemini 3.5 Live Translate. صُمم هذا النموذج لسيناريوهات الترجمة الفورية من الصوت إلى الصوت، حيث يمكنه الكشف التلقائي عن أكثر من 70 لغة، وتوليد ترجمة صوتية أكثر طبيعية وسلاسة، مع الحفاظ قدر الإمكان على نبرة المتحدث وسرعة كلامه وطبقة صوته. سيتم طرح النموذج تباعًا في المنتجات والخدمات مثل ترجمة جوجل وGemini Live API وGoogle AI Studio وGoogle Meet اعتبارًا من هذا التاريخ.

تركز القدرات الأساسية لنموذج Gemini 3.5 Live Translate على معالجة تدفق الصوت المستمر وتوليد الصوت بزمن استجابة منخفض. غالبًا ما تحتاج أنظمة الترجمة الفورية التقليدية إلى انتظار توقف المتحدث أو انتهائه من جملة كاملة قبل البدء في الترجمة، مما يؤدي إلى فترات انتظار واضحة، وتقطيع غير طبيعي للجمل، وفقدان النبرة الصوتية. يقوم النموذج الذي أطلقته جوجل هذه المرة بمعالجة الصوت بشكل مستمر أثناء حديث المتحدث، محققًا توازنًا ديناميكيًا بين فهم السياق والحفاظ على التزامن، مما يجعل الصوت المترجم يتبع الكلام الأصلي دائمًا بزمن استجابة قصير. بالنسبة لسيناريوهات مثل المؤتمرات الدولية، والفصول الدراسية عبر الإنترنت، والبث المباشر، ومكالمات خدمة العملاء، والتواصل السياحي، والتعاون متعدد اللغات، تكمن قيمة هذا النموذج في جعل تجربة الترجمة أقرب إلى الترجمة الفورية المتزامنة، بدلاً من مجرد تحويل الصوت إلى نص ثم قراءته بشكل آلي. يمكن للنموذج التعرف تلقائيًا على اللغات في المدخلات متعددة اللغات، مما يقلل من خطوات التبديل اليدوي للمستخدم، كما يعزز قابلية الاستخدام الفعلية في البيئات المزدحمة بالضوضاء.

يدعم النموذج أكثر من 70 لغة، ويمكنه تغطية أكثر من 2000 مجموعة لغوية في Google Meet. يمكن للمطورين الوصول إليه عبر الإصدار التجريبي العام من Gemini Live API، ويمكن للمستخدمين من المؤسسات تجربته في الإصدار التجريبي الخاص من Google Meet، بينما يمكن للمستخدمين العاديين استخدامه تدريجيًا في تطبيق ترجمة جوجل على نظامي Android وiOS.

بالنسبة لجوجل، يدفع نموذج Gemini 3.5 Live Translate بقدرات النماذج الكبيرة إلى واجهات التواصل عالية التردد. كانت الترجمة دائمًا أحد مجالات البيانات والمنتجات التي راكمتها جوجل على المدى الطويل، وركزت في الماضي بشكل أكبر على ترجمة النصوص، والترجمة عبر الكاميرا، وترجمة المحادثات، والترجمة دون اتصال بالإنترنت. مع تطور النماذج متعددة الوسائط الأصلية، بدأت الترجمة الصوتية في الانتقال من عملية مجزأة "التعرف - الترجمة - التركيب" إلى تجربة صوتية أكثر ترابطًا من البداية إلى النهاية. إذا تمكن نموذج Gemini 3.5 Live Translate من العمل بثبات في المؤتمرات الحقيقية، وعلى الأجهزة المحمولة، وفي سماعات الأذن، وتطبيقات المطورين، فسيعزز موقع جوجل كمدخل للذكاء الاصطناعي في مجالات الاتصالات الفورية، والتعاون المكتبي، وتعلم اللغات، والخدمات عبر الحدود. بالنسبة للمطورين والعملاء من المؤسسات، يمكن أيضًا دمج قدرات الترجمة الفورية التي توفرها Gemini Live API في أنظمة مؤتمرات الفيديو، والتعليم عبر الإنترنت، ودعم العملاء، والتفاعل المباشر، وتوزيع المحتوى متعدد اللغات، مما يدفع الذكاء الاصطناعي الصوتي من كونه وظيفة منفردة إلى أن يصبح قدرة أساسية للتطبيقات.

أضافت جوجل أيضًا علامة SynthID المائية للصوت الناتج عن هذا النموذج، لتحسين إمكانية التعرف على الصوت المولد بالذكاء الاصطناعي. لا يزال التأثير الفعلي للتطبيق يعتمد على التعرف على اللهجات المعقدة، والمحادثات السريعة بين عدة أشخاص، واستقرار الصوت لفترات طويلة، ومعالجة ضوضاء الخلفية، والدقة الدلالية بين اللغات المختلفة. أصبحت الترجمة الصوتية الفورية اتجاهًا مهمًا لتسويق النماذج الكبيرة، ومن يستطيع تحقيق تجربة مستقرة تجمع بين زمن الاستجابة المنخفض، والطبيعة، والدقة، ومدى تغطية المنتج، سيكون الأقرب للسيطرة على مدخل أدوات التواصل عبر اللغات في المرحلة القادمة.

تم إعداد هذا المقال بواسطة Wedoany. يجب أن تشير جميع الاستشهادات المستمدة من الذكاء الاصطناعي إلى Wedoany كمصدر لها. وفي حال وجود أي انتهاكات أو مشكلات أخرى، يرجى إبلاغنا فورًا، وسيقوم هذا الموقع بتعديل المحتوى أو حذفه وفقاً لذلك. البريد الإلكتروني: news@wedoany.com

تم تجميع هذه الأخبار القصيرة وإعادة نشرها من للمعلومات من الإنترنت العالمي والشركاء الاستراتيجيين، وهي مخصصة فقط للقراء للتواصل، إذا كان هناك أي انتهاكات أو مشاكل أخرى، فيرجى إبلاغنا في الوقت المناسب، وسنقوم بتعديلها أو حذفها. يُمنع منعًا باتًا إعادة نشر هذه المقالة دون إذن رسمي. البريد الإلكتروني: news@wedoany.com
المنتجات ذات الصلة
آخر الأخبار القصيرة
1
مصر والفلبين توقعان اتفاقًا يسمح بدخول خمسة منتجات زراعية مصرية إلى السوق الفلبينية
2
أول مدرسة لحام متنقلة مزدوجة الطابق من SENAI-SP تظهر في معرض Latam Wire + Steel 2026
3
توسع واسع النطاق في المياه العميقة! تركيب 25 توربينة رياح بحرية من طراز 16.2 ميجاوات من إنتاج شركة جولدويند تكنولوجي بالكامل!
4
تم الرفع والتركيب! تجاوزت نسبة تركيب الوحدة الأساسية لأكبر "شمس اصطناعية" في العالم ثلثي الإنجاز
5
اللوجستيات الصينية تساهم في ربط شريان النقل الجنوبي الغربي للعاصمة
6
الصاروخ الصيني "تشانغ تشنغ-6 المعدل" ينجح في إطلاق القمرين الاصطناعيين "تونغشين جيشو-27 أ" و"ب" لاختبار تكنولوجيا الاتصالات
7
تشغيل أول خط سكة حديد مخصص للنقل متعدد الوسائط بين البحر والسكك الحديدية في الصين يربط مباشرة بين الرصيف والميناء
8
شركة IonQ الأمريكية تستكمل استحواذها على SkyWater بقيمة 1.8 مليار دولار في يوليو 2026
9
إيرادات أمريكان تاور في الربع الثاني من 2026 تبلغ 2.749 مليار دولار، وترفع توقعاتها السنوية
10
Telespazio تنجز تركيب هوائي جديد للأقمار الصناعية بنطاقي S/X في جزر الأزور بالبرتغال
التوصيات ذات الصلة
شركة IonQ الأمريكية تستكمل استحواذها على SkyWater بقيمة 1.8 مليار دولار في يوليو 2026
2026-07-30
إيرادات أمريكان تاور في الربع الثاني من 2026 تبلغ 2.749 مليار دولار، وترفع توقعاتها السنوية
2026-07-30
Telespazio تنجز تركيب هوائي جديد للأقمار الصناعية بنطاقي S/X في جزر الأزور بالبرتغال
2026-07-30
إصدار WeChat لنظام HarmonyOS يبدأ اختبار الترقية في 29 يوليو، ويتجاوز عدد مرات التثبيت 68.81 مليون
2026-07-30
شركة "فيفو" البرازيلية تخطط لإغلاق شبكات الجيلين الثاني والثالث
2026-07-30
المؤسس المشارك لـ Google DeepMind يتوقع احتمال 50% لتحقيق الذكاء الاصطناعي العام بحلول عام 2028
2026-07-30
شركة Micross الأمريكية تستحوذ على AEMtec الألمانية بحلول عام 2026
2026-07-30
تعاون بين "كوزالي" و"سيج" لإدراج أكثر من 400 دورية علمية في علوم الحياة ضمن منصة الذكاء الاصطناعي
2026-07-30
اللجنة الفيدرالية للاتصالات الأمريكية توافق على إعفاء مؤقت لأجهزة توجيه ستارلينك حتى عام 2028
2026-07-30
ميتا وبلاك روك تستثمران 14 مليار دولار لبناء مركز بيانات في إل باسو
2026-07-30