جوجل تطلق Gemini 3.5 Transcribe لتحويل الصوت إلى نصوص بدقة غير مسبوقة

كشفت شركة جوجل رسميًا عن أحدث نماذجها للذكاء الاصطناعي Gemini 3.5 Transcribe، المخصص لتحويل الكلام الصوتي إلى نصوص بدقة استثنائية، محققًا معدل خطأ منخفضًا للغاية لا يتجاوز 2.6% عبر 85 لغة ولهجة مختلفة.

يمثل هذا النموذج قفزة نوعية في تقنيات المعالجة الصوتية، حيث يتميز بقدرته الفائقة على فهم اللهجات المحلية وتجاوز الضوضاء المحيطة، مما يجعله أداة مثالية لتفريغ الاجتماعات والمكالمات بشكل فوري ودقيق. وبحسب التقارير التقنية، يعتمد النموذج على بنية عصبية متطورة تتيح له تمييز الأصوات المتعددة في الغرفة الواحدة وعزل التشويش بدقة عالية.

وتسعى جوجل من خلال هذا الابتكار إلى تعزيز التواصل العالمي ودمج تقنيات الترجمة الفورية داخل التطبيقات الذكية والمساعدات الرقمية. وقد أكدت الشركة أن النموذج متاح حاليًا للمطورين عبر واجهات برمجة التطبيقات السحابية، لدعم قطاعات حيوية تشمل خدمة العملاء، التعليم الرقمي، وأتمتة التوثيق الطبي والقانوني.

يهدف هذا التطور إلى كسر حواجز اللغة وتوفير أدوات إنتاجية متطورة تمكن المؤسسات من الوصول إلى جمهورها العالمي باحترافية تامة. ومن المتوقع أن يساهم دمج هذا النموذج في خدمات جوجل اليومية في تحسين تجربة المستخدمين بشكل ملموس، مما يمهد الطريق لمستقبل أكثر تفاعلية في عالم المحادثات الذكية.