أعلنت شركة جوجل إطلاق نموذج جديد مخصص لتحويل الكلام إلى نص، يحمل اسم «Gemini 3.5 Transcribe»، في خطوة جديدة لتعزيز قدرات الذكاء الاصطناعي في مجال النسخ الصوتي.
وقالت جوجل إن النموذج الجديد سيحل محل «Chirp 3»، ويقدم قدرات متطورة في فهم السياق واستيعاب تفاصيل الكلام بصورة أكثر عمقًا.
دقة أعلى وتعرف تلقائي على اللغة
وأوضحت الشركة أن Gemini 3.5 Transcribe يتميز بقدرته على فهم السياق بشكل أكبر، إلى جانب التعرف التلقائي على اللغة المستخدمة أثناء التسجيل.
وأكدت جوجل أن النموذج الجديد يمثل أدق نموذج للنسخ الصوتي طورته الشركة حتى الآن، ما يعزز قدرته على تحويل المحادثات والكلام المنطوق إلى نصوص أكثر دقة.
وتعكس هذه الخطوة توجه جوجل نحو تطوير أدوات ذكاء اصطناعي قادرة على التعامل مع اللغة الطبيعية بصورة أكثر مرونة، وتحسين تجربة المستخدم في الكتابة والتفاعل الصوتي.
طرح تدريجي عبر منصات جوجل
وأشارت جوجل إلى أن ميزة Gemini 3.5 Transcribe ستكون متاحة للمستخدمين عبر منصة Google Antigravity، إلى جانب تطبيق «جيميناي» على نظام macOS.
ومن المقرر أن تتوسع إتاحة الميزة لاحقًا لتشمل متصفح كروم، بما يسمح للمستخدمين بالاستفادة من خاصية «Talk-to-Type» في أي حقل نصي على شبكة الإنترنت.
ومن شأن هذا التوسع أن يجعل تحويل الكلام إلى نص أكثر سهولة، إذ سيتمكن المستخدم من التحدث بدلًا من الكتابة التقليدية أثناء استخدام مختلف المواقع والخدمات عبر المتصفح.
ويأتي إطلاق Gemini 3.5 Transcribe ضمن سباق متواصل بين شركات التكنولوجيا لتطوير تقنيات التعرف على الكلام والذكاء الاصطناعي، وتحسين دقة وسرعة التفاعل بين المستخدم والأجهزة الرقمية.
اقرأ أيضًا:

