غوغل تكشف عن نموذج جديد لتحويل الكلام إلى نص بدقة أعلى
أعلنت غوغل عن نموذجها الجديد Gemini 3.5 Transcribe للنسخ الصوتي، الذي يعد الأكثر دقة حتى الآن، مع دعم لأكثر من 85 لغة وتحسينات في فهم السياق.

كشفت شركة غوغل النقاب عن نموذج مبتكر للنسخ الصوتي وتحويل الكلام إلى نص، أطلقت عليه اسم «Gemini 3.5 Transcribe»، ووصفته بأنه الأكثر دقة بين جميع النماذج التي طورتها الشركة في هذا المجال حتى الوقت الراهن.
يأتي هذا النموذج الجديد ليحل محل الإصدار السابق «Chirp 3»، حيث يتضمن تحسينات ملحوظة في قدرته على فهم السياق والتعرف التلقائي على اللغة، فضلاً عن دعمه لأكثر من 85 لغة مختلفة.
وأوضحت الشركة أن هذه الميزة ستكون متاحة عبر منصة «Google Antigravity» وتطبيق «Gemini» الخاص بنظام تشغيل أجهزة ماك، على أن يتم توسيع نطاقها لاحقاً لتشمل متصفح كروم.
ومن شأن هذه الخطوة أن تتيح للمستخدمين إمكانية تحويل الكلام إلى نص مكتوب في أي حقل نصي على شبكة الإنترنت، مما يسهل عملية إدخال البيانات والتفاعل مع المواقع الإلكترونية بشكل أكثر فعالية.
إعلان
وتأتي هذه التطورات في وقت يشهد فيه مجال الذكاء الاصطناعي نمواً متسارعاً، مع تزايد الاهتمام بتطبيقات تحويل الصوت إلى نص في مختلف المجالات، من التحرير الصحفي إلى إدارة الأعمال والتعليم.
المصدر: الوكيل الاخباري
إعلان
أخبار ذات صلة

تكنولوجيا
تلميذ روسي يبتكر نظامًا صوتيًا للمسيرات يحدد مواقع الأعداء

محليات
إطلاق حساب الناطق الرقمي الحكومي "فرح" على إنستغرام

تكنولوجيا
دايسون تكشف عن فرشاة أسنان ذكية بكاميرا وتقنية ذكاء اصطناعي

تكنولوجيا
غوغل تثير قلق الناشرين بميزات الذكاء الاصطناعي في البحث

تكنولوجيا
واتساب يختبر ميزة جديدة للكشف عن محتوى الذكاء الاصطناعي في القنوات

تكنولوجيا
غوغل تعالج خللًا في تطبيق الرسائل يرسل محادثات قديمة لمستخدمين خاطئين
التعليقات
لا تعليقات بعد — كن أول من يعلّق.
