2 Hrs
المصدر:
رقمي
رقمي
جاهز للتشغيل
جاهز للتشغيل
أعلنت جوجل عن نموذجها الجديد Gemini 3.5 Transcribe الذي يُحسّن تحويل الكلام إلى نص بدقة عالية سواء من الصوت المباشر أو التسجيلات السابقة. يدعم النموذج أكثر من 85 لغة ولهجة، ويتميز بقدرته على التمييز بين المتحدثين حتى ثلاثة أشخاص، بالإضافة إلى فهم الكلام الطبيعي، وإزالة الكلمات غير الضرورية، ومعالجة المصطلحات المتخصصة. يوفر النموذج وضعين رئيسيين: النسخ في الوقت الحقيقي بسرعة تقل عن ثانية، والتفريغ التلقائي للتسجيلات الطويلة، مع تحسينات كبيرة في سرعة ودقة الأداء، مما يعزز استخدامه في المساعدات الصوتية، الاجتماعات، وخدمات العملاء. يعمل حالياً في منتجات مثل Gboard على أندرويد وتطبيق Gemini على macOS، مع خطط لتوسيعه إلى متصفح Chrome ومنصات أخرى.
تنويه: هذا ملخص تم إنشاؤه بواسطة الذكاء الاصطناعي
التعليقات (0)