ويسبر (نظام التعرف على الكلام)
ويسبر (Whisper) هو نموذج تعلم آلي مفتوح المصدر من شركة OpenAI، صدر في سبتمبر 2022، ويُستخدم للتعرف على الكلام ونسخه بدقة، مع قدرة على الترجمة من لغات متعددة إلى الإنجليزية، مما جعله متطورًا في التعامل مع اللهجات والضوضاء والمصطلحات التقنية.
- البنية التقنية: يعتمد على محول ترميز-فك تشفير (Transformer) مع نظام الإشراف الضعيف، حيث يحوّل الصوت إلى مخطط طيف ميل ثم يعالجه عبر طبقات التفافية ومحولات، ويستخدم رموزًا خاصة للتحكم في اللغة والمهمة والطوابع الزمنية.
- الإصدارات: طورته OpenAI لنسخ فيديوهات يوتيوب والبودكاست لتدريب نماذجها، ثم أصدرت Whisper Large V2 في ديسمبر 2022، وWhisper Large V3 في نوفمبر 2023، وفي مارس 2025 استُبدلت بنماذج أحدث تعتمد على GPT-4o وGPT-4o mini بمعدلات خطأ أقل.
- التأثير: يمثل نقلة في مجال التعرف على الصوت، حيث يتيح معالجة 96 لغة غير إنجليزية، ويدعم الترجمة الفورية، مما يجعله أداة قوية للمطورين والباحثين.
Source: ويسبر (نظام التعرف على الكلام) — Wikipedia · Summary by RollWiki AI · Language: Arabic
Hello from Cyprus ♥️