مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

41 خبر
  • هدنة وحصار المضيق
  • العملية العسكرية الروسية في أوكرانيا
  • نبض الملاعب
  • هدنة وحصار المضيق

    هدنة وحصار المضيق

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • نبض الملاعب

    نبض الملاعب

  • فيديوهات

    فيديوهات

  • إسرائيل تواصل غاراتها على لبنان

    إسرائيل تواصل غاراتها على لبنان

روسيا.. ابتكار أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي

طوّر باحثو جامعة نوفوسيبيرسك التقنية الروسية أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي.

روسيا.. ابتكار أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي
صورة إرشيفية / abc-av.ru

أفاد بذلك  المشرف على المشروع يغور أنتونيانتس في حديث أدلى به لوكالة "تاس" الروسية.

يهدف هذا التطوير إلى المهام التي تتطلب إنتاجا مستقلا للمقطوعات الموسيقية والأجزاء الغنائية والمؤثرات الصوتية بناء على أوصاف نصية دون الارتباط بخدمات سحابية. ووفقا للمطورين، يوفر النظام دورة كاملة لإنتاج المحتوى الصوتي،  بدءا من الطلب النصي ووصولا للتصدير إلى المنصات واسعة الاستخدام WAV و MP3 و FLAC، ويعمل النظام  في نفس الوقت على أجهزة استهلاكية بحجم ذاكرة فيديو أقل من 6 غيغابايت.

وأشار أنتونيانتس إلى أن  "الميزة الرئيسية لتطويرنا هي الاستقلالية الكاملة عن المنصات الأجنبية وإمكانية العمل في بيئة مغلقة. لقد قمنا بضبط النموذج الأساسي باستخدام محولات LoRA المتخصصة لثلاثة أنواع من المحتوى، وهي الموسيقى الآلية، والأغاني المصحوبة بصوت بشري، والمؤثرات الصوتية، مما يتجنب تأثير اختلاط الخصائص ويحقق تطابقا أدق مع الطلب".

وعلى عكس الحلول الأساسية الموجهة للمستخدمين الناطقين بالإنجليزية، فإن الأداة الجديدة مهيأة للعمل مع الاستعلامات الناطقة بالروسية وتُظهر نتائج تنافسية. فقد بلغ متوسط معيار التقييم الذاتي MOS 4.1 من أصل 5 نقاط، وهو ما يُقارن بمعدلات المنصات التجارية الرائدة.

وأوضح مطور المشروع أرتور خوساينوف قائلا: " من ناحية تقنية تتم المعالجة على عدة مراحل: يقوم نموذج لغوي أولا بتشكيل هيكل دلالي للمقطوعة باستخدام سلسلة من التفكير، ثم يقوم المحول الانتشاري (diffusion transformer) بالتركيب الصوتي في الفضاء الكامن، أما وحدة التصدير فتقوم بتحويل المحتوى إلى الصيغ المستهدفة. وتسمح الواجهة الرسومية المدمجة بإدارة المشاريع، وحفظ وتحميل إعدادات التوليد المسبقة، والمعاينة قبل الاستماع، وتصدير المسارات دون الحاجة إلى محررات خارجية".

وأكد مبتكرو البرنامج أنهم يخططون مستقبلا لتوسيع النظام، بما في ذلك إضافة دعم الصوت المكاني لتطبيقات الواقع الافتراضي، وتنفيذ التكامل مع وحدات تحكم MIDI للتفاعل الحي، وتكييف البرنامج للسيناريوهات الصناعية،  بدءا من إنشاء مقاطع صوتية لألعاب الفيديو ووصولا إلى الدبلجة الآلية للأفلام والبث المباشر والبودكاست والإعلانات التجارية.

المصدر: تاس

التعليقات

"لا يهمنا إرضاء الرئيس الأمريكي".. مصدر إيراني يعلق على رفض ترامب لرد طهران بشأن إنهاء الحرب

ترامب يجتمع بالجنرالات ويقول: وقف النار مع إيران يحتضر ولا يمكنها امتلاك سلاح نووي لتدمير إسرائيل

قاليباف: مستعدون لكل الخيارات.. سيفاجأون

تفاصيل جديدة عن قاعدة إسرائيل السرية في صحراء العراق وعلاقتها باستهداف الطيارين

"الوصايا العشر".. المرشد الإيراني يحدد ثوابت طهران في الخليج ومضيق هرمز

برنامج "نيوزميكر" على RT كان السباق في كشف الغطاء عن القاعدة الإسرائيلية السرية في العراق (فيديو)

خلال 24 ساعة هبوط اضطراري ثان لمقاتلة إف 35 أمريكية بقاعدة الظفرة في الإمارات (فيديو)

لبنان لحظة بلحظة.. نتنياهو يتمسك بالخيار العسكري وبيروت تطالب ببسط سلطة الدولة على كامل أراضيها

"تانكر تراكرز": التسرب النفطي في مضيق هرمز مصدره ناقلة إماراتية تعرضت لاستهداف إيراني (فيديو)

بريطانيا وفرنسا ترسلان قطعا بحرية إلى مضيق هرمز تزامنا مع قمة دفاعية دولية غدا

تقرير إسرائيلي: ترامب يلعب مع إيران لعبة "الدجاجة".. الخيارات المستقبلية والطريق نحو القنبلة الذرية!

نتنياهو يعترف بانهيار صورة إسرائيل لدى الشباب الأمريكي وارتفاع تعاطفهم مع فلسطين

هل خدع نتنياهو الإسرائيليين؟ تصريحات متناقضة بين 2025 و2026 حول تدمير النووي الإيراني

أول تعليق إيراني رسمي على الدعم العسكري المصري للإمارات

مقتل وإصابة عناصر في الجيش السوري باستهداف حافلتهم غربي الحسكة (صورة)

عراقجي وعبد العاطي يبحثان التطورات الإقليمية ومسار المفاوضات الإيرانية الأمريكية

نتنياهو: لن نوقف الحرب على حزب الله مقابل اتفاق مع إيران

بيسكوف: اقتراح بوتين بترشيح شرودر كمفاوض أثار "عاصفة من النقاشات" في أوروبا