مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

23 خبر
  • اتفاق أمريكي إيراني لوقف الحرب على جميع الجبهات
  • العملية العسكرية الروسية في أوكرانيا
  • مونديال 2026
  • اتفاق أمريكي إيراني لوقف الحرب على جميع الجبهات

    اتفاق أمريكي إيراني لوقف الحرب على جميع الجبهات

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • مونديال 2026

    مونديال 2026

  • فيديوهات

    فيديوهات

روسيا.. ابتكار أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي

طوّر باحثو جامعة نوفوسيبيرسك التقنية الروسية أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي.

روسيا.. ابتكار أول برنامج وطني لتوليد المحتوى الصوتي بالذكاء الاصطناعي
صورة إرشيفية / abc-av.ru

أفاد بذلك  المشرف على المشروع يغور أنتونيانتس في حديث أدلى به لوكالة "تاس" الروسية.

يهدف هذا التطوير إلى المهام التي تتطلب إنتاجا مستقلا للمقطوعات الموسيقية والأجزاء الغنائية والمؤثرات الصوتية بناء على أوصاف نصية دون الارتباط بخدمات سحابية. ووفقا للمطورين، يوفر النظام دورة كاملة لإنتاج المحتوى الصوتي،  بدءا من الطلب النصي ووصولا للتصدير إلى المنصات واسعة الاستخدام WAV و MP3 و FLAC، ويعمل النظام  في نفس الوقت على أجهزة استهلاكية بحجم ذاكرة فيديو أقل من 6 غيغابايت.

وأشار أنتونيانتس إلى أن  "الميزة الرئيسية لتطويرنا هي الاستقلالية الكاملة عن المنصات الأجنبية وإمكانية العمل في بيئة مغلقة. لقد قمنا بضبط النموذج الأساسي باستخدام محولات LoRA المتخصصة لثلاثة أنواع من المحتوى، وهي الموسيقى الآلية، والأغاني المصحوبة بصوت بشري، والمؤثرات الصوتية، مما يتجنب تأثير اختلاط الخصائص ويحقق تطابقا أدق مع الطلب".

وعلى عكس الحلول الأساسية الموجهة للمستخدمين الناطقين بالإنجليزية، فإن الأداة الجديدة مهيأة للعمل مع الاستعلامات الناطقة بالروسية وتُظهر نتائج تنافسية. فقد بلغ متوسط معيار التقييم الذاتي MOS 4.1 من أصل 5 نقاط، وهو ما يُقارن بمعدلات المنصات التجارية الرائدة.

وأوضح مطور المشروع أرتور خوساينوف قائلا: " من ناحية تقنية تتم المعالجة على عدة مراحل: يقوم نموذج لغوي أولا بتشكيل هيكل دلالي للمقطوعة باستخدام سلسلة من التفكير، ثم يقوم المحول الانتشاري (diffusion transformer) بالتركيب الصوتي في الفضاء الكامن، أما وحدة التصدير فتقوم بتحويل المحتوى إلى الصيغ المستهدفة. وتسمح الواجهة الرسومية المدمجة بإدارة المشاريع، وحفظ وتحميل إعدادات التوليد المسبقة، والمعاينة قبل الاستماع، وتصدير المسارات دون الحاجة إلى محررات خارجية".

وأكد مبتكرو البرنامج أنهم يخططون مستقبلا لتوسيع النظام، بما في ذلك إضافة دعم الصوت المكاني لتطبيقات الواقع الافتراضي، وتنفيذ التكامل مع وحدات تحكم MIDI للتفاعل الحي، وتكييف البرنامج للسيناريوهات الصناعية،  بدءا من إنشاء مقاطع صوتية لألعاب الفيديو ووصولا إلى الدبلجة الآلية للأفلام والبث المباشر والبودكاست والإعلانات التجارية.

المصدر: تاس

التعليقات

قاليباف: إدارة مضيق هرمز لن تعود إلى ما كانت عليه قبل الحرب وتم الإفراج عن 12 مليار دولار من أصولنا

ترامب يفتح "الصندوق الأسود" ويكشف تفاصيل التفاهمات مع إيران في سويسرا

لغز "قنديل البحر" في سماء إيران.. طيار أمريكي يروي ما رآه قبل إسقاط طائرته

ترامب: نغادر إيران الآن وهي دون قدرات صاروخية أو برنامج نووي

رئيس وزراء قطر يطالب بـ"خط ساخن" ويحذر من انتحال صفة "الحرس الثوري"

الحرس الثوري يحسم الجدل حول عدد السفن المسموح لها بعبور مضيق هرمز

ترامب: إيران تترنح والكونغرس يمد لها يد العون "في وقت الحرب"

نتنياهو يتحدث عن التحرر من التبعية لواشنطن ويطرح على ضباطه سؤالا وجوديا

بحضور ممثلين دوليين ‏وحقوقيين.. جلسة لمحاكمة أحد رموز نظام الأسد

السعودية تؤكد دعمها لسوريا وتوجه نداء باسم العرب

زاخاروفا: اليورانيوم المخصص لأوكرانيا قد يصل إلى مصنع في دولة ثالثة

ريابكوف: مواجهة مباشرة مع الغرب ستقود إلى عواقب كارثية وروسيا ستتخذ إجراءات مضادة في بحر البلطيق

بوتين: روسيا مستعدة للرد السريع والفعّال على أي تهديد

طهران ترد على تصريحات ترامب حول "تحول هدف الحرب إلى إثراء المزارعين الأمريكيين"

ضغوط من داخل الليكود ومخاوف من فقدان السلطة.. هل دخل نتنياهو أخطر أزماته السياسية؟