مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

34 خبر
  • حرب الخليج
  • رياضة
  • منتدى الشرق الاقتصادي في فلاديفوستوك
  • حرب الخليج

    حرب الخليج

  • رياضة

    رياضة

  • منتدى الشرق الاقتصادي في فلاديفوستوك

    منتدى الشرق الاقتصادي في فلاديفوستوك

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • قمة شنغهاي في بيشكيك

    قمة شنغهاي في بيشكيك

  • فيديوهات

    فيديوهات

  • الكرملين: محادثات مدير CIA راتكليف في موسكو كانت سرية للغاية وبوتين لم يخطط للقائه

    الكرملين: محادثات مدير CIA راتكليف في موسكو كانت سرية للغاية وبوتين لم يخطط للقائه

  • "كافح وانتصر!" .. أكثر من 1000 شخص يشاركون في سباق رياضي بمنتدى الشرق الاقتصادي في فلاديفوستوك

    "كافح وانتصر!" .. أكثر من 1000 شخص يشاركون في سباق رياضي بمنتدى الشرق الاقتصادي في فلاديفوستوك

الذكاء الاصطناعي على بعد أشهر من تحقيق العلامة الكاملة في "الامتحان الأخير للبشرية"

يدعي مطورون أنه خلال بضعة أشهر فقط، ستتمكن أنظمة الذكاء الاصطناعي من الحصول على العلامة الكاملة في أحد أصعب الاختبارات المعرفية في العالم، المسمى "الامتحان الأخير للبشرية" (HLE).

الذكاء الاصطناعي على بعد أشهر من تحقيق العلامة الكاملة في "الامتحان الأخير للبشرية"
Gettyimages.ru

وهذا الاختبار صممه مسؤولو التكنولوجيا لقياس مدى ذكاء أنظمتهم، ويتكون من 2500 سؤال تم اختيارها بدقة، وتغطي نحو مائة موضوع مختلف، بدءا من علوم الصواريخ والأساطير وصولا إلى علم وظائف الأعضاء.

وكل سؤال يتطلب مستوى فهم لا يقل عن درجة الدكتوراه، وأي شخص يحصل على درجة قريبة من 100% يعد "خبيرا عالميا".

وقبل عامين فقط، حصل نظام ChatGPT من OpenAI على نسبة 3% فقط في هذا الاختبار، ولم تكن نتائج أنظمة "غوغل" وAnthropic أفضل بكثير. وقتها، ساعدت هذه النتائج في تهدئة المخاوف من تفوق الذكاء الاصطناعي، حيث أثبتت وجود فجوة كبيرة بين نماذج اللغة الكبيرة وأفضل الأكاديميين في العالم.

لكن يبدو أن هذا الاختبار المستحيل قد يصبح مجرد محطة أخرى في المسيرة السريعة للذكاء الاصطناعي. ففي الشهر الماضي فقط، سجل نظام Gemini من "غوغل" نسبة 45.9%، بعد أن كان قد حصل على 18.8% بعد أشهر فقط من محاولته الأولى.

ويقول كالفن تشانغ، رئيس الأبحاث في شركة Scale (الشركة المسؤولة عن الاختبار): "أردنا إنشاء اختبار أكاديمي بمستوى خبراء بشر، لا يستطيع حله سوى حفنة من الناس على وجه الأرض. لكننا رأينا تقدما مذهلا في نماذج اللغة خلال السنوات الماضية، والمطورون يقومون بعمل رائع في تحسين قدرات هذه النماذج على التفكير".

وتضيف كيت أولشيفسكا، مديرة المنتج في Google DeepMind: "إذا كان هذا هو هدفنا الوحيد في الحياة، أعتقد أننا سنصل إليه بسرعة كبيرة". وقد حققت شركة Anthropic (صانعة نظام Claude AI) نسبة 34.2%، وهي تحسن نتائجها بسرعة.

والحصول على درجة 100% في هذا الاختبار سيكون تطورا مهما، لأن الاختبار "مصمم ليكون آخر اختبار أكاديمي مغلق من نوعه"، كما يقول مبتكروه. وهذا يعني أنه إذا تمكن الذكاء الاصطناعي من حل هذا الاختبار، فسوف نحتاج في المستقبل إلى اختباره بأسئلة لا يعرف أي إنسان إجابتها.

وقد تم إنشاء الاختبار بالتعاون مع "مركز سلامة الذكاء الاصطناعي"، وهو منظمة غير ربحية، لقياس مدى معرفة الذكاء الاصطناعي وعمق تفكيره. 

وفي سبتمبر 2024، أطلق القائمون على الاختبار نداء عالميا لجمع الأسئلة، وقدموا جائزة قدرها 500 ألف دولار. وقد استجاب خبراء من نحو 50 دولة، وقدموا 70 ألف سؤال، بشرط أن تكون الإجابات قصيرة وواضحة وغير متوفرة بسهولة على الإنترنت.

وتم استبعاد الأسئلة التي استطاعت أي نماذج ذكاء اصطناعي حالية الإجابة عليها، ما قلص القائمة إلى 13 ألف سؤال. ثم تم اختيار 2500 سؤال نهائي، مع إجراء بعض التعديلات لاحقا بناء على ملاحظات المستخدمين. وما يزال عدد كبير من هذه الأسئلة سريا، لمنع الأنظمة من الاستفادة من الإجابات المتداولة عبر الإنترنت.

والنجاح في هذا الاختبار يذكرنا بفوز كمبيوتر IBM العملاق "ديب بلو" على بطل العالم في الشطرنج غاري كاسباروف عام 1997، وهو الأمر الذي حير توقعات معظم الخبراء. ومنذ ذلك الحين، تم تجاوز العديد من اختبارات الذكاء الاصطناعي الكبرى، مثل اختبار "المهام المتعددة الضخمة لفهم اللغة" (MMLU) الذي صدر عام 2020، ثم تم إيقافه بعد أن أصبح سهلا للغاية على الأنظمة، حيث كانت تسجل أكثر من 90%.

وتضيف أولشيفسكا أنه مع اقتراب الذكاء الاصطناعي من إتقان الاختبارات البشرية، أصبح التركيز الرئيسي للمطورين هو تجاوز حدود المعرفة البشرية الحالية. لكن تشانغ يرى أن هناك دائما مجالا للتخصص البشري، حيث يصعب على الذكاء الاصطناعي إتقان المجالات العملية مثل الجراحة، وكذلك المهارات القائمة على القرار مثل الحكم السليم والإبداع.

المصدر: ديلي ميل

التعليقات

الوكالة الدولية للطاقة الذرية: إيران قادرة على إنتاج عدة أسلحة نووية وترفض التعاون مع المفتشين

وكالة "مهر": تم اختبار منظومة الدفاع الجوي الجديدة لأول مرة بنجاح وتمكنت من إسقاط مسيرة أمريكية

بيان عسكري إيراني: ستوجه القوات المسلحة ضربات ساحقة ومُدمّرة إلى العدو الأمريكي ردا على عدوانه

الولايات المتحدة تصدر تنبيها أمنيا لرعاياها في الشرق الأوسط: "احتمال حدوث تصعيد غير متوقع"

مصدر عسكري إيراني: سنرد حتما على "جريمة الأمريكيين" الأخيرة.. ردنا سيكون "أضعافا مضاعفة"

الحرس الثوري الإيراني: استهدفنا قاعدة لمشاة البحرية الأمريكية في الأردن ومقتل عدد كبير منهم بالهجوم

بوتين: الجيش الروسي تلقى أوامر بشن ضربات انتقامية واسعة النطاق ضد البنية التحتية للطاقة الأوكرانية

الحرس الثوري يعلن استهداف ناقلة تحت عين الحراسة الأمريكية

دوي انفجارات في مواقع عسكرية والقنصلية الأمريكية في أربيل

الحرس الثوري الإيراني: الضربات الأمريكية تعزز إغلاق مضيق هرمز.. والرد بدأ بإسقاط مسيّرة MQ-9

ارتفاع حصيلة قتلى انفجار السيارة المحملة بالذخيرة بريف إدلب السورية إلى 5 أشخاص (فيديوهات)

مراسلتنا: الدفاعات الأردنية تتصدى لصواريخ في سماء المفرق والأزرق وإربد (فيديو)

الحرس الثوري: نفذنا هجوما صاروخيا ومسيّرا على القواعد الأمريكية في أربيل وقتلنا عددا من المعتدين

رويترز: الحصار الأمريكي المفروض على إيران يحقق ما عجزت عنه العقوبات

مصدر أمني إيراني يكشف لـ"RT" حقيقة الحركة البحرية الحالية عبر مضيق هرمز

سوريا.. الأمن الداخلي يدخل الحسكة في إطار دمج "قسد" بمؤسسات الدولة (صور+ فيديوهات)

مصادر أمريكية: الولايات المتحدة تستهدف ناقلتين إيرانيتين ضمن سياسة "ناقلة مقابل ناقلة"