اضغط ⬆️ ثم "إضافة للشاشة الرئيسية"

الرئيسية حياتنا نماذج الـAI تفشل في حل مسائل رياضيات بحثية الأربعاء 17 حزيران 2026 10:52 ص نماذج الـAI تفشل في حل مسائل رياضيات بحثية

الرئيسية حياتنا نماذج الـAI تفشل في حل مسائل رياضيات بحثية  الأربعاء 17 حزيران 2026  10:52 ص نماذج الـAI تفشل في حل مسائل رياضيات بحثية
أخبار البلد -   خضع الذكاء الاصطناعي، ضمن مشروع "First Proof"، لأحد أكثر اختبارات الرياضيات صعوبة حتى الآن، إذ طُلب من أربعة أنظمة للذكاء الاصطناعي حلّ عشر مسائل بحثية معقّدة.

ولم تكن هذه المسائل ضمن بيانات التدريب الخاصة بالنماذج المشاركة، فيما تولّى علماء رياضيات متخصصون مراجعة الإجابات وتقييمها. ويُعد هذا الاختبار الأول من نوعه، إذ يجمع بين مسائل عالية التعقيد، وأسئلة جديدة غير مألوفة لأنظمة الذكاء الاصطناعي، إلى جانب تقييم رسمي يجريه خبراء متخصصون

وأظهرت النتائج أن نماذج الذكاء الاصطناعي الحالية لا تزال أقل كفاءة من كبار علماء الرياضيات في التعامل مع مسائل مماثلة، كما أنها تفتقر إلى الحدس الرياضي وتظل عرضة لارتكاب الأخطاء أو ما يُعرف بـ"الهلوسة".


واقترح عشرة باحثين هذه المسائل من أعمالهم العلمية غير المنشورة. واقتصرت المشاركة على النماذج المتاحة للجمهور، بما في ذلك نموذج ChatGPT 5.5 Pro من OpenAI، إلى جانب فرق أكاديمية من جامعة كاليفورنيا، وجامعة برينستون، والمعهد الفيدرالي السويسري للتكنولوجيا في زيورخ.


وطوّرت فرق من جامعة كاليفورنيا والمعهد الفيدرالي السويسري للتكنولوجيا ما يُعرف بـ"الأنظمة الوسيطة"، وهي أنظمة يتولى فيها أحد روبوتات الدردشة طرح الحلول، بينما يقوم آخر بمراجعتها والتحقق منها، مع تبادل المعلومات بينهما عدة مرات عند الحاجة.


وسجّل نموذج المعهد الفيدرالي السويسري للتكنولوجيا أفضل أداء، بعدما نجح في حل ست مسائل من أصل عشر. واعتمد النظام على تحسين استجابات ChatGPT من خلال "مجلس استشاري" مكوّن من ثلاثة روبوتات دردشة متقدمة.

 

وجاء فريق جامعة كاليفورنيا في المركز الثاني بنظام مساعد قائم على ChatGPT، تلاه فريق OpenAI باستخدام ChatGPT دون أدوات مساعدة، ثم فريق جامعة برينستون الذي استخدم نظاما قائما على Gemini 3.1 Pro.


ورغم ذلك، لم يتمكن أي فريق من حل ثلاث مسائل من أصل عشر. ووفقا للمشاركين، افتقرت الأنظمة في بعض الحالات إلى الفكرة الجوهرية التي يتوصل إليها البشر بصورة بديهية، بينما نجحت في حالات أخرى في اختيار النهج الصحيح لكنها أخفقت في تنفيذ التفاصيل بدقة.


ومن أبرز التحديات التي رُصدت ظاهرة "الهلوسة"، حيث قدمت أنظمة الذكاء الاصطناعي نتائج غير صحيحة حتى عند مطالبتها بالتحقق من المراجع. كما لوحظ أن بعض النماذج قامت بنسخ أجزاء من مقالات ومصادر منشورة دون الإشارة إليها بشكل واضح.


وأشار الباحثون إلى أن نشر هذه المسائل سيتيح للشركات والمؤسسات الأخرى استخدامها مستقبلا لاختبار قدرات أنظمة الذكاء الاصطناعي وتقييم أدائها في مواجهة التحديات الرياضية المعقدة. science.mail.ru


شريط الأخبار "طحالب مصرية" تربك محطات تحلية المياه في إسرائيل الحرس الثوري يهدد الأمريكيين بضربات أكثر قوة إذا استمرت هجماتهم على السفن الإيرانية إحراق مسجد إثر اشتباكات بسبب خلاف حول المولد النبوي في السودان مجلس جامعة الدول العربية يرحب بعقد الأردن اجتماعًا لدعم القدس في 5 آب الماضي بالعاصمة عمّان "مستثمري الإسكان": كلفة الأرض تصل إلى نصف سعر الشقة في بعض مناطق عمّان إطلاق مشروع تطوير المواقع السِّياحيَّة في شرق المملكة واشنطن تنفي وجود خطة لترحيل الفلسطينيين من غزة "الإفتاء": التوصية بالتبرع بالأعضاء بعد الوفاة جائزة شرعا نقابة الصحفيين تعلن نتائج جائزة الحسين للإبداع الصحفي لعام 2025 صدق او لا تصدق، (1390) دينارا لكل وفاة في حادث انقلاب الحافلة المصرية إسرائيل تدرس إدخال قوات دولية إلى "مناطق تجريبية" في غزة مرشح ليلة الخميس يكسر تزكية غرفة صناعة عمان...... " ويجهد بلى" الهئية العامة" ويجبرها للتوجه للصناديق ..مالقصة؟؟ إطلاق خدمة تقديم طلب إصدار "الجواز الإلكتروني" في عدد من مراكز الخدمات الحكومية فرق الإنقاذ النبيالية تواصل البحث عن ناجين بعد أكثر من 10 أيام على الفيضانات أزمة البنزين تخنق بغداد.. طوابير طويلة، محطات مغلقة، ومواطنون غاضبون بورصة عمّان في أسبوع : ارتفاع التداولات 25% والمؤشر يصعد فوق 4 آلاف نقطة 1.031 مليار دينار صادرات تجارة عمان خلال 8 أشهر انخفاض أسعار الذهب في الأردن.. وعيار 21 عند 89.700 دينار دوي انفجارات قرب جزيرة خرج الإيرانية لا حصانة خلف الخوارزميات.. العجارمة: الحكومة مسؤولة مدنياً وإدارياً ودستورياً عن أخطاء "فرح" أمام القضاء والبرلمان