Skip to content

2. المسائل الثلاث التي تمت دراستها والنتائج

سيُطلب من IA دراسة ثلاث مسائل بدءًا من الأبسط إلى الأكثر تعقيدًا. لنلقِ نظرة على لقطة شاشة من Google Gemini:

 
  • في [1]، يظهر URL الخاص بـ Gemini؛
  • في [2]، إصدار جيميني المستخدم؛
  • في [3-5]، الأسئلة الثلاثة المطروحة على Gemini؛

2.1. المشكلة 1

المشكلة 1 هي سؤال بسيط:

 

ستجيب جميع IA بشكل صحيح على هذا السؤال.

2.2. المسألة 2

المسألة 2 هي كما يلي (لقطة شاشة من Gemini):

 
  • في [1]، يتم شرح مبدأ حساب ضريبة عام 2019 على دخل عام 2018 في PDF. سنعود إلى هذا الموضوع لاحقًا؛
  • في [2]، نقدم تعليمات دقيقة لـ Gemini بشأن ما نريده، وهو برنامج نصي Python مستقل يحل المشكلة المطروحة ويتحقق من صحة الحل المقترح من خلال 11 اختبارًا فرديًّا؛
  • في [3]، يجب كتابة شيء ما لتشغيل Gemini؛

نحن هنا في نفس الحالة تمامًا مثل حالة TD المُقدَّمة إلى الجامعة.

ستعمل ملفات IA التي تم اختبارها على حل المشكلة باستثناء MistralAI وPerplexity.

2.3. المشكلة 3

باستخدام لقطة شاشة أخرى من Google Gemini، فإن المشكلة 3 هي كما يلي:

 
  • في [1]، نقدم تعليماتنا، وهي نفسها كما في السابق. ولكن بما أننا لم نقدم PDF الذي كان يقدم قواعد الحساب الدقيقة، فسيتعين على IA البحث عن هذه القواعد على الإنترنت؛
  • في [3]، نبدأ تشغيل IA؛

لم يجتز هذا الاختبار سوى ثلاثة ملفات IA، مرتبة حسب التميز (وهذا رأي شخصي بحت، كما هو واضح):

  1. ChatGPT من OpenAI؛
  1. Grok من xAI؛
  2. Goggle Gemini؛

فشل LIA ClaudeAI في حل المسألة 3. فشل IA و MistralAI في حل المسألتين 2 و 3، وكذلك IA Perplexity. فشل IA و DeepSeek في حل المسألة 3.