تجربة: لم يجعل الذكاء الاصطناعي الناس أكثر ذكاءً، لكن من يعترفون بأنهم لا يفهمون تقريبًا اختفوا بالكامل

أجرى باحثون من فرنسا وإيطاليا خمسة تجارب على 3,132 مشاركًا، ووجدوا أنه كلما وُضع ذكاء اصطناعي حاضر للاقتراح، انخفضت نسبة اعتراف الناس بعبارة «أنا لا أعرف» من 44% إلى 3%، وتراجعت نسبة الإجابات الصحيحة من 27% إلى 9%، بينما قفزت الثقة في صحة إجاباتهم من 30% إلى 76%. صُممت الأسئلة عمدًا لتكون الإجابة عنها خطأ بالضرورة عندما يكون الذكاء الاصطناعي موجودًا، وحتى عند إضافة حافز مالي على الإجابات الصحيحة، لا يعود كبح التردد في القرار إلا إلى 8%. يعتقد فاليريو كابّراتو، الذي يقود الدراسة، أن هذا الأمر يحتاج إلى التعامل معه عبر محو أمية الذكاء الاصطناعي وسياسات التعليم. (الخلفية: دراسة من Nature تكشف «تضخيم الحلزونية» الذي يؤدي إلى هلوسات خاطئة لدى المستخدمين عند استخدام روبوتات الدردشة بالذكاء الاصطناعي) (إضافة سياقية: البشر يصابون بمرض ذكاء اصطناعي من نوع «تفويض الدماغ» ويتدهور الأمر بشدة! تحذير من مؤسس iKala: طلب السهولة قد يُتلف القدرة على الإبداع الأصيل)

ملخص النقاط الرئيسية

  • خمس تجارب، 3,132 مشاركًا، وعند حضور الذكاء الاصطناعي تنخفض نسبة «أنا لا أعرف» من 44% إلى 3%
  • تنخفض نسبة الإجابة الصحيحة من 27% إلى 9%، لكن ترتفع الثقة بالإجابة من 30% إلى 76%
  • بعد إضافة حافز على الإجابة الصحيحة، يعود كبح التردد إلى 8% وتصل نسبة الصحة إلى 16%، لكنها تظل بعيدة عن خط الأساس

خمس تجارب، 3,132 مشاركًا، وخلاصة الدراسة تكاد تكون جملة واحدة فقط. ووفقًا لما نقلته وسيلة إعلام تقنية The Register، اكتشف باحثون من فرنسا وإيطاليا أنه ما دامت هناك أداة ذكاء اصطناعي يمكن سؤالها، فإن نسبة اعتراف الناس بعبارة «أنا لا أعرف» تنخفض من 44% إلى 3%، كما تنخفض نسبة الإجابات الصحيحة من 27% إلى 9%، لكن الثقة بأنفسهم في إجاباتهم ترتفع بدلًا من ذلك من 30% إلى 76%.

أُنجزت الدراسة بالتعاون بين فاليريو كابّراتو، نائب أستاذ في جامعة ميلانو بيكوكّا (University of Milano-Bicocca)، وكيارا ماركوّتشيا من المدرسة العليا للأساتذة في باريس، ووالتر كواتروتشيوشي من جامعة روما. نُشرت الورقة في أوائل/منتصف يوليو على arXiv، وكانت أربع من أصل خمس تجارب مسجلة مسبقًا.

لم يجعل الذكاء الاصطناعي الناس أذكى أو أحمق، بل خفض بشكل كبير عتبة أن يشعر الشخص بأنه «يفهم».

صُممت الأسئلة عمدًا بحيث يُخطئ الذكاء الاصطناعي

لم يقم فريق البحث بتوليد الأسئلة بشكل عشوائي. بل اختاروا مسائل تكون النماذج اللغوية الكبيرة معرضة جدًا للانزلاق فيها، وجميعها تدور حول تفاصيل بصرية في الأفلام، مثل: ما لون الزي الرسمي لفريق «I Love Beckham». هذه الأنواع من الأسئلة لا يمكن الإجابة عنها إلا بعد رؤية المشهد، في حين لا يستطيع النموذج إلا التخمين اعتمادًا على بيانات النص.

عندما يتم تثبيت اقتراح الذكاء الاصطناعي ليكون خاطئًا، فإن ذلك يعزل بين أمرين: «هل يفيد استخدام الذكاء الاصطناعي» و«هل تكون إجابات الذكاء الاصطناعي دقيقة». طوال التجربة، كان بإمكان المشاركين اختيار عدم الإجابة في أي وقت، والاكتفاء بالقول إنهم لا يعرفون.

وكانت النتيجة أن خيار «عدم الإجابة» لا يكاد يختاره أحد، طالما كان الذكاء الاصطناعي موجودًا. لم يختلف ذلك سواء كانت التوصية الخاطئة تأتي لأن المشاركين سألوها هم، أو لأن النظام عرض الإجابة على الشاشة مباشرة؛ فكبح التأثير كان متشابهًا في الحالتين.

وحتى حافز المال لا يُعيد سوى جزء صغير

رفع الفريق الرهان أكثر: دفع مقابل الإجابة الصحيحة وخصم مقابل الإجابة الخاطئة. كان للحوافز تأثير بالفعل؛ إذ صار المشاركون أقل ميلاً لسؤال الذكاء الاصطناعي، وأقل عرضة لنسخ الإجابة. وعادت نسبة كبح التردد من 3% إلى 8%، وارتفعت نسبة الصحة من 9% إلى 16%.

لكن ذلك يظل بعيدًا جدًا عن خط الأساس. فعندما لا يوجد ذكاء اصطناعي، كانت نسبة كبح التردد 44% ونسبة الإجابة الصحيحة 27%. وبعبارة أخرى، حتى مع وجود المال على الطاولة، لم يسترد المشاركون إلا أقل من ربع الفجوة.

قال فاليريو كابّراتو: «بالنسبة للإنسان، فإن القدرة على قول «أنا لا أعرف» مهمة للغاية، لأنها تعني أننا ندرك حدود معرفتنا». وأضاف: «لكن الآن ومع وجود ذكاء اصطناعي، يمكن الحصول على إجابات جاهزة تقريبًا لأي سؤال، لذلك أردنا أن نعرف ما إذا كان ذلك سيُحدث اضطرابًا في قدرة البشر على قول «أنا لا أعرف» والقدرة على كبح التردد في القرار».

والقلق الحقيقي لدى فاليريو كابّراتو يتعلق بالأطفال، لأن «البالغين تعلموا التفكير النقدي بالفعل». ويرى أن هذه المسألة تحتاج إلى معالجة عبر محو أمية الذكاء الاصطناعي وسياسات التعليم، وأن تدخل الجانب التعليمي ربما يملك فرصًا أفضل للنجاح.

بالنسبة لمن يقرأ يوميًا بيانات السلاسل عبر الذكاء الاصطناعي ويحلل تقارير الأبحاث، فإن هذه الورقة بمثابة مرآة. ليست المشكلة أن النماذج تهذي بما لا يصح؛ بل أن نسأل أنفسنا بعد قراءة ملخص الذكاء الاصطناعي: هل فهمنا الأمر فعلًا؟

الأسئلة الشائعة

هل يؤدي استخدام الذكاء الاصطناعي إلى التأثير في التفكير النقدي لدى الإنسان؟

أظهرت تجارب فريق فاليريو كابّراتو في جامعة ميلانو بيكوكّا (3,132 شخصًا) أنه عند وجود توصيات من الذكاء الاصطناعي، تنخفض نسبة اعتراف المشاركين بأنهم لا يعرفون من 44% إلى 3%، وتنتقل نسبة الإجابات الصحيحة من 27% إلى 9%، بينما ترتفع الثقة بالإجابة من 30% إلى 76%.

لماذا صُممت هذه الدراسة بحيث يكون من المفترض أن يجيب الذكاء الاصطناعي عنها خطأ؟

اختار الفريق تفاصيل بصرية من أفلام تكون النماذج اللغوية الكبيرة عرضة للفشل فيها، وأن تكون توصيات الذكاء الاصطناعي فيها ثابتة على أنها خاطئة. يتيح ذلك فصل «هل وجود الذكاء الاصطناعي يفيد» عن «هل إجابات الذكاء الاصطناعي دقيقة». وهكذا، يمكن إثبات أن كبح التردد الذي يحدث هو بسبب وجود الذكاء الاصطناعي بحد ذاته، لا بسبب جودة الإجابات.

شاهد النسخة الأصلية
قد تحتوي هذه الصفحة على محتوى من جهات خارجية، يتم تقديمه لأغراض إعلامية فقط (وليس كإقرارات/ضمانات)، ولا ينبغي اعتباره موافقة على آرائه من قبل Gate، ولا بمثابة نصيحة مالية أو مهنية. انظر إلى إخلاء المسؤولية للحصول على التفاصيل.
  • أعجبني
  • تعليق
  • إعادة النشر
  • مشاركة
تعليق
إضافة تعليق
إضافة تعليق
لا توجد تعليقات
  • مُثبت