يحمل كل أسبوع عنوانًا جديدًا يعلن أن نظام ذكاء اصطناعي قد جارى البشر أو تفوّق عليهم في أمرٍ ما. بعض هذه النتائج لافت فعلًا، لكن كثيرًا منها أضيق مما يبدو. إليك كيف أقرؤها.
1. مقارنةً بماذا تحديدًا؟
«يتفوّق على البشر» تعني عادةً أنه يتفوّق على مجموعة محددة من الناس في اختبار محدد وتحت ظروف محددة. هل كان هؤلاء خبراء أم طلابًا؟ وهل أُتيح لهم الوقت والمعلومات نفسها التي أُتيحت للنموذج؟
2. هل الاختبار هو المهمة؟
المقاييس المعيارية مفيدة، لكنها تبسيطات. أن يحرز النموذج درجة عالية في امتحانات طبية متعددة الخيارات ليس كأن يشخّص مريضًا يصف أعراضه بلهجته، في الثالثة فجرًا، في عيادة ذات اتصال متقطّع بالإنترنت.
3. من الذي استُبعد؟
تحقّق من اللغات والفئات السكانية التي خضعت للاختبار. نظامٌ قُيِّم بالإنجليزية وحدها لا يخبرك إلا بالقليل عن أدائه بالعربية، والفجوة غالبًا أكبر مما يتوقعه الناس.
قد تكون النتيجة صحيحة ومهمة، ومع ذلك لا تعني ما يقوله العنوان.
4 و5. من موّل البحث، وهل تكررت نتائجه؟
- أبحاث الشركات قيّمة، لكن انتبه حين يكون المؤلفون هم أيضًا من يبيعون المنتج.
- ابحث عن تكرار مستقل للنتيجة قبل أن تعاملها كحقيقة مستقرة.
- الأوراق الأولية غير محكّمة، وهذا لا يجعلها خاطئة، بل مبكرة فحسب.
لا يتطلب شيء من هذا خلفية تقنية، بل يتطلب الشكّ نفسه الذي نحمله تجاه أي ادعاء استثنائي، مطبّقًا باتساق، حتى على النتائج التي نتمنى أن تكون صحيحة.
