الذكاء الاصطناعي يعيد تشكيل قطاعات حيوية في المجتمع مثل الرعاية الصحية، والتمويل، والعدالة. من تشخيص الأمراض، واتخاذ قرارات الموافقة على القروض، إلى الأحكام القضائية، يمكن لقرارات الذكاء الاصطناعي أن تؤثر بعمق على حياتنا. لكن هل يمكننا الوثوق بهذه الأنظمة بينما تظل آليات عملها الداخلية مخفية، محجوبة داخل نماذج حسابية معقدة مثل الشبكات العصبية العميقة التي لا يستطيع البشر فهمها إلا كـ""صناديق سوداء"" غامضة؟ الحاجة إلى مزيد من الشفافية والثقة في الذكاء الاصطناعي تصبح أكثر إلحاحًا مع انتشار استخدام هذه الأنظمة، خاصة في القطاعات الحيوية.
على النقيض من ذلك، يستخدم الذكاء الاصطناعي القابل للتفسير تقنيات توضح كيفية عمل نماذج الذكاء الاصطناعي، مما يسمح لنا بالثقة بها، والتحقق منها، واستخدام هذه التقنيات المتقدمة بمسؤولية. ومع ذلك، فإن الذكاء الاصطناعي القابل للتفسير ليس حلاً كاملاً ويواجه تحديات خاصة عند محاولة شرح نماذج التعلم الآلي التي تقوم عليها تقنيات الذكاء الاصطناعي. وتصبح قضايا الشرح والتفسير أكثر تعقيدًا مع النماذج اللغوية الكبيرة (LLMs)، التي تُعد من أكثر أنواع الذكاء الاصطناعي شيوعًا اليوم.
بالنسبة لأصحاب المصلحة مثل صانعي السياسات، والمنظمين، والمستخدمين النهائيين لتقنيات الذكاء الاصطناعي، من المفيد أن يكون لديهم فهم أساسي لمفاهيم وأساليب وطرق الذكاء الاصطناعي القابل للتفسير، بالإضافة إلى معرفة إمكانياته وحدوده. وهذا يساعد في وضع توقعات واقعية ورفع معايير قابلية التفسير للأنظمة المستخدمة في المستقبل.
لماذا نحتاج إلى قابلية التفسير؟
يمكن للذكاء الاصطناعي الحديث أداء مهام مذهلة، مثل قيادة السيارات، وتوقع طي البروتينات، وتصميم الأدوية، وكتابة نصوص قانونية معقدة. ومع ذلك، فإن أنظمة الذكاء الاصطناعي غالبًا ما تعمل بشكل غامض وغير شفاف، مما يصعب فهم أو الثقة في نتائجها. هذا النقص في الشفافية ليس مجرد إزعاج، بل يشكل مخاطر أمنية وقانونية وأخلاقية وعملية. فعلى سبيل المثال، يجب أن يشرح نظام الذكاء الاصطناعي الذي يرفض طلب قرض أسباب قراره لضمان عدم تحيزه أو عشوائيته.
تزداد الحاجة إلى الشفافية بشكل خاص عندما يتخذ الذكاء الاصطناعي قرارات حساسة مثل التشخيصات الطبية والأحكام القضائية، إذ أن عدم وجود تفسيرات كافية قد يؤدي إلى انتهاك الحقوق القانونية، أو تعزيز التحيزات، أو التسبب في عواقب ضارة غير مقصودة.
يجب أن تكون قرارات أنظمة الذكاء الاصطناعي مفهومة وقابلة للتحقق ومسؤولة عنها. ويزداد عدد الباحثين والمنظمين والمستخدمين الذين يدركون أنه بدون قابلية تفسير كافية، لا يمكن للذكاء الاصطناعي أن يصبح تكنولوجيا موثوقة في عمليات اتخاذ القرار.
يقوم الذكاء الاصطناعي القابل للتفسير بتلبية هذه الاحتياجات من خلال تمكين المستخدمين وصانعي القرار من فهم المنطق الكامن وراء عمل النموذج، ويهدف إلى سد الفجوة بين أداء الذكاء الاصطناعي وحاجتنا لفهم سلوكه.
فهم الذكاء الاصطناعي القابل للتفسير
يشير الذكاء الاصطناعي القابل للتفسير إلى قدرة نموذج الذكاء الاصطناعي على شرح طريقة عمله بشكل واضح يمكن للبشر فهمه. ويتجاوز هذا الشرح الوضوح التقني ليشمل عدة مفاهيم مرتبطة:
الشفافية: قدرة المستخدمين على الوصول إلى معلومات حول كيفية عمل النظام الداخلي للذكاء الاصطناعي.
المسؤولية: إمكانية تتبع قرارات الذكاء الاصطناعي وتحديد المسؤوليات بوضوح.
القابلية للتتبع: القدرة على إعادة بناء عمليات اتخاذ القرار، وهو أمر حاسم لأغراض التدقيق والرقابة.
القابلية للتفسير: قدرة المستخدمين على فهم كيفية ارتباط البيانات المدخلة بالنتائج المحددة بسهولة.
الموثوقية: أنظمة الذكاء الاصطناعي تنتج نتائج موثوقة وعادلة وأخلاقية بشكل مستمر.
يُستخدم مصطلح أوسع هو الذكاء الاصطناعي الموثوق لوصف الأنظمة التي تتميز بالتنبؤية، والقوة، والعدالة، والتصميم الأخلاقي، والامتثال للمعايير الاجتماعية والقانونية. يبنى الثقة على الفهم؛ فإذا استوعب المستخدمون منطق النظام، فسيكونون أكثر ميلاً لاتباع توصياته. ومن خلال التفسير، يتحول الذكاء الاصطناعي من تقنية غامضة إلى أداة يمكن للبشر التحكم فيها والإشراف عليها والثقة بها.
ومن المهم الإشارة إلى أن مستوى التفسير يختلف باختلاف الجمهور؛ فمثلاً، ما يراه عالم البيانات واضحًا قد يربك قاضيًا أو جهة تنظيمية. لذلك، يجب أن يقوم الذكاء الاصطناعي القابل للتفسير بترجمة العمليات المعقدة إلى تفسيرات مفهومة ومخصصة لجماهير محددة، لضمان الاستخدام العملي للذكاء الاصطناعي في سياقات متنوعة.
مقايضة أداء الذكاء الاصطناعي مقابل قابليته للتفسير
تقدم العديد من نماذج الذكاء الاصطناعي القوية، مثل الشبكات العصبية العميقة، دقة مذهلة في مهام مثل التعرف على الصور ومعالجة اللغة الطبيعية. فهي تكتشف أنماطًا معقدة من مجموعات بيانات ضخمة دون الحاجة إلى قواعد مبرمجة صراحةً من قبل الإنسان. ومع ذلك، تأتي هذه القدرات المتقدمة بثمن: إذ لا توفر هذه النماذج تفسيرات واضحة لنتائجها بسهولة. فهي صعبة التفسير بسبب التبعيات غير الخطية، وعدد المعاملات الكبير، والهياكل متعددة الطبقات. ونتيجة لذلك، غالبًا ما تكون طريقة عملها الداخلية غير مفهومة حتى للخبراء. هذا الجمع بين الأداء العالي وقلة القابلية للتفسير يخلق ما يُعرف بـ ""مقايضة الأداء مقابل القابلية للتفسير"".
وهذا يضعنا أمام معضلة: هل نفضل النماذج الأبسط الأقل دقةً ولكن عملياتها شفافة، أم النماذج المعقدة ذات الأداء العالي التي تبقى غامضة؟ يعتمد الاختيار بشكل كبير على سياق التطبيق. ففي المجالات التي تكون فيها النتائج ذات تأثير كبير، قد يكون من المقبول تقليل الدقة قليلاً إذا أدى ذلك إلى زيادة فهم وموثوقية قرارات نظام الذكاء الاصطناعي بشكل ملحوظ.
النهج المتبعة في التفسير
عادةً ما تنقسم طرق التفسير إلى فئتين رئيسيتين:
إعطاء الأولوية للنماذج القابلة للتفسير intrinsically interpretable models
النماذج القابلة للتفسير مثل الانحدار الخطي واللوجستي، وأشجار القرار، أو أنظمة القواعد البسيطة الأخرى، توفر شفافية فطرية لأن عمليات اتخاذ القرار فيها مباشرة وسهلة التتبع. تمكّن هذه النماذج المستخدمين من فهم كيف تؤثر نقاط البيانات المحددة على النتائج بشكل مباشر، مما يسهل التحقق والتدقيق. لذلك، من الأفضل اختيار هذه النماذج كلما أمكن ذلك لأغراض التفسير.تطبيق طرق التفسير بعد التنفيذ post-hoc explanation methods
بالنسبة للنماذج الأكثر تعقيدًا مثل الغابات العشوائية (random forest) والشبكات العصبية المختلفة، يمكن أن توضح طرق التفسير بعد التنفيذ المخرجات (كالقرارات أو المحتوى المولد) بعد صدورها، دون التأثير على النماذج نفسها. تشمل هذه الطرق:
طرق خاصة بالنموذج model-specific methods: تفسيرات مخصصة لأنواع معينة من النماذج (مثل تصوّر أشجار القرار).
طرق عامة للنماذج model-agnostic methods: تقنيات عامة تُطبق عبر أنواع مختلفة من النماذج ولا تحتاج للوصول إلى البُنى الداخلية، وتعتمد فقط على تحليل المدخلات/المخرجات (مثل أهمية الميزات عبر التبديل permutation feature importance).
تفسيرات محلية local explanations: تركز على التنبؤات الفردية. توفر طرق مثل SHAP أو LIME وضوحًا حول كيفية مساهمة كل متغير إدخالي في قرارات معينة.
تفسيرات عامة global explanations: تقدم رؤى حول سلوك النموذج ككل، وتحدد القواعد والأنماط العامة للقرار عبر البيانات (مرة أخرى SHAP أو LIME)؛ وهي ضرورية لتقييم العدالة والامتثال التنظيمي.
وغالبًا ما يؤدي الجمع بين هذه الأساليب إلى حلول أكثر فاعلية من خلال تكييف التفسيرات لتناسب احتياجات المستخدم والسياق.
تحديات الذكاء الاصطناعي القابل للتفسير
على الرغم من إمكانياته، لا يزال الذكاء الاصطناعي القابل للتفسير يواجه العديد من العقبات التكنولوجية الكبيرة:
طرق غير متناسقة: عدم وجود معايير موحدة لتقييم طرق التفسير نفسها يصعّب ضمان الموثوقية وقابلية التكرار، مما يجعل من الصعب تحديد أي تفسير هو ""صحيح"" أو الأكثر فائدة.
معالجة البيانات غير المنظمة: تواجه الطرق التقليدية صعوبة في التعامل مع أنظمة الذكاء الاصطناعي التي تعالج بيانات معقدة وغير منظمة مثل النصوص أو الصور، حيث يتأثر المعنى بالسياق بشكل كبير، وليس فقط بالكلمات الفردية، بل أيضاً بالبنية النحوية والإشارات الضمنية.
القيود الحاسوبية: تشغيل طرق التفسير على نماذج ذكاء اصطناعي ضخمة تحتوي على مليارات المعاملات، مثل النماذج اللغوية الكبيرة (LLMs)، يتطلب قوة حاسوبية كبيرة، مما يجعل التفسيرات الفورية أمراً تحدياً.
التواصل الفعّال: حتى التفسيرات الدقيقة تصبح غير فعالة إذا لم تكن مفهومة أو قابلة للتطبيق من قِبل الجمهور المستهدف (مثل المحامين، القضاة، أو الجهات التنظيمية).
الطبيعة متعددة الأبعاد للبيانات غير المنظمة تمثل تحديًا إضافيًا، خاصة بالنسبة للنصوص. وهذا يبرز الحاجة إلى ابتكار أساليب جديدة للحفاظ على فعالية التفسير.
شرح النماذج اللغوية الكبيرة (LLMs)
تُعتبر النماذج اللغوية الكبيرة المستخدمة اليوم، مثل ChatGPT وClaude وGemini، من الركائز الأساسية لتطبيقات الذكاء الاصطناعي الحديثة في توليد اللغة الطبيعية، لكنها تواجه تحديات فريدة. على الرغم من قدرتها العالية على إنتاج محتوى مترابط وغني بالسياق، إلا أن حجمها وتعقيدها يجعل من الصعب جدًا تفسير سبب تقديم النموذج لإجابة معينة، أو ربط مفاهيم محددة، أو استبعاد أخرى. ويعد فهم سبب إنتاجها لمخرجات أو تحيزات معينة أمرًا بالغ الصعوبة، مما يجعلها ""الصندوق الأسود"" الأمثل.
كما أن هذه النماذج غالبًا ما تعكس التحيزات الموجودة في بيانات التدريب الخاصة بها. ومن دون تفسير واضح، يصعب التحقق مما إذا كان المحتوى الناتج تمييزيًا أو غير صحيح أو غير أخلاقي. وهذا يجعل استخدام مثل هذه النماذج في سياقات حساسة، مثل القضايا القضائية، محفوفًا بالمخاطر، وقد يؤدي إلى أخطاء نظامية أو انتهاكات لحقوق الإنسان.
يُعد تفسير المخرجات النصية تحديًا كبيرًا؛ فبيانات النصوص ذات أبعاد عالية، وحساسة للسياق، وغنية بالمعاني الضمنية، بينما تعجز طرق التفسير التقليدية عن التقاط العلاقات المفاهيمية المعقدة. على سبيل المثال، قد ينتج النموذج ملخصًا قانونيًا دقيقًا، لكن يبقى من غير الواضح أي أجزاء من الوثيقة الأصلية تم اعتبارها ذات صلة وأي المعرفة القانونية تم تطبيقها ضمنيًا.
ونظرًا لأن هذه النماذج التأسيسية توفر التقنية الأساسية لمجال الذكاء الاصطناعي الوكِلي (Agentic AI) سريع التطور، والذي سيؤثر بشكل واسع في العالم الحقيقي، من المهم تقييم مدى قدرة طرق التفسير الحالية على تحسين مراقبة سلوك النماذج.
حتى الآن، تُصنف تقنيات تفسير النماذج اللغوية الكبيرة وفقًا لطريقة تدريبها واستخدامها إلى نمطين رئيسيين (حسب Zhao وآخرين، 2024):
التعديل الدقيق (Fine-tuning): يشمل تكييف نموذج مُدرب مسبقًا على مجموعة بيانات صغيرة متخصصة لتعزيز الأداء في مهام محددة (مثل التفسير القانوني أو التشخيص الطبي). في هذه الحالة، تركز التفسيرات على كيفية تأثير التعديل الدقيق على هياكل الانتباه، والتمثيل الدلالي، أو الكيانات والعبارات الرئيسية.
التحفيز (Prompting): يعتمد على استخدام مدخلات مصممة خصيصًا (تعليمات، أسئلة، أمثلة) دون تعديل النموذج نفسه. تحلل طرق التفسير هنا أي عناصر في المدخلات أثرت على الاستجابة أو كيف شكل السياق النتيجة. وبما أن التمثيلات الداخلية غير متاحة، تعتمد هذه التفسيرات غالبًا على تحليل التغييرات في المدخلات/المخرجات.
فهم سلوك النماذج في أي من النمطين صعب بسبب البنية غير الخطية المعقدة للنماذج اللغوية الكبيرة، حيث يمكن لتغييرات بسيطة في المدخلات أن تؤدي إلى اختلافات كبيرة في المخرجات، مما يصعب تقديم تفسيرات مستقرة وقابلة للتكرار.
تشمل الطرق التجريبية الأخرى تصور الانتباه، تحليل تأثير الرموز (Tokens)، والتعلم التبايني للكشف عن الاختلافات الرئيسية في المخرجات. هذه التقنيات تشكل مجال بحث سريع النمو يهدف إلى كشف آليات عمل النماذج اللغوية الكبيرة لدعم الموثوقية، والعدالة، والامتثال التنظيمي. لمزيد من المعلومات المتعمقة، يمكن الاطلاع على Zhao وآخرين (2024).
التفسيرية كممارسة معيارية
كما ذُكر، يُعد الذكاء الاصطناعي القابل للتفسير (Explainable AI) نموذجًا أوسع يستخدم أساليب وطرق خاصة لتحسين فهمنا للنماذج المعقدة في الذكاء الاصطناعي. وهو مكوّن أساسي في سبيل الوصول إلى ذكاء اصطناعي موثوق، ويرتبط بمفاهيم مثل الشفافية، والمساءلة، وقابلية التتبع، وقابلية الفهم، والثقة في الذكاء الاصطناعي. إعطاء الأولوية للتفسيرية يؤسس لقاعدة تجعل من تقنية الذكاء الاصطناعي أداة داعمة للبشرية تقوم على تعزيز الثقة، وتحسين العدالة، والتوافق مع القوانين والمعايير الأخلاقية.
لا تزال هناك العديد من التحديات في مجال التفسيرية، خاصةً فيما يتعلق بالنماذج اللغوية الكبيرة المعقدة المستخدمة على نطاق واسع. حتى الآن، يواجه مطورو ومستخدمو الذكاء الاصطناعي مفاضلات صعبة بين أداء النموذج وقابلية تفسيره. علاوة على ذلك، قد لا يكون الذكاء الاصطناعي شفافًا بشكل كامل أبدًا، تمامًا كما أن التفكير البشري يحمل دائمًا قدرًا من الغموض. لكن هذا لا ينبغي أن يقلل من السعي المستمر للرقابة والمساءلة عند استخدام هذه التقنية القوية والمؤثرة.
على العكس، يجب أن تحفز هذه القيود على تبني نهج أكثر جدية والتزامًا في السعي نحو التفسيرية. في الطريق نحو نشر الذكاء الاصطناعي بشكل فعّال وآمن ومسؤول، يجب أن تكون التفسيرية مبدأً أساسيًا في التصميم، وأن تتحول إلى معيار عالمي يوجه أبحاث الذكاء الاصطناعي المستقبلية، وتنظيمه، وتكيّف المؤسسات معه.
