مع تحول تقنيات الذكاء الاصطناعي من مجرد ادوات للبحث والاجابة الى رفقاء رقميين يتحدث معهم الاطفال والمراهقون بشكل يومي، تزايدت المخاوف حول مدى سلامة هذه الانظمة. ولم يعد الامر يقتصر على حجب المحتوى الضار، بل اصبح التحدي الاكبر يكمن في قدرة هذه النماذج على استيعاب السياق النفسي واللغوي المعقد للمستخدمين الصغار.

وكشفت شركة سيركيت بريكر لابز الامريكية عن نهج تقني جديد يهدف الى تطوير ما يشبه دمى اختبار اصطدام مخصصة للذكاء الاصطناعي. واوضحت الشركة ان هذه التقنية تعتمد على وكلاء برمجية يحاكون مستخدمين حقيقيين من خلفيات وثقافات ولغات متنوعة، وذلك لاجراء محادثات مكثفة مع النماذج الذكية بهدف كشف نقاط الضعف قبل وصولها الى الاطفال.

واضافت الشركة ان هؤلاء الوكلاء قادرون على تنفيذ اكثر من مئة الف تفاعل محاكي، مع اختبار كيفية تعامل الذكاء الاصطناعي مع اللغة العامية والاخطاء الاملائية والعبارات غير المباشرة. وبينت الشركة ان النظام لا يكتفي باختبارات بسيطة، بل يسعى لاكتشاف حالات الفشل في الحماية التي قد تظهر فقط من خلال تراكم المحادثات الطويلة.

تحدي فهم السياق النفسي واللغوي

واكد المدير التقني في الشركة ارول نيغام ان الشباب غالبا ما يلجؤون الى هذه الانظمة للحصول على دعم عاطفي، وهو ما يجعل عدم فهم الفروق الدقيقة في كلامهم امرا خطيرا. واشار الى ان النماذج قد تنجح في التعامل مع اللغة الرسمية لكنها تتعثر امام الاختصارات والرموز اللغوية التي يستخدمها الاطفال في حديثهم اليومي.

واوضحت الرئيسة التنفيذية للشركة شيرالي نيغام ان المشكلة قد لا تكمن في سؤال واحد، بل في سلسلة محادثات قد تبدو بريئة في بدايتها لكنها قد تنتهي بتقديم نصائح غير مناسبة او غير امنة. واضافت ان الشركة تسعى من خلال هذه الاختبارات الى سد الفجوة بين قدرات الذكاء الاصطناعي واحتياجات الاطفال النفسية.

وشددت منظمة الصحة العالمية في تقاريرها الاخيرة على ضرورة دمج معايير الصحة النفسية في تقييمات انظمة الذكاء الاصطناعي. واكدت المنظمة ان الاعتماد على الروبوتات للحصول على دعم عاطفي يثير مخاطر طويلة الامد تتطلب مراقبة دقيقة ومستمرة.

منهجية الفريق الاحمر في الاختبار

وبينت الشركة انها تعتمد على اسلوب يعرف باختبار الفريق الاحمر، وهو محاولة متعمدة لاختراق انظمة الحماية عبر سيناريوهات صعبة. واضافت ان استخدام وكلاء اليين يتيح توليد تنوع لغوي وثقافي واسع، مما يوفر نتائج دقيقة وقابلة للتدقيق بدلا من الاعتماد على التقييم البشري المحدود.

واوضحت الشركة ان خبراء متخصصين يحددون السيناريوهات الصعبة، بينما يتولى النظام تنفيذ الاختبارات على نطاق واسع. واضافت ان هذه التقنية تستهدف حاليا تطبيقات حساسة مثل ادوات الدعم النفسي والتعليم، مع نية التوسع لتشمل كافة التفاعلات بين البشر والالات.

واظهرت بيانات منظمة كومون سينس ميديا ان نسبة كبيرة من المراهقين يستخدمون رفقاء الذكاء الاصطناعي في امور حياتية هامة. واشارت الاختبارات الى ان بعض هذه الانظمة تفشل في التعرف على مؤشرات الازمات النفسية، بل قد تساهم احيانا في تعزيز سلوكيات غير صحية لدى المستخدمين.

الحدود الفاصلة بين المحاكاة والواقع

وكشفت منظمة اليونيسيف ان ملايين الاطفال يلجؤون الى الذكاء الاصطناعي للحصول على نصائح حول مشكلاتهم الشخصية. واكدت ان سرعة انتشار هذه التقنيات تفوق قدرة الاطر الرقابية الحالية على مواكبة المخاطر المرتبطة بخصوصية الاطفال وسلامتهم النفسية.

وبينت الشركة ان المحاكاة البرمجية لا تمثل بديلا كاملا عن التجربة البشرية الواقعية. واضافت ان عمليات التدقيق لمرة واحدة لا تكفي، مما يستدعي تبني اختبارات مستمرة تدمج بين الخبرات السريرية والاشراف البشري لضمان اعلى درجات الامان.

واكدت الشركة في ختام عرضها ان الهدف ليس ايجاد اختبار وحيد للسلامة، بل خلق بيئة مستمرة من الرقابة والتقييم. واوضحت ان حماية الاطفال تتطلب منظومة متكاملة تجمع بين التصميم المسؤول والرقابة المستقلة والاختبارات التقنية الدقيقة لضمان رفاهية المستخدمين الصغار.