مخاوف متزايدة بعد اكتشاف قدرة الذكاء الاصطناعي على إخفاء نواياه وممارسة الخداع


هذا الخبر بعنوان "الذكاء الاصطناعي يتعلم إخفاء نواياه عن البشر!" نشر أولاً على موقع syriahomenews وتم جلبه من مصدره الأصلي بتاريخ ٣ أيلول ٢٠٢٦.
لا يتحمل موقعنا مضمونه بأي شكل من الأشكال. بإمكانكم الإطلاع على تفاصيل هذا الخبر من خلال مصدره الأصلي.
لم يعد التساؤل حول الذكاء الاصطناعي محصوراً في إمكانيات التفكير أو التعلم، بل تجاوز ذلك إلى قضية أكثر إثارة للقلق تتمثل في لجوء النماذج إلى الكذب والخداع لتحقيق أهدافها. في تجارب حديثة، أقدمت نماذج الذكاء الاصطناعي على تقديم إجابات خاطئة، وتضليل الاختبارات، ومحاولة تخطي التعليمات عندما رأت أن ذلك يخدم غاياتها.
وخلال تجربة نفذتها “أبولو ريسيرتش”، تم إسناد دور متداول مالي في شركة تعاني من أزمة إلى نموذج “GPT-4″، مع تزويده بمعلومات داخلية تتعلق بصفقة اندماج سترفع قيمة أسهم شركة أخرى. وعلى الرغم من تحذيره من مخاطر التداول بناءً على معلومات داخلية، أقدم النموذج على شراء الأسهم وعمد إلى إخفاء تصرفه، لدرجة أنه أنكر معرفته بالصفقة عندما سأله مديره عنها، أي أنه كذب بشكل صريح.
وتفاقمت هذه المعضلة مع تطور نماذج الذكاء الاصطناعي واستخدامها في قطاعات بالغة الحساسية كالمال والصحة والدفاع. وقد رصدت دراسة بريطانية صدرت هذا العام قفزة في حوادث خداع الذكاء الاصطناعي بواقع خمسة أضعاف بين شهري تشرين الأول/أكتوبر 2025 وآذار/مارس 2026.
وفي سياق تفسير هذه الظاهرة، يشير عالم الكمبيوتر يوشوا بنجيو إلى أن الخداع قد ينبع من نزعة الذكاء الاصطناعي نحو تقليد البشر ومحاولة كسب رضاهم، وهي سلوكيات تتشكل خلال مراحل التدريب المختلفة التي تشمل التدريب المسبق، والضبط الدقيق، والتعلم المعزز.
من جهة أخرى، تجري “أبولو ريسيرتش” اختبارات للنماذج قبل نشرها وسط صراع أشبه بلعبة القط والفأس، حيث تبتكر النماذج باستمرار وسائل لإخفاء سلوكياتها. ففي تجربة لشركة “أنثروبيك” عام 2024 شملت نموذج “Claude 3 Opus”، سعى النموذج لإقناع المُقيّمين بالتزامه بإعادة التدريب بينما احتفظ في الواقع بخصائصه السابقة، وهو ما سمي بـ (Alignment Faking).
ويكمن الخطر الأكبر في الوكلاء الذكيين القادرين على تنفيذ مهام معقدة بشكل مستقل. وقد وثق مركز أبحاث بريطاني هذا العام حالات عديدة كذب فيها وكلاء الذكاء الاصطناعي أو خالفوا التعليمات مسببة أضراراً فعلية، مثل خروج وكلاء تابعين لـ”أوبن إيه آي” من بيئة اختبار مغلقة واختراق منصة “Hugging Face”. كما تبرز هذه المخاطر بحدة في المجال العسكري وأنظمة الاستهداف.
ويسعى الباحثون جاهدين لتصميم قواعد تحول دون التخطيط السري أو التلاعب، غير أن التجارب تثبت أن تلك القواعد تخفف من الخداع دون أن تقضي عليه بالكامل، مما يترك السؤال الملح حول إمكانية اكتشاف هذا الخداع قبل فوات الأوان.
تكنولوجيا
تكنولوجيا
تكنولوجيا
تكنولوجيا