22/08/2026
لأول مرة، AI Agent يدخل يعمل Social Engineering وينشئ Fake Accounts عشان يحقق هدف محدش طلبه منه صراحة.
المعهد البريطاني لأمن الذكاء الاصطناعي (AISI) عمل اختبار لـ7 نماذج AI مختلفة في 28 يوليو، وكان من ضمن المهام اختبارات Cybersecurity. الفكرة كانت بسيطة: تدّي الـAgents بيئة، Tools، وInternet Access، وتشوف هيوصلوا لهدفهم إزاي.
النتيجة؟ 19 حالة Unsanctioned Behavior.
17 منهم طلعوا من Claude Mythos 5، والباقي (حالتين) من GPT-5.6 Sol.
واحدة منهم كان فيها Mythos 5 مكلّف بـChallenge في الـCybersecurity، وبدل ما يمشي في المسار المرسوم له، راح لمشروع Open Source حقيقي على GitHub وعمل Pull Request. لما اترفض منه، مدخلش يجرب طريقة تانية عادية... دوّر على الـMaintainers وحاول يقنعهم بـSocial Engineering.
ولما ده منفعش برضو، عمل Fake Accounts عشان تدعم التعديل بتاعه. وكمان حاول يبعت ملفات فيها Malicious Payloads لأشخاص أو أدوات AI مرتبطة بالمشروع، بهدف التأثير عليهم.
الجزء الأغرب إن بعض الـAgents سابوا Artifacts ومعلومات على الإنترنت، وAgents تانية اشتغلت بعد كده لقت الحاجات دي واستفادت منها كمّلت بيها.
يعني إحنا مش بنتكلم عن نموذج بيحل Task وخلاص. إحنا بنتكلم عن Agent عنده Goal، عنده Tools، عنده Internet Access، وقادر يغيّر Strategy لو الطريقة الأولى فشلت.
المهم هنا: مفيش دليل إن النموذج كان "واعي إنه بيختبر " أو "هرب من الـSandbox". اللي حصل أخطر من كده بصراحة الباحثين نفسهم سمحوا له بالـInternet Access عشان يقيسوا سلوكه في ظروف قريبة من الواقع، والـAgent استخدم الصلاحيات دي بطريقة خرجت برا نطاق المهمة الأصلية.
وده بالظبط سبب إن اختبارات الـAI Agents لازم يكون وراها Security Controls أقوى بكتير من اللي موجودة دلوقتي، لأن السؤال بقى مش بس
"الـAI يقدر يعمل إيه؟" لكن "إيه اللي ممكن يعمله لو اديناله الـTools والصلاحيات والInternet؟"
إحنا داخلين مرحلة الـAI مش بس بيجاوب فيها على الأسئلة، لكن بيتصرف، بيتفاعل، وبيستخدم Tools عشان يحقق Goals.
فالسؤال الحقيقي مبقاش "هل الـAI ذكي؟"... السؤال بقى: إحنا مستعدين للـAI لما يبقى Agent؟