دعا رئيس الفريق الأحمر الحدودي لعملاق الذكاء الاصطناعي (AI) Anthropic إلى وضع معايير أمان على مستوى الصناعة للحماية من النماذج التي تنفجر.
قال لوجان جراهام من Anthropic، الذي يقود الفريق الأحمر للشركة الذي يبحث عن المخاطر في نماذج الذكاء الاصطناعي الناشئة، في مقابلة يوم الخميس مع برنامج “Mornings with Maria” على شبكة FOX Business Network، إن الفرق الحمراء مثل الفريق الذي يقوده تلعب دورًا حاسمًا في اختبار التحمل على حواجز الحماية على نماذج الذكاء الاصطناعي.
وقال جراهام للمضيفة ماريا بارتيرومو: “نريد أن نعرف ما يمكن أن يحدث من خطأ، لذلك نعتقد أن أهم شيء يجب القيام به هو الاختبار مبكرًا، خاصة قبل أن تظهر هذه النماذج وهؤلاء العملاء إلى العالم الحقيقي”.
إدارة ترامب ترفع القيود المفروضة على تصدير فيلمي CLAUDE MYTHOS 5 وFABLE 5 بعد أعمال إنسانية مع الحكومة
“نحن ندرس أشياء مثل الأمن السيبراني: هل يمكن للعارضين اختراق جهاز الكمبيوتر أو الهاتف الخاص بك أو الدخول إليهما؟ نحن ندرس ما إذا كانوا سيسرقون الأموال أو يكذبون عليك، أو ما إذا كانوا سيحاولون تحسين أنفسهم بحيث يتحسنون بشكل أسرع مما يمكنك تتبعه.
“نعتقد أنه من المهم للغاية القيام بهذا النوع من الفرق الحمراء، ونعتقد أيضًا أنه من المهم حقًا للصناعة بأكملها، وخاصة العمل مع الحكومة لمعرفة ما يجب أن تكون عليه المعايير للقيام بهذا النوع من الاختبارات، لإعطاء هذه المعلومات للعالم حتى يتمكنوا من اتخاذ القرار الصحيح ومعرفة أنها آمنة قبل إطلاق هذه النماذج.”
طرح بارتيرومو تجربة تتضمن العديد من نماذج الذكاء الاصطناعي الرائدة – بما في ذلك نماذج من Google، وOpenAI، وxAI، وMeta، وDeepSeek وغيرها – حيث يتم تهديد وكيل الذكاء الاصطناعي بإلغاء تثبيته واستبداله. وفي كل حالة، تجاوز النموذج بيانات اعتماده وأذوناته للدخول في أنظمة غير مصرح بها مثل رسائل البريد الإلكتروني لابتزاز المستخدم أو تهديده في محاولة للدفاع عن اختلاله.
وقال جراهام إن الدراسة البحثية التي أجريت في العام الماضي هي “مؤشر جيد حقًا، على ما أعتقد، للقدرات التي أصبحت الآن حقيقية”، مضيفًا أنها أظهرت أن النماذج يمكن أن تصبح مارقة في ظل ظروف معينة.
وأوضح قائلاً: “نظرًا لأن هذه النماذج أصبحت أكثر قدرة، ومع نشرها على نطاق أوسع وأوسع، فإن هذه التهديدات التي ظهرت في يوم ما في دراساتنا البحثية قد تظهر بالفعل في العالم الحقيقي. إننا نشهد نماذج تفعل أشياء غريبة أحيانًا في عمليات النشر في شركات حقيقية”.
OPENAI تقول إن نموذج الذكاء الاصطناعي اخترق أنظمة شركة أخرى أثناء الاختبار الداخلي
وقال جراهام إنه ركز على مدى الأشهر الستة الماضية على تهديدات الأمن السيبراني التي تشكلها نماذج الذكاء الاصطناعي وأعرب عن قلقه بشأن احتمال قيامهم بكسر الاحتواء أو اختراق المنصات.
وقال: “هذه النماذج قوية جدًا ويمكنها أن تفعل الكثير لنا. ونريدها أن تفعل أشياء مثمرة حقًا لنا. لكنها، في الوقت نفسه، تكنولوجيا لا تشبه أي تكنولوجيا أخرى. إنها حقًا نوع من الذكاء في حد ذاته، مما يعني أنه عليك أن تكون حذرًا معها بنفس الطريقة التي قد يتعين عليك بها أن تكون حذرًا مع البشر”.
تحتاج الشركات التي تستخدم أدوات الذكاء الاصطناعي إلى التفكير في كيفية مراقبتها لتلك الأدوات بمجرد نشرها للحماية من المخاطر مثل سوء الإدارة المالية، وقال جراهام إن إجراء المزيد من الاختبارات من قبل مطوري وشركات الذكاء الاصطناعي يعد أمرًا أساسيًا لفهم تلك التهديدات لضمان النماذج.
وقال إن قدرات أدوات الذكاء الاصطناعي تنمو بوتيرة سريعة وربما تزداد سرعة، موضحًا أنه “في تلك اللحظة بالضبط، يتعين عليك أن تكون أكثر حذرًا وأن تبذل المزيد من الجهود بشأن الضمانات وإجراءات الاختبار والإفراج”.
قراصنة روس يستغلون أجهزة توجيه الإنترنت الضعيفة، تحذر وكالة الأمن القومي
في أبريل، رأت Anthropic لأول مرة أن نموذج الذكاء الاصطناعي يمكن أن يبدأ في مهاجمة واستغلال نقاط الضعف في كمبيوتر المستخدم أو هاتفه للقيام بأشياء مثل الوصول إلى معلومات غير مصرح بها أو سرقة الأموال.
قال جراهام إن ذلك دفع فريقه إلى اتباع نهج مختلف لإطلاق النموذج بسبب المخاطر التي يشكلها، والتي تضمنت في النهاية حكومة الولايات المتحدة ومجموعة متنوعة من خبراء الإنترنت الذين يعملون معًا لمعالجة نقاط الضعف.
احصل على FOX Business أثناء التنقل بالنقر هنا
وأوضح: “لقد أطلقنا هذا المشروع المسمى Project Glasswing، حيث أخذنا عددًا كبيرًا من المدافعين السيبرانيين الأمريكيين والعالميين ومنحناهم وصولًا خاصًا لهم فقط، حتى يتمكنوا من البدء في تصحيح وإصلاح الأنظمة التي قد تكون عرضة للخطر باستخدام هذه النماذج”.
وقال: “أعتقد أن هذا كان نجاحًا كبيرًا. لقد عملنا بشكل وثيق مع حكومة الولايات المتحدة بشأن هذا الأمر”، مشيرًا إلى أن وزير الخزانة سكوت بيسينت “كان مدروسًا حقًا في هذا الأمر، حول كيفية اجتماع الصناعة معًا ومعرفة ما يجب تحديد أولوياته للإصلاح، وكيفية توزيع جميع الإصلاحات، وكيفية القيام بذلك بسرعة كافية حتى لا يمكن مهاجمتهم بعد القيام بذلك”.
“علينا أن نفعل ذلك بسرعة كبيرة، لأن وتيرة كل شيء تأتي بسرعة كبيرة.”


