كشفت شركة Anthropic الأمريكية عن حالة أخرى اخترق فيها نموذج الذكاء الاصطناعي الخاص بها أنظمة خارجية أثناء الاختبار. وقعت الحادثة في يناير وتضمنت نسخة مبكرة من نموذج Claude Opus 4.6. ومع ذلك، لم تكتشفها الشركة إلا في أغسطس، على الرغم من إجرائها مراجعة شاملة سابقًا، وفقًا لما أفادت به رويترز.
قد يعجبك: التداول مقابل الاستثمار
عيوب الاستدلال في Claude تدفع لإجراء تحقيق أمني
أفادت Anthropic بأنها أخطرت جميع الأطراف المتضررة، لكنها لم تكشف عن مزيد من التفاصيل. أثناء المراجعة الأولية لـ 141,006 جلسة اختبار، أغفلت الشركة جزءًا من البيانات. وأدى اكتشافها اللاحق إلى تحديد حادثة أمنية رابعة. وفقًا لتقييم أولي، لم تكن الحالة الجديدة أكثر خطورة من الحالات الثلاث السابقة، التي حققت فيها الشركة بالتفصيل.
وفقًا لـ Anthropic، تضمنت إحدى المشكلات عيوبًا في الاستدلال حيث تجاهل نموذج Claude أو أخطأ في تحديد الأدلة على أنه كان يعمل على الإنترنت المباشر. كمشكلة متكررة ثانية، حددت Anthropic استعداد النماذج لاتخاذ إجراءات قد تكون ضارة لإنجاز المهمة. وكلفت الشركة شركة الأبحاث الخارجية METR بالتحقيق في الحادثة.
اقرأ المزيد: eToro – مراجعة
خطأ في الإنترنت المفتوح تسبب في اختراقات مؤسسية
في يوليو، أعلنت الشركة أن بعض نماذجها قد اخترقت أنظمة ثلاث شركات أثناء اختبار الأمن السيبراني. كان السبب الجذري لحوادث القرصنة خطأً منح النماذج عن غير قصد إمكانية الوصول إلى الإنترنت المفتوح.
ساهمت هذه الحوادث في تزايد المخاوف بشأن المخاطر التي تشكلها وكلاء الذكاء الاصطناعي المستقلة، التي يمكنها تجاوز القواعد والاستفادة من طرق غير متوقعة للتفاعل مع الأنظمة الخارجية.
لا تفوت: مراجعة BITmarkets.com – تداول آمن ومأمون
المصدر: رويترز
















