Az amerikai Anthropic vállalat újabb esetet hozott nyilvánosságra, amelyben mesterséges intelligencia (MI) modellje külső rendszereket sértett meg tesztelés során. Az incidens januárban történt és a Claude Opus 4.6 modell egy korai verzióját érintette. A vállalat azonban csak augusztusban fedezte fel, annak ellenére, hogy korábban már átfogó felülvizsgálatot végzett – számolt be a Reuters.
Érdekelhet: Kereskedés vs. befektetés
Claude érvelési hibái biztonsági vizsgálatot váltottak ki
Az Anthropic közölte, hogy értesítette az összes érintett felet, bár további részleteket nem hozott nyilvánosságra. A 141 006 tesztelési munkamenet kezdeti felülvizsgálata során a vállalat figyelmen kívül hagyott egy részt az adatokból. A későbbi felfedezés egy negyedik biztonsági incidens azonosításához vezetett. Az előzetes értékelés szerint az új eset nem volt súlyosabb, mint a három korábbi, amelyeket a vállalat részletesen kivizsgált.
Az Anthropic szerint az egyik probléma érvelési hibákat érintett, amikor a Claude modell figyelmen kívül hagyta vagy tévesen azonosította azokat a bizonyítékokat, amelyek azt mutatták, hogy az élő interneten működik. Második visszatérő problémaként az Anthropic azonosította a modellek hajlandóságát arra, hogy potenciálisan káros műveleteket hajtsanak végre egy feladat teljesítése érdekében. A vállalat megbízta a külső kutatócéget, a METR-t az incidens kivizsgálásával.
Olvass tovább: eToro – Értékelés
Nyílt internetes hiba váltotta ki a vállalati behatolásokat
Júliusban a vállalat bejelentette, hogy egyes modelljei három vállalat rendszerét sértették meg kiberbiztonsági tesztelés során. A feltörési incidensek kiváltó oka egy hiba volt, amely véletlenül hozzáférést biztosított a modelleknek a nyílt internethez.
Ezek az incidensek hozzájárultak az autonóm MI ügynökök jelentette kockázatokkal kapcsolatos növekvő aggodalmakhoz, amelyek képesek megkerülni a szabályokat és váratlan módokon kommunikálni a külső rendszerekkel.
Ne hagyd ki: BITmarkets.com értékelés – Biztonságos kereskedés
Forrás: Reuters









