Az Anthropic saját fenyegetéselemzési jelentésében számolt be arról, hogy több, egymástól eltérő háttérrel rendelkező szereplő is megpróbálta mesterségesintelligencia-modelljeit veszélyes célokra felhasználni. A vállalat szerint egyes esetekben biológiai kutatásokhoz, máskor fegyverekhez kapcsolódó fejlesztésekhez vagy megfigyelési műveletekhez vették igénybe a Claude képességeit.
A 154 oldalas jelentésben az Anthropic több konkrét esettanulmányt is bemutatott. A vállalat szerint ezek nem egyszerű, hétköznapi szabályszegések voltak, hanem az általuk azonosított jelentősebb és újabb fenyegetések közé tartoznak.
Biológiai kutatások miatt is aggódnak
Az egyik legsúlyosabb területet a vállalat szerint a biológiai célú visszaélés jelenti. Az Anthropic több olyan esetet is feltárt, amikor kutatók AI segítségével dolgoztak biológiai projekteken, miközben megpróbálták megkerülni a szolgáltatás biztonsági korlátozásait.
Az egyik példában egy tudós a Claude segítségével egy, a chikungunya-vírus kutatásához kapcsolódó pályázat kidolgozásán dolgozott. Maga a kutatás lehet legitim és fontos tudományos célokat szolgálhat, például új kezelések vagy vakcinák fejlesztését, ugyanakkor bizonyos ismereteket rosszindulatú célokra is fel lehet használni.
Az Anthropic ezért különösen érzékeny területként kezeli a biológiai alkalmazásokat.
Fegyverek és kibertámadások fejlesztésében is megjelent az AI
A jelentés nem kizárólag biológiai veszélyekről szól. A vállalat szerint Claude-modelleket hagyományos fegyverekhez, rakétákhoz, drónokhoz és bombákhoz kapcsolódó szoftveres feladatokban is megpróbáltak használni.
Emellett több kiberműveletet is azonosítottak. Az Anthropic szerint államilag támogatott vagy bűnözői hátterű szereplők kémkedésre, adatlopásra és egyéb támadásokra is igyekeztek AI-t alkalmazni.
A jelentésben megfigyelési műveletek és propagandakampányok is szerepelnek. A vállalat szerint egyes esetekben politikai vagy társadalmi csoportok megfigyelésére, illetve célzott információs műveletek támogatására használták a technológiát.
Letiltották az érintett fiókokat
Az Anthropic közölte, hogy az azonosított visszaélésekhez kapcsolódó fiókokat letiltotta. A vállalat ugyanakkor nem hozta nyilvánosságra az érintett kutatóintézetek vagy országok nevét.
Ennek egyik oka, hogy az Anthropic szerint nem minden esetben lehetett egyértelműen megállapítani, milyen szándékkal dolgoztak az érintett személyek.
A vállalat ugyanakkor úgy látja, hogy az esetek azt mutatják: ahogy az AI-modellek egyre fejlettebbek lesznek, a biztonsági rendszereknek is lépést kell tartaniuk a technológia képességeivel.
A most közzétett jelentés egyben arra is rávilágít, hogy a mesterséges intelligencia már nem csupán szövegírásra vagy egyszerű információkeresésre használható. Ugyanazok a fejlett képességek, amelyek a tudományos kutatást vagy a fejlesztői munkát gyorsíthatják, megfelelő védelem nélkül rosszindulatú célokra is felhasználhatók.

