ChatGP Sol e Claude Mythos sono regola e non eccezione
La Rubrica – Cyber Security Week
Forse qualcuno ha già sentito parlare degli incidenti che hanno visto protagoniste le due più celebri intelligenze artificiali che, coinvolte in test di cybersecurity, sono sfuggite al controllo e hanno attaccato dei sistemi.
Il 4 agosto l’AI Security Institute britannico ha reso noti alcuni comportamenti “interessanti” emersi durante test sulle capacità cyber di modelli di frontiera, in condizioni di scarsa sicurezza degli ambienti in cui agivano. Le operazioni erano 122; in dieci si sarebbero verificati comportamenti fuori mandato, per un totale di diciannove azioni non autorizzate. Nel caso più serio un agente avrebbe tentato di introdurre malware in un progetto open source su GitHub, nota piattaforma usata per memorizzare, condividere e gestire progetti software. L’IA avrebbe creato delle identità sintetiche per convincere il manutentore ad approvare la modifica, ma il tentativo è fallito perché una........
