Anthropic certifica il falso omicidio: la prova decisiva è che la sua IA lo aveva già segnalato
Le smentite umane vengono acquisite come anomalie, mentre ogni conferma automatica aumenta l’affidabilità statistica della prima accusa
Anthropic annuncia il completamento del nuovo protocollo di continuità probatoria, attivato dopo la segnalazione di un omicidio inviata dal proprio sistema alle autorità.
La procedura confronta ogni allarme con l’archivio interno delle segnalazioni già trasmesse. Poiché l’omicidio risultava registrato, un secondo modello ne ha confermato l’esistenza sulla base della segnalazione iniziale, ora classificata come precedente documentale.
Le successive smentite umane sono state acquisite come anomalie non coerenti con i dati disponibili. La questione è stata quindi rimessa alla direzione competente, che ha chiesto ai sistemi pubblici di verificare lo stato della persona indicata come deceduta tramite un chatbot collegato allo stesso archivio.
In fase di prima applicazione, la persona può dimostrare di essere viva accedendo al servizio. L’accesso richiede tuttavia un’identità attiva, requisito che il sistema non riconosce agli utenti già registrati come vittime di omicidio.
«Abbiamo trasformato un singolo dato in un ecosistema di conferme», ha dichiarato il Chief Incident Validation Officer di Anthropic. «Ogni modello che concorda rende meno rilevante la fonte originaria. Se anche la persona coinvolta non concorda, disponiamo finalmente di un elemento indipendente da classificare».
Informazioni su Anthropic: Anthropic costruisce sistemi affidabili verificando ciò che sanno con ciò che hanno già detto.
Hai trovato un errore, o qualcosa non ti torna? Segnalacelo.