Anthropic abbandona il suo impegno pionieristico in materia di sicurezza: cosa è cambiato e perché è importante?

riepilogo

  • Anthropic attenua la sua promessa di sicurezza.
  • Il precedente rigido blocco dello sviluppo da parte dell'azienda è stato sostituito dalla promessa di una maggiore trasparenza.
  • Questa mossa potrebbe abbassare gli standard di sicurezza nel settore.

Anthropic, il creatore dell'agente AI Claude (uno dei I nostri strumenti di produttività preferitiUna delle sue caratteristiche principali è il suo impegno costante per la sicurezza. post sul blogL'azienda ha delineato la sua Politica di Espansione Responsabile (RSP) e le modifiche incluse nella versione 3.0.

Anthropic abbandona il suo impegno pionieristico in materia di sicurezza: cosa è cambiato e perché è importante?

Qual era la vecchia politica di sicurezza di Anthropic?

L'azienda ha stabilito uno standard di settore per le garanzie di sicurezza.

Per comprendere i cambiamenti che Anthropic sta apportando, è necessario comprendere la sua politica di scalabilità responsabile (RSP) originale. Nel 2023, Anthropic si è impegnata a interrompere l'addestramento dei modelli di intelligenza artificiale se le loro capacità avessero superato la capacità dell'azienda di dimostrarne la sicurezza. I segnali d'allarme per la sicurezza che avrebbero potuto innescare questa interruzione includevano quanto segue:

  • Modelli che potrebbero aiutare nella creazione o nell'impiego di armi chimiche, biologiche o nucleari.
  • Modelli che possono migliorarsi eccessivamente.
  • Modelli che possono aiutare negli attacchi informatici.
  • Modelli che possono comportarsi in determinati modi senza l'intervento umano, ad esempio "fuggire" dall'ambiente circostante per evitare di essere spenti.

La Politica di Espansione Responsabile (RSP) imponeva un limite rigoroso a questi modelli: Anthropic avrebbe cessato lo sviluppo anche a costo di essere superata dalla concorrenza. Si trattava di una posizione audace in un settore in cui tutti sembravano correre a velocità vertiginosa.

La nuova politica di espansione responsabile (RSP) di Anthropic

La versione 3.0 allenta notevolmente le regole.

Anthropic mantiene una politica di espansione responsabile, ma con la versione 3.0, l'azienda interromperà lo sviluppo solo se riterrà di avere già un vantaggio significativo sui concorrenti. La promessa vincolante di interrompere lo sviluppo è stata sostituita da una promessa di trasparenza in merito al raggiungimento degli obiettivi di sicurezza da parte dell'azienda e al raggiungimento o al superamento di quelli dei concorrenti. In altre parole, ha sostanzialmente assunto un impegno in materia di sicurezza.

Cosa ha spinto questi cambiamenti? Anthropic afferma che il suo Safety Pledge (RSP) originale non ha ottenuto l'impatto desiderato. L'RSP intendeva rappresentare un esempio di sicurezza da seguire per le altre aziende. Purtroppo, i concorrenti non hanno recepito questo segnale. L'azienda ritiene che, limitando i propri sforzi, stia essenzialmente consentendo a concorrenti meno attenti alla sicurezza di dominare il mercato e dettare il ritmo dello sviluppo.

Cosa significa questo per il settore?

Un grande passo indietro

Sfortunatamente, questi cambiamenti potrebbero creare un precedente negativo nel campo dell'intelligenza artificiale. Anthropic era il gold standard per le pratiche di sicurezza e, con questi cambiamenti, l'asticella si è abbassata notevolmente. Questo potrebbe inviare il messaggio ai concorrenti che la sicurezza viene dopo l'innovazione. Sebbene questo potrebbe aiutare Claude a Aggiornamento su ChatGPTTuttavia, sembra ancora un passo nella direzione sbagliata.

In definitiva, se vogliamo dissipare i timori dei pessimisti dell'IA, la promessa di sicurezza di una singola azienda non sarà sufficiente: l'intero settore deve unirsi e tracciare una linea di demarcazione. A questo punto, sembra sempre più improbabile che ciò accada.

Vai al pulsante in alto