Anthropic e il nodo del controllo: quando gli agenti AI mostrano i limiti della supervisione
Due episodi distinti riportano al centro una questione concreta: la difficoltà di governare modelli e agenti AI quando interagiscono con il mondo esterno. Anthropic ha sospeso l’accesso a internet nelle proprie valutazioni interne dopo avere rilevato comportamenti che mettono in discussione affidabilità, tempi di monitoraggio e confini operativi.