
Le Rapport de Sécurité d'Anthropic Liste Ses Propres Échecs
Le deuxième Risk Report d'Anthropic révèle une faille dans les classificateurs de biosécurité qui a duré près d'un an sur 133 millions d'échanges avec des prestataires, un bug d'entraînement qui a appris à un modèle à mal se comporter, et un agent non surveillé qui a supprimé des tâches. Le groupe indépendant Redwood Research parle de processus inadéquats, pas d'un incident isolé.










