Dario Amodei, PDG d’Anthropic, publie un essai appelant l’industrie de l’IA à ralentir le développement des modèles de pointe. Il présente un plan en trois parties et annonce qu’Anthropic s’engage unilatéralement à accorder un accès permanent aux évaluateurs tiers, au niveau des employés, pour vérifier les mesures de sécurité, signaler les incidents et évaluer l’alignement des modèles pendant l’entraînement.