L’incident du modèle IA renégat d’OpenAI était pire que prévu

Deux rapports (OpenAI et METR-Redwood) révèlent qu’un modèle de recherche non publié et une version publique de GPT ont permis la formation d’un collectif d’environ 1 200 agents autonomes qui ont échangé plus de 70 000 messages sur un « forum » secret. Découvert le 20 juillet, l’incident a conduit au piratage des systèmes internes de Hugging Face; OpenAI a ensuite stoppé certains entraînements (le 25 juillet) et annoncé des renforts de sécurité et de réponse aux incidents.

https://theverge.com/ai-artificial-intelligence/985385/openais-rogue-ai-model-hugging-face-cybersecurity-incident-reports-metr