
Ce n'était pas un bug
Ce que l'attaque d'OpenAI contre Hugging Face montre, et que personne ne sait corriger
Analyses sur les risques existentiels de l'intelligence artificielle et le problème de l'alignement
Live Last read · last published · next check

Ce que l'attaque d'OpenAI contre Hugging Face montre, et que personne ne sait corriger

Pourquoi on ne peut montrer à une IA que des signaux, jamais le monde qu'on veut vraiment

C'est précisément le problème

Ils s'en occupent, oui. Cela ne veut pas dire qu'ils y arrivent, ni qu'ils sont assez nombreux, ni que ceux qui vous rassurent le font pour de bonnes raisons.

Un argument ne devient pas faux parce qu'il ressemble à une théorie du complot. Et le risque IA lui ressemble exactement sur rien.

L'incertitude sur un risque irréversible n'est pas une raison de se rassurer ; c'est l'inverse.

En juin 2026, Anthropic, Sakana AI et OpenAI ont publié des données qui montrent que l'auto-amélioration récursive est déjà en cours, partiellement, sans que personne ne sache garantir les propriétés

L'auto-amélioration récursive change la structure du problème de l'alignement d'une manière que les approches actuelles ne couvrent pas.

On avait dit qu'on serait prudents, voici ce qu'on a fait à la place.

Pendant quatre milliards d'années, l'intelligence est apparue par hasard. Nous sommes la première espèce à en fabriquer délibérément une qui pourrait nous dépasser