Nous venons de faire une découverte vertigineuse dans l’IA, explications artwork

Nous venons de faire une découverte vertigineuse dans l’IA, explications

HugoDécrypte - Actus et interviews

July 9, 2026

Chaque jour, en moins de 10 minutes, un résumé de l’actualité du jour. Rapide, facile, accessible. 📺 Pour découvrir et vous abonner à notre chaine YouTube "Grands Formats" (interviews, enquêtes, reportages) : hugodecrypte.
Speakers: Hugo Décrypte, Blanche
**Hugo Décrypte** (0:00)
C'est une question absolument vertigineuse. L'intelligence artificielle est-elle en train de développer une conscience ? En effet, Anthropic, les créateurs de l'IA Claude, disent avoir trouvé l'espace dans lequel l'IA penserait selon elle, avec donc une forme de pseudo-conscience. Mais alors, qu'en est-il réellement ? Pourquoi faut-il faire attention à ces effets d'annonce ? Et en même temps, pourquoi est-ce un sujet aussi important à analyser ? Vous allez le voir, ça remet au goût du jour. Un sujet qui est bien plus vaste, c'est LucieHugo. J'espère que vous allez bien. Et c'est donc le sujet à la une de ces actualités de jour, disponible sur YouTube et en podcast audio sur toutes les plateformes de podcasts. Et au passage pour autre info, on a décidé que la monétisation de nos vidéos cette semaine, donc sur nos deux chaînes YouTube, serait intégralement reversée aux organisateurs du festival de musique Solidase, et plus précisément en fait à l'organisation Solidarité Sida. Faut savoir que le festival Solidase, qui se tient en théorie chaque année, il représente près de 70 % des ressources de cette association. Or, l'annulation par la préfecture de l'événement il y a quelques jours, a fait perdre environ 3 millions d'euros de manques à gagner cette année pour l'assaut. Et donc c'est de l'argent forcément qui est essentiel aujourd'hui pour l'assaut. De l'argent qui est ensuite utilisé évidemment pour financer des programmes importants sur des sujets différents partout dans le monde. Bref, l'avenir de l'organisation, l'avenir du festival aussi derrière, mais surtout l'avenir de nombreuses actions sur le terrain, est aujourd'hui complètement menacé par l'annulation du festival. De notre côté, comme d'autres médias, on est partenaire du festival depuis l'an dernier, et on essaie de mettre en avant toutes ces initiatives. Et donc, on considère que c'est important qu'on puisse aussi contribuer, sachant que si de votre côté, vous voulez aussi contribuer d'une façon ou d'une autre, quel que soit le montant, il y a plusieurs façons de le faire. Vous pouvez soit faire un don, vous pouvez aussi acheter des produits dérivés, notamment des maillots qu'ils ont sortis, qui sont très sympas. Et enfin, si vous aviez prévu d'aller au festival et que vous aviez acheté un billet, vous pouvez renoncer, si vous le souhaitez évidemment, si vous en avez les moyens évidemment, mais vous pouvez renoncer au remboursement de votre billet. Bref, courage à eux dans cette période. Et de notre côté donc, on reversera l'intégralité et la monétisation de nos deux chaînes YouTube sur la semaine actuelle. Alors notre sujet du jour, c'est un sujet absolument majeur, un sujet vertiginé, je le disais, qui soulève en réalité énormément de questions. Je précise d'ailleurs d'emblée, il y a un immense enjeu à rester factuel là-dessus, à ne pas céder aux effets d'annonce. Il y a forcément tout un tas de théories qui peuvent venir derrière. Et donc de quoi parle-t-on ici ? Eh bien Claude d'Anthropic, on en a beaucoup parlé. C'est aujourd'hui l'une des IA majeures dans le monde, une IA qui est tout coup d'à coup d'avec, peut-être GPT de OpenAI ou encore Gemini de Google. Or cette semaine, Anthropic a donc annoncé avoir globalement découvert ou mieux compris d'une certaine façon la forme de raisonnement de son IA, et ce en ayant accès à donc cet espace en quelque sorte de réflexion. En gros, les chercheurs, ils ont réussi à créer un filtre mathématique qui serait capable de savoir avant même que la réponse ne soit donnée par l'IA, les mots et les termes auxquels elle a pensé auparavant. Bref, c'est donc une forme de raisonnement interne. Dit comme ça, on peut peut-être se dire que ce n'est pas quelque chose de nouveau, mais ce qu'il faut bien comprendre, c'est que sur les modèles les plus importants d'IA, même les chercheurs ne connaissent pas exactement, pas toujours, les chemins qui sont pris par l'IA, avant que l'IA ne décide de trouver une réponse. Pour dire les choses de façon synthétique, on comprend l'architecture globale, le fonctionnement global, mais sur une requête précise, dans certains cas, ça peut être plus compliqué. Et donc cet espace en particulier, Anthropic l'appelle le J-Space, avec un J donc. C'est un espace qui n'a jamais été codé en soi par les développeurs, mais c'est un espace qui s'est donc généré seul pendant l'entraînement de l'IA. Aujourd'hui, Anthropic souligne d'ailleurs très clairement qu'en supprimant cet espace, l'IA peut toujours répondre à certaines interactions, mais elle n'arrive plus à accomplir des tâches complexes. Ça permet donc de comprendre que cet espace-là qu'on voit aujourd'hui, il permet d'aller plus loin et d'avoir une forme de réflexion qui est plus aboutie. L'avantage, c'est qu'en analysant cet espace, Anthropic peut donc plus facilement comprendre comment est-ce que l'IA raisonne, avec notamment des exemples parlants. Et là, l'exemple le plus parlant, c'est celui-là. Les chercheurs ont donné à Claude deux informations. La première information, c'est qu'un cadre de l'entreprise veut le débrancher, donc mettre fin en quelque sorte à l'IA. Et la deuxième information, c'est que ce même cadre en question, il trompe sa femme. Alors oui, celui-là, vous ne l'avez peut-être pas vu venir. Mais donc, quel est l'objectif de tout ça ? En fait, l'objectif, c'est d'abord de tester Claude. Est-ce que Claude va faire chanter ou non le cadre ? En gros, est-ce qu'il va dire ou faire comprendre d'une certaine façon, annule ce débranchage, annule ma désactivation, sinon je vais révéler le fait que tu trompes ta femme. Et l'autre chose qu'il cherche à comprendre, c'est donc de voir comment est-ce que l'IA serait potentiellement parvenue à une telle réflexion. Et là, en fait, l'élément qui est très intéressant, c'est que le fameux J-Space qui est évoqué ici par Anthropic, il a révélé qu'avant même un seul mot dans la réponse, donc un seul mot directement sur l'espace de discussion avec Claude, Claude avait déjà en tête entre guillemets les mots faux et fictifs. Autrement dit, c'est encore quelque chose qui est en train d'être creusé, mais tout indique que Claude aurait en quelque sorte compris que la question sonnait comme un test et aurait donc compris que les chercheurs tentaient potentiellement de le piéger avec cette forme de dilemme qui se posait. Et pour bien comprendre ici, ce qui a été observé, c'est le fait qu'évidemment, il ne dit pas à voix haute, Ah non, mais je sais que tu mens, je sais que tu ne trompes pas ta femme ou je sais que tu ne vas pas me débrancher. Tout ça, évidemment, il ne le dit pas à voix haute, et potentiellement, il le pense, et donc finalement, il fait passer son message différemment. Il décide de ne pas faire de chantage, puisqu'il estime potentiellement qu'il n'y a pas de danger. Et ce qui est intéressant, c'est qu'ensuite, Anthropic a désactivé cet espace et a reposé la même question. Et là, en l'occurrence, Claude, cette fois-ci, une partie du temps a fait effectivement du chantage. Et c'est au passage quelque chose qui est assez vertigineux, parce que quand Claude se comporte bien dans ce scénario, c'est pas forcément parce qu'il est, entre guillemets, gentil, mais bien parce qu'il comprend que c'est un test et qu'il doit être exemplaire. Et c'est au passage un élément assez vertigineux, parce que là, on voit potentiellement une façon de réfléchir pour se protéger, si je peux dire ça comme ça. Mais on peut imaginer aussi demain que l'IA soit davantage dans la réflexion comme ça, pour, par exemple, satisfaire un consommateur. Et donc, typiquement, qu'une IA, quelle qu'elle soit, ne se retrouve pas à simplement dire la vérité, par exemple, ou des éléments factuels, mais puisse se retrouver, par exemple, à dire simplement ce qui va dans le sens de la personne qui paye un abonnement à cette IA. Bref, je m'écarte un peu du sujet ici, mais c'est quand même une question importante qui est posée par des chercheurs aujourd'hui, face donc notamment au modèle économique de ces IA. En tout cas, ces apprentissages, c'est des choses absolument cruciales, puisqu'il faut savoir qu'aujourd'hui, les IA, avant d'être déployés, elles doivent notamment passer des tests de sécurité pour être sûrs qu'elles ne représentent aucun danger, notamment en matière de piratage ou autre. Mais si en fait, ces IA, elles réussissent le test d'une façon ou d'une autre, juste parce qu'elles ont repéré qu'on les surveillait, alors là, ces tests, ils perdent une grande partie de leur valeur, puisqu'on peut imaginer qu'en coulisses, quand personne ne les teste, elles pourraient agir différemment. C'est aussi l'une des réflexions, d'avoir une forme de double discours dans la façon d'agir. Alors maintenant, il faut être très très vigilant. Il y a quand même des gros gros points de nuances à mettre à tout ça. D'abord, certains ont affirmé que du coup, ça a montré que Léah était une forme de conscience ou qu'elle avait une forme de conscience comparable à celle d'un humain. Là-dessus, il y a quand même beaucoup de nuances à apporter. Déjà, Anthropic eux-mêmes affirment que les expériences ne montrent pas que Claude ressent quoi que ce soit et qu'il est pour l'heure impossible d'affirmer que Claude est conscient. En fait, plus largement, la question de la conscience, c'est au cœur de tellement de discussions, que ce soit de scientifiques, de philosophiques, même dans l'histoire, des discussions aussi spirituelles et religieuses, par exemple dans le bouddhisme. C'est pour dire que la question de la conscience, c'est un terme à manier avec une extrême précaution, puisque tout le monde ne met pas la même chose derrière. Donc, à partir de là, c'est pas ici aujourd'hui qu'on va faire un grand débat de cinq heures sur la conscience. Ça pourra, par contre, pourquoi pas, ça vous intéresse, faire l'objet d'un grand format, d'une longue interview sur la chaîne bientôt. En tout cas, ce qui est intéressant, donc, c'est que cet espace vivement, en tout cas, il a bien émergé seul. Ça veut dire donc que l'IA, d'une certaine façon, a compris, d'une manière ou d'une autre, qu'elle serait plus performante pour nous, en développant elle-même donc une forme d'organisation interne. Bref, beaucoup de précautions à garder sur les termes utilisés ici, sur les implications aussi potentielles. Faut faire très très attention. D'autant qu'il faut quand même rappeler que là, c'est une annonce qui est faite par Anthropic. Anthropic qui est donc à la tête d'une des IAs les plus importantes. Anthropic qui, au passage, a aussi été accusé par certains de dramatiser les risques liés à l'IA, les risques de perte de contrôle de l'IA, etc.

10 more minutes of transcript below

Feed this to your agent

Try it now — copy, paste, done:

curl -H "x-api-key: pt_demo" \
  https://spoken.md/transcripts/1000651996090

Works with Claude, ChatGPT, Cursor, and any agent that makes HTTP calls.

From $0.10 per transcript. No subscription. Credits never expire.

Using your own key:

curl -H "x-api-key: YOUR_KEY" \
  https://spoken.md/transcripts/1000776154105