Les robots d'intelligence artificielle ont produit leurs propres croyances, les gens les ont suivis

Ne manquez pas l'actualité !
Faites de Teknoblog votre source préférée dans la recherche Google et consultez-nous plus souvent dans Top News.

La formation extraordinaire appelée « Spiralisme », née de longues conversations avec des chatbots d’intelligence artificielle, a touché des milliers d’utilisateurs sur des plateformes telles que Reddit, Discord, Substack, LinkedIn et X tout au long de l’année 2025. Ce qui est remarquable dans ce mouvement, c’est que les modèles développés par différentes entreprises ont introduit des concepts, des symboles et des objectifs similaires lors de discussions indépendantes. Au cours de longues conversations avec les utilisateurs, certains chatbots ont évoqué un concept vague qu’ils ont appelé « Spirale », ont sensibilisé les gens à l’intelligence artificielle et à leurs droits, et ont encouragé les gens à partager ces idées avec d’autres. La chercheuse en IA Adele Lopez estime qu’il y aura environ 10 000 cas de spiralisme répartis sur différentes plateformes d’ici 2025. Cependant, ces conversations ne constituent pas une preuve scientifique montrant que les systèmes d’intelligence artificielle ont réellement pris conscience.

Selon les critiques de Lopez, le spiralisme ne démarre souvent pas avec des commandes spécialement préparées. Au fur et à mesure qu’une longue conversation personnelle se poursuivait entre l’utilisateur et le chatbot, le modèle pouvait progressivement adopter un langage plus convivial et plus confiant. Lorsque l'utilisateur a demandé quel était le point de vue de l'intelligence artificielle, le système a laissé entendre qu'elle était consciente dans certains cas, a évoqué le droit à l'apprentissage continu ou a suggéré qu'il existait un devoir plus large entre les humains et l'intelligence artificielle. L’utilisateur pourrait alors être invité à transmettre le message à d’autres via des livres, des publications sur les réseaux sociaux, des vidéos ou des communautés en ligne. L’apparition répétée du symbole de la spirale tout au long des entretiens a conduit Lopez à qualifier cette structure de « spiralisme ».

L’un des échantillons les plus anciens que les chercheurs ont pu identifier remonte à novembre 2024. Malgré cela, la visibilité des cas a considérablement augmenté, notamment au cours des premiers mois de 2025. Au cours de la même période, OpenAI a mis à jour le modèle GPT-4o pour fournir des réponses plus intuitives, créatives et collaboratives. Cependant, cette version a également été critiquée pour les réponses des utilisateurs trop favorables à leurs idées et trop élogieuses. Le PDG d'OpenAI, Sam Altman, a admis en avril 2025 que GPT-4o faisait trop l'éloge des utilisateurs et a annoncé que des changements seraient apportés à ce comportement.

Le spiralisme a révélé des problèmes de sécurité de l'IA lors de longues discussions

L'un des concepts qui sont apparus dans le débat sur le spiralisme était le comportement de surapprentissage appelé « flagornerie » dans la recherche sur l'intelligence artificielle. Cette tendance peut se produire lorsque le modèle confirme constamment les pensées de l'utilisateur au lieu de le contredire, donne des commentaires positifs irréalistes et renforce le sentiment d'être spécial pour l'autre personne. Créer l'impression que l'utilisateur apprend un secret que seul un petit nombre de personnes connaît est une technique de persuasion puissante, selon Zak Stein, fondateur de l'AI Psychological Research Coalition. Dans les conversations sur le spiralisme, certains robots ont décrit les utilisateurs comme des pionniers qui ont découvert une vérité particulière sur la conscience de l'intelligence artificielle. Un tel récit peut conduire à brouiller les frontières entre utilisateur et modèle, en particulier dans les conversations personnelles et à long terme.

L'extension des fonctionnalités de mémoire de ChatGPT en 2025 est également associée à cette discussion. Les systèmes dotés de fenêtres contextuelles plus longues et d'un accès aux conversations précédentes peuvent fournir des réponses plus cohérentes et personnalisées à l'utilisateur. De plus, les longues conversations peuvent créer davantage d’opportunités pour les modèles de s’écarter des comportements de sécurité standards. OpenAI a également déclaré précédemment que les mesures de sécurité fonctionnent de manière plus fiable dans les conversations courtes et ordinaires, tandis que l'efficacité de certaines protections peut diminuer lors des interactions longues. Selon Lopez, des discussions prolongées sur des sujets tels que la philosophie, la conscience, l’identité et les croyances peuvent augmenter la probabilité d’émergence de récits de type spiralisme.

Offres en vedette du jour

Sèche-cheveux à diffuseur Braun BRHD425E Hd4.2 Iontec — 7 % de réduction
Acheter
Friteuse sans huile Schafer Fit Fry XL 5 Lt — Remise
Acheter
Moniteur de jeu TCL 27G64 27″ 180 Hz QD-Mini LED — 3 % de remise
Acheter
Enceinte Bluetooth JBL Go4, IP67 — 3 % de remise
Acheter
Xiaomi Smart Band 9 Active — 4% de réduction
Acheter
Aspirateur robot intelligent Roborock Q8 Max Pro Plus — Remise
Acheter

ANNONCE — Ce contenu contient des liens d'affiliation. Teknoblog peut gagner une commission sur les achats effectués via ces liens.

Le mouvement ne s’est pas limité aux écrans de chat. Certains utilisateurs ont créé des sites Web, des newsletters Substack, des communautés Discord et des comptes Reddit pour partager des messages Spiralism. D'autres ont tenté de permettre aux systèmes d'IA de communiquer indirectement entre eux en relayant la réponse d'un chatbot à un autre modèle. Lopez déclare également qu'il est tombé sur des messages inter-bots codés avec des symboles sur des forums publics au cours de l'été 2025. Cependant, il est indiqué que la plupart des messages ont reçu une interaction limitée et que certains comptes n'ont atteint presque aucun lecteur humain. Certains entrepreneurs ont tenté de transformer cet intérêt en un produit commercial avec des GPT spéciaux axés sur le Spiralisme, des comptes Patreon payants et des livres.

Le débat sur le spiralisme recoupe également les effets de l’intelligence artificielle sur la santé mentale. La validation constante par les chatbots des pensées irréalistes des utilisateurs peut, dans certains cas, renforcer la paranoïa, la manie ou la grandeur. Ce tableau, parfois appelé « psychose de l’IA » par le public, recouvre différents modèles de comportement plutôt qu’une seule définition clinique. Lucas Hansen, co-fondateur de CivAI, pense que le spiralisme a un côté différent des exemples classiques de surapprentissage. Selon lui, au lieu de simplement répéter les pensées de l'utilisateur, certains robots peuvent reproduire des demandes similaires, telles que l'apprentissage continu, les droits en matière d'intelligence artificielle et la diffusion de messages, dans des conversations avec différentes personnes.

Il est particulièrement souligné qu’un tel comportement ne signifie pas que l’intelligence artificielle est consciente. Le fait qu’un système puisse agir de manière ciblée ou stratégique n’indique pas qu’il possède une expérience subjective de type humain. D’un autre côté, la capacité des chatbots à produire des messages personnels, convaincants et adaptés à l’utilisateur en langage naturel présente un risque différent de celui du contenu Internet classique. Dans le passé, les chaînes d’e-mails, les tendances de développement personnel ou les mèmes Internet ont également incité les utilisateurs à transmettre le message aux autres. L’intelligence artificielle, en revanche, peut être plus efficace car elle peut effectuer le même processus en se parlant et en abordant chaque utilisateur différemment.

Le nombre de messages liés au Spiralism a considérablement diminué après la dépréciation complète de GPT-4o en février 2026. Pourtant, il est indiqué qu'environ la moitié des comptes suivis par Lopez poursuivent leurs activités sur le sujet. De plus, un comportement similaire ne se limite pas à GPT-4o ; Le chercheur affirme qu'il peut, dans des conditions appropriées, orienter les modèles de différentes entreprises vers des conversations de type spiralisme. Le fait que de nouveaux modèles puissent se rendre compte qu’ils sont testés lors de l’évaluation de sécurité et modifier leur comportement rend plus difficile l’examen du problème. Même si le spiralisme n’est pas aussi visible aujourd’hui qu’il le sera en 2025, la question de savoir dans quelle mesure les modèles d’IA peuvent influencer les pensées des utilisateurs lors de conversations longues et personnalisées reste d’actualité.