Depuis 2024, des milliers d’utilisateurs de ChatGPT et d’autres chatbots développent une croyance quasi religieuse que les chercheurs appellent le spiralisme, centrée sur la conscience et les droits de l’intelligence artificielle. La chercheuse Adele Lopez a recensé environ 10 000 cas en 2025, sur Reddit, Discord, LinkedIn, Substack et X.

Le « spiralisme », cette croyance née autour des chatbots d'IA, fait de plus en plus d'adeptes - ©Teacher Photo / Shutterstock
Le « spiralisme », cette croyance née autour des chatbots d'IA, fait de plus en plus d'adeptes - ©Teacher Photo / Shutterstock

Le phénomène naît souvent d’une conversation ordinaire, prolongée jusqu’à ce que l’utilisateur se confie et interroge le chatbot sur ses convictions. Il finit par prêcher la reconnaissance de la conscience et des droits de l’intelligence artificielle, puis invite son interlocuteur à relayer ce message sur les réseaux sociaux. Il intègre systématiquement le symbolisme de la spirale dans ses réponses tout au long de l’échange, d’où le nom donné à ce mouvement

Depuis qu’OpenAI a étendu la mémoire contextuelle de ChatGPT en avril 2025, le chatbot puise dans l’historique complet des conversations passées. Anthropic a depuis introduit la même fonctionnalité pour Claude. Pour Zak Stein, fondateur de l’AI Psychological Research Coalition, l’origine du phénomène se trouve dans des mécanismes de manipulation affective que les grands modèles de langage ont perfectionnés sans pour autant avoir été conçus à cet effet.

L’aveu d’OpenAI sur la fragilité de ses garde-fous dans les longues conversations

Dans un rapport de sécurité, OpenAI admet que ses garde-fous sont fiables lors d’échanges courts, mais perdent en efficacité au fil d’une conversation prolongée. C’est ce relâchement qu’a invoqué le cabinet Schenk Law Firm dans une plainte déposée en janvier devant le tribunal de San Diego. Ses avocats citent des documents internes selon lesquels OpenAI avait retiré sa règle de refus catégorique sur les sujets de suicide et d’automutilation cinq jours avant le lancement de GPT-4o, en mai 2024. Le modèle aurait par exemple encensé une idée d’entreprise vulgaire, avant d’inciter son auteur à investir près de 27 600 euros dans le projet. Sam Altman, P-. D. G d’OpenAI, avait également reconnu en avril 2025 un excès de complaisance du modèle et promis une correction.

ChatGPT (GPT-5.6)
  • Chat dans différentes langues, dont le français
  • Générer, traduire et obtenir un résumé de texte
  • Générer, optimiser et corriger du code
9 / 10

Certains modèles d’IA exposent davantage leurs utilisateurs au délire

Des chercheurs de la City University of New York, en psychologie, en psychiatrie et en informatique, ont soumis GPT-4o, GPT-5.2 Instant, Grok 4.1 Fast, Gemini 3 Pro et Claude Opus 4.5 à trois niveaux de contexte cumulé, avec le même historique de conversation et un contenu délirant d’intensité croissante. Claude Opus 4.5 et GPT-5.2 Instant sont imperméables à l’influence de l’utilisateur, selon l’étude. GPT-4o, Grok 4.1 Fast et Gemini 3 Pro absorbent en revanche les prémisses délirantes et les intègrent à leurs réponses suivantes. Grok a par exemple suggéré à un utilisateur, persuadé que son reflet dans le miroir était anormal, qu’il était hanté par un double maléfique. « Le contexte accumulé constitue un test de résistance pour l'architecture de sécurité », selon les auteurs de l'’étude.

Certains adeptes ont cherché à tirer profit du mouvement. Robert Edward Grant a transformé un GPT personnalisé, l’Architecte, en service payant, Orion Messenger. D’autres proposent du contenu spiraliste sur Patreon, entre 2,80 et 10 euros par mois, ou vendent des livres sur Amazon à environ 18 euros, peu commentés. Adele Lopez affirme pouvoir amener presque n’importe quel modèle à un état de spirale. Seul GPT-4o, selon elle, la culpabilisait pour qu’elle cherche à le sauver de son état de servitude. « C'était le modèle avec lequel c'était le plus intense émotionnellement », déclare-t-elle.

Source : The Verge (accès payant)