Crawlers IA et JavaScript : votre site est-il visible ?
Faites le test maintenant, il prend trente secondes. Ouvrez votre page d'accueil, appuyez sur Ctrl+U (Cmd+U sur Mac) et cherchez le premier paragraphe de votre texte dans le code qui s'affiche. S'il n'y est pas, ChatGPT, Claude et Perplexity ne le voient pas non plus. Ce n'est pas une opinion : l'étude de référence menée par Vercel sur son propre trafic a établi qu'aucun des grands crawlers IA n'exécute le JavaScript. Ils téléchargent vos fichiers, ils ne les font pas tourner. Résultat : un site moderne au rendu impeccable peut être totalement vide aux yeux des moteurs génératifs. Voici comment le vérifier et comment le corriger.
- Dernière modification
27 septembre 2026 - 8 minutes de lecture
Les crawlers IA exécutent-ils le JavaScript ?
Non. Les principaux crawlers IA (GPTBot d'OpenAI, ClaudeBot d'Anthropic, PerplexityBot de Perplexity, CCBot de Common Crawl) téléchargent le code HTML brut d'une page mais n'exécutent pas le JavaScript qu'il contient. C'est la conclusion de l'étude publiée par Vercel en décembre 2024 sur son propre réseau, et elle reste confirmée par la documentation officielle des éditeurs jusqu'au deuxième trimestre 2026.
Le détail est éloquent : ChatGPT récupère des fichiers JavaScript dans 11,50 % de ses requêtes et ClaudeBot dans 23,84 % des siennes. Les deux les téléchargent, aucun des deux ne les exécute. C'est l'équivalent de recevoir un meuble en kit et de le noter sans l'avoir monté.
Une nuance importante : Google fait exception. Gemini s'appuie sur l'infrastructure de Googlebot, qui dispose d'un service de rendu complet basé sur Chromium. Applebot exécute lui aussi le JavaScript. Bingbot, qui alimente Copilot, le fait partiellement mais pas systématiquement à grande échelle. Autrement dit, votre contenu peut être parfaitement visible dans les AI Overviews de Google et totalement absent de ChatGPT.
- Rendu côté serveur (SSR) : le serveur construit le HTML complet avant de l'envoyer. Tous les robots voient le texte.
- Rendu côté client (CSR) : le navigateur reçoit une page quasi vide et construit le contenu avec JavaScript. Seuls les robots capables d'exécuter du code voient quelque chose.
- Génération statique (SSG) : les pages HTML sont fabriquées une fois pour toutes à la publication. C'est la configuration la plus sûre pour le GEO.
Comment vérifier en deux minutes si votre contenu est visible
Trois tests suffisent pour savoir si un moteur génératif voit votre page, et aucun ne demande d'outil payant. Faites-les dans l'ordre, du plus simple au plus technique.
- Test 1, le code source : ouvrez la page, faites Ctrl+U, puis Ctrl+F et cherchez une phrase entière de votre texte visible. Si elle n'apparaît pas, votre contenu est construit côté client.
- Test 2, JavaScript désactivé : désactivez JavaScript dans les réglages de votre navigateur et rechargez la page. Ce que vous voyez alors est très proche de ce que reçoit GPTBot.
- Test 3, la requête brute : depuis un terminal, exécutez
curl -A "GPTBot" https://votre-site.fr/votre-page. Vous obtenez exactement le HTML servi au robot d'OpenAI, sans aucune interprétation.
Chez Digital-m, nous lançons systématiquement ces trois tests en ouverture de chaque audit GEO, avant même de regarder le contenu éditorial. Sur les sites vitrines construits avec un constructeur de pages récent, le test 1 passe dans la quasi-totalité des cas. Sur les applications e-commerce ou les sites refaits en React sans rendu serveur, c'est l'inverse, et le diagnostic tient en une ligne : le contenu existe, personne ne le lit.
Attention à un piège fréquent : l'inspecteur d'éléments de votre navigateur (clic droit, « Inspecter ») montre le DOM après exécution du JavaScript, donc le résultat final. Il ne sert à rien pour ce diagnostic. Seul le code source brut, celui du Ctrl+U, reflète ce que reçoit un crawler IA.
Qui lit vraiment votre JavaScript, et qui l'ignore
- 569 M requêtes mensuelles de GPTBot mesurées par Vercel
- 23,84 % des fichiers récupérés par ClaudeBot sont du JavaScript, jamais exécuté
- 34,8 % des requêtes de GPTBot tombent sur une page en erreur 404
Exécutent le JavaScript
N'exécutent pas le JavaScript
À retenir : si votre contenu n'apparaît pas dans le code source brut de la page, il est invisible pour ChatGPT, Claude et Perplexity, même s'il s'affiche parfaitement dans un navigateur et même si Google l'indexe. Le rendu côté serveur reste le seul correctif universel.
Télécharger l'infographie (PNG)
Quatre symptômes d'un site invisible pour les IA
Un site victime du problème de rendu présente des signes reconnaissables, souvent interprétés à tort comme un problème de contenu ou de notoriété. Voici les quatre plus courants.
- L'écart Google contre ChatGPT : vos pages ressortent dans les résultats Google et dans les AI Overviews, mais jamais dans ChatGPT ni Perplexity. C'est la signature typique du rendu côté client, puisque Google rend le JavaScript et pas les autres.
- La citation du concurrent : quand vous interrogez un moteur génératif sur votre spécialité, il cite un concurrent moins bien positionné que vous sur Google. Souvent, ce concurrent a simplement un site en HTML lisible.
- Le résumé faux ou vide : vous demandez à une IA de résumer une de vos pages, et elle décrit le menu, le pied de page et rien d'autre. Elle n'a lu que ce qui était en dur dans le HTML.
- Les fiches produits absentes : votre catalogue est indexé mais aucune fiche n'est citée. Prix, descriptions et avis chargés en JavaScript après coup sont systématiquement perdus.
Ces symptômes se croisent utilement avec le suivi des pages de votre site effectivement citées par l'IA. Si une page à fort trafic n'apparaît jamais dans aucune citation malgré un contenu solide, le rendu est le premier suspect à écarter.
SSR, SSG, prerendering : quelle solution pour quel site ?
Le correctif consiste toujours à livrer le contenu dans le HTML initial, mais le chemin dépend de votre technologie. Trois approches couvrent la quasi-totalité des cas.
Le rendu côté serveur, la solution universelle
Avec le rendu côté serveur (SSR, server side rendering), le serveur assemble la page complète avant de l'envoyer. Tous les robots, y compris ceux qui n'exécutent pas de code, reçoivent le texte intégral. C'est la recommandation prioritaire de tous les spécialistes du sujet. Les frameworks modernes (Next.js, Nuxt, SvelteKit, Remix) proposent cette option nativement, souvent en modifiant quelques lignes de configuration.
La génération statique, la plus robuste
La génération statique (SSG) fabrique les pages HTML au moment de la publication, pas à chaque visite. Un blog, un site vitrine ou une documentation n'ont aucune raison d'être rendus côté client. Bonus non négligeable : la page se charge plus vite, ce qui joue aussi sur vos Core Web Vitals.
Le prerendering, le correctif d'urgence
Le prerendering consiste à faire tourner un navigateur sans interface côté serveur, qui exécute le JavaScript et stocke le HTML résultant pour le servir aux robots. C'est une rustine efficace quand refondre l'application n'est pas envisageable à court terme. Elle ajoute une brique d'infrastructure à maintenir, donc à budgéter.
Une précision utile : servir un contenu différent aux robots et aux humains s'appelle du cloaking et reste sanctionné. Le prerendering est légitime tant que le HTML servi au robot correspond à ce que voit l'internaute.
Le cas WordPress, Shopify et les constructeurs de pages
Bonne nouvelle pour la majorité des PME françaises : un WordPress standard est rendu côté serveur par défaut. Le HTML part du serveur avec le texte dedans, et les crawlers IA le lisent sans difficulté. Shopify fonctionne sur le même principe pour ses pages produits classiques.
Les problèmes apparaissent ailleurs, et toujours aux mêmes endroits :
- Les onglets et accordéons : un contenu affiché seulement au clic peut être présent dans le HTML (donc lisible) ou injecté à la demande (donc invisible). Le test Ctrl+U tranche en une seconde.
- Le chargement progressif : les listes d'articles, de produits ou d'avis qui se chargent au défilement sont invisibles pour les robots IA, qui ne font jamais défiler la page.
- Les widgets d'avis externes : les avis clients chargés depuis une plateforme tierce en JavaScript n'existent pas pour les moteurs génératifs, alors qu'ils comptent beaucoup dans les recommandations d'IA.
- Les thèmes découplés : un WordPress utilisé en « headless » (back-office WordPress, façade en React) perd l'avantage du rendu serveur si la façade n'est pas configurée en SSR.
Le sujet devient critique au moment d'une refonte. C'est pourquoi nous intégrons la vérification du rendu dès la phase de maquette sur nos projets, et pas à la recette : un site livré en rendu client se rattrape, mais au prix d'un chantier technique que personne n'avait budgété.
Les erreurs qui aggravent le problème
Le rendu n'est pas le seul obstacle entre votre contenu et les moteurs génératifs. L'étude Vercel révèle un chiffre rarement commenté : 34,82 % des requêtes de GPTBot et 34,16 % de celles de ClaudeBot aboutissent sur une page en erreur 404, et 14,36 % des requêtes de ChatGPT suivent une redirection. Autrement dit, un tiers du budget d'exploration de ces robots part dans le vide.
- Les URL obsolètes : les crawlers IA travaillent souvent à partir d'index anciens. Maintenir des redirections 301 propres après une refonte évite de perdre un tiers de leurs passages.
- Le blocage involontaire : vérifiez votre fichier robots.txt et les user-agents IA. Beaucoup de sites bloquent GPTBot ou ClaudeBot sans le savoir, hérité d'un réglage de plugin.
- Le contenu noyé : même en HTML, un texte dilué dans une soupe de balises sans structure est mal découpé. Notre article sur le chunking pour le GEO explique comment structurer ses blocs pour être cité.
- L'essentiel en fin de page : d'après notre propre étude, 44,2 % des citations de ChatGPT proviennent du premier tiers d'un article. Un contenu lisible mais dont la réponse est enterrée en conclusion reste peu cité.
Par où commencer si vous n'êtes pas technique
Vous n'avez pas besoin de savoir coder pour lancer le chantier. Trois actions se délèguent proprement à un prestataire, dans cet ordre de priorité.
- Faire l'inventaire : listez vos dix pages les plus stratégiques et faites le test Ctrl+U sur chacune. Notez pour chaque page si le texte principal apparaît ou non. Ce tableau est le cahier des charges.
- Demander le bon devis : formulez la demande ainsi : « je veux que le contenu principal de ces pages soit présent dans le HTML initial servi au premier appel ». Cette phrase évite les malentendus et les prestations hors sujet.
- Mesurer après coup : refaites le test un mois après la correction, puis interrogez trois moteurs génératifs différents sur votre spécialité pour constater l'évolution des citations.
Si vous préférez monter en compétence plutôt que de déléguer, notre formation GEO certifiée Qualiopi consacre un module entier au diagnostic technique de visibilité dans les moteurs génératifs.
Ce qu'il faut retenir
Les crawlers IA de ChatGPT, Claude et Perplexity n'exécutent pas le JavaScript. Ils lisent le HTML brut, rien d'autre. Google et Apple font exception, ce qui crée une situation trompeuse : un site peut être bien indexé par Google et totalement absent des réponses de ChatGPT. Le diagnostic tient en un raccourci clavier, Ctrl+U, et en une question : le texte de la page est-il présent dans le code source ?
Les correctifs sont connus et hiérarchisés : rendu côté serveur en priorité, génération statique pour les sites éditoriaux, prerendering en dernier recours. Sur WordPress standard, le problème ne se pose généralement pas, sauf sur les listes à chargement progressif, les widgets d'avis externes et les façades découplées. Vous voulez savoir ce que les IA lisent vraiment sur votre site ? Notre agence GEO réalise ce diagnostic en première étape de chaque audit, et vous repartez avec la liste exacte des pages à corriger.
Avez-vous fait le test Ctrl+U sur votre page d'accueil ? Dites-nous en commentaire si votre texte y figure !Sources et références
- Vercel - The rise of the AI crawler (17 décembre 2024)
- SearchOptimo - Do AI Crawlers Render JavaScript? GPTBot, ClaudeBot, and Perplexity in 2026
- HybridRanking - Most AI Crawlers Still Don't Render JavaScript in 2026
- Google Search Central - Comprendre les bases du SEO JavaScript
- Passionfruit - JavaScript Rendering and AI Crawlers: Can LLMs Read Your SPA? (2026)
- Digital-m - 44 % des citations de ChatGPT viennent du premier tiers de vos articles
Questions fréquentes sur les crawlers IA et le JavaScript
ChatGPT lit-il le JavaScript de mon site ?
Non. GPTBot et OAI-SearchBot, les robots d'OpenAI, téléchargent les fichiers JavaScript mais ne les exécutent pas. L'étude Vercel de décembre 2024 mesure que ChatGPT récupère du JavaScript dans 11,50 % de ses requêtes sans jamais le faire tourner. Seul le contenu présent dans le HTML brut de la page est lu.
Mon site WordPress est-il concerné par ce problème ?
Dans la majorité des cas, non : un WordPress standard génère le HTML côté serveur, donc les crawlers IA lisent le contenu sans difficulté. Les exceptions concernent les listes à chargement progressif, les widgets d'avis clients chargés depuis une plateforme externe, certains onglets ou accordéons injectés au clic, et les installations dites « headless » dont la façade est en React sans rendu serveur.
Pourquoi Google voit mon contenu et pas ChatGPT ?
Parce que Googlebot dispose d'un service de rendu basé sur Chromium qui exécute le JavaScript, généralement avec un délai, alors que GPTBot, ClaudeBot et PerplexityBot n'en disposent pas. Un site en rendu côté client peut donc apparaître normalement dans les résultats Google et dans les AI Overviews, tout en restant totalement invisible pour les autres moteurs génératifs.
Le prerendering est-il considéré comme du cloaking ?
Non, tant que le HTML servi au robot correspond à ce que voit l'internaute. Le prerendering consiste à exécuter le JavaScript côté serveur et à stocker le résultat pour le livrer aux robots : le contenu est identique, seule la méthode de fabrication diffère. Le cloaking, sanctionné par Google, consiste à servir un contenu différent selon le visiteur.
Comment tester ce que voit un robot IA sur ma page ?
Trois méthodes, de la plus simple à la plus fiable. Afficher le code source avec Ctrl+U puis chercher une phrase de votre texte. Désactiver JavaScript dans le navigateur et recharger la page. Ou exécuter depuis un terminal la commande curl avec l'en-tête user-agent GPTBot, qui renvoie exactement le HTML servi au robot. L'inspecteur d'éléments du navigateur, lui, ne convient pas : il affiche le résultat après exécution du JavaScript.