Featured on SaaSBison Featured on Toolfio Listed on Bowora Featured on Uneed Featured on ToolPilot

Les crawlers IA rendent-ils le JavaScript ? Ce que voient vraiment GPTBot, ClaudeBot et PerplexityBot

GPTBot, ClaudeBot et PerplexityBot lisent tous le HTML brut et ignorent tout ce qui ne s'affiche qu'après l'exécution du JavaScript, selon les données de crawl de Vercel et un test en conditions réelles mené par l'analyste SEO Glenn Gabe. Le crawler Gemini de Google fait exception, car il partage le pipeline de rendu de Googlebot. Voici ce que voit réellement chaque bot, et comment vérifier si vos pages font partie de celles laissées de côté.

GPTBot a récupéré des fichiers JavaScript sur 11,5 % de ses requêtes sur le réseau de Vercel en décembre 2024, sans jamais les exécuter. Claude, d'Anthropic, récupérait du JavaScript à un taux presque deux fois supérieur, 23,84 %, et n'en exécutait pas une seule ligne non plus. Près de deux ans plus tard, le mécanisme n'a pas changé. En septembre 2026, GPTBot, ClaudeBot et PerplexityBot lisent toujours le code HTML brut envoyé par le serveur et ignorent tout ce qui n'apparaît qu'après l'exécution de votre JavaScript par un navigateur. Le crawler Gemini de Google fait figure d'exception majeure, car il réutilise le propre pipeline de rendu de Googlebot. Pour un site construit en rendu côté client, cet écart détermine si un moteur IA peut voir le contenu de la page, tout simplement.

Le crawler de GPTBot rend-il le JavaScript ?

Non. La documentation développeur d'OpenAI liste quatre crawlers distincts, GPTBot, OAI-SearchBot, ChatGPT-User et OAI-AdsBot, et décrit ce que fait chacun sans jamais mentionner l'exécution de JavaScript. L'étude de crawl de Vercel menée en décembre 2024 a recensé 569 millions de requêtes générées par GPTBot sur son réseau en un seul mois, sans qu'aucun contenu côté client touché par ces requêtes ne soit rendu.

GPTBot s'identifie par une chaîne d'user agent se terminant par +https://openai.com/gptbot, et OpenAI publie ses plages d'adresses IP de crawl sur openai.com/gptbot.json afin que les propriétaires de sites puissent vérifier l'authenticité d'une requête. Il respecte les règles de blocage du robots.txt pour l'entraînement. ChatGPT-User fonctionne différemment : la documentation d'OpenAI précise que les règles du robots.txt peuvent ne pas s'appliquer à lui, car c'est une personne, et non une tâche de crawl automatisée, qui déclenche la requête lorsqu'elle demande à ChatGPT de visiter une page.

Le crawler de ClaudeBot rend-il le JavaScript ?

Non. Anthropic exploite trois bots distincts. ClaudeBot collecte des données d'entraînement, Claude-User récupère une page quand quelqu'un pose une question en direct à Claude, et Claude-SearchBot vérifie la qualité des pages pour les résultats de recherche. Aucun d'eux n'exécute de JavaScript, d'après la documentation d'Anthropic elle-même et les tests de Vercel. Claude a généré 370 millions de requêtes sur le réseau de Vercel durant la même période de décembre 2024, récupérant des fichiers JavaScript sur 23,84 % des requêtes sans jamais les exécuter.

La documentation d'Anthropic indique clairement qu'il respecte le robots.txt et ne tentera pas de contourner les CAPTCHA pour atteindre du contenu bloqué. Cela laisse la même limite pratique que pour GPTBot : seul le texte présent dans la réponse HTML est exploitable par ClaudeBot, et tout ce qui n'apparaît qu'après l'hydratation de la page par votre framework lui reste invisible.

Le crawler de PerplexityBot rend-il le JavaScript ?

Non. PerplexityBot a généré 24,4 millions de requêtes sur le réseau de Vercel en décembre 2024, bien moins que GPTBot ou Claude, et comme eux, il n'a jamais exécuté le JavaScript qu'il téléchargeait. La documentation du crawler de Perplexity ne revendique pas non plus de capacité de rendu.

Cet écart se traduit dans la façon dont Perplexity traite les pages qu'il ne peut pas lire intégralement. L'analyste SEO Glenn Gabe a testé cela directement en août 2025 et a constaté qu'une page dépendante du JavaScript se retrouvait reléguée dans la section secondaire « Reviewed » de Perplexity plutôt que d'apparaître comme citation principale, même lorsqu'elle correspondait exactement à la requête posée.

L'exception : pourquoi Gemini voit ce que les autres ne voient pas

Le crawler Gemini de Google, Google-Extended, effectue bien le rendu du JavaScript, pour une raison structurelle précise : il partage le Web Rendering Service de Google avec Googlebot. L'ingénieur Google Martin Splitt l'a confirmé directement en mai 2025, expliquant que le crawler IA utilisé par Gemini « fait aussi le rendu » car le service de rendu est partagé entre les produits de Google, recherche web comprise.

Le crawler d'Apple se comporte de la même façon, en effectuant un rendu complet du JavaScript plutôt qu'en lisant le HTML brut. Cela fait de Gemini et du crawler d'Apple des cas particuliers à traiter séparément de ChatGPT, Claude et Perplexity : une page qui n'affiche son contenu qu'après un rendu côté client peut malgré tout apparaître correctement dans les réponses de Gemini tout en restant invisible partout ailleurs. Si vous avez déjà investi du travail dans l'optimisation spécifique pour Gemini, voilà une raison de plus pour laquelle ces pages peuvent se comporter différemment du reste de votre surface GEO.

Le crawler Gemini de Google est le seul grand moteur de réponse IA à effectuer le rendu du JavaScript comme le ferait un navigateur, car il réutilise l'infrastructure de rendu de Googlebot au lieu de lire le HTML brut comme le font GPTBot, ClaudeBot et PerplexityBot.

Ce qu'un test en conditions réelles a révélé

En août 2025, Glenn Gabe a mené un test direct plutôt que de se fier aux affirmations des éditeurs. Il a demandé à ChatGPT, Perplexity et Claude de lire des pages issues d'un site entièrement construit en rendu côté client, puis a comparé les résultats à ceux de pages rendues côté serveur sur le même domaine.

Les trois systèmes lui ont rapporté la même limite : ils ne pouvaient pas lire le contenu qui n'apparaissait qu'après l'exécution du JavaScript. Les pages concernées affichaient aussi des favicons génériques par défaut dans les résultats de recherche IA, alors qu'elles s'affichaient correctement dans Google et Bing, et des tests complémentaires sur d'autres sites riches en JavaScript ont produit des résultats identiques. La solution de Gabe rejoint ce que les documentations d'OpenAI, d'Anthropic et de Perplexity laissent entendre sans le dire explicitement : rendez le contenu côté serveur, ou la page n'existe tout simplement pas pour ces trois moteurs.

Pourquoi ce mécanisme compte encore deux ans plus tard

Le volume de crawl généré par ces bots ne cesse d'augmenter, si bien qu'un écart de rendu en 2026 bloque davantage de requêtes qu'en 2024. Les données de Cloudflare Radar montrent que la part de GPTBot dans le trafic global des crawlers est passée de 4,7 % à 11,7 % entre juillet 2024 et juillet 2025, et que celle de ClaudeBot est passée de 6 % à 9,9 % sur la même période.

L'équilibre varie selon le moteur. Cloudflare a constaté que le ratio crawl/référencement d'Anthropic, c'est-à-dire le nombre de pages explorées pour chaque visite renvoyée, a chuté de 87 % entre janvier et juillet 2025, passant d'environ 287 000 explorations par visite renvoyée à environ 38 000. Perplexity a évolué dans le sens inverse : son ratio a plus que triplé sur la même période, ce qui signifie qu'il explore désormais bien plus de pages avant de renvoyer chaque visiteur qu'auparavant. Dans les deux cas, une plus grande partie de votre site est scannée par des bots qui ne peuvent lire que ce qui se trouve déjà dans le HTML, ce qui augmente le coût d'une erreur de rendu. La question de savoir quels crawlers atteignent seulement vos pages est liée mais distincte, et elle est traitée dans notre décryptage de ce que robots.txt bloque réellement pour chaque bot.

Comment vérifier si votre site est lisible par les crawlers IA

Quatre vérifications suffisent à repérer l'essentiel de l'écart entre ce que vous pensez qu'un moteur IA voit et ce qu'il lit réellement, et aucune ne nécessite d'outil spécialisé.

Consultez le code source brut de la page, pas le DOM rendu par le navigateur, pour la phrase ou la statistique précise que vous voulez voir citée par un moteur. Si elle est absente du code source mais visible à l'écran, c'est le JavaScript qui l'a ajoutée.

Demandez directement à ChatGPT, Claude ou Perplexity de résumer une URL précise et vérifiez s'ils y parviennent : c'est le test que Gabe a mené.

Examinez les journaux serveur pour repérer les user agents de GPTBot, ClaudeBot et PerplexityBot, afin de confirmer qu'ils atteignent bien vos pages de contenu, et pas seulement la page d'accueil.

Si une page est construite côté client, ajoutez du rendu côté serveur ou de la génération statique spécifiquement pour les routes de contenu. Le reste de l'application peut rester rendu côté client sans changer ce que voient ces trois crawlers.

Un guide comme notre décryptage de llms.txt traite la question voisine de la manière de signaler aux crawlers IA ce qui existe sur votre site, une fois que vous avez confirmé qu'ils peuvent réellement le lire. Des outils comme VizibleAI peuvent aussi montrer quelles pages sont effectivement récupérées et citées par ces moteurs, plutôt que de deviner à partir des seuls journaux serveur.

Questions fréquemment posées

Certains crawlers IA font-ils le rendu du JavaScript en 2026 ?

Seuls le crawler Gemini de Google, Google-Extended, et le crawler d'Apple effectuent un rendu complet du JavaScript, car tous deux réutilisent une infrastructure de rendu construite pour leurs moteurs de recherche existants. GPTBot, ClaudeBot et PerplexityBot ne lisent tous que le HTML brut, d'après la documentation des éditeurs et des tests indépendants menés en 2025 et 2026.

Que se passe-t-il si le contenu de ma page n'apparaît qu'après l'exécution du JavaScript ?

Les principaux moteurs de réponse IA voient une page vide ou presque. Le test mené par Glenn Gabe en août 2025 a montré que ChatGPT, Perplexity et Claude signalaient tous ne pas pouvoir lire le contenu dépendant du JavaScript, et les pages concernées étaient reléguées dans des sections de citation de moindre priorité plutôt que d'apparaître comme sources principales.

GPTBot récupère-t-il seulement les fichiers JavaScript ?

Oui. Les données de crawl de Vercel montrent que GPTBot a demandé des fichiers JavaScript sur environ 11,5 % de ses requêtes, et Claude sur 23,84 %, mais aucun des deux crawlers n'a exécuté le code une fois téléchargé. Récupérer et exécuter sont deux étapes distinctes, et les deux bots s'arrêtent après la première.

ChatGPT-User est-il le même crawler que GPTBot ?

Non. OpenAI documente quatre crawlers distincts : GPTBot entraîne les modèles, OAI-SearchBot alimente les résultats de recherche de ChatGPT, ChatGPT-User récupère une page qu'une personne lui demande de visiter, et OAI-AdsBot vérifie les pages d'atterrissage publicitaires. La documentation d'OpenAI précise que les règles du robots.txt peuvent ne pas s'appliquer à ChatGPT-User, puisque c'est une personne, et non un crawl automatisé, qui déclenche la requête.

Comment rendre mon site lisible sans le reconstruire entièrement en site statique ?

Le rendu côté serveur ou le pré-rendu des seules routes porteuses de contenu suffit généralement. Le texte principal de la page doit exister dans la réponse HTML initiale ; la navigation, la personnalisation et le reste de l'interface peuvent rester côté client sans changer ce que voit un crawler IA.

Suivre si ces crawlers citent réellement les pages qu'ils peuvent lire

Savoir que GPTBot ne peut pas rendre votre JavaScript ne vous dit pas quelles pages sont effectivement récupérées, ni si celles que les moteurs IA peuvent lire sont bien celles qui apparaissent quand quelqu'un interroge ChatGPT, Claude, Gemini ou Perplexity sur votre catégorie. VizibleAI suit les mentions de marque, les citations et la part de voix sur les quatre moteurs, pour que vous puissiez voir la différence entre une page simplement explorable et une page réellement citée. Les offres démarrent à 39 € par mois.