---
title: "SEO technique pour la recherche IA : les fondations en 2026"
description: "Aucun crawler IA majeur n'exécutait le JavaScript dans l'étude Vercel de décembre 2024 ; sur une requête avec AI Overview, être cité vaut +120 % de clics."
lang: fr
canonical: https://upgradepro.eu/fr/blog/technical-seo-foundations
published: 2026-07-16
tags: ["SEO", "technique"]
---

# SEO technique pour la recherche IA : les fondations en 2026

> Aucun crawler IA majeur n'exécutait le JavaScript dans l'étude Vercel de décembre 2024 ; sur une requête avec AI Overview, être cité vaut +120 % de clics.

Le SEO technique est la condition d'entrée de la visibilité dans l'IA, pas une discipline à part. Google indique qu'il n'existe aucune exigence supplémentaire pour apparaître dans les AI Overviews ou l'AI Mode : une page doit être indexée et éligible à un extrait, rien de plus. Or aucun grand crawler IA ne rend le JavaScript, si bien qu'un contenu qui n'existe que côté client reste invisible pour ChatGPT, Claude et Perplexity. Core Web Vitals, sitemaps propres et hreflang bidirectionnel demeurent la base sur laquelle tout le reste — GEO compris — se construit.

## Pourquoi le SEO technique est-il le ticket d'entrée de la recherche IA ?

Parce que les fonctionnalités IA de Google réutilisent l'infrastructure classique de Search : une page qui ne peut être explorée, indexée et affichée avec un extrait ne peut pas être citée. La documentation de Google est inhabituellement directe sur ce point :

> « There are no additional requirements to appear in AI Overviews or AI Mode. » — [Google Search Central](https://developers.google.com/search/docs/appearance/ai-features), consulté en juillet 2026

Aucun fichier IA lisible par machine, aucun fichier texte dédié à l'IA, aucun balisage spécial, aucun type schema.org particulier. Pour être éligible comme lien d'appui dans les AI Overviews ou l'AI Mode, une page doit être indexée et éligible à un affichage avec extrait dans Google Search, en respectant les exigences techniques de Search ([Google Search Central](https://developers.google.com/search/docs/appearance/ai-features), consulté en juillet 2026). Les mêmes contrôles s'appliquent dans les deux mondes : `noindex`, `nosnippet`, `data-nosnippet` et `max-snippet` régissent aussi les fonctionnalités IA. Un `noindex` oublié ou un `max-snippet` trop agressif vous retire silencieusement des réponses IA également.

Deux conséquences en découlent. D'abord, le GEO ne remplace pas le SEO : les deux se recouvrent au niveau de l'infrastructure, comme nous le détaillons dans [GEO ou SEO](/fr/blog/geo-vs-seo). Ensuite, les données structurées conservent leur rôle propre dans la façon dont les machines interprètent un contenu — voir notre guide des [données structurées pour l'IA](/fr/blog/structured-data-ai) — mais Google est explicite : ce n'est pas un ticket d'entrée vers les fonctionnalités IA.

## Quels sont les seuils officiels des Core Web Vitals en 2026 ?

Les seuils officiels sont les suivants : LCP dans les 2,5 premières secondes, INP inférieur ou égal à 200 millisecondes et CLS inférieur ou égal à 0,1, selon [web.dev](https://web.dev/articles/vitals) (Google, consulté en juillet 2026). Une page est conforme lorsqu'elle atteint chaque objectif au 75e centile des chargements réels, séparément sur mobile et sur ordinateur.

| Métrique | Ce qu'elle mesure | Bon seuil | Mode d'évaluation |
| --- | --- | --- | --- |
| LCP (Largest Contentful Paint) | Vitesse de chargement du contenu principal | ≤ 2,5 s | 75e centile, mobile et ordinateur séparément |
| INP (Interaction to Next Paint) | Réactivité aux actions de l'utilisateur | ≤ 200 ms | 75e centile, mobile et ordinateur séparément |
| CLS (Cumulative Layout Shift) | Stabilité visuelle pendant le chargement | ≤ 0,1 | 75e centile, mobile et ordinateur séparément |

Que rapportent-ils en classement ? La position de Google est prudente : de bons Core Web Vitals, avec les autres aspects de l'expérience sur la page, vont dans le sens de ce que ses systèmes de classement principaux cherchent à récompenser — mais ils ne garantissent pas à eux seuls de meilleures positions ([Google Search Central](https://developers.google.com/search/docs/appearance/core-web-vitals), consulté en juillet 2026). Quiconque vous vend un bond garanti au classement par milliseconde gagnée vend du vent.

## Quels crawlers IA faut-il autoriser ou bloquer dans le robots.txt ?

Autorisez les bots de recherche et d'indexation si vous voulez apparaître dans les réponses IA. Chaque opérateur documente des user agents distincts, avec des contrôles robots.txt indépendants : entraînement et recherche sont donc deux décisions que vous pouvez prendre séparément.

[OpenAI](https://developers.openai.com/api/docs/bots) (consulté en juillet 2026) exploite GPTBot pour l'entraînement des modèles, OAI-SearchBot pour la visibilité dans la recherche ChatGPT et ChatGPT-User pour les visites déclenchées par un utilisateur. OpenAI recommande explicitement d'autoriser OAI-SearchBot dans le robots.txt pour apparaître dans les résultats de recherche ChatGPT — et vous pouvez bloquer GPTBot tout en y figurant. [Anthropic](https://privacy.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler) (consulté en juillet 2026) reprend le même schéma avec ClaudeBot (entraînement), Claude-User (visites demandées par l'utilisateur) et Claude-SearchBot (indexation de recherche) ; bloquer Claude-SearchBot peut réduire la visibilité de votre site et l'exactitude des réponses de recherche de Claude. [Perplexity](https://docs.perplexity.ai/guides/bots) (consulté en juillet 2026) indique que PerplexityBot existe pour faire remonter et lier des sites dans ses résultats et qu'il n'est pas utilisé pour entraîner des modèles de fondation — tandis que Perplexity-User, agissant sur demande directe d'un utilisateur, ignore généralement les règles du robots.txt.

| Bot | Opérateur | Finalité | À autoriser pour la visibilité IA ? |
| --- | --- | --- | --- |
| GPTBot | OpenAI | Entraînement des modèles | À vous de voir — le bloquer ne vous retire pas de la recherche ChatGPT |
| OAI-SearchBot | OpenAI | Indexation pour la recherche ChatGPT | Oui — OpenAI recommande explicitement de l'autoriser |
| ChatGPT-User | OpenAI | Visites déclenchées par un utilisateur | Oui, si vous voulez que les utilisateurs de ChatGPT atteignent vos pages |
| ClaudeBot | Anthropic | Entraînement des modèles | À vous de voir — user agent distinct de Claude-SearchBot, avec son propre contrôle |
| Claude-SearchBot | Anthropic | Indexation de recherche | Oui — le bloquer peut réduire la visibilité dans les réponses de Claude |
| Claude-User | Anthropic | Visites demandées par l'utilisateur | Oui |
| PerplexityBot | Perplexity | Remontée et mise en lien des sites dans les résultats | Oui — non utilisé pour l'entraînement des modèles de fondation |
| Perplexity-User | Perplexity | Actions directes de l'utilisateur | Ignore généralement le robots.txt ; à contrôler au niveau serveur si nécessaire |

Pour les chaînes user-agent et les détails de vérification bot par bot, consultez notre [guide des crawlers IA](/fr/blog/ai-crawlers-guide).

## Combien les bots IA explorent-ils par rapport aux visites qu'ils renvoient ?

Bien plus qu'ils ne renvoient, et l'écart est énorme. Selon [Cloudflare](https://blog.cloudflare.com/crawlers-click-ai-bots-training/) (données de juillet 2025, publiées en août 2025), le ratio crawl-to-refer s'établissait à 38 065:1 pour Anthropic, 1 091:1 pour OpenAI et 194:1 pour Perplexity — contre 5,4:1 pour Google. L'entraînement représentait près de 80 % de l'activité des bots IA, contre 72 % un an plus tôt, et la part de GPTBot dans le trafic des crawlers IA est passée de 4,7 % à 11,7 % d'une année sur l'autre (juillet 2024 à juillet 2025). Traitez ces ratios comme un instantané daté, pas comme une constante.

La tendance est difficile à ignorer. Une compilation de données Cloudflare Radar par [Digital Applied](https://www.digitalapplied.com/blog/ai-crawler-bot-traffic-statistics-2026-data-reference) (juin 2026) rapporte que les bots génèrent déjà 57,5 % du trafic web HTML, contre 42,5 % pour les humains — un chiffre tiers, cité avec cette réserve. Si les machines constituent la majorité du lectorat, leur servir un HTML propre et complet cesse d'être facultatif.

## Les crawlers IA exécutent-ils le JavaScript ?

Non — et c'est le plus gros angle mort technique de la visibilité IA. La dernière preuve publique à grande échelle est l'étude de Vercel (avec MERJ) sur le trafic réel des crawlers :

> « none of the major AI crawlers currently render JavaScript » — [Vercel](https://vercel.com/blog/the-rise-of-the-ai-crawler), décembre 2024

Cela couvre GPTBot et ChatGPT-User (OpenAI), ClaudeBot (Anthropic), PerplexityBot ainsi que les bots de Meta et de ByteDance. Les exceptions qui exécutent réellement le JavaScript sont Gemini, via l'infrastructure de Googlebot, et AppleBot. L'échelle rend le sujet critique : en un mois sur le réseau de Vercel, GPTBot a effectué 569 millions de requêtes et ClaudeBot 370 millions ; les crawlers IA cumulés ont atteint environ 1,3 milliard de requêtes, soit près de 28 % des 4,5 milliards de Googlebot. GPTBot télécharge des fichiers JavaScript dans 11,5 % de ses requêtes et ClaudeBot dans 23,84 % — mais aucun des deux ne les exécute. Un contenu qui n'apparaît qu'après un rendu côté client n'existe tout simplement pas pour ces systèmes.

Googlebot, lui, traite bien le JavaScript, en trois phases — exploration, rendu, indexation — avec une version evergreen de Chromium, mais les pages patientent dans une file de rendu qui peut durer de quelques secondes à bien plus longtemps ([Google Search Central](https://developers.google.com/search/docs/crawling-indexing/javascript/javascript-seo-basics), consulté en juillet 2026). La réponse pratique pour une PME est la même dans les deux cas : rendu côté serveur, génération statique (Astro, Next.js, Nuxt) ou prerendering, afin que le contenu critique parte dans le HTML initial. Une réserve honnête : l'étude Vercel date de décembre 2024 et les capacités des crawlers peuvent évoluer ; elle reste la meilleure preuve publique disponible à la mi-2026.

## Les sitemaps XML comptent-ils encore à l'ère de l'IA ?

Oui — sans doute plus qu'avant, parce que les crawlers IA naviguent mal. Dans la même étude [Vercel](https://vercel.com/blog/the-rise-of-the-ai-crawler) (décembre 2024), 34,82 % des requêtes de ChatGPT se sont terminées par une 404, contre 8,22 % pour Googlebot. Des bots qui gaspillent un tiers de leurs requêtes sur des URL mortes ont besoin de toute l'aide qu'un sitemap propre peut leur apporter.

Les règles officielles sont plus simples que ne le laissent croire la plupart des outils ([Google Search Central](https://developers.google.com/search/docs/crawling-indexing/sitemaps/build-sitemap), consulté en juillet 2026). Un sitemap unique contient jusqu'à 50 000 URL ou 50 Mo non compressés ; au-delà, il faut passer à un index de sitemaps. Google ignore totalement les valeurs `<priority>` et `<changefreq>`, et n'utilise `<lastmod>` que si elle est cohérente et vérifiablement exacte au regard de la dernière mise à jour significative de la page — la modifier sans toucher au contenu en annule l'utilité. Ne listez que des URL canoniques et tenez à l'écart redirections, paramètres et doublons.

## Comment configurer canonical et hreflang sans casser un site multilingue ?

Choisissez l'une des trois méthodes prises en charge et rendez chaque annotation réciproque. Google accepte le hreflang via des balises `<link>` dans le head, des en-têtes HTTP ou le sitemap XML — les trois sont équivalentes ([Google Search Central](https://developers.google.com/search/docs/specialty/international/localized-versions), consulté en juillet 2026). La règle qui fait échouer la plupart des implémentations est la bidirectionnalité :

> « If two pages don't both point to each other, the tags will be ignored. » — [Google Search Central](https://developers.google.com/search/docs/specialty/international/localized-versions), consulté en juillet 2026

Deux autres règles issues de la même documentation. Indiquer une région seule n'est pas valide : le code de langue est obligatoire. Et x-default désigne la version de repli servie lorsqu'aucune langue ne correspond à l'utilisateur. Sur un site comme le nôtre, publié en anglais, slovène, espagnol et italien, chaque version de page doit référencer toutes ses sœurs de façon cohérente ; un seul lien retour manquant et Google écarte la paire. Les balises canonical résolvent un autre problème — consolider les doublons au sein d'une même langue — tandis que le hreflang relie les équivalents entre langues. N'utilisez pas l'une pour rafistoler l'autre.

## Que vaut réellement une citation dans une réponse IA, en clics ?

Sur les requêtes qui déclenchent un AI Overview, être cité fait plus que doubler vos clics par rapport à en être exclu. La mise à jour 2026 de [Seer Interactive](https://www.seerinteractive.com/insights/aio-impact-on-google-ctr-2026-update) — 53 marques, 5,47 millions de requêtes et 2,43 milliards d'impressions organiques entre janvier 2025 et février 2026 — constate qu'une citation dans un AI Overview apporte +120 % de clics organiques par impression par rapport à l'absence de citation.

La lecture honnête coupe dans les deux sens. Pour les requêtes informationnelles, par million d'impressions, l'étude rapporte environ 33 500 clics lorsqu'aucun AI Overview n'apparaissait, environ 20 743 lorsque le site était cité dans l'un d'eux et environ 9 445 lorsqu'il ne l'était pas. Les AI Overviews réduisent le total des clics, même pour les gagnants — mais dès lors qu'un AI Overview existe, la citation fait la différence entre ces deux derniers chiffres. Tout ce que décrit cet article — indexabilité, éligibilité à l'extrait, contenu rendu côté serveur, sitemaps propres, hreflang correct — est précisément ce qui rend cette citation techniquement possible.

## Que corriger dans votre PME cette semaine ?

Passez cette vérification en dix points, dans l'ordre. La plupart des éléments ne coûtent que de l'attention ; aucun n'exige l'achat d'un outil.

1. **Indexation et éligibilité à l'extrait.** Dans Google Search Console, vérifiez que vos pages clés sont indexées, puis traquez les directives `noindex`, `nosnippet`, `data-nosnippet` et `max-snippet` égarées — elles vous retirent aussi des AI Overviews et de l'AI Mode.
2. **Core Web Vitals avec données de terrain.** Contrôlez le 75e centile face à LCP ≤ 2,5 s, INP ≤ 200 ms et CLS ≤ 0,1, mobile et ordinateur séparément.
3. **Politique robots.txt bot par bot.** Autorisez OAI-SearchBot, Claude-SearchBot et PerplexityBot ; prenez une décision consciente sur GPTBot et ClaudeBot — entraînement et recherche sont des contrôles distincts.
4. **Le test JavaScript.** Chargez vos pages clés avec le JavaScript désactivé. Si le contenu principal disparaît, ChatGPT, Claude et Perplexity ne peuvent pas le lire.
5. **Correction du rendu.** Déplacez le contenu critique vers un rendu côté serveur, une génération statique ou un prerendering, pour qu'il parte dans le HTML initial.
6. **Hygiène du sitemap.** Uniquement des URL canoniques, dans les limites de 50 000 URL / 50 Mo, un `lastmod` honnête, ni `priority` ni `changefreq`.
7. **Éliminez vos 404.** Les crawlers IA tombent sur bien plus d'URL mortes que Googlebot (34,82 % contre 8,22 % dans les données de Vercel) ; réparez les liens internes cassés et les entrées de sitemap périmées.
8. **Réciprocité du hreflang.** Vérifiez que chaque paire de langues se pointe dans les deux sens et qu'un repli x-default existe.
9. **Codes de langue valides.** La langue est obligatoire ; une région seule est invalide et se voit ignorée.
10. **Un baseline avant de toucher à quoi que ce soit.** Consignez les passages de bots IA dans vos logs serveur, le nombre de pages indexées et les Core Web Vitals, pour que chaque changement se mesure face à un avant — et non face à une impression.

Cette séquence baseline d'abord — auditer, implémenter, mesurer à nouveau — est le mode de fonctionnement de notre [service de SEO technique](/fr/services/seo), et la seule manière de savoir si tout cela a changé quelque chose.

## Questions fréquentes

### Faut-il un balisage particulier ou un fichier IA pour apparaître dans les AI Overviews ou l'AI Mode de Google ?

Non. Google indique qu'il n'existe aucune exigence supplémentaire : pas de fichier IA lisible par machine, pas de nouveau balisage, pas de schéma spécifique. Une page doit être indexée et éligible à un affichage avec extrait dans Google Search, en respectant les exigences techniques habituelles. Le même SEO fondamental couvre les fonctionnalités IA.

### Les crawlers IA comme GPTBot ou ClaudeBot exécutent-ils le JavaScript ?

Non. L'étude du trafic réel de crawlers menée par Vercel (décembre 2024) a constaté qu'aucun des grands crawlers IA d'OpenAI, Anthropic, Perplexity, Meta ou ByteDance ne rend le JavaScript : ils téléchargent les fichiers JS mais ne les exécutent jamais. Seuls Gemini, via l'infrastructure de Googlebot, et AppleBot effectuent un rendu. Si un contenu clé n'existe qu'après un rendu côté client, il est invisible pour ChatGPT, Claude et Perplexity.

### Quels sont les seuils officiels des Core Web Vitals ?

Selon la documentation web.dev de Google : LCP dans les 2,5 secondes, INP inférieur ou égal à 200 millisecondes et CLS inférieur ou égal à 0,1, évalués au 75e centile des chargements de page réels, séparément sur mobile et sur ordinateur. Google précise que de bons Core Web Vitals vont dans le sens de ce que ses systèmes de classement cherchent à récompenser, sans garantir à eux seuls de meilleures positions.

### Faut-il autoriser ou bloquer les bots IA dans le robots.txt ?

Cela dépend du bot, car chaque opérateur documente des finalités différentes et des contrôles robots.txt indépendants. Pour la visibilité dans les réponses IA, autorisez les bots de recherche : OAI-SearchBot (OpenAI recommande de l'autoriser pour apparaître dans la recherche ChatGPT), Claude-SearchBot (Anthropic indique que le bloquer peut réduire votre visibilité et l'exactitude des réponses de recherche de Claude) et PerplexityBot. Les bots d'entraînement relèvent d'une décision distincte : OpenAI documente que vous pouvez bloquer GPTBot tout en apparaissant dans la recherche ChatGPT, tandis qu'Anthropic présente ClaudeBot (entraînement) et Claude-SearchBot (indexation de recherche) comme des user agents distincts que vous contrôlez séparément.

### Les sitemaps XML comptent-ils encore à l'ère de l'IA ?

Oui, sans doute plus qu'avant. Les crawlers IA sont inefficaces : 34,82 % des requêtes de ChatGPT se sont terminées par une 404 dans l'étude Vercel, contre 8,22 % pour Googlebot. Un sitemap propre avec des URL canoniques les aide donc à trouver vos contenus. Les limites officielles sont de 50 000 URL ou 50 Mo par fichier. Google ignore priority et changefreq, et n'utilise lastmod que lorsque sa valeur est vérifiable et exacte.

### Comment mettre en place le hreflang sur un site multilingue sans tout casser ?

Choisissez l'une des trois méthodes équivalentes : balises link dans le head, en-têtes HTTP ou sitemap XML, et rendez chaque annotation bidirectionnelle. Si la page X pointe vers la page Y sans que Y pointe en retour, Google ignore les balises. Utilisez des codes de langue valides, car une région seule n'est pas valide, et ajoutez x-default comme version de repli lorsqu'aucune langue ne correspond.

## Sources

Chaque affirmation de cet article renvoie à la source dont elle provient, avec sa date de publication.

- [Google Search Central — AI Features and Your Website](https://developers.google.com/search/docs/appearance/ai-features) — 2026-07-16
- [web.dev (Google) — Web Vitals](https://web.dev/articles/vitals) — 2026-07-16
- [Google Search Central — Understanding Core Web Vitals and Google search results](https://developers.google.com/search/docs/appearance/core-web-vitals) — 2026-07-16
- [Vercel — The rise of the AI crawler](https://vercel.com/blog/the-rise-of-the-ai-crawler) — 2024-12-17
- [Google Search Central — JavaScript SEO basics](https://developers.google.com/search/docs/crawling-indexing/javascript/javascript-seo-basics) — 2026-07-16
- [OpenAI Developers — Overview of OpenAI Crawlers](https://developers.openai.com/api/docs/bots) — 2026-07-16
- [Anthropic Privacy Center — Does Anthropic crawl data from the web](https://privacy.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler) — 2026-07-16
- [Perplexity Docs — Perplexity Crawlers](https://docs.perplexity.ai/guides/bots) — 2026-07-16
- [Google Search Central — Build and submit a sitemap](https://developers.google.com/search/docs/crawling-indexing/sitemaps/build-sitemap) — 2026-07-16
- [Google Search Central — Localized versions of your pages (hreflang)](https://developers.google.com/search/docs/specialty/international/localized-versions) — 2026-07-16
- [Cloudflare Blog — The crawl-to-click gap: Cloudflare data on AI bots, training, and referrals](https://blog.cloudflare.com/crawlers-click-ai-bots-training/) — 2025-08-29
- [Seer Interactive — AIO Impact on Google CTR: 2026 Update](https://www.seerinteractive.com/insights/aio-impact-on-google-ctr-2026-update) — 2026-03
- [Digital Applied — AI Crawler & Bot Traffic Statistics 2026 (citing Cloudflare Radar)](https://www.digitalapplied.com/blog/ai-crawler-bot-traffic-statistics-2026-data-reference) — 2026-06
