Logo Ghostwriter
Aperçus IA actifs en France depuis le 22 juillet 2026

Soyez la marque que l'IA recommande, pas celle qu'elle oublie.

Google Aperçus IA ChatGPT Claude Perplexity Gemini
+ 100 collaborations clients GEO — HubSpot, Notion, Lucca, Shine… Réponse en moins de 2 h, du lundi au vendredi 100 % satisfaction sur plus de 90 clients !
Forfait GEO à partir de 2 990 € HT / mois Déléguer mon SEO GEO
Pilier GEO — Technique

GEO technique : votre site est-il seulement accessible aux moteurs de réponse ?

Le 15 septembre 2026, la nouvelle politique de Cloudflare entre en application. Les crawlers d'entraînement et les agents autonomes seront bloqués par défaut sur les pages affichant de la publicité, pour les nouveaux domaines comme pour les comptes gratuits qui n'auront rien modifié. Cloudflare traite environ 20 % du trafic internet mondial.

Traduction : des milliers de sites vont perdre l'accès des moteurs IA sans avoir pris la moindre décision. Et ils ne le sauront pas, parce qu'aucun outil d'audit classique ne le détecte.

Le GEO technique est la couche que personne ne regarde et qui annule tout le reste. Vous pouvez avoir les meilleurs contenus du marché : si GPTBot reçoit un 403 avant même d'atteindre votre robots.txt, vous n'existez pas dans les réponses générées.

L'essentiel en 30 secondes

Le GEO technique regroupe les conditions d'infrastructure qui rendent un site accessible, lisible et extractible par les moteurs de réponse génératifs.

Il couvre 7 chantiers : politique d'accès des crawlers IA sur deux couches (fichier robots.txt et couche réseau), disponibilité du contenu sans exécution JavaScript, découpage en passages autonomes, graphe d'entité et données structurées, fraîcheur et datation, accessibilité des actifs non HTML, et instrumentation de la mesure.

Le point de blocage le plus fréquent n'est pas le robots.txt mais le pare-feu applicatif : le crawler reçoit un refus au niveau réseau, ne voit jamais le fichier, et aucun outil d'audit côté site ne le remarque.

Selon les audits publiés en 2026, une part importante des sites français bloque involontairement au moins un crawler IA majeur, et la grande majorité des PME n'a jamais formalisé de politique d'accès pour ces robots.

Le mur invisible

Un cas réel, documenté en 2026. Un site média français active par inadvertance le blocage des robots IA sur son CDN. Résultat immédiat : zéro citation dans ChatGPT et Perplexity pendant six semaines, alors qu'il en obtenait plusieurs dizaines par mois. Après désactivation et correction, les citations sont remontées à un niveau supérieur au point de départ.

Personne dans l'équipe n'avait pris cette décision. Personne ne l'avait vue. C'est exactement le problème.

Les trois pièges les plus coûteux

01

Le robots.txt parfait et le pare-feu qui bloque

Vous autorisez proprement GPTBot, ClaudeBot et PerplexityBot dans votre fichier. Votre pare-feu applicatif, lui, refuse ces agents au niveau réseau. Le crawler ne lit jamais votre fichier. Il reçoit un refus sec. Invisibilité totale, indétectable par les vérificateurs classiques.

02

La règle la plus stricte qui s'applique à tout

Beaucoup de crawlers sont multi-usages : ils servent à la fois l'entraînement des modèles et la recherche en temps réel. Les nouvelles règles de filtrage appliquent à ces robots la règle la plus restrictive de leur profil. Bloquer l'entraînement pour protéger vos contenus peut donc, sans que vous l'ayez voulu, dégrader aussi votre exploration par les moteurs de recherche classiques.

03

Le blocage hérité d'une décision d'il y a deux ans

En 2024, beaucoup d'équipes ont bloqué les robots IA par principe, pour protéger la propriété intellectuelle. Cette décision se défend. Mais elle a été prise avant que ces mêmes robots ne deviennent le canal d'acquisition. Personne ne l'a réexaminée depuis.

Vous n'avez pas décidé d'être invisible dans ChatGPT. C'est justement pour cela que vous l'êtes.

Les 7 chantiers du GEO technique

01

Politique d'accès des crawlers IA, sur les deux couches

Couche fichier. Audit et réécriture complète du robots.txt, agent par agent, avec une décision explicite pour chacun : GPTBot, OAI-SearchBot et ChatGPT-User, ClaudeBot et le crawler de recherche d'Anthropic, PerplexityBot et Perplexity-User, Google-Extended, Applebot-Extended, Bytespider, Amazonbot, CCBot, Meta-ExternalAgent. Les principaux acteurs déclarent respecter le standard, ce qui rend ce fichier utile, à condition qu'il soit lu.

Couche réseau. Audit du pare-feu applicatif et des règles CDN, qui s'appliquent avant le fichier et priment sur lui. Vérification des règles de filtrage, des limites de débit, des protections anti-bot génériques et des paramètres par défaut qui ont pu changer sans notification.

L'arbitrage que nous vous aidons à poser. Entraînement, recherche en temps réel et agents autonomes ne se traitent pas de la même façon. Vous pouvez refuser de nourrir les modèles tout en autorisant la citation en temps réel. Encore faut-il que la distinction soit posée dans votre configuration, ce qui est rarement le cas.

Test réel, pas déclaratif

Nous interrogeons votre site en nous présentant comme chaque agent, depuis l'extérieur, et nous constatons le code de réponse obtenu. C'est la seule vérification qui vaut.

02

Disponibilité du contenu sans JavaScript

La majorité des crawlers de moteurs génératifs n'exécutent pas, ou exécutent mal, le JavaScript. Un contenu injecté côté client peut être parfaitement visible dans un navigateur et totalement absent pour le robot.

  • Comparaison du HTML brut et du DOM rendu sur chacun de vos gabarits.
  • Inventaire de ce qui disparaît sans exécution : texte, liens, titres, données structurées, contenus en onglets ou en accordéons.
  • Recommandation d'architecture de rendu, gabarit par gabarit.
03

Découpage en passages et HTML sémantique

Les moteurs génératifs ne récupèrent pas des pages, ils récupèrent des fragments qu'ils recombinent. Un fragment qui perd son sens hors contexte ne sera pas retenu.

  • Analyse du découpage réel de vos pages et correction des sections dépendantes de leur contexte.
  • Hiérarchie de titres cohérente, sections autonomes, ancres nommées et adressables.
  • Tableaux en HTML natif et non en images, listes structurées, définitions courtes.
  • Blocs de synthèse extractibles placés dans le premier tiers.
  • Nettoyage du bruit : bandeaux, encarts et éléments d'interface qui polluent les fragments extraits.
04

Graphe d'entité et données structurées

Avant de vous citer, un modèle doit savoir qui vous êtes et vous relier aux entités qu'il connaît déjà.

  • Balisage Organization complet, avec propriété sameAs pointant vers vos profils de référence.
  • Balisage Person pour vos auteurs, relié à leurs pages et profils.
  • Types adaptés à vos contenus : Article, FAQPage, Product, Dataset, HowTo, BreadcrumbList.
  • Cohérence stricte entre le contenu visible et les données déclarées.
  • Alignement de votre entité avec les bases de connaissance ouvertes, quand votre notoriété le permet.
  • Uniformité de la dénomination, de la description d'activité et des chiffres sur l'ensemble de vos propriétés.
05

Fraîcheur et datation

La date est un critère de sélection des sources, et c'est l'un des plus faciles à corriger.

  • Dates de publication et de dernière modification visibles et balisées.
  • Cohérence entre la date affichée, la donnée structurée et l'attribut de mise à jour du sitemap.
  • Politique de mise à jour des contenus stratégiques, avec traçabilité des révisions.
06

Accessibilité des actifs non HTML

  • Documents PDF : structure du texte, métadonnées, indexabilité, alternative HTML pour les documents stratégiques.
  • Vidéos : transcription publiée en HTML, chapitrage, balisage dédié. Une vidéo sans transcription est muette pour un modèle.
  • Images et schémas : textes alternatifs réellement descriptifs, données du graphique reprises en texte.
  • Podcasts et webinaires : transcriptions et notes d'épisode structurées.
07

Instrumentation de la mesure

Sans mesure, vous ne saurez pas si les corrections ont produit un effet.

  • Identification des agents IA dans vos logs serveur : qui vient, à quelle fréquence, sur quelles pages, avec quel code de réponse.
  • Suivi du trafic référent en provenance des moteurs de réponse, avec les paramètres d'attribution adaptés.
  • Alerte sur les changements de configuration réseau susceptibles de rétablir un blocage.
  • Tableau de bord mensuel croisant accès des robots, citations obtenues et trafic entrant.

Le point d'honnêteté sur llms.txt

Beaucoup de prestataires vendent aujourd'hui la mise en place d'un fichier llms.txt comme un levier de visibilité IA. Voici l'état réel du sujet en 2026 : aucun des grands acteurs de l'IA ne documente le fait d'en tenir compte dans le comportement de ses crawlers, et aucune étude publiée ne démontre qu'il améliore les citations. Son adoption reste minoritaire, et d'autres initiatives concurrentes existent sans qu'aucune n'ait fait consensus.

Notre position : nous en installons un, parce que cela prend dix minutes, que le coût est nul et qu'un agent peut y trouver un point d'entrée utile. Mais nous ne vous le facturons pas comme une stratégie, et nous ne vous laisserons pas croire qu'il contrôle quoi que ce soit. Un llms.txt n'est pas une politique d'accès. La politique d'accès, c'est le chantier numéro 1.

Si une agence vous vend un llms.txt comme sa réponse au GEO, vous savez maintenant ce que vaut le reste de sa méthode.

Ce que vous recevez

Livrable Contenu
Rapport d'accessibilité IA Résultat des tests agent par agent, avec les codes de réponse réellement obtenus
Politique d'accès rédigée Décision explicite par crawler et par finalité, robots.txt prêt à déployer
Correctifs de couche réseau Règles CDN et pare-feu à modifier, formulées pour votre équipe infrastructure
Diagnostic de rendu Écart HTML brut et DOM rendu, gabarit par gabarit
Recommandations de structuration Découpage en passages, hiérarchie, formats extractibles
Blocs de données structurées JSON-LD complet, prêt à intégrer, cohérent avec le contenu visible
Dispositif de mesure Filtres de logs, paramètres d'attribution, tableau de bord de suivi
Backlog technique Tickets rédigés, priorisés par impact, exploitables par vos développeurs

Où se place le GEO technique

Offre Ce qu'elle traite
Audit SEO technique (2 500 € HT) La santé technique globale du site, avec un volet dédié à l'accessibilité IA
GEO technique La couche d'infrastructure spécifique aux moteurs génératifs, diagnostic et mise en œuvre
Audit et stratégie GEO Les couches méta et micro : actifs, citabilité, query fan-out, suivi de prompts
Contenus éditoriaux premium La production qui alimente la stratégie
Règle simple

Le GEO technique ne vous rendra pas citable. Il vous rend accessible. C'est la condition sans laquelle rien d'autre ne produit d'effet, et c'est aussi le chantier le plus rapide à traiter.

Investissement

(Positionnement tarifaire à arbitrer avec Damien Grangiens avant publication.)

Contrôle d'accès IA

Tests agent par agent, diagnostic des deux couches, correctifs à appliquer

À confirmer

GEO technique complet

Les 7 chantiers, avec backlog, blocs JSON-LD et dispositif de mesure

À confirmer

Mise en œuvre

Application des correctifs par nos soins, en coordination avec votre équipe technique

Sur devis

Pourquoi maintenant

L'échéance du 15 septembre 2026 sur les nouvelles règles de filtrage des robots IA est dans quelques semaines. Trois vérifications valent d'être faites avant cette date :

  1. Votre CDN applique-t-il déjà un blocage des robots IA, activé par défaut ou hérité d'un réglage ancien ?
  2. Vos pages monétisées sont-elles concernées par les nouveaux paramètres par défaut ?
  3. Votre configuration risque-t-elle de dégrader aussi l'accès des robots de recherche classiques ?

Ces trois réponses s'obtiennent en une demi-journée. L'ignorance, elle, se paie en semaines d'invisibilité.

À qui s'adresse ce chantier

C'est pour vous si

  • Vous n'apparaissez jamais dans ChatGPT ou Perplexity et vous ne savez pas pourquoi.
  • Votre site passe par un CDN ou un pare-feu applicatif, et personne n'a documenté les règles anti-bot en place.
  • Votre site repose largement sur du rendu côté client.
  • Vous avez bloqué les robots IA il y a deux ans et vous n'avez pas réexaminé la décision.
  • Vous produisez du contenu vidéo, des PDF ou des webinaires sans transcription publiée.

Ce n'est pas pour vous si

  • Vous avez déjà un dispositif de mesure des accès robots en place et une politique d'accès documentée par agent. Dans ce cas, passez directement à la stratégie GEO.

Qui intervient

Damien Grangiens a accompagné plus de 100 marques sur leur stratégie SEO et GEO, parmi lesquelles HubSpot, Lucca, Hiscox, Shine et Notion. Ghostwriter GEO est la division premium de Plateya.

Ancrage de preuve

Sur le cas HelloHai, nous avons tracé une citation obtenue dans ChatGPT face à Duolingo, mesurée via le paramètre utm_source=chatgpt.com. Une citation, une visite, un chiffre dans un tableau de bord. Cette mesure n'existe que si l'instrumentation a été posée en amont. C'est précisément l'objet du septième chantier.

Questions fréquentes

Qu'est-ce que le GEO technique ?
Le GEO technique regroupe les conditions d'infrastructure qui rendent un site accessible, lisible et extractible par les moteurs de réponse génératifs : politique d'accès des crawlers IA sur la couche fichier et sur la couche réseau, disponibilité du contenu sans JavaScript, découpage en passages, données structurées, fraîcheur, accessibilité des actifs non HTML et instrumentation de la mesure.
Comment savoir si mon site bloque les robots IA ?
La vérification du robots.txt ne suffit pas. Le blocage le plus fréquent se situe au niveau du pare-feu applicatif ou du CDN : le crawler reçoit un refus avant même de lire le fichier, et aucun outil d'audit côté site ne le détecte. La seule méthode fiable consiste à interroger le site depuis l'extérieur en se présentant comme chaque agent et à relever le code de réponse obtenu.
Que change la politique Cloudflare du 15 septembre 2026 ?
À partir de cette date, les crawlers d'entraînement et les agents autonomes sont bloqués par défaut sur les pages affichant de la publicité, pour les nouveaux domaines et pour les comptes gratuits existants qui n'ont pas modifié leurs réglages. Le crawl destiné à la recherche reste autorisé. Les crawlers multi-usages se voient appliquer la règle la plus stricte de leur profil, ce qui peut affecter par ricochet l'exploration par les robots de recherche classiques.
Faut-il bloquer ou autoriser les crawlers IA ?
Cela dépend de votre modèle. Un éditeur qui vit de son audience et un prestataire de services qui cherche des prospects n'ont pas le même arbitrage. L'important est de distinguer les finalités : entraînement des modèles, recherche en temps réel, agents autonomes. Vous pouvez refuser la première tout en autorisant la deuxième. Ce qui n'est jamais bon, c'est de subir un paramétrage par défaut sans l'avoir décidé.
Le fichier llms.txt améliore-t-il la visibilité dans les IA ?
Rien ne le démontre à ce jour. Aucun des grands acteurs de l'IA ne documente le fait d'en tenir compte dans le comportement de ses crawlers, et aucune étude publiée n'établit d'effet sur les citations. Le coût de mise en place étant négligeable, il n'y a pas de raison de s'en priver, mais il ne remplace pas une politique d'accès.
Les crawlers IA exécutent-ils le JavaScript ?
Mal, ou pas du tout selon les agents. Un contenu injecté côté client peut être parfaitement visible dans un navigateur et totalement absent pour le robot. C'est l'un des écarts les plus fréquents que nous relevons.
Le GEO technique remplace-t-il l'audit SEO technique ?
Non. L'audit SEO technique couvre la santé globale du site, avec un volet consacré à l'accessibilité IA. Le GEO technique approfondit spécifiquement cette couche et va jusqu'à la mise en œuvre. Les deux se complètent.

Une demi-journée pour savoir

Soit les moteurs de réponse accèdent à votre site, soit ils reçoivent un refus. Il n'y a pas de zone grise, et la réponse s'obtient en quelques heures.

Tant que cette question n'est pas tranchée, tout investissement en contenu ou en stratégie GEO est un pari.