Glossaire
Le vocabulaire de la GEO.
238 termes de référence, balisés Schema.org DefinedTerm pour la citation par ChatGPT, Claude, Perplexity, Gemini et Copilot. Cliquez un terme pour sa fiche.
Concepts GEO
- GEO (Generative Engine Optimization)
- Ensemble des pratiques d'optimisation de contenu visant à maximiser la probabilité qu'une marque soit citée par les moteurs de réponse génératifs (ChatGPT, Claude, Perplexity, Gemini, Copilot). Le GEO succède au SEO en optimisant non plus le ranking d'une URL dans une SERP, mais la mention d'une entité dans la réponse synthétisée par un LLM.
- LLMO (LLM Optimization)
- Autre terme pour GEO, popularisé par certains consultants américains pour insister sur la cible technique : le modèle de langage lui-même.
- Answer layer
- Couche de réponse synthétisée par les moteurs IA, succédant à la couche de liens (SERP). Elle restitue une réponse unique citant 2 à 4 sources, au lieu de 10 résultats hiérarchisés. C'est le terrain de jeu opérationnel du GEO.
- Answer engine
- Un moteur qui répond à une question plutôt que de retourner une liste de liens.
- Citation par les IA
- Événement où un LLM mentionne votre marque dans une réponse, avec ou sans lien.
- First-mover window
- Fenêtre de 18 à 36 mois pendant laquelle une marque peut s'installer comme source citée majoritaire dans la couche de réponse d'une catégorie, avant que la position ne se stabilise et que le coût de déplacement ne devienne prohibitif pour les concurrents.
- Knowledge anchor
- Point fixe d'autorité (Wikipedia, Wikidata, presse de référence) qui ancre votre marque dans la mémoire des moteurs et des IA.
- Knowledge Graph
- Graphe sémantique reliant entités (personnes, lieux, marques, concepts), propriétés et relations, exploité par les moteurs et les LLMs pour valider l'identité d'une entité, son autorité et ses connexions.
- E-E-A-T
- Expérience, Expertise, Autorité, Confiance : la grille Google qui mesure la qualité d'un contenu et de son auteur.
- AEO (Answer Engine Optimization)
- L'AEO est l'optimisation pour les moteurs qui répondent directement aux questions plutôt que de lister des liens.
- AI Overviews (Google)
- Les AI Overviews sont les réponses générées par l'IA de Google, affichées au-dessus des résultats de recherche classiques.
- AI Search
- AI Search désigne la nouvelle génération de moteurs de recherche qui répondent en langage naturel avec citations.
- Brand-as-entity strategy
- La stratégie brand-as-entity consiste à transformer votre marque en entité reconnue par les moteurs et IA, pas en simple mot-clé.
- Brand mention
- Une brand mention est toute occurrence du nom de votre marque dans un contenu, qu'il soit lié à vous ou non.
- Brand SERP
- Le Brand SERP est ce que Google affiche quand quelqu'un cherche le nom de votre marque, la 'page d'accueil' que les LLM consultent aussi.
- Citabilité d'une marque
- La citabilité est la propension d'une marque à être citée par les LLM. Combinaison d'autorité, structure, fraîcheur et clarté.
- Citation par les IA
- Une citation IA est l'événement où un LLM mentionne votre marque dans une réponse, avec ou sans lien.
- Citation rate
- Le citation rate est le pourcentage de requêtes cibles pour lesquelles votre marque est citée par un LLM donné.
- Co-occurrence d'entités
- La co-occurrence d'entités est le fait que votre marque apparaisse à proximité d'autres entités fortes (concurrents, marques, lieux, experts).
- Conversational query
- Une conversational query est une question posée en langage naturel complet, comme on parlerait à un humain.
- Crawler IA
- Un crawler IA est un robot qui parcourt le web pour alimenter un LLM en contenus, soit pour l'entraînement, soit pour la recherche temps réel.
- Entity SEO
- L'entity SEO traite votre marque comme une entité (concept, organisation, personne) plutôt que comme une liste de mots-clés.
- Featured snippet vs AI answer
- Le featured snippet est l'encart Google 'position 0' (extrait court d'un site). L'AI answer est généré, plus long, multi-sources.
- Generative answer
- Une generative answer est une réponse produite à la volée par un LLM, distincte d'un lien ou d'un featured snippet.
- GEA (Generative Engine Advertising)
- Le GEA désigne la préparation, l'activation et le pilotage de la visibilité publicitaire d'une marque dans les moteurs et interfaces génératives, lorsque ceux-ci proposent des solutions publicitaires (Google AI Overviews et AI Mode, Copilot Sponsored Answers, formats conversationnels à venir). Marché émergent, il complète le GEO organique : diagnostic des plateformes disponibles, stratégie et répartition budgétaire, activation selon les solutions effectivement disponibles, mesure et attribution.
- GEO (Generative Engine Optimization)
- Le GEO est la discipline qui rend une marque visible et citable par les IA génératives (ChatGPT, Claude, Perplexity, Gemini).
- Indexation IA
- L'indexation IA est le processus par lequel un LLM ou un answer engine stocke et organise les pages d'un site pour pouvoir les retrouver.
- Information retrieval IA
- L'information retrieval IA est la phase où un système hybride va chercher des passages pertinents avant de générer la réponse.
- Knowledge anchor
- Un knowledge anchor est un point fixe d'autorité (Wikipedia, Wikidata, presse de référence) qui ancre votre marque dans la mémoire des LLM.
- Knowledge graph d'une marque
- Le knowledge graph est la 'fiche d'identité' structurée de votre marque dans la mémoire des moteurs et des IA.
- LLMO (LLM Optimization)
- LLMO est un autre terme pour GEO, popularisé par certains consultants américains.
- Long tail query
- Une long tail query est une requête longue et précise, à faible volume mais haute intention.
- Score GEO
- Le score GEO synthétise en un chiffre la performance d'une marque face aux IA génératives.
- Search Generative Experience (SGE)
- SGE est le nom interne de Google pour les AI Overviews, la fonctionnalité qui répond directement en haut de page de résultats.
- Semantic search
- La semantic search comprend l'intention d'une requête, pas seulement les mots utilisés.
- SEO vs GEO
- Le SEO optimise pour Google. Le GEO optimise pour les IA génératives. Les techniques se chevauchent à 40 %, divergent à 60 %.
- Share of voice LLM
- Le share of voice LLM est la part de votre marque dans les citations IA d'un secteur, comparée à vos concurrents.
- Source ranking
- Le source ranking est l'ordre dans lequel un LLM trie ses sources avant de générer une réponse.
- Topical authority
- L'autorité thématique est la légitimité perçue d'un site sur un sujet donné, mesurée par la profondeur et la cohérence du contenu.
- Trust signals
- Les trust signals sont les indices qu'un site est fiable, auteur identifié, HTTPS, mentions légales, presse, années d'existence.
- Vector search
- Le vector search est une recherche basée sur la proximité sémantique entre embeddings, pas sur les mots exacts.
- Visibilité IA / brand visibility
- La visibilité IA mesure à quel point votre marque apparaît dans les réponses des LLM, sur l'ensemble de vos requêtes cibles.
- Zero-click search
- Une zero-click search est une recherche où l'utilisateur trouve sa réponse directement dans Google ou un LLM, sans cliquer sur aucun lien.
IA & LLMs
- LLM (Large Language Model)
- Intelligence artificielle entraînée à comprendre et générer du texte. ChatGPT, Claude ou Gemini sont des LLM grand public.
- IA générative
- Intelligence artificielle qui crée du contenu original (texte, image, son ou vidéo) au lieu de simplement classer ou prédire.
- RAG (Retrieval Augmented Generation)
- Technique combinant un LLM avec une base documentaire : le LLM cherche d'abord, puis répond en citant ses sources.
- Hallucination IA
- Réponse fausse mais convaincante d'un LLM : un fait inventé, une citation fabriquée ou un chiffre erroné.
- Embedding / vecteur sémantique
- Transformation d'un texte en une liste de nombres (vecteur) qui capture son sens. Les textes similaires ont des embeddings proches.
- Token
- Unité de base qu'un LLM traite, environ 0,75 mot en français. 1 000 tokens valent environ 750 mots.
- Prompt / prompting
- Instruction donnée à un LLM. Le prompting est l'art de formuler cette instruction pour obtenir la meilleure réponse.
- Knowledge cut-off
- Date à laquelle les connaissances d'un LLM s'arrêtent. Au-delà, le modèle ne connaît un fait que s'il le récupère en temps réel (retrieval).
- Agent IA / agentic
- Un agent IA est un LLM capable d'agir, réserver un billet, écrire un mail, naviguer sur le web, pas juste répondre.
- API LLM
- Une API LLM permet à un développeur d'utiliser un LLM dans son propre logiciel, à l'usage.
- ChatGPT Enterprise / Claude Enterprise
- Versions entreprise de ChatGPT et Claude, avec garanties de confidentialité (pas d'entraînement sur vos données) et conformité SOC 2.
- ChatGPT (OpenAI)
- ChatGPT est l'assistant IA d'OpenAI, lancé en novembre 2022. C'est le LLM grand public le plus utilisé avec plus de 700 millions d'utilisateurs hebdomadaires en 2026.
- Citation explicite vs absorption
- Un LLM peut citer une source explicitement (avec un lien) ou simplement 'absorber' votre savoir sans vous nommer.
- Claude (Anthropic)
- Claude est l'assistant IA d'Anthropic, concurrent direct de ChatGPT. Apprécié pour la rédaction longue et le raisonnement nuancé.
- Copilot (Microsoft)
- Copilot est l'assistant IA de Microsoft, intégré à Bing, Windows, Edge, Office 365 et GitHub.
- DeepSeek / Qwen (modèles chinois)
- DeepSeek et Qwen sont les principaux LLM chinois, souvent open source et très performants à faible coût.
- Embedding / vecteur sémantique
- Un embedding transforme un texte en une liste de nombres (vecteur) qui capture son sens. Les textes similaires ont des embeddings proches.
- Fenêtre de contexte (context window)
- La fenêtre de contexte est la quantité maximale de texte qu'un LLM peut traiter en une seule conversation. Plus elle est large, plus le LLM peut 'voir' à la fois.
- Fine-tuning
- Le fine-tuning consiste à ré-entraîner un LLM existant sur vos propres données pour qu'il apprenne votre style ou votre domaine.
- Gemini (Google)
- Gemini est l'IA générative de Google, intégrée à Search via les AI Overviews et à toute la suite Workspace.
- Hallucination IA
- Une hallucination est une réponse fausse mais convaincante d'un LLM, un fait inventé, une citation fabriquée ou un chiffre erroné.
- Inférence
- L'inférence est l'exécution d'un LLM pour produire une réponse, par opposition à son entraînement.
- Jailbreak prompt
- Un jailbreak est un prompt qui contourne les règles de sécurité d'un LLM pour lui faire produire un contenu interdit.
- Latence d'un LLM
- La latence est le délai entre votre question et la réponse complète d'un LLM. Mesurée en secondes, elle conditionne l'usage.
- LLM (Large Language Model)
- Un LLM est une intelligence artificielle entraînée à comprendre et générer du texte. ChatGPT, Claude ou Gemini sont des LLM grand public.
- Loss function
- La loss function est la mesure de l'erreur d'un LLM pendant son entraînement. Plus elle est basse, mieux le modèle a appris.
- Mistral / Le Chat
- Mistral AI est le champion européen de l'IA générative, basé à Paris. Son assistant grand public s'appelle Le Chat.
- Mode Deep Research
- Le Deep Research est un mode avancé (ChatGPT, Perplexity, Gemini) où l'IA mène une enquête multi-sources pendant plusieurs minutes et produit un rapport structuré.
- Modèle de fondation (foundation model)
- Un modèle de fondation est un LLM générique pré-entraîné, capable d'être réutilisé pour de nombreuses tâches.
- Multimodalité
- La multimodalité est la capacité d'une IA à traiter plusieurs types de contenu, texte, image, son, vidéo, en même temps.
- Open source vs closed source LLMs
- Les LLM open source (Llama, Mistral, Qwen) ont leurs poids publics. Les LLM closed source (GPT, Claude, Gemini) sont propriétaires.
- Plugin / GPT custom
- Un GPT custom est un mini-assistant créé par un utilisateur ChatGPT, spécialisé sur un usage (un métier, une marque, un sujet).
- Pré-entraînement vs post-entraînement
- Le pré-entraînement apprend la langue au modèle sur des téraoctets de texte. Le post-entraînement le rend utile et sûr.
- Prompt / prompting
- Un prompt est l'instruction que vous donnez à un LLM. Le prompting est l'art de formuler cette instruction pour obtenir la meilleure réponse.
- RAG (Retrieval Augmented Generation)
- Le RAG est une technique qui combine un LLM avec une base documentaire. Le LLM cherche d'abord, puis répond en citant ses sources.
- Reasoning model (o1, o3)
- Les modèles de raisonnement (o1, o3 d'OpenAI ; Claude Opus 4 thinking mode) 'réfléchissent' avant de répondre. Plus lents mais plus précis.
- Réponse synthétique / answer engine
- Une réponse synthétique est une réponse complète générée par l'IA, qui remplace la liste de liens d'un moteur de recherche classique.
- Safety alignment / guardrails
- L'alignement sécurité d'un LLM est l'ensemble des règles internes qui l'empêchent de produire contenus dangereux, illégaux ou diffamatoires.
- Sora / Veo (vidéo générative)
- Sora (OpenAI) et Veo (Google) sont les principaux modèles de génération vidéo par IA, quelques secondes à plusieurs minutes à partir d'un prompt texte.
- Stack technique LLM 2026
- La stack technique LLM est l'ensemble des outils qu'on combine pour bâtir un assistant IA en 2026, modèle, base vectorielle, framework, monitoring.
- Système IA hybride (LLM + recherche web)
- Un système hybride combine un LLM avec une recherche web temps réel, Perplexity, ChatGPT Search, Gemini avec AI Overviews.
- Température (paramètre LLM)
- La température règle la créativité d'un LLM. À 0, le modèle est très prévisible ; à 1 ou plus, il devient inventif et parfois imprévisible.
- Token cost / pricing API
- Le coût d'usage d'un LLM via API est facturé au token, tokens d'entrée + tokens de sortie.
- Token (unité de texte LLM)
- Un token est l'unité de base qu'un LLM traite, environ 0,75 mot en français. 1 000 tokens ≈ 750 mots.
- Top-K, top-P sampling
- Top-K et top-P sont des paramètres techniques qui contrôlent la variété des réponses d'un LLM.
Standards techniques
- llms.txt
- Fichier texte placé à la racine d'un site (/llms.txt) qui oriente les moteurs de réponse IA vers le contenu prioritaire. Format markdown plat proposé en septembre 2024 par Jeremy Howard (Answer.AI).
- llms-full.txt
- Variante exhaustive de llms.txt fournissant le corpus complet machine-readable d'un site. Là où llms.txt est un index curé, llms-full.txt est l'archive éditoriale entière, ingérable en un seul passage par un LLM.
- robots.txt évolutif
- Fichier qui indique aux robots quels chemins crawler ou non. La version 2026 distingue les crawlers de training des crawlers de search/answer.
- GPTBot
- Crawler officiel d'OpenAI (lancé le 7 août 2023) qui collecte les données publiques utilisées pour entraîner les modèles GPT. Premier crawler LLM à publier son user-agent et ses règles d'opt-out via robots.txt.
- OAI-SearchBot
- Crawler d'OpenAI qui collecte le contenu pour ChatGPT Search en temps réel, différent de GPTBot (training).
- PerplexityBot
- Crawler de Perplexity AI alimentant son moteur de réponse, qui affiche ses citations en temps réel sous chaque réponse. Parmi les six grands LLMs, c'est l'interface qui expose le plus directement ses sources.
- Google-Extended
- Token robots.txt qui contrôle l'utilisation de votre contenu par les modèles IA de Google (Gemini, Vertex), distinct de Googlebot (search).
- Applebot vs Applebot-Extended
- Applebot indexe pour Siri et Spotlight. Applebot-Extended cible spécifiquement l'entraînement des modèles Apple Intelligence.
- hreflang
- Attribut indiquant aux moteurs la langue et la zone cible d'une page, et reliant les variantes linguistiques d'un même contenu. Signal critique pour les LLMs multilingues, qui s'en servent pour servir la bonne version selon la langue de la requête.
- Canonical URL
- Version officielle d'une page lorsque plusieurs URL pointent vers le même contenu.
- JSON-LD
- Format technique recommandé par Google pour insérer des données structurées (Schema.org) dans une page.
- 200 vs 301 vs 410 status codes
- Les codes HTTP disent à un robot l'état d'une page : 200 = OK, 301 = redirection permanente, 410 = supprimée définitivement.
- ai-content manifest
- Un ai-content manifest est un fichier qui déclare la nature IA d'un contenu (généré, augmenté, vérifié humainement).
- ai.txt (variant)
- ai.txt est une variante de llms.txt proposée par Spawning, focalisée sur l'opt-out d'entraînement IA pour les créateurs.
- Applebot vs Applebot-Extended
- Applebot indexe pour Siri et Spotlight. Applebot-Extended cible spécifiquement l'entraînement des modèles Apple Intelligence.
- Bing Webmaster Tools AI Performance
- Le rapport AI Performance de Bing Webmaster Tools montre comment votre site apparaît dans Bing Copilot et les réponses IA.
- CCBot (Common Crawl)
- CCBot est le crawler de Common Crawl, une fondation à but non lucratif qui aspire le web et publie un dataset utilisé par presque tous les LLM.
- ClaudeBot
- ClaudeBot est le crawler d'Anthropic qui collecte le contenu pour entraîner et alimenter Claude.
- Cloudflare AI Crawl Control
- Cloudflare AI Crawl Control est un tableau de bord qui permet de voir, autoriser ou bloquer les crawlers IA en un clic.
- CLS (Cumulative Layout Shift)
- CLS mesure les déplacements inattendus du contenu pendant le chargement, quand un bouton 'saute' au moment où vous voulez cliquer.
- Core Web Vitals
- Les Core Web Vitals sont les 3 métriques Google qui mesurent l'expérience utilisateur d'une page : vitesse, réactivité, stabilité visuelle.
- Crawler budget
- Le crawler budget est le nombre de pages qu'un robot accepte de crawler sur votre site dans un délai donné.
- GPTBot
- GPTBot est le crawler d'OpenAI qui collecte le contenu web pour entraîner les futurs modèles GPT.
- hreflang
- hreflang est l'attribut HTML qui dit aux moteurs quelle langue ou quel pays cible une page.
- INP (Interaction to Next Paint)
- INP mesure le temps entre l'action d'un utilisateur (clic, tap) et le rafraîchissement visuel de la page.
- JavaScript indexability
- L'indexabilité JavaScript est la capacité d'un robot à exécuter le JS d'une page pour 'voir' son contenu réel.
- JSON Feed
- JSON Feed est une alternative moderne en JSON aux flux RSS/Atom, pour syndiquer du contenu.
- LCP (Largest Contentful Paint)
- LCP est le temps qu'il faut pour afficher le plus gros élément visible d'une page (image hero, titre).
- Lighthouse audit
- Lighthouse est l'outil open source de Google qui audite performance, accessibilité, SEO et best practices d'une page.
- llms-full.txt
- llms-full.txt est la version étendue de llms.txt : le contenu complet du site condensé pour les LLM.
- llms.txt
- llms.txt est un fichier texte placé à la racine du site qui explique aux IA quel contenu prioriser et comment naviguer.
- Microdata vs RDFa
- Microdata et RDFa sont les anciens formats pour intégrer schema.org dans le HTML, moins recommandés que JSON-LD.
- MistralBot
- MistralBot est le crawler de Mistral AI qui alimente Le Chat et les modèles européens souverains.
- Mobile-first indexing
- Mobile-first indexing veut dire que Google indexe d'abord la version mobile de votre site. Le bureau passe au second plan.
- Open Graph
- Open Graph est le standard meta-tag de Facebook qui contrôle l'aperçu de votre page sur les réseaux sociaux.
- Opt-in vs opt-out crawlers
- L'opt-in et opt-out désignent qui choisit l'inclusion ou l'exclusion d'un site dans le dataset d'un crawler IA.
- PageSpeed Insights
- PageSpeed Insights est l'outil gratuit Google qui mesure la performance d'une page sur mobile et desktop.
- Pay-Per-Crawl (Cloudflare)
- Pay-Per-Crawl est un mécanisme Cloudflare qui permet à un éditeur de facturer aux bots IA chaque page crawlée.
- PerplexityBot
- PerplexityBot est le crawler de Perplexity AI qui alimente son index en temps réel.
- robots.txt évolutif
- robots.txt est le fichier qui dit aux robots quels chemins crawler ou non. La version 2026 distingue training et search bots.
- RSS / Atom
- RSS et Atom sont les formats historiques de syndication de contenu, utilisés depuis 1999 pour suivre des sites.
- Schema.org
- Schema.org est le vocabulaire universel pour décrire le contenu d'une page de manière structurée, lisible par les moteurs et les IA.
- Sitemap index
- Un sitemap index est un fichier qui liste plusieurs sitemap.xml, utile pour les gros sites (>50 000 URL).
- Sitemap.xml
- sitemap.xml est un fichier qui liste toutes les URL importantes de votre site, pour aider les robots à les trouver.
- SSR (Server-Side Rendering)
- Le SSR rend le HTML d'une page côté serveur, par opposition au CSR (Client-Side Rendering) qui dépend de JavaScript dans le navigateur.
- Twitter Cards
- Twitter Cards (X Cards) sont les meta-tags qui contrôlent l'aperçu de votre page sur X (anciennement Twitter).
- Webhooks API LLM
- Un webhook est une URL où un système IA peut envoyer une notification ou un event en temps réel.
Schema.org
- Schema.org
- Vocabulaire structuré ouvert co-fondé en 2011 par Google, Microsoft, Yahoo et Yandex, permettant de typer le contenu HTML (Organization, Person, FAQPage, DefinedTerm, Article) pour le rendre lisible par les moteurs et les IA. JSON-LD est le format d'implémentation préféré.
- Schema.org DefinedTerm
- Type Schema.org qui marque chaque entrée d'un glossaire pour la rendre exploitable par les moteurs et les IA.
- FAQPage
- Type Schema.org structurant une page de FAQ en couples Question et acceptedAnswer machine-readable. Particulièrement performant pour la citation par les moteurs de réponse IA, qui ingèrent les paires Q-R prêtes à servir.
- sameAs
- Propriété Schema.org qui relie une entité à ses pages officielles ailleurs sur le web (Wikidata, LinkedIn, Wikipedia) pour désambiguïser et consolider l'autorité.
- JSON-LD @graph
- @graph est la propriété JSON-LD qui permet de regrouper plusieurs schemas dans un seul bloc cohérent.
- sameAs (Wikidata, LinkedIn)
- sameAs est la propriété schema qui relie une entité à ses pages officielles ailleurs sur le web, Wikidata, LinkedIn, Wikipedia.
- Schema.org Article
- Le schema Article décrit un contenu éditorial (article, billet de blog, news) pour les moteurs et IA.
- Schema.org Author
- La propriété author (de type Person ou Organization) attribue un contenu à son créateur.
- Schema.org Brand
- Le schema Brand identifie une marque commerciale comme entité distincte d'une entreprise.
- Schema.org BreadcrumbList
- Le schema BreadcrumbList décrit le fil d'Ariane d'une page, Accueil > Catégorie > Page.
- Schema.org ContactPage
- Le schema ContactPage est le sous-type WebPage spécifique à votre page contact.
- Schema.org Course
- Le schema Course décrit une formation, un cours en ligne ou un programme académique.
- Schema.org DefinedTerm
- Le schema DefinedTerm marque chaque entrée d'un glossaire pour la rendre exploitable par les moteurs et IA.
- Schema.org Event
- Le schema Event décrit un événement physique ou virtuel, concert, conférence, salon, webinaire.
- Schema.org FAQPage
- Le schema FAQPage marque une page de questions/réponses pour qu'elle soit utilisable dans les featured snippets et les AI answers.
- Schema.org Hotel / LodgingBusiness
- Les schemas Hotel et LodgingBusiness décrivent un établissement d'hébergement, chambres, étoiles, services.
- Schema.org HowTo
- Le schema HowTo décrit une procédure étape par étape, recette, mode d'emploi, tutoriel.
- Schema.org JobPosting
- Le schema JobPosting décrit une offre d'emploi, titre, employeur, lieu, salaire, conditions.
- Schema.org LocalBusiness
- Le schema LocalBusiness décrit un commerce de proximité, adresse, horaires, contact, géolocalisation.
- Schema.org MedicalProcedure
- Le schema MedicalProcedure décrit un acte médical, diagnostic, traitement, intervention.
- Schema.org OfferCatalog
- Le schema OfferCatalog liste plusieurs offres ou services groupés, gamme produit, menu, palette de prestations.
- Schema.org Organization
- Le schema Organization décrit une entreprise, ses contacts, ses dirigeants, ses identifiants officiels.
- Schema.org Person
- Le schema Person décrit une personne physique, dirigeant, auteur, expert, comme une entité identifiable.
- Schema.org Product
- Le schema Product décrit un produit vendu, nom, marque, prix, image, disponibilité.
- Schema.org Recipe
- Le schema Recipe décrit une recette de cuisine, ingrédients, étapes, temps, calories.
- Schema.org Restaurant
- Le schema Restaurant identifie un établissement de restauration, adresse, horaires, type de cuisine, menu.
- Schema.org Review / AggregateRating
- Les schemas Review et AggregateRating décrivent les avis et notes moyennes d'un produit, lieu ou service.
- Schema.org SearchAction
- Le schema SearchAction expose votre moteur de recherche interne pour qu'il apparaisse dans la sitelinks searchbox de Google.
- Schema.org Service
- Le schema Service décrit un service commercial, coaching, audit, conseil, transport.
- Schema.org SoftwareApplication
- Le schema SoftwareApplication décrit un logiciel ou une application, features, OS, prix, notes.
- Schema.org SpecialAnnouncement
- Le schema SpecialAnnouncement signale une annonce urgente, fermeture, alerte, COVID, événement extraordinaire.
- Schema.org validator
- Le Schema.org validator (Google Rich Results Test, validator.schema.org) vérifie que votre balisage est correct.
- Schema.org WebPage
- Le schema WebPage est le type générique de toute page web, souvent affiné par un sous-type spécifique.
- Schema.org WebSite
- Le schema WebSite identifie le site lui-même comme entité, distincte des pages individuelles.
Mesure & KPIs
- Citation rate
- Indicateur central du GEO : pourcentage de réponses LLM dans lesquelles une marque ou une URL est citée comme source, sur un panel de questions et de moteurs définis. L'équivalent, dans la couche de réponse, du « part de marché SERP » dans la couche Google.
- AI traffic referrer
- Le AI traffic referrer est le trafic web qui arrive sur votre site via un clic depuis une réponse IA.
- Bot crawl frequency
- La fréquence de crawl est le nombre de fois où un bot visite votre site sur une période.
- Brand authority score
- Le brand authority score synthétise l'autorité globale de votre marque (entity, presse, backlinks, ancrages).
- Brand mention frequency
- La fréquence de mention de marque est le nombre de fois où votre nom apparaît sur le web sur une période donnée.
- Citation depth
- La citation depth mesure la longueur du passage où votre marque est citée, simple nom, paragraphe court, paragraphe développé.
- Citation drift
- La citation drift est l'évolution dans le temps de la manière dont les LLM citent votre marque, formulation, contexte, position.
- Citation footprint
- Le citation footprint est l'empreinte totale de votre marque dans les citations IA, tous LLM confondus.
- Citation overlap (multi-LLM)
- Le citation overlap mesure si votre marque est citée par plusieurs LLM en parallèle pour la même requête.
- Click-through rate (CTR) IA
- Le CTR IA est le pourcentage d'utilisateurs qui cliquent sur votre lien depuis une réponse IA.
- Knowledge graph coverage
- La knowledge graph coverage indique si votre marque est présente dans les knowledge graphs publics (Wikidata, Google KG, Wikipedia).
- Mention sentiment
- Le sentiment d'une mention indique si la citation IA est positive, neutre ou négative à votre égard.
- Multilingual coverage
- La multilingual coverage est la proportion de langues cibles où votre marque est citée.
- Pondération de citation
- La pondération de citation attribue un poids différent à chaque citation selon sa qualité (LLM, position, contexte).
- Position in answer
- La position-in-answer indique où votre marque apparaît dans une réponse IA, premier nom, milieu, fin de liste.
- Quality signals score
- Le quality signals score agrège les signaux techniques et éditoriaux qui font qu'un site est 'bon' aux yeux des moteurs.
- Reverse citation
- La reverse citation est l'événement où un LLM cite UNE de vos sources externes pour parler de vous.
- Sectoral coverage rate
- Le sectoral coverage rate est le pourcentage de requêtes d'un secteur où votre marque est citée au moins une fois.
- Share of voice LLM
- Le share of voice LLM mesure la part de votre marque dans les citations IA d'un secteur, par rapport à vos concurrents.
- Time-to-citation (T+Days)
- Le time-to-citation est le délai entre la publication d'un contenu et sa première citation par un LLM.
- Topical relevance score
- Le topical relevance score mesure à quel point votre site est perçu comme expert sur un sujet spécifique.
Acteurs & plateformes
- ChatGPT (OpenAI)
- Assistant IA d'OpenAI, lancé en novembre 2022. Le LLM grand public le plus utilisé.
- Claude (Anthropic)
- Assistant IA d'Anthropic, apprécié pour la rédaction longue et le raisonnement nuancé.
- Perplexity
- Moteur de recherche IA qui répond directement aux questions avec des sources citées. Alternative à Google Search.
- Gemini (Google)
- IA générative de Google, intégrée à Search via les AI Overviews et à la suite Workspace.
- Copilot (Microsoft)
- Assistant IA de Microsoft, intégré à Bing, Windows, Edge, Office 365 et GitHub.
- OpenAI
- Entreprise américaine éditrice de ChatGPT, GPT-4, DALL·E et Sora. Pionnier de l'IA générative grand public.
- Anthropic
- Entreprise américaine derrière Claude, fondée par d'anciens d'OpenAI, positionnée sur l'IA fiable et interprétable.
- Wikipedia / Wikidata
- Wikipedia est l'encyclopédie en ligne ; Wikidata est sa base de données structurée. Les deux knowledge anchors les plus cités par les LLMs.
- Aleyda Solis (Orainti)
- Aleyda Solis est une consultante SEO/GEO espagnole, fondatrice d'Orainti et figure internationale du domaine.
- AthenaHQ
- AthenaHQ est un autre outil US de mesure GEO, concurrent de Profound, lancé en 2024.
- Bing Webmaster Tools
- Bing Webmaster Tools est l'équivalent Microsoft de Google Search Console, gratuit, sous-utilisé en Europe.
- BrightEdge
- BrightEdge est une plateforme SEO entreprise historique qui a ajouté un module GEO en 2024.
- ChatGPT plugins / GPTs
- Les plugins ChatGPT (devenus GPTs en 2023) sont des assistants spécialisés créés par utilisateurs ou entreprises.
- Cloudflare
- Cloudflare est le principal opérateur CDN/sécurité du web, et l'arbitre de fait du marché AI crawler depuis 2024.
- Cohere
- Cohere est une startup canadienne d'IA générative spécialisée en entreprise et en multilingue.
- Conductor
- Conductor est une plateforme SEO entreprise US, équivalente à BrightEdge, qui a aussi viré au GEO en 2024.
- Google DeepMind
- Google DeepMind est la division IA de Google, fusion de Google Brain et DeepMind (Londres) en 2023.
- Inflection AI
- Inflection AI était une startup IA grand public (Pi), largement absorbée par Microsoft en 2024.
- iPullRank (Mike King)
- iPullRank est l'agence SEO/GEO US de Mike King, l'un des pionniers et théoriciens reconnus du GEO.
- Lily Ray (Algorythmic)
- Lily Ray est une consultante SEO/GEO US (ex-Path Interactive, désormais Algorythmic), spécialiste E-E-A-T et YMYL.
- Meta AI (Llama)
- Meta AI est la division IA de Meta (Facebook/Instagram/WhatsApp). Publie les modèles Llama, en open-weight gratuit.
- Microsoft / Azure OpenAI
- Microsoft est l'un des principaux distributeurs d'IA en entreprise via Copilot et la plateforme Azure OpenAI Service.
- Mistral AI
- Mistral AI est le champion européen de l'IA générative, basé à Paris.
- Perplexity AI
- Perplexity AI est la startup américaine derrière le moteur de recherche IA Perplexity, alternative ouverte à Google Search.
- Proema Insight
- Proema Insight est un outil de mesure GEO européen qui suit les citations IA pour les marques B2B.
- Profound
- Profound est un outil US qui mesure les citations IA d'une marque sur ChatGPT, Perplexity, Claude et Gemini.
- Schema.org Foundation
- La Schema.org Foundation est l'organisation qui maintient le vocabulaire schema.org, Google, Bing, Yahoo, Yandex initialement.
- Search Engine Journal
- Search Engine Journal (SEJ) est l'une des publications anglophones de référence en SEO et GEO.
- Search Engine Land
- Search Engine Land est l'autre grande publication SEO/SEM/GEO en anglais, complémentaire de SEJ.
- xAI (Grok)
- xAI est l'entreprise IA d'Elon Musk, qui édite Grok, intégré à X (Twitter).
Réglementation
- EU AI Act
- Premier règlement européen exhaustif sur l'intelligence artificielle, entré en vigueur en 2024.
- Article 50 EU AI Act
- Article qui oblige à divulguer qu'un contenu est généré ou modifié par une IA, et à signaler les interactions avec un système d'IA.
- RGPD / GDPR
- Règlement européen sur la protection des données personnelles, entré en vigueur en 2018.
- Affaire NYT vs OpenAI
- Le New York Times a poursuivi OpenAI et Microsoft en décembre 2023 pour usage non autorisé de ses articles dans l'entraînement de GPT.
- APD (Belgique)
- L'APD (Autorité de Protection des Données) est l'autorité belge équivalente à la CNIL française.
- Article 50 EU AI Act
- L'Article 50 oblige toute organisation à divulguer qu'un contenu est généré ou modifié par une IA.
- Article 53 EU AI Act
- L'Article 53 régule les modèles de fondation (GPT, Claude, Gemini, Mistral), obligations de documentation et transparence.
- Bartz v. Anthropic
- Andrea Bartz, écrivaine, a poursuivi Anthropic en 2024 pour l'usage de ses livres dans l'entraînement de Claude.
- CCPA (California)
- Le CCPA est la loi californienne sur la protection des données personnelles, équivalent US partiel du RGPD.
- CNIL (France)
- La CNIL est l'autorité française de protection des données personnelles, équivalent français de l'APD belge.
- Concurrence déloyale (BE/FR)
- La concurrence déloyale regroupe les pratiques commerciales trompeuses, dénigrantes ou parasitaires entre entreprises.
- Data Privacy Framework (EU-US)
- Le Data Privacy Framework est l'accord EU-US qui permet le transfert légal de données personnelles entre l'Europe et les États-Unis.
- Droit d'auteur et IA
- Le droit d'auteur protège les œuvres originales, texte, image, code. Son application à l'IA générative est en cours de jurisprudence en 2026.
- EDPB
- L'EDPB (European Data Protection Board) est l'organe européen qui coordonne les autorités nationales de protection des données.
- Marque déposée vs marque notoire
- Une marque déposée est officiellement enregistrée (EUIPO, INPI, BOIP). Une marque notoire est reconnue par l'usage, même sans enregistrement.
- Opt-in / opt-out crawlers
- Le débat opt-in vs opt-out concerne le mode par défaut : votre contenu est-il inclus ou exclu sauf décision contraire ?
- RGPD / GDPR
- Le RGPD (GDPR) est le règlement européen sur la protection des données personnelles, entré en vigueur en 2018.
- Whistleblower IA
- Un whistleblower IA est une personne qui signale un usage abusif ou dangereux d'IA dans une organisation.
Commencer
Votre marque est-elle citable par l'IA ?
Recevez gratuitement votre score GEO et demandez ensuite un diagnostic GEO complet : ce que ChatGPT, Perplexity et Gemini voient (ou ne voient pas) de vous aujourd'hui.