Contenus pour les IA — des pages prêtes pour les moteurs génératifs

Cinq contrôles déterministes sur le HTML de chaque page du site, calculés par le robot interne pendant l'Audit SEO — texte dans le HTML, réponse en ouverture, titres-questions, schéma du contenu, paragraphes courts — avec un score par page, les pages exclues et leur motif, et le lien avec Présence IA : pour chaque prompt non cité, la page qui devrait répondre, ses contrôles et l'analyse IA de ce qui lui manque.

Contenus pour les IA répond à une question que ni l’Audit SEO ni Présence IA ne couvrent seuls : les pages du site sont-elles écrites de façon qu’un moteur génératif (ChatGPT, Perplexity, AI Overview de Google) puisse les extraire et les citer ? L’Audit SEO regarde la santé technique, Présence IA mesure si les IA vous citent réellement. Entre les deux il y a la forme du contenu, contrôlée page par page.

Vous y accédez depuis le projet → groupe de la barre latérale Audit SEO → Contenus pour les IA (ou, depuis la page Audit SEO, c’est la vue ?tab=geo).

D’où viennent les données. Les contrôles sont calculés pendant l’exploration de l’Audit SEO par le robot interne de Miraqo, sur le HTML déjà téléchargé : aucun appel supplémentaire, aucun coût. Si vous voyez « Ces contrôles commencent avec les nouveaux audits », le dernier audit est antérieur à la fonction : cliquez sur Lancer l’audit et la page se remplit à la fin de l’exploration.

Ce qui est mesuré, et ce qui ne l’est pas

Ce sont des contrôles déterministes de forme, sans intelligence artificielle : ils disent si le contenu est extractible, pas s’il est exhaustif. Une page vide de sens mais bien structurée obtient 100 ; une page excellente servie uniquement en JavaScript obtient 0. Le score de page est la part de contrôles réussis parmi ceux applicables à cette page : transparent, sans pondération cachée. Il n’entre pas dans le score de l’Audit SEO.

Pour savoir si les IA citent réellement le site, il y a Présence IA ; pour savoir ce qui manque à une page par rapport à ce que les IA répondent, il y a l’analyse IA « Pourquoi pas ? », décrite plus bas.

Les cinq contrôles

Contrôle Ce qu’il regarde Réussi si Pourquoi ça compte
Texte dans le HTML Les mots dans le HTML servi par le serveur, avant l’exécution du JavaScript La page n’est pas presque vide Les robots IA n’exécutent généralement pas le JavaScript : une page rendue uniquement côté client n’existe pas pour eux. S’il échoue, les quatre autres contrôles ne s’appliquent pas.
Réponse en ouverture Le premier paragraphe d’au moins 10 mots après le H1 (les lignes plus courtes — auteur et date, temps de lecture, étiquettes — sont ignorées) Il existe et ne dépasse pas 120 mots Les IA prélèvent une réponse directe, pas une introduction. Si seules des lignes courtes suivent le H1, la page affiche « Non (0) ».
Titres-questions Les H2 et H3 qui se terminent par un point d’interrogation Au moins un, sur les pages avec au moins deux H2/H3 Les blocs question → réponse sont les plus cités dans les réponses génératives.
Schéma du contenu Les types JSON-LD déclarés dans la page Au moins un parmi Article, BlogPosting, FAQPage, HowTo, Product, Service, Recipe, Event, LocalBusiness… Organization, WebSite, WebPage et BreadcrumbList ne comptent pas : Yoast et consorts les mettent sur toutes les pages. Ne s’applique pas aux archives de catégorie.
Paragraphes courts La longueur de chaque <p> du contenu (menu, en-tête et pied de page exclus) Aucun paragraphe de plus de 150 mots Un mur de texte ne se découpe pas en blocs citables.

Entre parenthèses, dans le tableau, vous trouvez la donnée derrière chaque résultat : les mots du paragraphe d’ouverture, combien de H2/H3 sont des questions, les types JSON-LD trouvés, les paragraphes longs sur le total.

Les cartes en haut

  • Score moyen (0–100) : moyenne des scores des pages contrôlées. ≥70 bon, 40–69 à améliorer, <40 critique.
  • Pages évaluées : les pages HTML avec au moins trois contrôles applicables, et combien ont été exclues.
  • Robots IA : si robots.txt interdit la page d’accueil aux robots des moteurs IA (OAI-SearchBot, PerplexityBot, ClaudeBot, Google-Extended…). Un robot bloqué ne lit aucune page, quel que soit le score : c’est le contrôle qui passe avant tous les autres.
  • llms.txt : si /llms.txt existe à la racine du site, l’index en texte brut que certains moteurs IA lisent pour s’orienter. Facultatif, peu coûteux.

En dessous, une carte par contrôle avec le nombre de pages qui l’échouent : la vue la plus rapide pour comprendre où est le problème du site.

La page Contenus pour les IA : en haut le score moyen en anneau, les cartes Pages évaluées, Robots IA et llms.txt ; mise en évidence, la rangée des cinq cartes de contrôle Texte dans le HTML, Réponse en ouverture, Titres-questions, Schéma du contenu et Paragraphes courts, chacune avec le nombre de pages qui l’échouent

Contrôlées et exclues

Deux onglets au-dessus du tableau :

  • Contrôlées — les pages qui entrent dans le score, triées de la pire : commencez ici. Chaque ligne montre l’URL et le titre, le score et les cinq résultats (Oui, Non, ou « — » quand le contrôle ne s’applique pas à cette page). La recherche par URL filtre le tableau ; au-delà de 300 lignes, celles au score le plus bas sont affichées.
  • Exclues — les pages hors du score, avec la colonne Motif : noindex (les moteurs ne l’indexent pas, donc ne la citent pas : connexion, réinitialisation du mot de passe, confidentialité…), hors du domaine du projet (atteinte via une redirection, par exemple une page de connexion tierce), moins de 3 contrôles applicables (ni paragraphes ni titres : ce n’est pas une page de contenu, comme les archives d’une page de statut).

Le tableau Contenus pour les IA avec les deux onglets Contrôlées et Exclues mis en évidence ; en dessous, la recherche par URL et les premières lignes triées du score le plus bas avec les cinq résultats Oui/Non et la donnée entre parenthèses

L’onglet Exclues : le tableau avec la colonne Motif mise en évidence, qui indique pour chaque page hors du score noindex, hors du domaine du projet ou moins de 3 contrôles applicables

Les catégories comptent. Les archives de catégorie restent parmi les pages contrôlées : dans un e-commerce, la catégorie est la page que l’on optimise pour les moteurs génératifs, les produits ne peuvent pas être soignés un par un. Une catégorie sans même un paragraphe de description affiche « Réponse en ouverture : Non (0) », et c’est une action concrète à mener.

« Pourquoi pas ? » dans Présence IA

Le lien avec Présence IA est la raison d’être de cette page. Dans le tableau des prompts, à côté de chaque prompt qu’aucune source IA ne cite, vous trouvez le bouton 🔎 Pourquoi pas ?. Ouvert, il montre :

  • la page du site qui devrait répondre au prompt : l’URL qui se positionne sur Google pour le mot-clé associé, sinon la page dont le titre, le H1, la meta description et l’URL sont les plus proches du prompt ;
  • son score et les cinq contrôles, avec le lien pour l’ouvrir dans Contenus pour les IA ;
  • un verdict en une ligne : commencez par les contrôles en rouge si la forme a des défauts, ou la forme est bonne : la page ne couvre pas ce que les IA répondent si tout est vert.

Si aucune page du site ne ressemble au prompt, il le dit clairement : il manque un contenu pour cette intention, et les IA ne peuvent pas citer une page qui n’existe pas.

Le tableau Résultats par prompt de Présence IA avec le bouton Pourquoi pas ? mis en évidence sous un prompt non cité ; en dessous, la ligne dépliée avec la page qui devrait répondre, son score Contenus pour les IA avec les cinq résultats, le lien Ouvrir dans Contenus pour les IA et le bouton Analyser avec l’IA

La page candidate est choisie par recoupement de mots entre le prompt et le titre/H1/description/URL : cela fonctionne bien quand la page existe et parle la langue du prompt, mais peut se tromper de page quand deux pages similaires partagent les mêmes mots. Pour ce cas, il y a l’analyse IA.

✨ Analyser avec l’IA

Dans la même ligne, ✨ Analyser avec l’IA lance la vraie analyse : un modèle de langage lit les réponses que les IA ont données à ce prompt, les sources qu’elles ont citées (les concurrents) et la page candidate lue en direct, et répond avec :

  1. une synthèse en deux ou trois phrases : la raison principale pour laquelle le site n’est pas cité, adressée à qui écrit la page ;
  2. ce qui manque à la page : jusqu’à cinq manques concrets — sous-thèmes, données, comparaisons, questions — avec ce que les IA ou les sources disent sur ce point ;
  3. à faire, dans l’ordre : jusqu’à quatre actions.

Sans page candidate, l’analyse décrit plutôt ce que devrait contenir la page à créer. En bas, vous trouvez les sources citées par les IA, à lire pour comprendre ce qui est récompensé.

La ligne Pourquoi pas ? avec le résultat de l’analyse IA mis en évidence : la synthèse, la liste Ce qui manque à la page avec cinq points en gras, les actions numérotées À faire dans l’ordre et, en bas, la date de l’analyse et les sources citées par les IA

Un appel payant par prompt, dans la limite du budget mensuel. Chaque analyse est un appel IA (environ trois centimes de coût réel) et compte dans un budget mensuel lié au forfait — Solo 20, Starter 40, Pro 100, Agency 200 par mois, 5 pendant l’essai gratuit. Le résultat reste enregistré sur le prompt : cliquer à nouveau ne coûte rien tant qu’un nouveau contrôle de Présence IA n’est pas arrivé ; ensuite il peut être régénéré. L’action requiert la permission Analyse IA du membre (voir Permissions utilisateur). L’analyse sort dans la langue de l’interface de la personne qui la lance : c’est un conseil pour l’auteur, pas un texte pour le site.

Notes et limites

  • Analyse de forme, pas de fond : les cinq contrôles ne jugent ni la qualité ni l’exhaustivité du texte. Pour cela il y a l’analyse IA, à lire toutefois comme un avis à vérifier, pas comme une règle.
  • Sites en JavaScript (SPA) : le robot lit le HTML servi par le serveur et n’exécute pas le JavaScript, exactement comme la plupart des robots IA. Un site Vue/React/Angular en mode client affiche « Texte dans le HTML : Non » sur chaque page ; le même framework en SSR ou SSG fonctionne normalement.
  • Les seuils (10 et 120 mots pour l’ouverture, 150 pour les paragraphes, deux H2/H3 pour les titres-questions) sont calibrés sur des sites réels et identiques pour tous : ils ne sont pas configurables.
  • Les contrôles se mettent à jour à chaque nouvel audit avec le robot interne ; il n’y a pas de rafraîchissement indépendant. Les onglets Contrôlées/Exclues et le bouton « Pourquoi pas ? » utilisent les données du dernier audit terminé.
  • L’accès à la page suit la permission Audit SEO du membre ; le bouton « Pourquoi pas ? » apparaît dans Présence IA pour qui voit les prompts, l’analyse IA pour qui a la permission Analyse IA.

Voir aussi :

Dernière mise à jour: 2 octobre 2026