À propos de findable-audit
findable-audit est un outil gratuit et open source qui mesure la findabilité d’un site web — par les moteurs de recherche classiques et par les assistants IA comme ChatGPT, Claude ou Perplexity.
Il répond à une question : quand quelqu’un cherche ce que vous proposez, les moteurs et les crawlers IA peuvent-ils atteindre vos pages, extraire votre contenu et vous citer comme source ?
Ce qui est vérifié
Chaque audit échantillonne plusieurs pages du site cible et exécute 137 contrôles regroupés en 8 familles pondérées : accès IA (directives robots pour GPTBot, ClaudeBot et consorts), contenu pour moteurs de réponse (llms.txt, contenu extractible rendu côté serveur), données structurées (entités JSON-LD, Open Graph), SEO technique (canonicals, redirections, sitemaps), sémantique on-page (titres, intertitres, liens internes), performance et Core Web Vitals, accessibilité, et en-têtes de sécurité.
Comment le score fonctionne
Chaque contrôle rapporte des points et vient avec une correction concrète et priorisée. Les scores par famille sont pondérés en un score unique sur 100 et une note A–F : deux audits du même site sont directement comparables dans le temps — la CLI peut même faire échouer un build CI quand un déploiement fait régresser le score.
Open source
Le moteur est sous licence MIT, avec très peu de dépendances. Le même catalogue de contrôles alimente cette application web, un outil en ligne de commande et une gate CI. Ce site est audité avec son propre moteur — le dogfooding garde les recommandations honnêtes.
Les 8 familles pondérées
- Accès IA (poids 16 %) : directives robots.txt et règles edge pour GPTBot, ClaudeBot, PerplexityBot et 25 autres agents IA.
- Contenu pour moteurs de réponse (18 %) : llms.txt, contenu rendu côté serveur, chapô en réponse directe, listes et tableaux extractibles.
- Données structurées (15 %) : entités JSON-LD, Open Graph, balisage FAQPage et Article, ancrage d’entité via sameAs.
- SEO technique (15 %) : canonicals, redirections, sitemaps, hreflang, consolidation d’hôte et pagination.
- On-page (12 %) : titres, méta-descriptions, hiérarchie des intertitres, textes alternatifs et maillage interne.
- Performance et Core Web Vitals (10 %) : LCP, CLS, INP et TTFB, mesurés via PageSpeed Insights lorsqu’une clé API est fournie.
- Accessibilité (7 %) : points de repère, étiquettes de formulaire, titres d’iframe, alternatives textuelles et ordre des titres.
- Sécurité et confiance (7 %) : HTTPS, HSTS, Content-Security-Policy, X-Content-Type-Options et Referrer-Policy.
Questions fréquentes
findable-audit est-il gratuit ?
Oui. L’application web et l’outil en ligne de commande sont gratuits et sous licence MIT, et aucun compte n’est nécessaire pour lancer un audit.
Quelle différence entre le GEO et le SEO ?
Le SEO optimise le classement de liens sur une page de résultats. Le GEO optimise le fait d’être atteint, extrait et cité à l’intérieur d’une réponse IA. findable-audit note les deux en une passe, parce qu’un seul crawl répond aux deux questions.
Que conservez-vous des sites que j’audite ?
Le rapport lui-même est éphémère et expire du serveur quelques minutes après la fin de l’audit. Un enregistrement d’usage minimal est conservé par audit : l’URL et son domaine, le score, la note, les huit sous-scores par famille, un horodatage et une empreinte salée de l’adresse IP. Le contenu des pages et les résultats détaillés ne sont jamais stockés.
Puis-je utiliser findable-audit en intégration continue ?
Oui. La CLI enregistre un rapport de référence et, avec --fail-on-regression, sort en code non nul quand un déploiement fait baisser le score. Une action GitHub composite et une sortie JUnit XML sont fournies avec le dépôt.
La recherche derrière l’outil
- GEO : Generative Engine Optimization (KDD 2024) — arXiv 2311.09735
- C-SEO Bench : réécrire le contenu est largement inefficace — arXiv 2506.11097
- Search Arena : à quelle fréquence les moteurs récupèrent et citent — arXiv 2508.00838