CrawlSEO
Supervision SEO auto-hébergée sous licence MIT qui réunit les données Google Search Console, un crawler de site et les Core Web Vitals dans un seul tableau de bord, avec un serveur MCP pour que les agents IA puissent l'interroger
CrawlSEO est un tableau de bord SEO auto-hébergé sous licence MIT qui récupère vos propres données Google Search Console, explore votre site et mesure les Core Web Vitals au même endroit, puis expose l'ensemble aux agents IA via un serveur Model Context Protocol. Il vise les fondateurs plutôt que les spécialistes SEO : la moitié gratuite, c'est tout ce que Google rapporte déjà sur vous, et les parties qui exigent des données externes — volume de mots-clés et backlinks — fonctionnent avec votre propre clé chez un fournisseur payant. Le projet en est à ses débuts : lisez-le comme une couche de supervision qui dit ce qui a changé, pas comme un outil qui décide quoi en faire.
Ce qu'est CrawlSEO
CrawlSEO (github.com/crawlseo/crawlseo) est un tableau de bord de supervision SEO auto-hébergé, bâti sur Next.js, PostgreSQL et Prisma, publié sous licence MIT par Brandson Digital. Vous le connectez en OAuth à votre propre propriété Google Search Console, pointez son crawler sur votre site, et il maintient les deux vues côte à côte : ce que Google rapporte sur vos pages, et ce que vos pages contiennent réellement.
- Analyse Search Console mots-clés, pages, clics, impressions et position, avec comparaison sur 28 jours et indicateurs d'évolution.
- Crawler de site jusqu'à 2 000 pages par exploration, avec score de santé, 16 types de problèmes et notes de correction par page.
- Core Web Vitals LCP, CLS, INP et TTFB tirés de PageSpeed Insights, mobile et bureau côte à côte. Notre définition de ces mesures est sur Core Web Vitals.
- Détection d'opportunités mots-clés au seuil du top, pages à faible CTR, dégradation du contenu et cannibalisation de mots-clés.
- Alertes chutes de trafic, changements de position, nouvelles 404 et dégradation des vitals, par e-mail, Slack, Telegram ou webhook.
- Un serveur MCP dix outils permettant à Claude Code, Claude Desktop ou Cursor d'interroger les mêmes données via le Model Context Protocol.
Le déploiement se fait en Docker Compose sur une image multi-architecture prête à l'emploi, ou en installation manuelle avec Node et PostgreSQL. Le projet est jeune : créé en avril 2026, quatre personnes y ont contribué et sa seule version étiquetée est la v0.1.0. Lisez le nombre d'étoiles comme un intérêt et non comme une maturité, et attendez-vous à être un utilisateur précoce plutôt qu'un client.
Ce qu'il lit gratuitement et ce qui exige une clé payante
Ce partage compte plus que la liste des fonctionnalités, car il détermine ce que l'outil peut vous dire dès le premier jour sans budget.
| Donnée | Provenance | Coût |
|---|---|---|
| Clics, impressions, position, requêtes | Votre propre propriété Search Console, en OAuth | Gratuit |
| Problèmes de crawl, titres, codes de statut | Le crawler intégré de CrawlSEO, sur votre serveur | Gratuit |
| Core Web Vitals | Google PageSpeed Insights | Gratuit |
| Volume de mots-clés, difficulté, CPC | DataForSEO, avec votre clé | Payant ; repli gratuit via Google Autocomplete |
| Backlinks, domaines référents, texte d'ancre | DataForSEO, avec votre clé | Payant |
Cette dernière ligne n'est pas un raccourci du mainteneur. Nous avons cherché la même chose en construisant nos propres rapports Search Console, et nous l'avons confirmé : l'API Search Console n'expose aucun point de terminaison sur les liens, et le rapport Liens n'existe que dans l'interface web. Tout outil bâti sur les données GSC doit donc aller chercher les backlinks ailleurs, ou laisser le panneau vide. Bon à savoir avant de reprocher à un outil SEO gratuit de verrouiller le seul chiffre que tout le monde réclame.
Où il s'insère dans la pile de croissance d'un fondateur
La supervision est la moitié bon marché du SEO. Un tableau de bord peut vous dire qu'une page est passée de la position 8 à la 14, qu'un changement de gabarit a posé une balise canonique sur la mauvaise URL, ou qu'une route renvoie des 404 depuis un déploiement. Il ne peut pas écrire la page qui se positionne, obtenir le lien, ni décider lequel de quarante problèmes signalés mérite un après-midi. Cet écart, c'est le vrai travail, et c'est là que se place AgentCeres — l'AI Growth Officer sur agentceres.com : une équipe de rôles spécialisés qui rédige le contenu, la prospection et les annonces, un humain approuvant tout ce qui sort.
Le type de problème qu'un moniteur attrape est bien réel, et il nous est arrivé. Notre propre site marketing pré-rend des milliers de pages en huit langues, et un problème de canoniques est apparu dans Search Console sous forme de pages explorées par Google puis non indexées sous notre URL. Aucun test ne l'a vu, parce que rien n'était cassé : les pages s'affichaient très bien. Si vous exploitez un site volumineux ou généré programmatiquement, quelque chose doit surveiller Search Console à votre place, et auto-héberger ce quelque chose sur votre propre base est une réponse raisonnable. Si le site est petit, commencez par le SEO d'un site tout neuf, et lisez budget de crawl avant de supposer que l'exploration est votre goulot d'étranglement.
FAQ
- CrawlSEO remplace-t-il Ahrefs ou Semrush ?
- Pas sur ce pour quoi la plupart les achètent. Ahrefs et Semrush vous vendent leur propre exploration de tout le web : mots-clés des concurrents, index de backlinks, positions de domaines que vous ne possédez pas. CrawlSEO rend compte du site que vous contrôlez, à partir de données que Google vous donne déjà, et ne loue des données tierces que si vous fournissez une clé. Si votre question est "que se passe-t-il sur mon site", l'échange est équitable. Si elle est "sur quoi mon concurrent se positionne", il ne l'est pas.
- Que permet réellement le serveur MCP à un agent ?
- Il expose dix outils à tout client Model Context Protocol comme Claude Code, Claude Desktop ou Cursor : lister les sites, récupérer mots-clés, pages et trafic, lancer une exploration et lire ses problèmes, obtenir les vitals et les opportunités. En pratique, vous interrogez un agent sur vos données Search Console dans la session même où vous éditez la page, au lieu d'exporter un CSV d'abord. Les données restent sur votre propre instance.
- Est-il prêt pour la production ?
- Traitez-le comme un projet précoce. Il est sous licence MIT, publie des images Docker multi-architectures, exécute les migrations au démarrage du conteneur et a reçu un vrai travail de sécurité : en juillet 2026, le crawler a été durci contre le SSRF et les identifiants de base de données de compose sont passés en variables d'environnement. Il reste jeune, avec quatre contributeurs et une seule étiquette v0.1.0. Auto-hébergez-le derrière votre propre authentification, épinglez une étiquette d'image plutôt que de suivre latest, et gardez un export de ce qui vous manquerait.
You built it. Now grow it.
AgentCeres is a managed AI marketing team — specialists draft the SEO, social, and outreach that fill your links, you approve what ships. 14-day free trial, from $39/month.