Le SEO technique consiste à faire en sorte que Google puisse découvrir, explorer, afficher et indexer les pages qui comptent pour votre activité, et seulement celles-là. C’est la fondation du référencement : un contenu excellent ne se classe pas si Googlebot ne le voit pas, et des liens de qualité perdent leur effet s’ils pointent vers des pages dupliquées. Chez SEORank, nous ne nous contentons pas de recommander : les développeurs de Novatis Agency corrigent eux-mêmes le code, les gabarits et la configuration du serveur.
La plupart des sites que nous analysons n’ont pas un problème technique « général ». Ils en ont deux ou trois, très précis, qui expliquent l’essentiel du manque à gagner : des filtres qui génèrent des milliers de pages inutiles, une balise canonical mal configurée, un menu que Google ne lit pas. Le travail consiste à les trouver vite et à les corriger proprement.
Comment Google traite votre site, étape par étape
Pour comprendre d’où vient un problème de SEO technique, il faut suivre le parcours d’une URL chez Google. Chaque étape a ses symptômes et ses leviers :
| Étape côté Google | La question à se poser | Symptômes dans la Search Console | Leviers techniques |
|---|---|---|---|
| Découverte | Google connaît-il l’existence de mes pages ? | Pages absentes des rapports, « Détectée, actuellement non indexée » | Liens internes en <a href>, sitemap XML propre, profondeur de clic réduite |
| Exploration | Googlebot peut-il télécharger la page sans erreur ? | Erreurs 5xx, 404, bloquée par robots.txt, temps de réponse élevé | Hébergement, règles robots.txt, redirections, pagination |
| Rendu | Le contenu et les liens existent-ils après exécution du JavaScript ? | HTML rendu vide ou partiel dans l’inspection d’URL | Rendu côté serveur, pré-rendu, suppression des dépendances bloquantes |
| Indexation | La page est-elle jugée unique et utile ? | « Explorée, actuellement non indexée », doublons, soft 404 | Canonical, noindex, fusion de pages, contenu différenciant |
| Affichage | La page peut-elle obtenir un résultat enrichi et un bon extrait ? | Rapports Améliorations, erreurs de données structurées | JSON-LD conforme, balises title et meta description, images |
Cette lecture évite les faux diagnostics. Une page « Explorée, actuellement non indexée » n’a pas un problème d’exploration : Google l’a vue et a choisi de ne pas l’indexer. La réponse est alors souvent éditoriale (page trop proche d’une autre, trop pauvre) plutôt que technique.
Exploration : robots.txt, sitemaps et budget de crawl
Le fichier robots.txt indique aux robots ce qu’ils peuvent explorer. Il est souvent mal utilisé pour « cacher » des pages. Or Google rappelle qu’une URL bloquée par le robots.txt peut quand même apparaître dans les résultats : pour exclure une page de l’index, il faut une instruction noindex, une protection par mot de passe ou sa suppression. Nous vérifions donc que chaque règle du robots.txt a une raison d’être et qu’elle ne bloque ni des ressources nécessaires au rendu (CSS, JavaScript) ni des pages que vous voulez voir classées.
Le sitemap XML, lui, doit contenir uniquement des URL canoniques, indexables et répondant en 200. Un sitemap qui liste des redirections ou des pages en noindex envoie des signaux contradictoires. Google précise dans son guide des sitemaps qu’ils sont surtout utiles aux grands sites, aux sites récents peu liés et aux contenus riches en médias.
Quant au budget de crawl, sujet très discuté, Google réserve ses recommandations sur la gestion du budget d’exploration aux sites de plus d’un million de pages, à ceux de plus de 10 000 pages modifiées quotidiennement et à ceux qui accumulent des URL détectées mais non indexées. Pour un site de 300 pages, parler de budget de crawl est généralement hors sujet ; pour un catalogue PrestaShop avec des facettes ouvertes, c’est au contraire la priorité.
Indexation : canonical, noindex, doublons et soft 404
Un même contenu accessible par plusieurs URL (paramètres de tri, versions avec ou sans barre oblique finale, déclinaisons de produits) oblige Google à choisir une version. Il le fait en combinant plusieurs signaux, décrits dans sa page sur le choix de l’URL canonique : redirections, balise rel="canonical", présence dans le sitemap, liens internes. Quand ces signaux se contredisent, Google peut retenir une URL que vous n’auriez pas choisie.
Nous contrôlons aussi les « soft 404 » : des pages qui répondent 200 mais affichent un contenu vide ou un message d’erreur. Google les traite comme des erreurs, comme l’explique sa documentation sur les codes HTTP et erreurs réseau. Les causes typiques : catégories sans produit, résultats de recherche interne vides, fiches de produits épuisés vidées de leur contenu.
- Une seule URL indexable par contenu, désignée de façon cohérente par tous les signaux.
- Balise noindex uniquement sur des pages non bloquées dans le robots.txt, sinon Google ne la lit pas.
- Produits épuisés : page conservée avec alternatives si le produit revient, redirection vers le plus proche équivalent sinon.
- Pages de recherche interne et combinaisons de filtres sans demande exclues de l’index.
Rendu JavaScript : ce que Googlebot voit vraiment
Google traite les pages JavaScript en trois phases : exploration, rendu dans un Chromium sans interface, puis indexation du HTML rendu. Sa documentation sur les principes de base du SEO JavaScript recommande toujours le rendu côté serveur ou le pré-rendu, des liens en balises <a href> et un routage par URL réelles. En pratique, nous comparons pour chaque gabarit le HTML initial et le HTML rendu : si le texte principal, les liens du menu ou les balises title n’existent qu’après exécution du script, le risque est réel. C’est particulièrement vrai des configurateurs, des filtres en AJAX et des sites construits comme des applications.
Architecture, profondeur de clic et maillage interne
Plus une page est éloignée de l’accueil, moins elle reçoit de liens internes et moins elle est explorée. Nous mesurons la profondeur de chaque gabarit et la distribution des liens internes. Une règle pratique : les pages qui portent votre chiffre d’affaires devraient être accessibles en trois clics au plus. Nous vérifions aussi les ancres utilisées : un lien « cliquez ici » n’apprend rien à Google sur la page cible. La méthode détaillée figure dans notre guide du maillage interne, et le travail de fond sur l’organisation des thèmes relève de la stratégie de contenu SEO.
Vitesse et Core Web Vitals
La vitesse perçue fait partie du SEO technique, mais c’est un chantier à part entière avec ses propres métriques (LCP, INP, CLS), ses outils et ses arbitrages avec le marketing. Nous la traitons dans une prestation dédiée d’optimisation des Core Web Vitals. Dans le cadre du SEO technique, nous repérons surtout les causes structurelles : temps de réponse du serveur, gabarits trop lourds, scripts tiers chargés sur toutes les pages.
Données structurées et résultats enrichis
Les données structurées aident Google à comprendre la nature d’une page (organisation, produit, article, fil d’Ariane, FAQ) et la rendent éligible à certains affichages enrichis. Google recommande le format JSON-LD, le plus simple à maintenir à grande échelle. Notre règle : un balisage complet et exact vaut mieux qu’un balisage exhaustif et approximatif. Nous intégrons le JSON-LD dans les gabarits, puis le testons avec l’outil de test des résultats enrichis. Les données doivent correspondre à ce que voit l’internaute : un prix ou une note présents dans le balisage mais absents de la page constituent une infraction aux consignes.
Mobile first, international et hreflang
Google utilise la version mobile d’un site pour l’indexation et le classement. Un contenu masqué sur mobile, des données structurées présentes seulement sur la version ordinateur ou des images différentes peuvent donc coûter des positions. Nous contrôlons cette parité gabarit par gabarit.
Pour les sites en plusieurs langues ou pays, les balises hreflang doivent être réciproques : chaque version pointe vers toutes les autres et vers elle-même, comme l’exige la documentation sur les versions localisées d’une page. C’est l’une des erreurs les plus fréquentes que nous rencontrons. La stratégie par marché est ensuite traitée par notre équipe de SEO international.
Codes HTTP, redirections, HTTPS et sécurité
Nous vérifions que chaque URL renvoie le bon code : 200 pour une page valide, 301 pour un déplacement définitif, 404 ou 410 pour une page supprimée sans équivalent. Les chaînes de redirections (A vers B vers C) et les boucles sont raccourcies pour pointer directement vers la destination finale. Côté sécurité, un site piraté (pages de spam injectées, redirections vers des sites douteux) peut disparaître des résultats : le rapport « Problèmes de sécurité » de la Search Console fait partie de nos contrôles, et si le mal est fait, notre accompagnement en cas de pénalité Google couvre le nettoyage et la demande de réexamen.
Priorités techniques selon votre CMS
Chaque plateforme a ses pièges récurrents. Voici ceux que nous rencontrons le plus souvent et ce que nous traitons d’abord :
| CMS | Pièges techniques fréquents | Ce que nous corrigeons en priorité |
|---|---|---|
| WordPress / WooCommerce | Pages d’archives, d’auteurs et d’étiquettes indexées, extensions qui ajoutent du JavaScript partout, pagination des commentaires | Règles d’indexation des taxonomies, allègement des extensions, gabarits de catégories |
| PrestaShop | Déclinaisons et filtres qui génèrent des milliers d’URL, pages de recherche interne indexées, doublons de fiches entre catégories | Canonical des déclinaisons, gestion des facettes, URL de catégorie par défaut |
| Shopify | URL de produits dupliquées sous /collections/…/products/, balisage du thème incomplet, applications qui alourdissent le rendu | Liens internes vers l’URL canonique, balisage Product, tri des applications |
| Laravel / Symfony / sur mesure | Routes qui renvoient 200 sur des pages vides, absence de sitemap, entêtes HTTP mal configurés | Codes de réponse, génération du sitemap, balises et données structurées dans les templates |
| Application JavaScript (React, Vue) | Contenu et liens visibles seulement après rendu, routage par fragments # | Rendu côté serveur ou pré-rendu, routage avec l’API History, vérification du HTML rendu |
Pour aller plus loin sur une plateforme donnée : SEO WordPress, SEO PrestaShop, SEO Shopify et, pour les catalogues en général, notre expertise SEO e-commerce.
Notre méthode : du diagnostic au correctif en production
Crawl comparé
Nous explorons le site comme Googlebot smartphone, avec rendu JavaScript, puis comparons avec le sitemap et les URL connues de la Search Console.
Qualification
Chaque anomalie est classée : bloquante (des pages rentables sont invisibles), pénalisante (elles sont affaiblies) ou mineure.
Tickets développeur
Un ticket par correctif, avec le gabarit concerné, l’exemple d’URL, le comportement attendu et le test de validation.
Correction par nos développeurs
Nos développeurs internes appliquent les correctifs sur votre CMS, en préproduction quand elle existe, ou coordonnent votre prestataire.
Recette SEO
Nouveau crawl ciblé, inspection d’URL et test des résultats enrichis avant la mise en production.
Suivi de l’indexation
Nous surveillons les rapports d’indexation et de statistiques d’exploration pendant plusieurs semaines pour confirmer l’effet.
Budget et délais
Le diagnostic complet fait partie de notre audit SEO, qui démarre dès 690 € HT. Les correctifs sont ensuite chiffrés en temps de développement sur votre CMS : certains prennent une heure (retirer un noindex, corriger un robots.txt), d’autres plusieurs jours (refondre la gestion des facettes, passer une application au rendu côté serveur). Dans nos formules mensuelles, à partir du pack Essentiel à 490 € HT par mois, les corrections techniques prioritaires sont incluses ; les chantiers lourds font l’objet d’un devis séparé. Tous les montants sont sur la page tarifs.
Côté délais, un correctif simple sur des pages souvent explorées peut produire un effet visible en quelques jours. Un nettoyage de milliers d’URL ou une nouvelle architecture se mesure plutôt sur plusieurs semaines, au rythme où Google réexplore le site. Nous suivons cette progression dans le rapport « Statistiques sur l’exploration » et le rapport d’indexation, puis nous la reportons dans votre reporting SEO mensuel.
Erreurs fréquentes et ce que nous refusons
- Corriger ce que l’outil colore en rouge sans vérifier l’impact : on passe des jours sur des alertes sans effet.
- Bloquer dans le robots.txt une page qu’on veut désindexer : Google ne voit plus le noindex, l’URL reste.
- Mettre en production sans recette SEO : une mise à jour de thème qui ajoute un noindex global arrive plus souvent qu’on ne le croit.
- Empiler des extensions « SEO » qui se contredisent sur les balises canonical ou les sitemaps.
- Refondre le site sans plan de redirections : c’est le chantier de la migration SEO, à préparer des mois avant.
Nous refusons les « optimisations » cosmétiques facturées comme des chantiers, les promesses de positions et les modifications en production sans sauvegarde ni validation. Si votre site a besoin d’un regard technique, décrivez-nous votre contexte : un consultant et un développeur vous répondent sous 24 heures ouvrées.