Test Googlebot : ce que Google reçoit de votre site suisse, JavaScript compris
Collez l’adresse d’une page publique. L’outil la charge avec l’agent utilisateur de Googlebot pour smartphone, exécute son JavaScript dans Chromium, puis met côte à côte le HTML reçu du serveur et le HTML obtenu après rendu. Sur un site en plusieurs langues, vous voyez la version servie à un robot qui n’a choisi ni le français, ni l’allemand, ni l’italien.
Rendu en cours…
Ce que le rapport contient
Un chargement complet de la page dans Chromium, avec le réseau, la console et une capture.
La réponse du serveur
Code HTTP, chaîne de redirections étape par étape, en-têtes qui comptent pour l’indexation comme X-Robots-Tag et Link, lecture du robots.txt pour Googlebot, et chronologie du chargement.
HTML brut contre HTML rendu
Title, meta description, meta robots, URL canonique, H1, nombre de H2, nombre de mots, liens internes et externes, images et attributs alt, JSON-LD, hreflang, langue déclarée. Chaque valeur que le JavaScript modifie est surlignée, et les liens qui n’existent qu’après rendu sont listés à part.
Ce que le navigateur a vu
Capture de la page en largeur mobile, ressources qui n’ont pas chargé avec leur statut ou le motif de l’échec, erreurs JavaScript remontées par la console, et les deux codes source consultables.
Les limites, dites avant que vous lanciez
L’outil simule Googlebot : même agent utilisateur, même famille de navigateur, mais les requêtes partent de notre serveur et non des adresses IP de Google. Un site qui vérifie l’origine réelle de Googlebot répondra donc autrement, souvent par un 403. Le rapport décrit ce qu’un robot obtient en chargeant la page. Pour savoir si elle figure dans l’index, la Search Console reste la référence. Seules les pages publiques en HTTP ou HTTPS, sur les ports standards, sont acceptées. L’outil ne clique sur rien, ne fait défiler aucun contenu, n’accepte aucun bandeau et ne choisit aucune langue. La capture s’arrête à 2 600 pixels de haut, chaque code source à un million de caractères, et le service est limité à huit inspections par heure et par connexion.
Un site suisse en plusieurs langues : la version que Googlebot reçoit
Googlebot n’envoie pas d’en-tête Accept-Language et explore le plus souvent depuis des adresses IP américaines. Il reçoit la version que votre site sert par défaut.
Redirection selon la langue du navigateur
Beaucoup de sites suisses envoient le visiteur vers /de/, /fr/ ou /it/ d’après la langue de son navigateur ou son adresse IP. Un robot qui n’annonce aucune de ces langues suit toujours la même branche. La chaîne de redirections du rapport montre laquelle. Si la racine renvoie systématiquement vers l’allemand, vos pages françaises ne sont découvertes que par les liens internes et les hreflang.
Hreflang posés par un script
Les annotations fr-CH, de-CH et it-CH sont parfois injectées par un gestionnaire de balises ou par le framework. Le rapport les compte dans le HTML brut et dans le HTML rendu. Zéro d’un côté et trois de l’autre : vos hreflang dépendent de la réussite du rendu, et les robots sans JavaScript ne les voient jamais.
Langue déclarée de la page
Un gabarit partagé entre les trois versions garde souvent le même attribut lang partout. Une page française déclarée de-CH brouille le signal envoyé aux moteurs et aux lecteurs d’écran. Inspectez une page par langue et comparez la ligne correspondante.
Pourquoi comparer le HTML brut et le HTML rendu
Le SEO JavaScript tient en une question : ce qui compte pour le référencement est-il déjà dans la réponse du serveur, ou seulement après l’exécution des scripts ?
Google rend les pages en deux temps
Googlebot lit d’abord le HTML renvoyé par le serveur, puis place la page en file d’attente pour la rendre avec Chromium. Les liens et le texte présents dès la première lecture sont découverts tout de suite. Ceux qui dépendent d’un script attendent le rendu, et manquent à l’appel si le script échoue ce jour-là.
Les assistants IA s’arrêtent au HTML brut
À ce jour, la plupart des robots qui alimentent les assistants IA récupèrent la réponse du serveur sans exécuter de script. Une page dont le contenu arrive entièrement par JavaScript leur apparaît vide. Le sujet touche la visibilité dans les réponses des IA autant que le référencement classique.
Une balise réécrite crée deux versions de la page
Un title, une canonique ou une meta robots que le JavaScript modifie après coup donne à Google deux lectures contradictoires. Un noindex présent dans le HTML brut est le cas le plus risqué : Google peut renoncer au rendu, et le script censé le retirer ne s’exécute jamais.
Une ressource bloquée dégrade le rendu sans bruit
Un fichier JavaScript interdit par le robots.txt, un bundle en 404 après une mise en production, une API qui refuse les robots : la page s’affiche chez vous grâce au cache, et reste incomplète pour un robot qui arrive à froid. La liste des ressources en échec sert à repérer ces cas.
Lire le rapport, dans l’ordre
Vérifier que la page est indexable
Code 200, aucune redirection inattendue, aucun noindex dans la meta robots ni dans l’en-tête X-Robots-Tag, adresse autorisée par le robots.txt, canonique qui pointe vers la page elle-même.
Contrôler la version linguistique servie
Regardez l’adresse finale, la langue déclarée et le nombre de hreflang. Répétez l’inspection sur une page de chaque langue : les trois rapports doivent raconter la même structure.
Mesurer la dépendance au JavaScript
Comparez le nombre de mots et de liens entre les deux colonnes. Un écart faible signale un rendu côté serveur solide. Un HTML brut presque vide signale une application rendue dans le navigateur, à traiter en priorité sur les pages qui doivent se positionner.
Corriger à la source, puis recontrôler
Rendu côté serveur, génération statique ou prérendu pour le contenu et les liens qui comptent, balises SEO et hreflang écrits dès la réponse du serveur. Relancez l’inspection après la mise en production : le cache de l’outil expire au bout de dix minutes.
Au-delà d’une page publique
La page que vous avez sous les yeux
Pour une page derrière un mot de passe, un site en préproduction ou un environnement local, là où un outil en ligne ne peut pas entrer. L’analyse porte sur la page telle que votre navigateur l’a rendue.
- Balises, titres et liens de la page rendue
- Liens brisés surlignés dans la page
- Données structurées JSON-LD
- Tout reste dans le navigateur
Tout un site
Une inspection porte sur une adresse. Pour savoir combien de pages répondent mal, redirigent ou pointent vers des liens morts dans chacune des langues, il faut parcourir le site entier.
- Statuts 4XX et 5XX, pages sans réponse
- Redirections, chaînes et boucles
- Liens internes et externes brisés
- Page source de chaque lien fautif
Pour contrôler les liens d’une seule page sans rien installer, le vérificateur de liens brisés fonctionne sur le même principe. À l’échelle du site, l’audit technique SEO lit le crawl complet. Et si le rapport révèle un chantier de rendu ou de structure linguistique à arbitrer, un consultant SEO et GEO en Suisse romande peut le cadrer avec votre équipe technique.
