Thomas Nedjar
Les applications
Outil gratuit

Test Googlebot : ce que Google reçoit de votre site suisse, JavaScript compris

Collez l’adresse d’une page publique. L’outil la charge avec l’agent utilisateur de Googlebot pour smartphone, exécute son JavaScript dans Chromium, puis met côte à côte le HTML reçu du serveur et le HTML obtenu après rendu. Sur un site en plusieurs langues, vous voyez la version servie à un robot qui n’a choisi ni le français, ni l’allemand, ni l’italien.

Sans inscription et sans adresse e-mail. Comptez 10 à 30 secondes, le temps de charger la page dans un vrai navigateur.

Périmètre

Ce que le rapport contient

Un chargement complet de la page dans Chromium, avec le réseau, la console et une capture.

La réponse du serveur

Avant tout rendu

Code HTTP, chaîne de redirections étape par étape, en-têtes qui comptent pour l’indexation comme X-Robots-Tag et Link, lecture du robots.txt pour Googlebot, et chronologie du chargement.

HTML brut contre HTML rendu

13 signaux comparés

Title, meta description, meta robots, URL canonique, H1, nombre de H2, nombre de mots, liens internes et externes, images et attributs alt, JSON-LD, hreflang, langue déclarée. Chaque valeur que le JavaScript modifie est surlignée, et les liens qui n’existent qu’après rendu sont listés à part.

Ce que le navigateur a vu

Capture, réseau, console

Capture de la page en largeur mobile, ressources qui n’ont pas chargé avec leur statut ou le motif de l’échec, erreurs JavaScript remontées par la console, et les deux codes source consultables.

Les limites, dites avant que vous lanciez

L’outil simule Googlebot : même agent utilisateur, même famille de navigateur, mais les requêtes partent de notre serveur et non des adresses IP de Google. Un site qui vérifie l’origine réelle de Googlebot répondra donc autrement, souvent par un 403. Le rapport décrit ce qu’un robot obtient en chargeant la page. Pour savoir si elle figure dans l’index, la Search Console reste la référence. Seules les pages publiques en HTTP ou HTTPS, sur les ports standards, sont acceptées. L’outil ne clique sur rien, ne fait défiler aucun contenu, n’accepte aucun bandeau et ne choisit aucune langue. La capture s’arrête à 2 600 pixels de haut, chaque code source à un million de caractères, et le service est limité à huit inspections par heure et par connexion.

Sites multilingues

Un site suisse en plusieurs langues : la version que Googlebot reçoit

Googlebot n’envoie pas d’en-tête Accept-Language et explore le plus souvent depuis des adresses IP américaines. Il reçoit la version que votre site sert par défaut.

Redirection selon la langue du navigateur

À lire dans « Réponse du serveur »

Beaucoup de sites suisses envoient le visiteur vers /de/, /fr/ ou /it/ d’après la langue de son navigateur ou son adresse IP. Un robot qui n’annonce aucune de ces langues suit toujours la même branche. La chaîne de redirections du rapport montre laquelle. Si la racine renvoie systématiquement vers l’allemand, vos pages françaises ne sont découvertes que par les liens internes et les hreflang.

Hreflang posés par un script

Ligne « Balises hreflang »

Les annotations fr-CH, de-CH et it-CH sont parfois injectées par un gestionnaire de balises ou par le framework. Le rapport les compte dans le HTML brut et dans le HTML rendu. Zéro d’un côté et trois de l’autre : vos hreflang dépendent de la réussite du rendu, et les robots sans JavaScript ne les voient jamais.

Langue déclarée de la page

Ligne « Langue déclarée »

Un gabarit partagé entre les trois versions garde souvent le même attribut lang partout. Une page française déclarée de-CH brouille le signal envoyé aux moteurs et aux lecteurs d’écran. Inspectez une page par langue et comparez la ligne correspondante.

SEO JavaScript

Pourquoi comparer le HTML brut et le HTML rendu

Le SEO JavaScript tient en une question : ce qui compte pour le référencement est-il déjà dans la réponse du serveur, ou seulement après l’exécution des scripts ?

Google rend les pages en deux temps

Googlebot lit d’abord le HTML renvoyé par le serveur, puis place la page en file d’attente pour la rendre avec Chromium. Les liens et le texte présents dès la première lecture sont découverts tout de suite. Ceux qui dépendent d’un script attendent le rendu, et manquent à l’appel si le script échoue ce jour-là.

Les assistants IA s’arrêtent au HTML brut

À ce jour, la plupart des robots qui alimentent les assistants IA récupèrent la réponse du serveur sans exécuter de script. Une page dont le contenu arrive entièrement par JavaScript leur apparaît vide. Le sujet touche la visibilité dans les réponses des IA autant que le référencement classique.

Une balise réécrite crée deux versions de la page

Un title, une canonique ou une meta robots que le JavaScript modifie après coup donne à Google deux lectures contradictoires. Un noindex présent dans le HTML brut est le cas le plus risqué : Google peut renoncer au rendu, et le script censé le retirer ne s’exécute jamais.

Une ressource bloquée dégrade le rendu sans bruit

Un fichier JavaScript interdit par le robots.txt, un bundle en 404 après une mise en production, une API qui refuse les robots : la page s’affiche chez vous grâce au cache, et reste incomplète pour un robot qui arrive à froid. La liste des ressources en échec sert à repérer ces cas.

Méthode

Lire le rapport, dans l’ordre

1

Vérifier que la page est indexable

Code 200, aucune redirection inattendue, aucun noindex dans la meta robots ni dans l’en-tête X-Robots-Tag, adresse autorisée par le robots.txt, canonique qui pointe vers la page elle-même.

2

Contrôler la version linguistique servie

Regardez l’adresse finale, la langue déclarée et le nombre de hreflang. Répétez l’inspection sur une page de chaque langue : les trois rapports doivent raconter la même structure.

3

Mesurer la dépendance au JavaScript

Comparez le nombre de mots et de liens entre les deux colonnes. Un écart faible signale un rendu côté serveur solide. Un HTML brut presque vide signale une application rendue dans le navigateur, à traiter en priorité sur les pages qui doivent se positionner.

4

Corriger à la source, puis recontrôler

Rendu côté serveur, génération statique ou prérendu pour le contenu et les liens qui comptent, balises SEO et hreflang écrits dès la réponse du serveur. Relancez l’inspection après la mise en production : le cache de l’outil expire au bout de dix minutes.

Aller plus loin

Au-delà d’une page publique

La page que vous avez sous les yeux

Extension Chrome · gratuite, sans compte

Pour une page derrière un mot de passe, un site en préproduction ou un environnement local, là où un outil en ligne ne peut pas entrer. L’analyse porte sur la page telle que votre navigateur l’a rendue.

  • Balises, titres et liens de la page rendue
  • Liens brisés surlignés dans la page
  • Données structurées JSON-LD
  • Tout reste dans le navigateur
Installer l’extension

Tout un site

Crawler desktop · gratuit jusqu’à 500 URL par site

Une inspection porte sur une adresse. Pour savoir combien de pages répondent mal, redirigent ou pointent vers des liens morts dans chacune des langues, il faut parcourir le site entier.

  • Statuts 4XX et 5XX, pages sans réponse
  • Redirections, chaînes et boucles
  • Liens internes et externes brisés
  • Page source de chaque lien fautif
Découvrir le crawler

Pour contrôler les liens d’une seule page sans rien installer, le vérificateur de liens brisés fonctionne sur le même principe. À l’échelle du site, l’audit technique SEO lit le crawl complet. Et si le rapport révèle un chantier de rendu ou de structure linguistique à arbitrer, un consultant SEO et GEO en Suisse romande peut le cadrer avec votre équipe technique.

FAQ

Questions fréquentes

Comment tester une page comme Googlebot ?
Collez son adresse dans le formulaire en haut de cette page et gardez l’agent utilisateur « Googlebot pour smartphone ». L’outil charge la page dans Chromium, exécute son JavaScript, puis affiche le HTML reçu du serveur à côté du HTML rendu, avec une capture, les ressources qui n’ont pas chargé et les erreurs de la console.
Mon site redirige selon la langue du navigateur : que voit Googlebot ?
Googlebot n’envoie pas d’en-tête Accept-Language et explore surtout depuis des adresses IP américaines. Il reçoit donc la version servie par défaut. Google recommande de ne pas rediriger automatiquement selon la langue, de donner une adresse distincte à chaque version et de les relier par des annotations hreflang. Le rapport montre la chaîne de redirections suivie et la langue déclarée de la page obtenue.
Quelle différence avec l’inspection d’URL de la Search Console ?
L’inspection d’URL de la Search Console reste la référence pour vos propres sites : elle seule dit si une page est dans l’index et ce que Google en a retenu. Elle exige une propriété validée. Cet outil fonctionne sur n’importe quelle page publique, y compris celle d’un concurrent ou d’un client dont vous n’avez pas encore les accès, et il met le HTML brut et le HTML rendu côte à côte.
Google exécute-t-il le JavaScript ?
Oui. Googlebot rend les pages avec une version récente de Chromium. Le rendu est une étape séparée de l’exploration : la page est d’abord lue telle que le serveur la renvoie, puis placée en file d’attente pour être rendue. Un contenu présent dès le HTML brut est donc pris en compte plus tôt et avec moins d’aléas qu’un contenu injecté par script.
Pourquoi le résultat diffère-t-il de ce que je vois dans mon navigateur ?
L’outil arrive sans cookies, sans session et sans historique, en largeur mobile de 412 pixels, et il ne clique sur rien. Un bandeau de consentement, un contenu réservé aux visiteurs connectés, une redirection selon le pays ou la langue, un bloc qui ne s’ouvre qu’au clic expliquent la plupart des écarts. Googlebot se comporte de la même façon sur ces points.
La page répond 403 à l’outil, que faire ?
Beaucoup de pare-feu vérifient qu’une requête signée Googlebot vient bien des adresses IP de Google, et refusent les autres. C’est une protection saine. Relancez l’inspection avec l’agent utilisateur « Chrome sur mobile » : le rendu JavaScript sera le même, seule la signature de la requête change.
Les assistants IA lisent-ils le contenu chargé en JavaScript ?
À ce jour, les robots qui alimentent les assistants IA récupèrent pour la plupart le HTML brut et n’exécutent aucun script. Un texte qui n’existe qu’après rendu leur échappe. La colonne « HTML brut » du rapport montre ce qu’ils reçoivent.
L’outil garde-t-il les adresses inspectées ?
Le résultat reste dix minutes en cache pour éviter de rendre deux fois la même page, puis il est effacé. Aucun historique des adresses n’est tenu. Une limite de huit inspections par heure et par connexion protège le serveur.
France
Suisse