4/5

À quoi correspond le code Google 410 ?

410 error google

Tout le monde connaît la fort désagréable erreur 404. De son côté, le code 410 est un peu plus rare l’on ne va pas toujours jusqu’à chercher la différence. Il est vrai que lorsqu’on applique rigoureusement le principe de Pareto, l’on a tendance à se dire qu’un simple message d’erreur aura peu d’influence sur la notoriété d’un site. Encore moins sur son référencement…

Toutefois, la différence entre le bon et l’excellent se mesure dans les détails. Si l’on garde à l’esprit que le SEO – et même SXO – fonctionne selon les lois de la concurrence, vient un moment où le plus petit des leviers compte.

Ainsi, quoi qu’on en dise, surveiller les codes de statut transmis dans les réponses à une demande URL demeure une pratique saine. Et nous allons voir pourquoi, avec l’exemple du code 410.

Signification du code d’erreur 410 “Gone”

Selon les termes de cette image, la définition devient on ne peut plus limpide. Le code 410 est la réponse renvoyée par le serveur lorsqu’une URL demandée a été supprimée volontairement et définitivement. Précision importante, et nous y reviendrons : ce code voyage dans l’en-tête HTTP de la réponse. Le navigateur et le robot d’exploration le lisent ; l’internaute, lui, ne le voit jamais.

Différences avec l’erreur 404 « not found »

Elle a beau être minime, elle apporte une tout autre signification à l’impasse virtuelle dans laquelle s’est engagé l’utilisateur ou le bot du moteur de recherche. La norme qui régit le protocole HTTP, la RFC 9110, est claire sur ce point. Le code 404 signifie simplement que le serveur n’a trouvé aucune ressource correspondant à l’URL demandée : il ne dit pas si cette absence est temporaire ou permanente, ni si la page a existé un jour. C’est une réponse volontairement neutre, qui laisse la question ouverte.

Le code 410 ajoute une seule information à cela : l’absence est probablement permanente et intentionnelle. Rien de plus. Tout l’écart entre les deux tient dans ce renseignement supplémentaire, et il s’adresse exclusivement aux machines.

Point de vue expérience utilisateur : l’internaute ne voit jamais le code

google 410

C’est le point que l’on lit le plus souvent de travers, alors autant l’énoncer sans détour : un 404 et un 410 servent exactement la même page d’erreur. Même titre, même message, même design. Sauf à ouvrir l’onglet Réseau des outils de développement de son navigateur, rien à l’écran ne permet de distinguer les deux. Le code de statut est un signal destiné aux machines – navigateurs, robots d’exploration, proxies, crawlers – et à elles seules.

Mettons que vous vous rendiez dans une rue où se trouve soi-disant une boulangerie-pâtisserie dont on vous a vanté les mérites. Mais en arrivant à l’adresse indiquée, vous tombez sur des locaux vides, sans aucun panneau. D’où provient l’erreur ? Du numéro de rue ? Du nom de rue ?

Peut-être l’établissement a-t-il emménagé plus loin, et vous avez manqué la bonne indication en arrivant ? En un mot, vous êtes “désorienté(e)”. Remarquez alors qu’avec un simple panneau indiquant la fermeture définitive de la boutique – et, mieux encore, l’adresse du nouveau local – vous seriez d’un coup délivré(e) de vos doutes.

Ce panneau, c’est le contenu de votre page d’erreur, pas le code renvoyé dans l’en-tête. Que le serveur réponde 404 ou 410, c’est le texte affiché qui fait toute l’expérience utilisateur : un message compréhensible, un lien vers l’accueil, un moteur de recherche interne, quelques suggestions de pages proches. Le code, lui, ne change strictement rien à ce que voit le visiteur.

Point de vue algorithme Google

Côté robots, en revanche, le code est la seule chose qui compte. Et la documentation actuelle de Google sur les erreurs HTTP est sans ambiguïté : tous les codes 4xx sont traités de la même façon – 401, 403, 404 et 410 compris – à une seule exception près, le 429 (Too Many Requests). Le 429 est le seul que Googlebot interprète comme un incident temporaire, qui le pousse à ralentir puis à revenir. L’idée répandue selon laquelle un 404 « ferait temporaire » au même titre qu’un 401 ou un 403 n’est plus d’actualité.

L’erreur 410 est, elle, interprétée d’emblée comme un choix délibéré de l’administrateur du serveur : la ressource est déclarée définitivement partie. C’est un signal plus explicite, mais ce n’est ni un ordre de suppression immédiate, ni une décision irréversible : rien ne vous empêche de remplacer plus tard ce 410 par une redirection 301 vers une page équivalente, si vous republiez un contenu comparable ou si l’URL se met à recevoir des liens.

Cela étant, dans sa vidéo explicative du 14 avril 2014, Matt Cutts souligne que les deux cas feront toujours l’objet d’une seconde vérification. Attention au contresens classique sur cette vidéo : la fenêtre de 24 heures qu’il évoque est une protection dans le système de crawl, pas un maintien de la page dans l’index. Google se laisse simplement un délai avant de considérer l’erreur comme confirmée, pour ne pas réagir à une panne passagère.

Dans les faits, aucun des deux codes ne fait disparaître une URL des résultats en 24 heures. La désindexation intervient après un nouveau passage du robot sur l’URL, soit quelques jours à quelques semaines dans les deux cas, selon la fréquence de crawl de la page. En réalité, le robot ne fait donc qu’une moindre différence entre les deux cas de figure. Reste une question qui inquiète beaucoup de webmasters : et si ces pages disparues finissaient par nuire au site ?

Beaucoup de pages 404 et 410 : faut-il s’en inquiéter ?

google 410

Il vous est probablement déjà arrivé de tomber sur un lien menant vers un article type “bon plan” et de vous heurter à une page qui n’existe plus, signe que la promotion est tout bonnement terminée. Ce n’est pas très grave, mais vous n’allez pas vous attarder. Retour à la case départ.

Commençons par désamorcer l’inquiétude la plus répandue : Google ne pénalise pas un site parce qu’il renvoie beaucoup de 404 ou de 410. Ces codes ne sont pas un signal de qualité et n’entrent dans aucun classement ; ils font partie du fonctionnement normal du web, où les pages naissent et meurent. Ils ne gaspillent pas non plus votre budget de crawl : une réponse 404 ou 410 est extrêmement légère à servir, et Googlebot espace de lui-même ses passages sur les URL qu’il sait mortes.

Le seul véritable enjeu est ailleurs : la perte de link equity. Une URL qui recevait des backlinks et qui bascule en 404 ou en 410 cesse de transmettre leur valeur au reste du site. Dès lors, comment vous y prendre avec autant de backlinks gaspillés sur des URL erronées ? C’est sur ces URL-là, et sur elles seules, que se joue l’arbitrage entre supprimer et rediriger.

Les bonnes pratiques

Pour repérer ces URL, vous pouvez vous servir de Google Search Console. Encore faut-il savoir ce qu’elle vous donne exactement. Le rapport concerné s’appelle « Indexation des pages » depuis 2023 (l’ancien rapport « Couverture » n’existe plus sous ce nom), et il ne répertorie pas l’ensemble de vos URL erronées : il affiche un échantillon des URL connues de Google, avec un export plafonné à 1 000 lignes par catégorie.

Ne comptez pas non plus sur elle pour séparer vos 404 de vos 410 : la Search Console regroupe les deux codes sous un unique libellé « Introuvable (404) ». Pour savoir ce que votre serveur renvoie réellement, URL par URL, il faut passer par un crawler (Screaming Frog, Sitebulb) ou par vos logs serveur.

Si vous aviez prévu un nettoyage de printemps, c’est le moment de traiter ces URL. Mais si vous devez en corriger plusieurs milliers, peut-être faudra-t-il procéder à d’autres types de corrections, faciles mais relativement chronophages :

rediriger en priorité les pages vers lesquelles pointent des liens externes (vive le code 301), vers un contenu réellement équivalent ;

– supprimer ou remanier les liens internes qui pointent encore vers ces URL ;

préférer une balise noindex quand la page doit rester accessible aux visiteurs mais n’a rien à faire dans l’index (filtres, pages de tri, contenus obsolètes encore utiles) : supprimer n’est pas la seule option ;

customiser les pages d’erreur (du moins si vous en avez le temps) : en plus de fournir des renseignements plus complets, vous augmentez le capital sympathie de votre site internet. Attention, cependant : ce genre de modification n’affecte en rien le comportement du robot, que ce soit positivement ou négativement.

Comment renvoyer un vrai code 410 (et les pièges à éviter)

Passons à la pratique. Renvoyer un 410 ne demande, dans la plupart des cas, qu’une ligne de configuration.

Apache (fichier .htaccess)

# Une URL précise
Redirect gone /ma-page

# Un ensemble d'URL, par expression régulière
RedirectMatch gone "^/promos/.*$"

La directive Redirect gone est l’équivalent lisible de Redirect 410 : malgré son nom, elle ne redirige nulle part, elle déclare la ressource disparue.

nginx

# Une URL précise
location = /ma-page { return 410; }

# Un répertoire entier
location ^~ /promos/ { return 410; }

WordPress, sans toucher au serveur

Si vous n’avez pas la main sur la configuration serveur, le hook template_redirect fait le travail depuis le fichier functions.php de votre thème enfant (ou un plugin maison) :

add_action( 'template_redirect', function () {

    $urls_supprimees = array(
        '/ma-page/',
        '/promos/soldes-2021/',
    );

    $chemin = parse_url( $_SERVER['REQUEST_URI'], PHP_URL_PATH );

    if ( in_array( $chemin, $urls_supprimees, true ) ) {
        status_header( 410 );
        nocache_headers();
        wp_die(
            'Cette page a été supprimée définitivement.',
            '410 Gone',
            array( 'response' => 410 )
        );
    }

} );

La plupart des extensions de redirection (Redirection, Rank Math, Yoast Premium) proposent le même résultat via une interface, en choisissant le statut 410 au lieu de 301.

Piège n° 1 : la page d’erreur qui répond 200 (soft 404)

C’est de loin l’erreur la plus fréquente. Une page affiche un joli message « page introuvable » à l’écran, mais le serveur, lui, renvoie un code 200 dans l’en-tête. Pour Google, c’est un soft 404 : une page qui dit « il n’y a rien ici » tout en prétendant que tout va bien.

Et celui-là, contrairement aux vraies 404 et 410, gaspille bel et bien du budget de crawl : Googlebot doit charger la page entière, puis analyser son contenu pour deviner qu’elle est vide, et il continue de repasser dessus comme sur n’importe quelle page valide. Vérifiez toujours le code réellement renvoyé – curl -I https://votre-site.fr/ma-page ou l’outil d’inspection d’URL de la Search Console – plutôt que ce qui s’affiche à l’écran.

Piège n° 2 : bloquer les URL supprimées dans le robots.txt

Le réflexe paraît logique : la page n’existe plus, autant interdire son exploration. C’est exactement l’inverse qu’il faut faire. Une URL bloquée dans le robots.txt ne sera jamais crawlée, donc votre 410 ne sera jamais vu – et l’URL peut rester affichée dans les résultats de recherche pendant des mois. Pour qu’un code de statut soit pris en compte, il faut que le robot puisse aller le lire. Laissez ces URL accessibles au crawl.

L’outil de suppression de la Search Console

Vous avez une URL urgente à retirer des résultats ? L’outil « Suppressions » de la Search Console la masque en quelques heures. Mais il s’agit d’un masquage temporaire, d’environ 6 mois : passé ce délai, l’URL réapparaît si le serveur répond toujours 200. C’est donc un pansement, à combiner systématiquement avec un vrai 410 (ou 404) côté serveur, seul capable de produire une désindexation durable.

Ce qu’on retient du code d’erreur http 410

google 410

Si on le compare régulièrement à l’erreur 404, c’est probablement à cause du fait que ces deux codes interviennent dans des situations relativement similaires. Mais la différence ne se joue pas du côté du visiteur, qui voit la même page d’erreur dans les deux cas : elle se joue du côté des machines. Le 410 dit explicitement au moteur que la suppression est volontaire et permanente, là où le 404 laisse la question ouverte. Un signal un peu plus net, pas un levier de référencement.

Certes, on ne vous recommande pas de mettre votre site sens dessus dessous juste pour adapter tous les messages d’erreur à l’URL correspondante. En revanche, si vous envisagiez déjà de mettre un coup de propre, c’est l’occasion de vous y mettre.

Enfin, n’oubliez pas de garder un œil sur vos backlinks, et de les exploiter au maximum, plutôt que de supprimer trop de contenus.

Vos questions, nos réponses !

Pourquoi choisir entre 404 et 410 ?

error 410 vs 404 C’est une question d’indexation, pas d’expérience utilisateur. L’internaute ne voit jamais le code de statut : la page d’erreur affichée est rigoureusement la même dans les deux cas. Le choix ne s’adresse qu’aux robots.

Et même de ce côté-là, l’écart reste modeste : les robots traiteront les deux types d’erreurs quasiment de la même façon, avec le même degré de vérification. Le 410 apporte simplement une information de plus – la suppression est intentionnelle et définitive – ce qui peut accélérer légèrement la désindexation. Quant à rassurer l’internaute, cela ne passe pas par le code mais par le contenu de la page d’erreur : un message clair, un lien vers l’accueil, quelques suggestions.

Où rediriger un backlink qui pointe vers une de mes pages 410 ?

Le mieux est de choisir une page web avec du contenu similaire à ce qui a été supprimé. Cependant, si l’URL n’a que peu d’impact sur votre SEO, vous pouvez toujours tenter un pas de côté, et assurer une redirection sur une ressource qui pourrait malgré tout intéresser le persona. C’est plus risqué : mieux vaut parfois s’en tenir au code 410 que de s’adonner à du netlinking forcé. Rappelez-vous que rien n’est figé : un 410 posé aujourd’hui peut être remplacé demain par une 301, le jour où vous publiez un contenu de remplacement digne de ce nom.

Quand soigner sa page d’erreur ?

Dès qu’elle reçoit du trafic. Puisque c’est le contenu de la page d’erreur – et non le code renvoyé – qui fait l’expérience utilisateur, un message qui met les formes, avec un lien vers l’accueil et quelques suggestions, donnera envie à l’utilisateur de rester sur votre site. En revanche, n’en attendez aucun gain de référencement : personnaliser une page d’erreur ne change rien au comportement du robot.

Une seule règle technique à ne jamais oublier : votre page d’erreur personnalisée doit continuer à renvoyer un code 404 ou 410, jamais un 200, sous peine de basculer en soft 404. Pour l’aspect technique, voici un point de départ pour enrichir la patte de votre site web !