Une baisse de trafic peut laisser peu de traces visibles dans votre tableau de bord SEO. Sans journaux de serveur, votre équipe ignore parfois quelles pages Googlebot a consultées avant l’incident.
Le problème dépasse le choix d’un outil : il concerne la durée de conservation, l’accès aux fichiers et la confidentialité des données visiteurs.
En bref : les données que votre hébergeur ne conserve pas
-
Les durées varient selon l’offre : Kinsta indique quatre jours pour ses journaux d’accès.
-
Un CDN possède ses propres traces ; le serveur d’origine ne voit pas toujours les requêtes mises en cache.
-
La Search Console ne remplace pas les journaux : elle décrit les robots de Google, avec des limites.
-
L’adresse IP est une donnée personnelle et son traitement relève du RGPD.
-
Un contrat doit préciser les champs, la durée, les accès et les modalités d’export.
Les journaux de serveur complètent la Search Console
Un journal d’accès enregistre les requêtes reçues par un serveur : URL, date, code de réponse et user-agent. Il peut aussi inclure l’adresse IP, le référent et la taille de la réponse. Ces données brutes aident à vérifier ce que les robots ont réellement demandé.
La Search Console répond à d’autres questions. Son rapport sur les statistiques d’exploration décrit les robots de Google, mais pas ceux d’autres éditeurs. Google précise aussi que certaines requêtes peuvent manquer et que les exemples d’URL ne forment pas une liste complète.
Pour mesurer clics et impressions, la Search Console reste utile. Pour examiner une URL précise ou un code d’erreur, les journaux de serveur apportent une preuve plus directe. Lors d’une chute de trafic après une refonte, l’analyse des causes d’une baisse post-refonte gagne donc à inclure les traces disponibles.
Un site de moins de mille pages n’a pas toujours besoin d’une analyse quotidienne des robots. Quelques semaines de données peuvent toutefois éclairer une anomalie, une attaque ou une mauvaise configuration. La bonne source dépend de la question posée.
L’hébergement web répartit les traces entre plusieurs couches
Un site peut s’appuyer sur un CDN, un serveur d’origine et une plateforme SaaS. Chaque couche peut recevoir ou traiter une partie des requêtes. Si le CDN sert une page depuis son cache, le serveur d’origine ne voit pas ce passage.
Le lieu de stockage compte autant que la durée. WP Engine distingue des journaux d’origine et de périphérie, avec des fenêtres et des volumes différents. Chez Cloudflare, certaines fonctions de journaux bruts dépendent de l’offre et de leur activation préalable.
Les boutiques SaaS posent une difficulté différente. La documentation Shopify ne décrit pas de journal HTTP complet pour une boutique standard. Les drains de journaux concernent certaines configurations Hydrogen et Shopify Plus ; leur flux doit aussi rejoindre un outil tiers.
Un marchand qui confie son compte à une agence peut ne pas détenir l’accès aux fichiers. Il faut donc vérifier le titulaire de chaque compte et demander un export vers un espace client. La transparence de l’hébergeur commence par une réponse écrite sur ces points.
| Couche technique | Trace accessible | Vérification à prévoir |
|---|---|---|
| Serveur d’origine | Requêtes reçues directement | Format, durée et export |
| CDN | Requêtes traitées en périphérie | Offre, rétention et échecs d’envoi |
| Plateforme SaaS | Journaux parfois limités ou absents | Exports et outils compatibles |
Un tableau de bord unique ne signifie donc pas que toutes les traces existent au même endroit. Il faut cartographier chaque couche avant de diagnostiquer une baisse.
Les champs utiles relient les requêtes aux incidents SEO
Un journal standard peut omettre des informations décisives. Le format combiné d’Apache et de Nginx ne donne pas toujours le temps de réponse ni le nom d’hôte. Or Google indique que ses robots peuvent ralentir leur exploration quand un serveur répond trop lentement.
Pour une analyse de trafic exploitable, demandez un horodatage en UTC, l’hôte, la méthode, l’URL complète, le code, la taille, le référent et le user-agent. Ajoutez le temps de réponse et le statut de cache du CDN. Ces champs rapprochent les traces de plusieurs couches.
Le user-agent ne prouve pas l’identité d’un robot. Un script peut déclarer qu’il s’agit de Googlebot sans l’être. Google recommande une vérification par DNS inverse, suivie d’une résolution directe, ou une comparaison avec ses plages IP publiées.
Un cas fréquent aide à comprendre l’enjeu : une boutique voit des réponses lentes et une baisse d’exploration. Sans durée de réponse dans les journaux, le lien reste une supposition. Avec ce champ, l’équipe peut comparer les délais aux passages des robots.
-
Horodatage et fuseau facilitent le rapprochement entre sources.
-
URL, code et taille révèlent erreurs et pages vides.
-
IP et user-agent aident à identifier les robots, après vérification.
-
Temps de réponse et cache montrent où la requête a été traitée.
Les robots d’IA ne figurent pas dans le rapport d’exploration Google. Les journaux peuvent révéler leurs visites, sous réserve d’une identification fiable.
La protection des données impose des règles de conservation
En France, une adresse IP constitue une donnée personnelle. Le RGPD impose une durée adaptée à la finalité et des mesures de sécurité. L’article 5, paragraphe 1, point e, encadre la limitation de conservation ; l’article 28 précise les obligations du sous-traitant.
La CNIL recommande, pour certaines traces de sécurité, une conservation de six mois à un an. Ce repère ne crée pas une durée obligatoire pour les journaux SEO. Chaque organisation doit justifier sa propre durée, avec l’appui de son DPO.
La pseudonymisation réduit les risques, mais ne fait pas sortir automatiquement les fichiers du RGPD. Un hachage simple d’adresse IPv4 peut être retrouvé par essais. Une clé secrète conservée séparément renforce la méthode, sans remplacer une validation juridique.
Un contrat peut prévoir une courte durée pour les IP brutes, puis une conservation plus longue pour les lignes pseudonymisées ou les agrégats. Il doit aussi désigner le responsable des purges. Une clause claire protège à la fois la vie privée en ligne et la capacité de diagnostic.
Pour cadrer les accès, créez des comptes nominatifs en lecture seule. Évitez de transmettre les identifiants complets de l’espace client : ils ouvrent parfois la facturation, le DNS ou la résiliation. Une agence qui traite des IP pour le compte du client doit faire l’objet d’un encadrement contractuel approprié.
Le contrat fixe l’accès aux données non conservées
Les documentations d’hébergeurs montrent des écarts importants. Kinsta indique une conservation de quatre jours ; WP Engine documente une fenêtre de 72 heures pour ses journaux de périphérie ; WordPress.com mentionne une durée de trente jours. Ces exemples concernent des offres précises, pas tout le marché.
Les journaux effacés ne se reconstituent pas. Une entreprise peut alors comparer ses rapports Search Console, mais elle ne récupérera pas les requêtes brutes manquantes. Pour un site marchand, cette limite complique l’analyse d’une erreur technique ou d’un pic de visites suspect.
Une spécification contractuelle peut préciser les couches concernées, les champs attendus, le format d’export, les durées et les droits d’accès. Demandez un extrait de test avant signature, puis vérifiez que l’export arrive bien dans un espace détenu par l’entreprise.
Un prestataire SEO peut aussi documenter une procédure de vérification des robots et de suppression des copies à la fin du contrat. Pour les campagnes courriel, la maîtrise des outils et des données mérite une vigilance similaire ; consultez cette présentation des fonctions de Mailtrap avant de comparer les usages.
La différence entre promesse commerciale et engagement tient au contrat. Une durée indiquée sur une page d’aide peut évoluer ; une clause signée donne un cadre vérifiable.
Pour évaluer les fonctions et les limites d’un outil associé à vos flux, cette analyse des tarifs et fonctionnalités de Mailtrap apporte un autre repère de comparaison.
Sources et références
Les références utiles incluent le guide Google sur l’exploration, la documentation Google sur la vérification des robots et l’aide Search Console sur les statistiques d’exploration. Le cadre juridique repose sur le RGPD, les recommandations de la CNIL sur la journalisation et l’arrêt de la Cour de cassation du 3 novembre 2016, n° 15-22.595.
Les durées mentionnées proviennent des documentations de Kinsta, de WP Engine et de WordPress.com. Les possibilités de journalisation varient selon les offres ; vérifiez les conditions applicables à votre compte.
FAQ sur les journaux de serveur et le SEO
{« @context »: »https://schema.org », »@type »: »FAQPage », »mainEntity »:[{« @type »: »Question », »name »: »Un petit site doit-il conserver ses journaux de serveur ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Une analyse du00e9taillu00e9e des robots nu2019est pas toujours nu00e9cessaire pour un site de petite taille. Quelques semaines de traces peuvent toutefois aider lors du2019une anomalie ou du2019un incident de su00e9curitu00e9. »}},{« @type »: »Question », »name »: »Lu2019hu00e9bergeur doit-il conserver un an les journaux SEO ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Non. Les ru00e8gles qui portent sur certaines donnu00e9es du2019identification ne cru00e9ent pas une duru00e9e gu00e9nu00e9rale pour les journaux SEO. Le contrat doit pru00e9ciser la conservation attendue. »}},{« @type »: »Question », »name »: »La Search Console montre-t-elle les robots du2019IA ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Non. Son rapport du2019exploration du00e9crit les robots de Google. Les journaux de serveur peuvent aider u00e0 repu00e9rer du2019autres robots, sous ru00e9serve de vu00e9rifier leur identitu00e9. »}},{« @type »: »Question », »name »: »Que faire si les journaux ont du00e9ju00e0 u00e9tu00e9 effacu00e9s ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Les fichiers supprimu00e9s ne peuvent pas u00eatre reconstituu00e9s. La Search Console fournit une vue partielle ; mettez en place un export ru00e9gulier pour les prochains incidents. »}}]}Un petit site doit-il conserver ses journaux de serveur ?
Une analyse détaillée des robots n’est pas toujours nécessaire pour un site de petite taille. Quelques semaines de traces peuvent toutefois aider lors d’une anomalie ou d’un incident de sécurité.
L’hébergeur doit-il conserver un an les journaux SEO ?
Non. Les règles qui portent sur certaines données d’identification ne créent pas une durée générale pour les journaux SEO. Le contrat doit préciser la conservation attendue.
La Search Console montre-t-elle les robots d’IA ?
Non. Son rapport d’exploration décrit les robots de Google. Les journaux de serveur peuvent aider à repérer d’autres robots, sous réserve de vérifier leur identité.
Que faire si les journaux ont déjà été effacés ?
Les fichiers supprimés ne peuvent pas être reconstitués. La Search Console fournit une vue partielle ; mettez en place un export régulier pour les prochains incidents.





