• [^] # Re: et les sites dynamiques?

    Posté par . En réponse à la dépêche Faut-il encore faire confiance à Google ?. Évalué à 7.

    Oui, parce que Google, un navigateur web, ou tout autre logiciel qui respecte le protocole HTTP, s'en fiche que le fichier se nomme en .html, .php, .txt, . doc, .spqr ...
    Pour déterminer le type d'un fichier, il ne doit se baser que sur une chose: l'entête content-type fournie dans la réponse HTTP. Si celle-ci précise bien qu'il s'agit de code HTML (type MIME text/html), il ne précise absolument pas quelle est l'origine du document, qu'il soit généré de manière statique ou dynamique, le client n'a pas à le savoir.
    (d'ailleurs, c'est parfaitement possible de faire des documents dynamiques que l'on nomme en .html)

    Le seul problème qui peut se poser pour les moteurs de recherche ou les caches, c'est de savoir si ils devront cacher le document ou non, et si oui, jusqu'à quelle date. C'est là qu'interviennent les headers expires, last-modified, pragma (utilisé avec la valeur no-cache), ou cache-control (utilisé en HTTP/1.1 pour remplaçer de manière un peu plus évoluée le rudimentaire pragma: no-cache)
    La présence de ces en-têtes, en soi, n'a toutefois rien à voir avec le fait que la page soit dynamique ou non (le serveur web peut être configuré pour les renvoyer avec tout ou partie des pages, et les pages HTML ou XHTML peuvent utiliser la balise <meta http-equiv="machin"> pour simuler la présence d'en-têtes HTTP.

    Un moteur de recherche comme Google indexera quand même les documents qui précisent ne pas devoir être cachés (normal). Toutefois, indexera-t-il aussi les documents qui précisent qu'ils expirent maintenant (comme la page du RV, par exemple)? Possible que non, vu que le seul site que je connaisse qui précise un champ expires arbitraire, n'est pas plus indexé sur Google que celui du RV. Les sites "normaux", eux, sont indexés sur Google, mais ne touchent apparemment pas au header expires.

    Faudrait tester...