un jeu en ligne a été plus que perturbé quand le petit robot a suivi des liens en GET. la réponse en général va être de dire que le W3C recommande que les formulaires qui modifient le contenu du site Web doivent plutôt utiliser des POST... soit. et encore, le désordre reste indiscutablement de la faute du robot qui suivait les liens comme un débile.
Ben naivement je dirais qu'on robot qui ne suit pas lien est pas efficace pour indexer le web. Ensuite Si le googlebot utilise tout les formulaire qui ont une methode GET, la c'est stupide.
- le plus beau : There are also some people who do not know about the robots exclusion protocol, and think their page should be protected from indexing by a statement like, "This page is copyrighted and should not be indexed", which needless to say is difficult for web crawlers to understand.
ça, c'est du foutage de gueule pur et dur. [...]
Donc si je met sur ma page en francais une image (toute petite) disant en allemand que le contenus de cette page est protégé et que tout reproduction partiel est interdite, tu trouve ca normal si je fait un procés a un moteur de recherche pour infraction a mon copyrigth??
Un robot ne pouvant que tres difficilement interpreter la semantiaque d'un message, a part utiliser des protocol comprehensible par un programme, je ne voit pas comment.
De plue le robot s'annonce en tant que tel, donc faire des droit d'acces restreint pour un robot, ca peut marcher.
C'est pas du foutage de gueule.
Ensuite le scan des livres, je suis plus ou moins d'accord, google force la main, mais google veut offrir un nouveau service et faire du opt-out est bien plus ismple administrativement que de faire du opt-in, d'autant plus que je pense que les editeurs ont une liste de leurs publications sous forme electronique.
Ensuite googple pourrais faire une solution plus acceptable en informant chaque editeur qu'il va scanner les bouquins (pas livre par livre).
Mais que faire quand l'editeur n'existe plus?.
Pour l'absence de ligne éditoriale:
c'est un moteur de recherche, pas un site d'information, ca me choque pas que l'on puisse tout trouver.
Je suis certain que si google pouvait laisser les gens configurer la categorie de contenus voulus de maniere arbitraire, Berner-lee serais super content et google aussi (Web semantic inside)
Google n'est pas parfait, ils doivent s'ameliorer (Crawl-delay, ... etc) mais de la a crier au foutage de gueule pour l'indexation, y'a un gros pas.
[^] # Re: Personne ne se rends compte de comment ça marche tout ça ???
Posté par ham . En réponse au journal Google, the internet trust must go on.... Évalué à 3.
Ben naivement je dirais qu'on robot qui ne suit pas lien est pas efficace pour indexer le web. Ensuite Si le googlebot utilise tout les formulaire qui ont une methode GET, la c'est stupide.
Donc si je met sur ma page en francais une image (toute petite) disant en allemand que le contenus de cette page est protégé et que tout reproduction partiel est interdite, tu trouve ca normal si je fait un procés a un moteur de recherche pour infraction a mon copyrigth??
Un robot ne pouvant que tres difficilement interpreter la semantiaque d'un message, a part utiliser des protocol comprehensible par un programme, je ne voit pas comment.
De plue le robot s'annonce en tant que tel, donc faire des droit d'acces restreint pour un robot, ca peut marcher.
C'est pas du foutage de gueule.
Ensuite le scan des livres, je suis plus ou moins d'accord, google force la main, mais google veut offrir un nouveau service et faire du opt-out est bien plus ismple administrativement que de faire du opt-in, d'autant plus que je pense que les editeurs ont une liste de leurs publications sous forme electronique.
Ensuite googple pourrais faire une solution plus acceptable en informant chaque editeur qu'il va scanner les bouquins (pas livre par livre).
Mais que faire quand l'editeur n'existe plus?.
Pour l'absence de ligne éditoriale:
c'est un moteur de recherche, pas un site d'information, ca me choque pas que l'on puisse tout trouver.
Je suis certain que si google pouvait laisser les gens configurer la categorie de contenus voulus de maniere arbitraire, Berner-lee serais super content et google aussi (Web semantic inside)
Google n'est pas parfait, ils doivent s'ameliorer (Crawl-delay, ... etc) mais de la a crier au foutage de gueule pour l'indexation, y'a un gros pas.