Pour accélerer le traitement, peut-être qu'on peut se contenter de faire le hash sur seulement une petite partie du fichier (les 2 premiers Ko de la partie de donnée). Meme deux morceaux qui commencent par du silence auront toujours un peu de bruit de fond pour les distinguer. Et si dans ta base tu detecte quand-même une collision, tu rajoutes 1Ko à hasher jusqu'à ce que ça ne collisionne plus.
[^] # Re: A propos de md5/sha1
Posté par daggett . En réponse au message identifier à coup sur un fichier.. Évalué à 1.