Oui, ce qui est cohérent avec le contexte visé : celui des streaming très gros, où la mémoire ne suffit pas à contenir chaque valeur distincte déjà rencontrée.
Mais pour le cas de tout les jours, genre dans ma base de données, je veux savoir combien de produits différents ont été vendu au client X, je m'attends pas à un chiffre approximé, et je m'attends pas non plus à 1,000,000,000 de lignes à lire.
Par contre, si on en est à approximer, et qu'on "connaît" la nature des données, on peut aller encore plus loin et ne pas écouter l'ensemble du flux de données, non ?
[^] # Re: Compléments
Posté par Dring . En réponse au lien Une nouvelle méthode efficace de comptage d’éléments distincts dans un flux de données. Évalué à 3.
Oui, ce qui est cohérent avec le contexte visé : celui des streaming très gros, où la mémoire ne suffit pas à contenir chaque valeur distincte déjà rencontrée.
Mais pour le cas de tout les jours, genre dans ma base de données, je veux savoir combien de produits différents ont été vendu au client X, je m'attends pas à un chiffre approximé, et je m'attends pas non plus à 1,000,000,000 de lignes à lire.
Par contre, si on en est à approximer, et qu'on "connaît" la nature des données, on peut aller encore plus loin et ne pas écouter l'ensemble du flux de données, non ?