URL: https://linuxfr.org/forums/programmation-sql/posts/le-probleme-des-bieres-et-des-couches-en-data-mining Title: Le problème des bières et des couches en data mining Authors: j_m Date: 2013年11月23日T16:18:34+01:00 License: CC By-SA Tags: Score: 2 Salut, Au début de mon cours sur les data warehouse on m'a parlé du problème des couches et des bières ([ici](http://www.forbes.com/forbes/1998/0406/6107128a.html) pour ceux qui connaissent pas). Selon l'histoire, un magasin aurait remarqué par une analyse de son data warehouse que de façon inattendue les couches étaient souvent achetées en même temps que des bières le dimanche, et que ça venait du fait que ce jour là les papa étaient chargés d'aller acheter des couches et qu'ils en profitait pour prendre des bières pour regarder le match de foot du dimanche. Le magasin a ensuite pu tirer parti de cette connaissance pour mettre les bières à côté des langes et les bénéfices auraient étés gigantesques. On nous a donc parlé de cet exemple et ensuite le cours a continué sans jamais revenir sur ce problème. Les problèmes que j'ai eu à modéliser en exercice concernaient des calculs de moyennes, et de ventes totale par jour, mois, année dans un schéma en étoile/galaxie. La question ----------- Pour le problème des bières et des couches, ce n'est plus une moyenne pour chaque jour et chaque produit qu'il faut stocker mais un tableau qui associe un coefficient de co-occurence d'achat entre chaque produit. Donc un espace de stockage en O(N2) au lieu de O(N), multiplié par le nombre de dimensions. Je n'ai pas eu à modéliser un tel problème dans mes exercices, est-ce vraiment comme ça qu'on fait ?