Pour des tables de plusieurs millions de lignes, il devient malin de travailler un peu sur le schéma de la DB.
En gros, plus ces tables sont petites sur le disque, plus les opérations dessus seront rapides. En effet, le facteur limitant devient les I/O, et tu veux les optimiser.
Donc je te conseille un peu de lecture sur le datawarehousing - en bon Français on devrait probablement utiliser un autre terme -.
En particulier, les notions de dimension et de cubes peuvent grandement t'aider.
Ceci dit, si tu nous donnais plus d'informations sur tes tables - par exemple sur leur structure, leur indexaction, le nombre de données distinctes pour chaque champ - on pourrait potentiellement t'aider.
Bon courage !
(au pire, tu peux prendre un gros serveur du type Amazon EC2 pour faire tes calculs pendant les quelques heures dont tu en as besoin)
# Data warehousing!
Posté par mac . En réponse au message Optimisation Postgre pour requetes de stats. Évalué à 4.
En gros, plus ces tables sont petites sur le disque, plus les opérations dessus seront rapides. En effet, le facteur limitant devient les I/O, et tu veux les optimiser.
Donc je te conseille un peu de lecture sur le datawarehousing - en bon Français on devrait probablement utiliser un autre terme -.
En particulier, les notions de dimension et de cubes peuvent grandement t'aider.
Ceci dit, si tu nous donnais plus d'informations sur tes tables - par exemple sur leur structure, leur indexaction, le nombre de données distinctes pour chaque champ - on pourrait potentiellement t'aider.
Bon courage !
(au pire, tu peux prendre un gros serveur du type Amazon EC2 pour faire tes calculs pendant les quelques heures dont tu en as besoin)