Je vais sans doute faire bondir des gens ici, mais pour de l'analyse de données, SQL c'est très bien aussi.
Les View, join, group by etc permettent facilement de travailler sur de gros volumes de données, d'agreger plusieurs sources, filtrer etc. J'ai monté plusieurs fois des bases pour des amis thésards (pas forcement en info). Ils ont trouvé ça assez intuitif, plus que R par exemple pour lesquels ils avaient pourtant eu des cours à l'inverse de SQL (bon l'utilisation de phpmyadmin aide aussi).
Le dernier exemple en date: une amie l'utilise pour traiter des données issues de l'INSEE. Avec souvent plusieurs tables à croiser, et une ou plusieurs lignes par communes (donc > 36000).
Quelques défauts par contre:
- Il semble y avoir un foutu bug dans mySQL qui double le nombre de ligne quand on fait des GROUP BY et des jointures implicites.
- Le EXPLAIN sous mySQL c'est franchement pas ça.. Faudrait que j'essai avec pgSQL.
# SQL
Posté par geb . En réponse à la dépêche Petite actu des outils d’analyse numérique. Évalué à 7.
Je vais sans doute faire bondir des gens ici, mais pour de l'analyse de données, SQL c'est très bien aussi.
Les View, join, group by etc permettent facilement de travailler sur de gros volumes de données, d'agreger plusieurs sources, filtrer etc. J'ai monté plusieurs fois des bases pour des amis thésards (pas forcement en info). Ils ont trouvé ça assez intuitif, plus que R par exemple pour lesquels ils avaient pourtant eu des cours à l'inverse de SQL (bon l'utilisation de phpmyadmin aide aussi).
Le dernier exemple en date: une amie l'utilise pour traiter des données issues de l'INSEE. Avec souvent plusieurs tables à croiser, et une ou plusieurs lignes par communes (donc > 36000).
Quelques défauts par contre:
- Il semble y avoir un foutu bug dans mySQL qui double le nombre de ligne quand on fait des GROUP BY et des jointures implicites.
- Le EXPLAIN sous mySQL c'est franchement pas ça.. Faudrait que j'essai avec pgSQL.