URL: https://linuxfr.org/users/ryan/journaux/data-et-libre-une-belle-histoire Title: #data et libre : une belle histoire ? Authors: Thomas Date: 2016年07月12日T13:31:07+02:00 License: CC By-SA Tags: bigdata et libre Score: 20 Mon cher journal, _DLFP a 18 ans, et ca fait 12 ans que je lis ce qu'il propose sans trop participer. Pourquoi ne pas apporter mon gravier à l'édifice ? A toi de juger de la pertinence du propos, qui oscillera peut-être entre le billet de blog et les réflexions de comptoir._ J'aimerais partager avec toi 2-3 réflexions que je me fais depuis quelque temps sur le rôle du libre dans le grand raout actuel que les communicants appellent "disruption digitale" : #BigData #IoT #analytics #deeplearning et toutes les autres saillies marketing mélangeant allégement équipement, infra, data et services. Ne serait-ce que pour le traitement de données, les termes marketing ne manquent pas : data science _aka_ business intelligence _aka_ analytics avancée etc \ Mon data, c'est la data. Analyse, traitement, visualisation ... mon activité professionnelle n'est possible que grâce aux outils open source, dont principalement numpy/scipy, pandas, scikit-learn (et pyMC, pour le fun). Je me retrouve à concurrencer techniquement les grosses boites de conseil et ESN avec ces quelques outils. Avec un peu de flair commercial (dont je manque), quelques compétences relationnelles (que je développe) et un bon background technique, il est donc possible de travailler en indépendant comme data scientist [[Science_des_données]]. Et ceci grâce au libre, que je remercierai par des dons dans l'année. \ Second point : est-il possible de faire sérieusement de l'analyse de donnée sans utiliser les outils libres ? Coder ses propres algorithmes d'apprentissage automatique (machine learning) est totalement idiot, voire impossible : il faut clairement maîtriser les maths et l'algorithmie tout en étant capable d'implémenter le tout ... illusoire ! Mes quelques contacts avec des collègues dans différentes boites me confirment qu'ils utilisent des outils similaires, ou du [[Hadoop]]/[[Apache_Spark]] qui sont aussi open-source. Ce qui incite fortement à penser que ces activités de traitement de données n'a pu se développer que grâce au libre [*]. Et qu'elle ne pourra pas vraiment s'en détacher. Je vois mal une boite se lancer dans une activité "BigData" en ré-inventant la roue. Sans compter les initiatives [[NoSQL]]. Enfin, dernier point qui, personnellement, me fait grand plaisir : le retour de la technique pure et dure dans le marketing et le commercial, qui sont les principaux utilisateurs de ces outils sympathiques de #data :-) Je me trompe peut-etre, mais j'ai l'impression que tout le mouvement du libre loupe une belle occasion de se féliciter de cette victoire de fait ! Hauts les cœurs \o/ \o/ Et toi, qu'en penses-tu, mon cher journal ? [*] ou à l'open-source. Je mélange un peu les deux, je le reconnais volontiers !

AltStyle によって変換されたページ (->オリジナル) /