Le Data Science (science des données) est un ensemble de disciplines spécialisées issues de divers domaines qui analysent les données et recherchent des solutions optimales. Auparavant, seules les statistiques mathématiques et les mathématiques appliquées s’en occupaient ; plus tard, l’apprentissage automatique et l’intelligence artificielle ont été adoptés, ajoutant l’informatique à l’arsenal d’analyse de données aux côtés des statistiques mathématiques.
En analysant de grands volumes de données, il devient possible de prendre des décisions de gestion plus efficacement. Les bénéfices de l’analyse de données peuvent être obtenus dans pratiquement n’importe quel domaine appliqué où suffisamment de données sont disponibles. Pour comprendre comment appliquer l’analyse de données à un domaine particulier, il faut posséder une expertise dans ce domaine.
Le data science englobe trois domaines distincts mais qui se chevauchent :
- les compétences d’un statisticien mathématicien capable de modéliser des ensembles de données et d’en extraire l’information essentielle ;
- les compétences d’un informaticien capable de concevoir et d’utiliser des algorithmes pour le stockage, le traitement et la visualisation efficaces des données ;
- l’expertise du domaine acquise par une étude classique du sujet — la capacité à la fois de formuler les bonnes questions et d’examiner les réponses dans le contexte approprié.
Dans cette optique, je recommanderais de considérer le data science non pas comme un nouveau champ de connaissances à étudier, mais comme un nouvel ensemble de compétences à appliquer dans un domaine que vous connaissez déjà bien.