Supports — Premiers pas en Machine Learning avec R
Machine Learning, R, CART, Random Forest, Data Science, Formation francophone
Premiers pas en Machine Learning avec R
Les supports de la formation, pour apprendre à votre rythme.
Ces supports sont ceux utilisés lors de la formation Pyranhia : conçus pour être autonomes, interactifs, et directement applicables à vos projets.
Pour qui ?
Ces supports s’adressent à vous si vous avez des bases en R et que vous souhaitez vous lancer dans le machine learning, ou disposer d’une ressource structurée en français pour un premier projet concret.
Prérequis :
- être à l’aise avec les structures de base :
data.frame,tibble, vecteurs ; - savoir manipuler des données avec
dplyr:filter(),select(),mutate(),group_by(),summarise(); - connaître les fonctions de base :
summary(),str(),head(),mean(); - avoir déjà créé un graphique avec
ggplot2(même basique) ; - utiliser le pipe
|>ou%>%.
Contenu du pack
2 jours de contenu structuré, des bases du Machine Learning aux méthodes basées sur les arbres
| Jour | Contenu |
|---|---|
| J1 | Overfitting et underfitting, séparation train/test (aléatoire, stratifiée), validation croisée k-fold, métriques d’évaluation en régression et en classification. Ateliers guidés : régression sur des données immobilières (California Housing) et classification de la survie des passagers du Titanic (régression logistique) |
| J2 | Arbres de décision (CART) : construction, élagage, avantages et limites. Bagging et Random Forest, erreur out-of-bag. Atelier : validation croisée appliquée à un Random Forest, du découpage en folds jusqu’au calcul des métriques |
Pour chaque journée
- notes de cours interactives (indices dévoilables, consignes d’ateliers, export PDF possible) ;
- diaporama consultable dans le navigateur ;
- scripts R des ateliers, prêts à compléter ;
- widgets interactifs pour explorer et visualiser les concepts clés (overfitting, R², RMSE, validation croisée, arbres de décision) : 5 widgets au total.
En bonus
- glossaire complet des termes ML ;
- guide pratique pour utiliser les LLM (ChatGPT, Claude…) dans vos projets data.
Tarifs et conditions
Tarif : 50€ 40€ avec le code KRILL20, jusqu’au 15 octobre 20261
Usage personnel uniquement, non cessible.
Les supports n’incluent pas d’encadrement ni l’accès au serveur de calcul. Les scripts sont reproductibles sur votre propre installation R grâce au fichier renv.lock fourni et au dépôt GitHub associé.
Les supports sont susceptibles d’être mis à jour (corrections, ajouts) sans préavis. Les mises à jour sont accessibles via le même lien, sans frais supplémentaires. L’accès est accordé pour une durée indéterminée, sous réserve du maintien de l’infrastructure technique.
En procédant au paiement, vous reconnaissez avoir pris connaissance des CGV et renoncez expressément à votre droit de rétractation pour ce contenu numérique à livraison immédiate (art. L221-28 du Code de la consommation).
Vous êtes un organisme ou un laboratoire ? Contactez-moi pour une licence institutionnelle.
Notes de bas de page
TVA non applicable – art. 293 B CGI↩︎
Comment ça marche ?
Voir la formation complète