PaliSkill
Python avancé

Leçon 4 / 10 — Chapitre 6: Manipuler des données avec pandas

Sélectionner des colonnes

Une colonne d'un DataFrame se sélectionne avec des crochets, un peu comme une clé de dictionnaire (vu dans Python Intermédiaire) — df["colonne"] renvoie une Series, l'objet pandas représentant une seule colonne.

import pandas as pd

df = pd.DataFrame({
    "produit": ["riz", "huile", "sucre"],
    "prix": [5, 8, 3],
})

print(df["prix"])

Ce code affiche la colonne prix entière, avec son index à gauche. type(df["prix"]) afficherait <class 'pandas.core.series.Series'> : une Series est essentiellement une colonne unique, indexée.

Plusieurs colonnes à la fois se sélectionnent avec une liste de noms entre crochets :

print(df[["produit", "prix"]])

Ce code affiche un DataFrame réduit à ces deux colonnes seulement, dans l'ordre demandé — remarquez les doubles crochets : les crochets extérieurs sélectionnent, les crochets intérieurs forment la liste des noms voulus.

Calculer sur une colonne entière fonctionne directement, sans boucle explicite :

print(df["prix"].sum())
print(df["prix"].mean())

À vous de jouer : sélectionnez une seule colonne d'un DataFrame avec df["colonne"], puis deux colonnes à la fois avec df[["col1", "col2"]].

🔒

Continuez ce module

Débloquez les leçons restantes ainsi que la certification finale.

2 500 XOF / 3,81 € / 4,15 $

Débloquez les 87 leçons restantes de ce module

Votre paiement est vérifié avant l'activation de l'accès