Tale spé · Chapitre 14 · Probabilités
Sommes de variables aléatoires
Linéarité de l'espérance, additivité de la variance, espérance et variance de la binomiale, somme et moyenne d'échantillon.
Sommaire
Ce qu'il faut savoir faire
- Linéarité de l'espérance
- Additivité de la variance
- Espérance et variance de la binomiale
- Somme et moyenne d'échantillon
Le chapitre précédent nous a appris à étudier une variable aléatoire : sa loi, son espérance, sa variance. Mais les situations réelles en combinent presque toujours plusieurs. Le joueur qui enchaîne les parties s'intéresse à son gain cumulé, pas au gain d'une seule partie ; l'industriel qui possède deux ateliers veut prévoir leur production totale ; le scientifique qui répète fois la même mesure raisonne sur la moyenne de ses résultats. Chaque fois, la quantité intéressante est une somme — ou une moyenne, qui n'est qu'une somme divisée par — de variables aléatoires.
Faut-il, pour étudier une telle somme, déterminer entièrement sa loi ? Ce serait souvent un travail considérable : la somme de dix dés prend déjà cinquante et une valeurs. Heureusement, deux outils remarquables permettent d'accéder directement à l'essentiel. Le premier est la linéarité de l'espérance : l'espérance d'une somme est la somme des espérances, toujours, sans la moindre hypothèse. Le second est l'additivité de la variance : la variance d'une somme est la somme des variances, mais cette fois à une condition, l'indépendance des variables — une notion que le modèle de la succession d'épreuves indépendantes du chapitre précédent nous fournit gratuitement.
Ces deux outils vont produire des dividendes immédiats : l'espérance et la variance de la loi binomiale, obtenues par une démonstration élégante — exigible au baccalauréat — qui découpe la binomiale en petites variables de Bernoulli ; puis le comportement de la somme et de la moyenne d'un échantillon, où l'on verra la moyenne se resserrer autour de l'espérance à mesure que l'échantillon grandit. Ce dernier phénomène, la concentration, ouvrira la porte du chapitre suivant.
Somme de deux variables aléatoires
Commençons par donner un sens précis aux objets du chapitre. Une fête foraine propose un jeu à deux roues que l'on fait tourner l'une après l'autre, de façon indépendante. La roue A comporte deux secteurs de même taille marqués et ; la roue B comporte quatre secteurs de même taille, un marqué et trois marqués . Le joueur gagne, en euros, la somme des deux nombres obtenus. Notons le gain fourni par la roue A et celui fourni par la roue B : le gain total du joueur est une nouvelle variable aléatoire, naturellement notée . Pour que cette écriture ait un sens, il faut que et soient définies sur la même expérience aléatoire — ici la succession des deux épreuves, dont l'univers est l'ensemble des couples de résultats.
Définition
Somme de variables aléatoires, produit par un réel. Soient et deux variables aléatoires définies sur un même univers , et un nombre réel.
La somme est la variable aléatoire qui, à chaque issue de , associe le nombre .
Le produit est la variable aléatoire qui, à chaque issue , associe le nombre .
Ces définitions n'ont rien de mystérieux : on ajoute ou on multiplie les valeurs, issue par issue. Si la fête foraine double tous les gains un jour de promotion, le gain de la roue A devient ; si elle offre en plus un euro à chaque joueur, il devient . Pour déterminer la loi d'une somme, on revient aux issues de l'expérience globale : on passe en revue les couples de résultats possibles, on calcule la somme associée à chacun, puis on regroupe les couples donnant la même somme.
Exemple
Le gain total des deux roues. Reprenons le jeu ci-dessus : et , . Les deux roues constituent une succession de deux épreuves indépendantes : la probabilité d'un couple de résultats est le produit des probabilités de ses composantes.
La somme peut prendre les valeurs , et . Passons en revue les quatre couples possibles : le couple donne avec la probabilité ; les couples et donnent tous deux , avec les probabilités respectives et ; le couple donne avec la probabilité . En regroupant, on obtient la loi de :
On vérifie que les probabilités ont pour somme .
La méthode fonctionne, mais son coût croît vite : avec deux dés il faudrait examiner couples, avec dix dés plus de soixante millions de listes. Si l'on ne s'intéresse qu'à l'espérance de la somme, un raccourci spectaculaire existe.
Linéarité de l'espérance
Propriété
Linéarité de l'espérance. Soient et deux variables aléatoires définies sur un même univers, et un réel. Alors En combinant les deux (et en notant qu'une variable constante égale à a pour espérance ), on retrouve la formule vue en première : .
Ces égalités sont valables sans aucune hypothèse sur et : aucune indépendance n'est requise.
Cette propriété est admise dans le cas général, mais vérifions-la sur l'exemple des deux roues, où toutes les lois sont connues. D'une part et , d'où . D'autre part, la loi de obtenue plus haut donne directement Les deux calculs coïncident : le joueur gagne en moyenne euros par partie. La linéarité s'étend de proche en proche à un nombre quelconque de variables : .
La vraie force de cette propriété est de donner l'espérance d'une somme sans jamais déterminer sa loi. C'est une méthode à part entière, très rentable au baccalauréat.
Méthode
Calculer une espérance sans déterminer la loi. Pour calculer l'espérance d'une variable aléatoire compliquée :
- Décomposer la variable en une somme de variables simples : gains des étapes successives d'un jeu, ou variables valant si un événement se réalise et sinon.
- Calculer l'espérance de chaque variable simple (souvent immédiate).
- Additionner les espérances par linéarité.
Aucune hypothèse d'indépendance n'est à vérifier : la linéarité de l'espérance vaut dans tous les cas.
Exemple
Deux calculs éclair. Somme de dix dés. On lance dix dés équilibrés et on note la somme des dix résultats. La variable prend les valeurs entières de à et sa loi est très pénible à déterminer. Mais , où est le résultat du -ième dé, d'espérance . Par linéarité :
Des questions de difficultés différentes. Un test comporte trois questions, que Léa réussit avec les probabilités respectives , et . Le nombre de bonnes réponses ne suit pas une loi binomiale : les probabilités de succès ne sont pas les mêmes d'une question à l'autre. Notons la variable qui vaut si la question est réussie et sinon : c'est une variable de Bernoulli, donc est égale à la probabilité de succès de la question . Comme , la linéarité donne Léa réussit en moyenne question — sans qu'on ait eu besoin de la loi de , ni même de savoir si les questions sont réussies indépendamment les unes des autres.
Variables indépendantes et variance d'une somme
L'espérance mesure la valeur moyenne ; la variance mesure la dispersion. Peut-on, comme pour l'espérance, additionner les variances ? La réponse est plus délicate : deux variables peuvent se compenser (quand l'une est grande, l'autre est petite) ou au contraire se renforcer, et la dispersion de leur somme en dépend. L'addition des variances n'est légitime que si les variables ne s'influencent pas — si elles sont indépendantes. En terminale, cette notion est toujours fournie par le modèle du chapitre précédent : on ne demandera jamais de démontrer une indépendance, elle découle de la construction de l'expérience.
Définition
Variables indépendantes (cadre du programme). Dans une succession d'épreuves indépendantes, deux variables aléatoires et qui portent sur des épreuves distinctes de la succession sont dites indépendantes : le résultat qui détermine n'a aucune influence sur celui qui détermine .
C'est le cas des deux roues de la fête foraine : ne dépend que de la roue A, que de la roue B, et les deux roues tournent indépendamment. À l'inverse, si se calculait à partir du même résultat que — par exemple —, les deux variables ne seraient pas indépendantes.
Propriété
Variance d'une somme et d'un produit par un réel. Soient et deux variables aléatoires définies sur un même univers, et un réel.
Si et sont indépendantes (propriété admise) :
Sans hypothèse d'indépendance :
La relation se justifie en quelques lignes avec la formule de König-Huygens et la linéarité de l'espérance :
En passant à la racine carrée, : multiplier une variable par multiplie son écart type par — et le carré de la variance explique la valeur absolue, car une dispersion ne peut pas être négative.
Exemple
Vérification sur les deux roues. Les variables et du jeu forain sont indépendantes. König-Huygens donne , d'où ; de même , d'où . Enfin, avec la loi de : , donc L'additivité est bien au rendez-vous.
Remarque
L'indépendance est indispensable pour la variance, pas pour l'espérance. Prenons une variable non constante et posons : les deux variables portent sur la même épreuve et se compensent exactement. Alors est la variable constante nulle, donc , tandis que : l'additivité de la variance est prise en défaut. En revanche reste parfaitement vraie. Il faut retenir ce contraste : l'espérance est linéaire sans aucune condition ; l'additivité de la variance exige l'indépendance.
Remarque
Les écarts types ne s'additionnent pas. Même pour des variables indépendantes, n'est pas égal à : ce sont les variances qui s'additionnent, et la racine carrée d'une somme n'est pas la somme des racines carrées. Sur les deux roues : , alors que . Pour additionner des dispersions, on passe donc toujours par les variances.
Comme la linéarité de l'espérance, l'additivité s'étend de proche en proche : si portent sur des épreuves deux à deux distinctes d'une succession d'épreuves indépendantes, alors . Nous voilà armés pour le résultat central du chapitre.
Espérance et variance de la loi binomiale
Soit une variable aléatoire suivant la loi binomiale . Calculer à partir de la loi obligerait à évaluer la somme des — un calcul rebutant. La bonne idée est toute autre : puisque compte les succès d'un schéma de Bernoulli, découpons ce comptage épreuve par épreuve. C'est la démonstration exigible du chapitre.
Propriété
Espérance, variance et écart type de la loi binomiale. Si suit la loi binomiale , alors
Démonstration. La variable compte le nombre de succès d'un schéma de Bernoulli de paramètres et . Pour chaque entier compris entre et , notons la variable aléatoire qui vaut si la -ième épreuve donne un succès, et sinon. Chaque suit la loi de Bernoulli de paramètre , et compter les succès revient à additionner ces variables :
Espérance et variance d'une variable de Bernoulli. La loi de donne . Par ailleurs prend les mêmes valeurs que (car et ), donc , et la formule de König-Huygens fournit
Espérance de . La linéarité de l'espérance, qui ne demande aucune hypothèse, donne
Variance de . Les variables portent sur des épreuves distinctes d'une succession d'épreuves indépendantes : elles sont indépendantes. L'additivité de la variance s'applique donc :
Enfin .
La formule confirme l'intuition : sur répétitions d'une épreuve réussie avec probabilité , on attend « en moyenne » une proportion de succès. Quant à la variance , elle est maximale pour — le hasard le plus imprévisible — et s'annule pour ou , où le résultat est certain.
Exemple
Retour aux lancers francs. La basketteuse du chapitre précédent réussit chaque lancer franc avec la probabilité , ses tirs étant indépendants. Sur une série de lancers, le nombre de tirs réussis suit la loi . Sans aucun calcul de loi : Elle réussit en moyenne lancers sur , avec un écart type d'environ : la plupart des séries donneront un score entre et réussites.
Échantillon de taille : somme et moyenne
Terminons par la situation la plus féconde : la répétition à l'identique d'une même expérience. Un laborantin mesure fois la même grandeur, un sondeur interroge personnes, un joueur lance fois le même dé. Chaque répétition produit une variable aléatoire, et toutes suivent la même loi : cette collection porte un nom.
Définition
Échantillon de taille . Un échantillon de taille d'une loi de probabilité est une liste de variables aléatoires indépendantes suivant toutes cette loi. On lui associe deux variables : la somme et la moyenne .
Notons l'espérance, la variance et l'écart type communs aux variables . Les outils du chapitre donnent immédiatement les caractéristiques de et de .
Propriété
Somme d'un échantillon. Pour un échantillon de taille d'une loi d'espérance , de variance et d'écart type :
En effet, la linéarité de l'espérance donne ; les variables de l'échantillon étant indépendantes, l'additivité de la variance donne , puis .
Propriété
Moyenne d'un échantillon. Sous les mêmes hypothèses :
La démonstration tient en une ligne : comme , on a et , d'où .
On reconnaît au passage une vieille connaissance : une variable suivant la loi est exactement la somme d'un échantillon de taille de la loi de Bernoulli de paramètre — c'est la décomposition de la section précédente. Les formules et , appliquées avec et , redonnent bien et .
Exemple
Une chaîne d'embouteillage. Une machine remplit des bouteilles dont le volume, en millilitres, est une variable aléatoire d'espérance et d'écart type . On prélève un échantillon de bouteilles, les remplissages étant indépendants.
Volume total. La somme vérifie millilitres et millilitres.
Volume moyen. La moyenne vérifie millilitres et Le volume moyen des bouteilles fluctue cinq fois moins qu'un volume individuel : mesurer une moyenne, c'est déjà filtrer le hasard.
Ces formules racontent deux histoires opposées. La somme se disperse de plus en plus quand grandit — son écart type croît sans limite. La moyenne , elle, fait exactement l'inverse : son espérance reste égale à quelle que soit la taille de l'échantillon, mais son écart type diminue quand augmente. Autrement dit, la moyenne d'un grand échantillon fluctue de moins en moins : elle se concentre autour de . Attention au rythme de cette concentration : à cause de la racine carrée, diviser l'écart type par exige de multiplier la taille de l'échantillon par .
Le phénomène se voit remarquablement bien sur un exemple. Prenons pour loi commune celle d'un dé équilibré, d'espérance et d'écart type , et traçons les lois exactes de la moyenne de lancers, pour , et .
Les trois distributions sont centrées sur la même valeur , matérialisée par le trait pointillé : conformément à , augmenter ne déplace pas le centre. Mais la dispersion fond à vue d'œil : l'écart type passe de (loi uniforme du dé seul) à pour la moyenne de deux lancers, puis à pour quatre lancers. Les valeurs extrêmes ( ou de moyenne) deviennent très improbables, et la probabilité s'accumule près de : la moyenne « oublie » les accidents des lancers individuels.
En résumé : la linéarité de l'espérance additionne les espérances sans aucune condition, l'additivité de la variance additionne les variances des variables indépendantes, et ce duo a livré sans effort l'espérance et la variance de la loi binomiale, puis les formules et pour la moyenne d'un échantillon. Cette dernière formule est une promesse : la moyenne d'un grand échantillon se concentre autour de l'espérance de la loi. Le chapitre suivant tiendra cette promesse en la quantifiant — avec quelle probabilité, et à quelle distance de , peut-on garantir que la moyenne se trouve ?
Bloqué sur « Sommes de variables aléatoires » ?
On peut le travailler ensemble dès cette semaine. La première heure est offerte — on fait le point honnêtement, et vous repartez au minimum avec une méthode.