Grammaire
Verbes irréguliers anglais : de combien en avez-vous besoin ?
Il vous en faut environ 45. Nous avons compté chaque forme passée irrégulière dans un corpus de 2.1 millions de mots tirés de romans anglais : 10 verbes en couvrent 74 %, 30 en couvrent 90 % et 45 en couvrent 95 %. Si l'on exclut be, have et do, 44 verbes atteignent les 90 %. Les quelque 150 autres verbes qui figurent sur les longues listes traditionnelles se partagent simplement les tout derniers pour cent restants.
Il vous faut environ 45 verbes irréguliers. Sur 2.1 millions de mots tirés de romans anglais, 10 verbes représentent 74 % de toutes les formes passées irrégulières, 30 verbes en représentent 90 % et 45 verbes en représentent 95 % ; les quelque 150 autres verbes figurant sur une longue liste typique se partagent les derniers pour cent restants.
Il s’agit d’une mesure précise, pas d’une règle empirique. Vous trouverez ci-dessous comment nous avons compté, le classement que cela a produit, et ce que cela implique pour l’ordre dans lequel vous devez les apprendre.
Combien de verbes irréguliers l’anglais compte-t-il ?
Tout dépend de la personne qui compte. Les listes de référence vont généralement d’environ 150 à plus de 200 verbes, car elles incluent des formes archaïques telles que smite, smote, smitten et des composés préfixés tels que undertake, undertook, undertaken.
Notre tableau de référence contient 213 verbes irréguliers avec leur prétérit et leur participe passé. Lorsqu’un verbe possède également une forme régulière, comme learned à côté de learnt, seule la forme irrégulière compte comme irrégulière. La question n’est pas de savoir quelle est la longueur de la liste, mais quelle proportion de celle-ci vous rencontrerez réellement.
Comment avons-nous mesuré ceux qui sont importants ?
Nous avons construit un corpus anglais de 21 romans issus du Projet Gutenberg, écrits à l’origine en anglais entre 1813 et 1925 : Austen, les sœurs Brontë, Dickens, Twain, Conan Doyle, Stoker, Joyce et Fitzgerald en font partie. Cela représente 2 138 259 mots.
Chaque mot a été étiqueté avec un analyseur morphosyntaxique automatique de la bibliothèque NLTK. Nous n’avons conservé que les mots étiquetés comme prétérit ou participe passé. Cette étape est cruciale : elle compte put et read lorsqu’il s’agit de formes passées, et ignore saw l’outil (la scie) ou left la direction (la gauche).
L’analyseur a trouvé 201 391 formes passées. Parmi celles-ci, 121 775 (60.5 %) étaient irrégulières. L’anglais possède beaucoup plus de verbes réguliers, mais les verbes irréguliers sont ceux que les gens utilisent le plus, ils dominent donc les textes réels.
Combien de verbes couvrent 80, 90 et 95 pour cent ?
Voici la couverture cumulée, avec et sans be, have et do. Ces trois-là sont généralement appris en premier, en tant qu’auxiliaires, et à eux seuls ils représentent plus de la moitié de toutes les formes irrégulières :
| Couverture des formes passées irrégulières | Tous les verbes irréguliers | Sans be, have, do |
|---|---|---|
| 50 % | 3 verbes | 9 verbes |
| 80 % | 15 verbes | 28 verbes |
| 90 % | 30 verbes | 44 verbes |
| 95 % | 45 verbes | 65 verbes |
| 99 % | 93 verbes | 110 verbes |
La courbe s’aplatit rapidement. Les 10 premiers verbes couvrent 73.8 % ; les 25 premiers couvrent 88.1 % ; les 50 premiers couvrent 95.9 %. Après cela, chaque nouveau verbe ajoute moins d’un cinquième de pour cent.
À l’autre extrémité, 54 des verbes de notre tableau sont apparus moins de dix fois sur 2.1 millions de mots, et 23 ne sont jamais apparus du tout, y compris forgo, oversleep et slink.
Quels sont les 25 verbes irréguliers à apprendre en premier ?
Si l’on met de côté be, have et do, voici les 25 verbes irréguliers les plus fréquents du corpus, avec la part des formes irrégulières qu’ils couvrent ensemble :
| Rang | Verbe | Prétérit | Participe passé | Couverture cumulée |
|---|---|---|---|---|
| 1 | say | said | said | 15.4 % |
| 2 | go | went | gone | 21.3 % |
| 3 | come | came | come | 26.8 % |
| 4 | see | saw | seen | 32.0 % |
| 5 | make | made | made | 36.5 % |
| 6 | take | took | taken | 40.5 % |
| 7 | get | got | got / gotten | 44.2 % |
| 8 | think | thought | thought | 47.4 % |
| 9 | know | knew | known | 50.1 % |
| 10 | find | found | found | 52.8 % |
| 11 | begin | began | begun | 55.4 % |
| 12 | give | gave | given | 57.8 % |
| 13 | feel | felt | felt | 60.1 % |
| 14 | tell | told | told | 62.3 % |
| 15 | hear | heard | heard | 64.3 % |
| 16 | leave | left | left | 66.3 % |
| 17 | stand | stood | stood | 67.9 % |
| 18 | put | put | put | 69.5 % |
| 19 | sit | sat | sat | 71.0 % |
| 20 | fall | fell | fallen | 72.3 % |
| 21 | bring | brought | brought | 73.5 % |
| 22 | speak | spoke | spoken | 74.7 % |
| 23 | become | became | become | 75.7 % |
| 24 | keep | kept | kept | 76.7 % |
| 25 | hold | held | held | 77.5 % |
Said représente à lui seul 15.4 % de tout ce qui se trouve en dehors des trois auxiliaires, car chaque ligne de dialogue dans une histoire en a besoin : “Come in,” she said. Rajoutez be, have et do, et ces 28 verbes couvrent près de neuf formes irrégulières sur dix.
Le classement se vérifie-t-il en dehors des romans victoriens ?
En grande partie, et nous l’avons testé de deux manières, car un corpus de romans surreprésente la narration au passé.
Livre par livre. Le nombre de verbes nécessaires pour une couverture de 90 % (sans be, have et do) variait de 25 dans Alice’s Adventures in Wonderland à 51 dans The Call of the Wild. Sur les 25 premiers verbes, 24 apparaissent dans les 21 livres.
Sur l’anglais moderne du web. Nous avons relancé le classement sur la liste de fréquence de mots de Peter Norvig, construite à partir du Google Web Trillion Word Corpus. Cette liste ne comporte pas d’étiquettes grammaticales, nous n’avons donc pu compter que les formes sans homographe courant, telles que went ou taken. Sur ces formes, 19 des 25 premiers verbes sont identiques dans les deux corpus, et 7 des 10 premiers. Le web favorise write, show et build (written, shown, built), qui conviennent aux instructions et aux descriptions de produits, et déclasse stand et fall, qui conviennent à la narration.
La conclusion survit aux deux tests : le noyau est constitué de quelques dizaines de verbes, et ce sont à peu près les mêmes dizaines, peu importe ce que vous lisez.
Quelles formes méritent une attention particulière ?
Le participe passé, pour une poignée de verbes. Pour la plupart des verbes, nos romans utilisent davantage le prétérit, mais lose apparaît sous forme de participe (lost) plus de deux fois plus souvent qu’au prétérit (324 contre 155), et show n’est irrégulier que dans son participe, shown.
Les participes portent le present perfect et la voix passive : I’ve lost my phone, Nothing has been decided, The house was built in 1920. Apprendre go, went, gone comme un ensemble de trois, plutôt que went seul, est ce qui vous permet d’utiliser correctement le present perfect lorsque vous atteignez le niveau A2.
Un troisième groupe se cache au grand jour : les verbes dont les trois formes sont identiques. Put, put, put est apparu 898 fois comme forme passée dans notre corpus, set 476 fois, cut 201 fois. Rien dans l’orthographe ne vous indique que la phrase est au passé ; seul le contexte le fait, comme dans Yesterday she put the letter on the table. Avec read, l’orthographe reste la même mais la prononciation change, passant de “reed” au présent à “red” au passé.
Ces verbes sont faciles à mémoriser et difficiles à remarquer, c’est pourquoi il vaut la peine de les pratiquer dans des phrases complètes plutôt que dans un tableau.
Deux autres pièges : lay est le passé de lie (s’allonger), et found est le passé de find, et non un verbe distinct, dans presque toutes les phrases que vous lirez.
Où se situe Leo par rapport aux verbes irréguliers ?
Le programme de Leo introduit les verbes irréguliers en deux vagues, et nous avons mesuré les deux par rapport au corpus. Le niveau A1 couvre be, do et huit verbes (go, see, have, say, come, take, get, make) : ces dix-là sont exactement les dix plus fréquents, et couvrent 73.8 % des formes passées irrégulières. La deuxième vague A2 en ajoute 18 autres, portant le total à 28 verbes et 87.2 %.
La mesure montre également ce que ces listes laissent de côté : begin, stand, fall, speak, become et hold sont dans le top 25 mais pas dans les deux premières vagues. Dans Leo, ils arrivent de la manière dont le reste de la longue traîne devrait le faire, à l’intérieur d’histoires de niveau adapté où le contexte permet de les deviner. L’application n’est pas encore publiée ; la liste d’attente est ci-dessous, et la progression complète se trouve sur la page des niveaux d’anglais.
Quelle est la conclusion sur les verbes irréguliers ?
Apprenez bien environ 45 verbes irréguliers, par fréquence, sous forme d’ensembles de trois formes. Cela couvre 95 % des formes passées irrégulières de notre corpus. Il vaut mieux rencontrer les verbes restants lors de vos lectures plutôt que de les mémoriser à partir d’une liste.
Les décomptes proviennent de notre propre script sur 21 romans du Projet Gutenberg (2 138 259 mots), étiquetés automatiquement, avec une vérification croisée sur la liste de fréquence web de Norvig. L’étiquetage automatique fait quelques erreurs, traitez donc les décimales comme des mesures spécifiques à ce corpus, et la forme de la courbe comme la véritable découverte.
Questions fréquentes
Combien y a-t-il de verbes irréguliers en anglais ?
Quels sont les 10 verbes irréguliers les plus courants en anglais ?
Combien de verbes irréguliers dois-je apprendre ?
Dois-je apprendre les verbes irréguliers par ordre alphabétique ?
Le participe passé est-il plus important que le prétérit ?
Ce classement s'applique-t-il à l'anglais moderne ?
Commencez à lire en anglais dès aujourd'hui
Des histoires par niveau, du grand débutant au C1 — avec audio natif, traduction au toucher et un programme calé sur le CECRL.
Un seul e-mail, le jour du lancement. Pas de newsletter, pas de relances.