About 37% of word-tokens are nouns
Richard A Hudson · Language · 1994
Une etude comparative de deux corpus de taille importante (l'un en anglais americain ecrit, l'autre en anglais britannique ecrit, contenant un million de mots chacun) revele quelques regularites statistiques : pres de 37% des occurrences lexicales appartiennent a la classe nominale ; le pourcentage des noms par classes de mots (nom commun, nom propre, pronom), la distribution des noms par type d'ecrit ( allant de l'editorial jusqu'a l'ecrit humoristique) presentent la meme constance dans les deux corpus. Cette regularite est confirmee par une etude statistique etendue sur six autres corpus de langues differentes