About 37% of word-tokens are nouns

Richard A Hudson · Language · 1994

Une etude comparative de deux corpus de taille importante (l'un en anglais americain ecrit, l'autre en anglais britannique ecrit, contenant un million de mots chacun) revele quelques regularites statistiques : pres de 37% des occurrences lexicales appartiennent a la classe nominale ; le pourcentage des noms par classes de mots (nom commun, nom propre, pronom), la distribution des noms par type d'ecrit ( allant de l'editorial jusqu'a l'ecrit humoristique) presentent la meme constance dans les deux corpus. Cette regularite est confirmee par une etude statistique etendue sur six autres corpus de langues differentes

Read the paper · More papers on PaperTik