Effects of High-Order Co-occurrences on Word Semantic Similarity

Benoı̂t Lemaire, Guy Denhière · Current psychology letters · 2006

Nous présentons un modèle informatique de la construction de la signification des mots par l'exposition aux textes, dans le but de simuler, paragraphe après paragraphe, les effets des valeurs de cooccurrence sur les similarités sémantiques intermots. La similarité est ici considérée comme une association sémantique. Les résultats montrent que la similarité entre deux mots M1 et M2 augmente fortement avec leur cooccurrence, diminue avec l'occurrence de M1 sans M2 ou de M2 sans M1, et augmente légèrement avec des cooccurrences d'ordre supérieur. Opérationnaliser la similarité par la fréquence de cooccurrence introduit donc probablement un biais : tout d'abord, il existe des cas pour lesquels il existe une similarité sans cooccurrence, et d'autre part, la fréquence de cooccurrence surestime la similarité.

Read the paper · More papers on PaperTik