Um Modelo de Identificação e Desambigüização de Palavras e Contextos

  • Christian Nunes Aranha PUC-Rio
  • Maria Cláudia de Freitas PUC-Rio
  • Maria Carmelita Pádua Dias PUC-Rio
  • Emmanuel Lopes Passos PUC-Rio

Resumo


Este trabalho aborda a questão da interpretação de palavras e contextos polissêmicos, e sugere que apenas o contexto é necessário para tal interpretação, independente de uma representação interna e autônoma das palavras. O contexto é visto como um aglomerado de palavras coocorrentes com uma palavra-alvo. Esse aglomerado é decorrente de um tratamento estatístico de textos, bem como de grafos que representam os dados obtidos. Os resultados preliminares mostram que este tipo de abordagem é promissor em termos de desambigüização de palavras polissêmicas.

Referências

Cruse, D. (1986) Lexical Semantics. Cambridge: CUP.

Farkas, I.& Li, P. (2002) “Modeling the development of lexicon with a growing self-organizing map”, Proceedings of the 6th Joint Conference on Information Sciences, Research Triangle Park, NC, p. 553-556.

Fillmore, C. & Atkins, B. (2000) “Describing polisemy: the case of ‘Crawl’ ”, In: Ravin & Leacock (eds.). Polysemy. Theoretical and computational approaches. Oxford: Oxford University Press.

Firth, J. R. (1957). Papers in Linguistics – 1934-1951. Oxford: Oxford University Press.

Manning, C & Schütze, H. (1999). Foundations of Statistical Natural Language Processing. Cambridge, Massachusetts: The MIT Press.

Schütze, H. (1998). “Automatic Word Sense Discrimination”, Computational Linguistics, 24(1), 97-123.

Schütze, H & J. Pedersen.(1995). “Information retrieval based on word senses”, Proceedings of the 4th Annual Symposium on Document Analysis and Information Retrieval, Las Vegas, EUA, p. 161-175.

Taylor, J. (2003). “Polisemy’s paradoxes”, Language Sciences (25) 637-655.

Widdows, D. (2003). “A Mathematical Model for Context and Word-Meaning”, Fourth International and Interdisciplinary Conference on Modeling and Using Context, Stanford, California, June 2003, pp. 369-382.

Widdows, D & Dorow, B. (2002). “A Graph Model for Unsupervised Lexical Acquisition”, Proceedings of the 19th International Conference on Computational Linguistics (COLING 2002), Taipei, Taiwan, p.1093-1099.
Publicado
31/07/2004
ARANHA, Christian Nunes; FREITAS, Maria Cláudia de; DIAS, Maria Carmelita Pádua; PASSOS, Emmanuel Lopes. Um Modelo de Identificação e Desambigüização de Palavras e Contextos. In: SIMPÓSIO BRASILEIRO DE TECNOLOGIA DA INFORMAÇÃO E DA LINGUAGEM HUMANA (STIL), 2. , 2004, Salvador/BA. Anais [...]. Porto Alegre: Sociedade Brasileira de Computação, 2004 . p. 94-103.