Difference between revisions of "NER - Reconhecimento de Locais e Eventos"

From HLT@INESC-ID

 
m
 
(7 intermediate revisions by 2 users not shown)
Line 1: Line 1:
 
__NOTOC__
 
__NOTOC__
<center><font size="+2">
+
{{infobox|name=Luís Romão
Proposta de Trabalho Final de Curso 2006/2007
+
|username=
</font></center>
+
|contact=lcsr
 
+
|phone=+351-213-100-300 ext. 2514
 
+
|fax=+351-213-145-843
 +
}}
 
== Orientação ==
 
== Orientação ==
  
Line 12: Line 13:
 
== Objectivo ==
 
== Objectivo ==
  
Identificar e classificar entidades mensionadas. São exemplos de entidades mensionadas: nomes de pessoas, cargos, organizações, acontecimentos, datas, entre outros.
+
Identificar e classificar entidades mencionadas das seguintes categorias: Local, Evento e Miscelânea.
  
 
== Descrição ==
 
== Descrição ==
  
A identificação e classificação de entidades mencionadas é uma sub-tarefa da área de extracção de informação que visa localizar e classificar as palavras de um texto escrito que referem nomes de pessoas, organizações, localidades, expressões temporais, quantidades, valores monetários, percentagens, etc. Por exemplo, a frase "O Pedro comprou 300 acções da EDP em 2006" contém as seguintes entidades: (i) "Pedro" é um nome de pessoa; (ii) "300" é uma quantidade; (iii) "EDP" é uma organização; (iv) "2006" é uma data. A definição das regras (autómatos) e o acesso à informação que está disponível (lema, categoria gramatical, contexto à direita (palavra, lema, categoria) e à esquerda) faz-se através do ambiente XIP, desenvolvido pela Zerox e licenciado ao INESC-ID.
+
A identificação e classificação de entidades mencionadas é uma sub-tarefa da área de extracção de informação que visa localizar e classificar as palavras de um texto escrito que referem nomes de pessoas, organizações, localidades, expressões temporais, quantidades, valores monetários, percentagens, etc. Por exemplo, a frase "O Pedro comprou 300 acções da EDP em 2006" contém as seguintes entidades: (i) "Pedro" é um nome de pessoa; (ii) "300" é uma quantidade; (iii) "EDP" é uma organização; (iv) "2006" é uma data. A definição das regras (autómatos) e o acesso à informação que está disponível (lema, categoria gramatical, contexto à direita (palavra, lema, categoria) e à esquerda) faz-se através do ambiente XIP, desenvolvido pela Xerox e licenciado ao INESC-ID. Também se pretende desenvolver uma ferramenta que permita a procura, em corpora, de padrões morfo-sintácticos. A categoria Local inclui: estradas, trajectórias, regiões (bairros, freguesias, vilas, aldeias, cidades, províncias, países, continentes, dioceses), estruturas (pontes, portos, barragens), locais naturais (montanhas, cadeias montanhosas, florestas, rios, poços, campos, vales, jardins, reservas naturais, praias, parques naturais), espaços públicos (praças, ópera, museus, escolas, mercados, aeroportos, estações, piscina, hospitais, instalações desportivas, centros de juventude, parques, câmara municipais, teatros, cinemas, galerias, parques campismo, universidades, bibliotecas, igrejas, centros médicos, parques de estacionamento, parques infantis, cemitérios, ...), espaços comerciais (farmácias, bares, restaurantes, hotéis, discotecas, pousadas, ...), outros edifícios (casas, mosteiros, creches, moinhos, aquartelamentos, castelos, lares, torres, pátios), locais abstractos feitos pelo homem. A categoria Evento inclui: conferências, festivais, eventos desportivos, fóruns, festas, concertos, guerras, batalhas, ... A categoria Miscelânea inclui: religiões, ideologias políticas, nacionalidades, línguas.
  
 
== Outros Dados ==
 
== Outros Dados ==
  
* Proposto por Luís Romão (#51035) e João Loureiro (#51015)
+
* Ano lectivo: 2006/2007
* Áreas Científicas:
+
* Unidades curriculares:  
* Local de trabalho: L²F (INESC-ID Lisboa).
+
  
 
[[category:Research]]
 
[[category:Research]]
[[category:Graduation Theses]]
+
[[category:Theses]]
 +
[[category:Masters Theses]]

Latest revision as of 19:53, 3 December 2007

Orientação

Objectivo

Identificar e classificar entidades mencionadas das seguintes categorias: Local, Evento e Miscelânea.

Descrição

A identificação e classificação de entidades mencionadas é uma sub-tarefa da área de extracção de informação que visa localizar e classificar as palavras de um texto escrito que referem nomes de pessoas, organizações, localidades, expressões temporais, quantidades, valores monetários, percentagens, etc. Por exemplo, a frase "O Pedro comprou 300 acções da EDP em 2006" contém as seguintes entidades: (i) "Pedro" é um nome de pessoa; (ii) "300" é uma quantidade; (iii) "EDP" é uma organização; (iv) "2006" é uma data. A definição das regras (autómatos) e o acesso à informação que está disponível (lema, categoria gramatical, contexto à direita (palavra, lema, categoria) e à esquerda) faz-se através do ambiente XIP, desenvolvido pela Xerox e licenciado ao INESC-ID. Também se pretende desenvolver uma ferramenta que permita a procura, em corpora, de padrões morfo-sintácticos. A categoria Local inclui: estradas, trajectórias, regiões (bairros, freguesias, vilas, aldeias, cidades, províncias, países, continentes, dioceses), estruturas (pontes, portos, barragens), locais naturais (montanhas, cadeias montanhosas, florestas, rios, poços, campos, vales, jardins, reservas naturais, praias, parques naturais), espaços públicos (praças, ópera, museus, escolas, mercados, aeroportos, estações, piscina, hospitais, instalações desportivas, centros de juventude, parques, câmara municipais, teatros, cinemas, galerias, parques campismo, universidades, bibliotecas, igrejas, centros médicos, parques de estacionamento, parques infantis, cemitérios, ...), espaços comerciais (farmácias, bares, restaurantes, hotéis, discotecas, pousadas, ...), outros edifícios (casas, mosteiros, creches, moinhos, aquartelamentos, castelos, lares, torres, pátios), locais abstractos feitos pelo homem. A categoria Evento inclui: conferências, festivais, eventos desportivos, fóruns, festas, concertos, guerras, batalhas, ... A categoria Miscelânea inclui: religiões, ideologias políticas, nacionalidades, línguas.

Outros Dados

  • Ano lectivo: 2006/2007
  • Unidades curriculares: