Técnicas de extração de informação para avaliação da qualidade de páginas web com o uso de ontologias
A qualidade dos conteúdos das páginas Web pode ser determinada parcialmente através de indicadores como autoria da página, existência de referências as fontes e reputação do responsável pela publicação. Este artigo discute a aplicação de técnicas de extração de informação na identificação de indicad...
| Autores: | , , , , , |
|---|---|
| Tipo de documento: | artigo |
| Estado: | Versão publicada |
| Data de publicação: | 2010 |
| País: | Brasil |
| Recursos: | Universidade Federal do Rio Grande do Sul (UFRGS) |
| Repositório: | Repositório Institucional da UFRGS |
| Idioma: | português |
| OAI Identifier: | oai:www.lume.ufrgs.br:10183/265050 |
| Acesso em linha: | http://hdl.handle.net/10183/265050 |
| Access Level: | Acceso aberto |
| Palavra-chave: | Web semântica Recuperacao : Informacao |
| Resumo: | A qualidade dos conteúdos das páginas Web pode ser determinada parcialmente através de indicadores como autoria da página, existência de referências as fontes e reputação do responsável pela publicação. Este artigo discute a aplicação de técnicas de extração de informação na identificação de indicadores de qualidade, especificamente autoria. Ao contrário de outras técnicas de extração, as técnicas desenvolvidas neste trabalho não utilizam a estrutura das páginas. Neste sentido, o artigo apresenta os resultados iniciais do trabalho, aponta algum dos problemas envolvidos e identifica técnicas que podem ser úteis para continuidade do trabalho. O objetivo final do trabalho é criar uma ferramenta que possibilite avaliar a qualidade de sites com conteúdo relacionado à área de saúde. Assim, os resultados do processo de extração são utilizados para popular uma ontologia onde estão definidos os critérios de qualidade para as páginas Web. |
|---|