Linguateca
URI permanente desta comunidade:
O objectivo da Linguateca, um centro de recursos -- distribuído -- para o processamento computacional da língua portuguesa, é servir a comunidade que se dedica ao processamento da nossa língua. Em particular, facilitar o acesso aos recursos já existentes, através do desenvolvimento de serviços de acesso na rede, e mantendo um portal com informação útil; desenvolver em colaboração com os interessados,
Notícias
Ligações:
Navegar
Percorrer Linguateca por Domínios Científicos e Tecnológicos (FOS) "Humanidades"
A mostrar 1 - 4 de 4
Resultados por página
Opções de ordenação
- Comida e bebida nas literaturas portuguesa e brasileira: o projeto ReadingFoodPublication . Santos, Diana; Bick, Eckhard; Mota, CristinaNeste artigo descrevemos brevemente o projeto ReadingFood sobre o campo semântico da comida e bebida na literatura, que pretende comparar as obras de quatro países no período 1840-1920, mas cingindo-nos a Portugal e ao Brasil. Após apresentar as infraestruturas já desenvolvidas, tornando pública a pesquisa neste domínio, apresentamos o trabalho já feito e alguns estudos preliminares: a criação de uma taxonomia do domínio na literatura, a desambiguação em contexto, e o estudo de refeições (ou eventos relacionados com comida e bebida).
- Culinária brasileira: um CorTrad mais saboroso com o CulBrasPublication . Rebechi, Rozane R.; Santos, Diana; Tagnin, Stella E. O.; RebechiEmbora muitos acreditem que traduzir receita culinária é algo corriqueiro, o tradutor experimenta problemas de diversos tipos ao se lançar a essa tarefa, desde a busca por equivalências lexicais até caracterı́sticas culturais. Uma fonte de consulta que pode ser de grande auxı́lio é um corpus paralelo, ou seja, textos numa lı́ngua com suas respectivas traduções. O CorTrad culinário, lançado em 2008, numa parceria entre o COMET e a Linguateca, tem desempenhado esse papel, permitindo vários tipos de pesquisas. É composto das receitas de um livro escrito originalmente em português, acompanhado de suas traduções em inglês. Neste artigo apresentamos um novo corpus culinário, o CulBras, composto apenas por receitas brasileiras, originalmente escritas em português e suas respectivas traduções em inglês, totalizando aproximadamente 120.000 palavras em cada lı́ngua. O processo de construção desse corpus é apresentado em detalhes, assim como são relatadas várias pesquisas possı́veis com os dois corpora, inclusive com a comparação entre eles. Convidamos os leitores a se deliciarem com o CulBras.
- Marcação de correferência para a caracterização de personagens em obras literárias em portuguêsPublication . Santos, Diana; Lima, Luisa; Pires, Emanoel; Souza, Marlo; de-Dios-Flores, Iria; Santos, Diana; Freitas, Larissa; Cruz Souza, Jackson Wilke da; Ribeiro, EugénioNeste artigo descrevemos a adição de correferência a corpos literários públicos, para a tarefa de caracterização de personagens na leitura distante. Começamos por motivar essa tarefa na área dos estudos literários computacionais, explicamos a forma como tornamos essa tarefa legível e revisável a pessoas da área dos Estudos Literários, transferindo para o BRAT, descrevemos os primeiros resultados e um pequeno corpo anotado público, assim como discutimos a criação de dois módulos de correferência.
- Paraphrase and translation: the importance of being closePublication . Santos, Diana; Barreiro, AnabelaThis article explores the concept of paraphrasing within computational linguistics, seeking to enrich its understanding by drawing parallels with translation studies and especially machine translation. It highlights the existence of two distinct yet related tasks: paraphrase generation and paraphrase detection, as well as points out the many (sometimes implicit) contact points in evaluation in both translation and paraphrasing. We claim that the concept of near-synonymy or near- equivalence is a shared concern of both disciplines, and its formalization should be pursued.
