Oto Araújo Vale
LENomes em Citação: VALE, Oto Araújo; VALE, Oto; ARAUJO-VALE, Oto; VALE, O.A.; Vale, Oto A.
Departamento de Letras
Resumo do Currículo Lattes
Graduou-se em Sciences du Langage - Universite de Paris VIII (1989), tem mestrado (DEA) em Sciences du Langage (DEA) - Universite de Paris VIII (1990) e doutorado em Linguística e Língua Portuguesa pela Universidade Estadual Paulista Júlio de Mesquita Filho (2002). Foi Professor Visitante na Universidade do Algarve no programa Erasmus Mundus, da Comunidade Europeia (2008) e pesquisador convidado na Université Catholique de Louvain (2014/2015). É Professor Associado do Departamento de Letras da Universidade Federal de São Carlos, onde atua na graduação e na pós-graduação. Tem experiência na área de Linguística, com ênfase em Linguística Computacional, atuando principalmente nos seguintes temas: expressões cristalizadas, léxico-gramática, dicionários eletrônicos e linguistica de corpus.
Painel de Gráficos e Inteligência de Produção
Análise cronológica da produção científica, intelectual e formação de recursos humanos ao longo dos anos.
Evolução da Produção por Categoria (Histórico Anual)
1985 - 2026Distribuição por Categoria
123 itens
Histórico de Orientações Concluídas por Nível
62 concluídas, 10 em andamento
Produção Científica Indexada em Bases Internacionais
Cruzamento entre os artigos publicados pelo docente, as revistas científicas e as bases internacionais de indexação.
Trabalhos por Base de Indexação
Distribuição dos artigos publicados pelo docente nas bases de dados indexadoras.
Evolução Temporal da Indexação por Base (1985–2026)
Histórico comparativo do número anual de artigos publicados em periódicos indexados.
Principais Colaboradores e Rede de Coautoria
Pesquisadores e docentes com maior volume de trabalhos e produções em parceria
Palavras-chave dos Trabalhos
Cadastradas pelo autor nos artigos e produções no Lattes
Temas e Termos Frequentes
Sintagmas e conceitos mais recorrentes nos títulos
Artigos em Periódicos (21)
Não diga nunca jamais: anotação de indicadores lexicais da negação no português Autores
A elaboração de um léxico-gramática para os adjetivos do Português Brasileiro
Dependência: o conceito e as gramáticas
Transcrição automática de entrevistas e anotação Universal Dependencies no Corpus Roda Viva
Falsos diminutivos do português brasileiro e seu reconhecimento em um dicionário computacional de livre acesso
Bases lexicais verbais do português brasileiro
ASPECTO VERBAL NAS CONSTRUÇÕES COM VERBO-SUPORTE
BAPTISTA, Jorge; MAMEDE, Nuno. Dicionário Gramatical de Verbos do Português. Faro: Universidade do Algarve Editora, 2020. 1117 p.
Comentcorpus
RECONHECIMENTO DO VOCABULÁRIO DE JORNAIS POPULARES BRASILEIROS POR UM DICIONÁRIO COMPUTACIONAL DE ACESSO LIVRE
Relações formais entre expressões cristalizadas e as construções verbais locativas livres
Análise sintático-semântica das construções verbais locativas da língua portuguesa
INTEGRAÇÃO DE PREDICADOS NOMINAIS EM PARSER: UMA EXPERIÊNCIA COM AS CONSTRUÇÕES COM O VERBO-SUPORTE DAR EM PORTUGUÊS BRASILEIRO
Construções Conversas do Português do Brasil
Delimitação das expressões adjetivais
Um corpus anotado de construções com verbo-suporte em Português
Tipologia das construções verbais em PB: uma proposta de classificação do verbo dar
EXPRESSÕES CRISTALIZADAS: TRANSPARÊNCIA E OPACIDADE
Substantivos portugueses não flexionam em gênero
Une classification des expressions figées du portugais du Brésil
Expressões cristalizadas negativas estativas
Livros Publicados ou Organizados (3)
Dialogar é preciso: linguística para o processamento de línguas
Avanços da linguística de corpus no Brasil
Filosofia, lingüística, informática: aspectos da linguagem
Capítulos de Livros Publicados (16)
Minhas contribuições como coordenador do PPGL da UFSCar
Linguistic Analysis Model for Monitoring User Reaction on Satirical News for Brazilian Portuguese
Measuring the Impact of Readability Features in Fake News Detection
ComentCorpus: o uso de mecanismos linguísticos na detecção de ironia e sarcasmo para o português do Brasil em um corpus opinativo
Contributions to the Study of Fake News in Portuguese: New Corpus and Automatic Detection Results
Fazer um exame: análise de predicados nominais com o verbo-suporte ?fazer? no Português do Brasil
Estudo contrastivo sobre as construções conversas em PB e PE
Proverb Variation: Experiments on Automatic Detection in Brazilian Portuguese Texts
As opiniões nas expressões e a expressão da opinião
Indentificação de expressões fixas em grandes corpora: até onde podem ir os métodos estatísticos?
Como os lexicógrafos poderiam descrever satisfatoriamente as colocações?
Do texto ao termo: interação entre Terminologia, Morfologia e Lingüística de Corpus na extração semi-automática de termos
An Evolutionary Method for Natural Language to SQL Translation
Classificação de expressões cristalizadas construidas com verbo suporte: primeira aboradagem
Some Regularities of Frozen Expressions in Brazilian Portuguese
Sintaxe, léxico e expressões idiomáticas
Textos em Jornais de Notícias / Revistas (3)
Palavras Essenciais
L'enfer pavé de bonnes intentions de John Boorman
Rencontre avec Joaquim Pedro de Andrade.
Trabalhos em Anais de Congressos & Apresentações (59)
A Lexicon-Grammar of Brazilian Portuguese Predicative Adjectives
The F1 of Formula One: Applicability of Pre-trained NER Models to Brazilian TV Interview Transcripts
Say ?No? to Missing Polarity: A Negation Enrichment of the Porttinari UD Treebank
Análise da Anotação de Negação em Corpora sob as Diretrizes da Universal Dependencies
O Obstáculo das Ambiguidades Estruturais da Língua para Modelos de Linguagem Linguisticamente Motivados
Elevação de sujeito e objeto da completiva-sujeito de adjetivos em português do Brasil
Using Large Language Models for Identifying Satirical News in Brazilian Portuguese
Towards a Syntactic Lexicon of Brazilian Portuguese Adjectives
Roda Viva boundaries: an overview of an audio-transcription corpus
Roda Viva: um corpus oral e a Universal Dependencies
Satiricorpus.br: a corpus of satirical news for brazilian portuguese
Linguistic and emotional dynamics in satirical vs. real news: a psycholinguistic analysis
Complementos de eco de adjetivos com completiva-sujeito em português do Brasil
Um estudo das construções dar + para + V [infinitivo] nas Universal Dependencies
Formal features for a syntactic-semantic classification of predicative adjectives in Brazilian Portuguese
A propósito do verbo falar no português brasileiro: uma análise em corpus e em bases de dados verbais
Sofrer uma ofensa, Receber uma advertência: Verbos-suporte Conversos de 'Fazer' no Português do Brasil
As bases de dados verbais ADESSE e ViPEr: uma análise constrastiva das construções locativas em espanhol e em português
Integrating support verb constructions into a parser
Novo dicionário de formas flexionadas do Unitex-PB: avaliação da flexão verbal
Análise contrastiva da classificação sintático-semântica dos verbos locativos no Português do Brasil e no Português europeu
Automatic Detection of Proverbs and their Variants
The fuzzy boundaries of operator verb and support verb constructions with dar 'give' and ter 'have' in Brazilian Portuguese
Description and Classification of Nominal Predicates with the Support Verb Fazer (Make/Do) in Brazilian Portuguese
Predicative Nouns Suffixation associated to the verb dar(give) in Brazilian Portuguese
False diminutives in Brazilian Portuguese
Brazilian Portugueses nominal predicates with 'fazer' (make/do): sports
Classes de objeto no futebol: resultados
Uma tipologia dos falsos diminutivos no português do Brasil
Antonymy in the Descriptive Adjectives of Brazilian Portuguese: a Proposal for Analysis
Identificação de expressões fixas em corpora: até onde podem ir os métodos estatísticos?
Building a large dictionary of abbreviations for named entity recognition in Portuguese historical corpora
DALILA - DICIONARIO AUTOMÁTICO DA LÍNGUA LATINA
Elaboração de um Glossário Automático Bilíngüe com Base no Modelo de Classes de Objetos
Construção de um dicionário eletrônico da língua latina
Problemas de sintaxe para os estudos lexicológicos
Expressões cristalizadas comparativas
Dicionário eletrônico de formas verbais compostas do português do Brasil: tipologia das expressões construídas com o verbo dizer
Etiquetas semânticas em dicionários eletrônicos
Ferramentas computacionais em Lingüística de Corpus : a construção de Classe de Objetos
Classificação de expressões cristalizadas construídas com verbo suporte: primeira abordagem
Expressões cristalizadas com sujeito livre e dois complementos fixos
Les expressions figées du portugais du Brésil
O debate Léxico Enciclopédia e o estudo do léxico do português brasileiro
Les expressions figées du portugais du Brésil
Classificação de expressões cristalizadas
Transparência e opacidade de expressões cristalizadas
Expressões cristalizadas estativas negativas
Apassivação de expressões cristalizadas verbais
Valência de expressões cristalizadas
Léxico: sistema e uso
Transparência e opacidade em expressões cristalizadas
Constituição de um corpus de língua falada de diálogos entre profissionais de ciências agrárias e homens do campo no interior de Goiás
Amplitude do léxico para aplicações computacionais
Dicionários eletrônicos e dicionários de frequência
Note sur la préposition a en portugais du Brésil
Descrição dos verbos com prefixo des- no português do Brasil
Descrição das variantes em -ejar e -ear nos verbos do português do Brasil
Descrição dos verbos com prefixo a- no português do Brasil
Trabalhos Técnicos, Pareceres e Consultorias (13)
Nomes predicativos do português
Corpus Roda Viva
Parecer para a Revista do GEL
Parecer para Fapes
Parecer para Revista Signotica
Parecer para a Revista do GEL
Parecer para a Revista Estudos Linguísticos
Parecer para a Revista Signótica
Parecer para a Revista do GEL
Parecer para a Revista Estudos Linguísticos
Parecer para a Revista Estudos Linguísticos
Membro do Conselho Editorial do livro 'Região, Nação, Identidade', organizado por Ofir Bergemann de Aguiar
Elaboração de estudo sobre a Pesquisa e a Extensão no Departamento de Letras
Inovação Tecnológica: Softwares e Patentes (1)
Unitex - Corpus processor
Demais Tipos de Produção (7)
Apresentação do vol. 39 (2010)
Editorial
Editorial
Editorial
Unitex - Manual de utilização
Apresentação de "Les Temps Modernes"
O contrato natural
Orientações Concluídas (62)
9 Doutorado • 13 Mestrado • 1 Pós-Doc • 17 TCC/Graduação • 20 PIBIC • 2 Outras
Ryan Marçal Saldanha Magaña Martinez
"A sintaxe-semântica dos adjetivos predicativos no português brasileiro: uma proposta taxonômica"
Claudia Dias de Barros
Ester Gonçalves de Oliveira
"Chatbots: a importância do processamento de linguagem natural para a experiência do usuário"
Isaac Souza de Miranda Junior
"Não é nada não: Uma análise das lexias negativas do português para anotação nas Universal Dependencies"
Francimeire Leme Coelho
"Uma análise comparativa das construções com verbos psicológicos do português brasileiro e eurpoeu"
Nathalia Perussi Calcia
"Dar e receber um abraço: uma análise da Conversão em Português brasileiro"
Gabriela Wick Pedro
"Aspectos linguísticos na descrição de notícias satíricas do português do Brasil: uma proposta tipológica"
Julia Trovo Caetano de Jesus
"Identificação das construções com os verbo suporte com intenção avaliativa em reviews de produtos em revies de produtos"
Bianca Moreira Lopes
"Aplicação da anotação de corpus para o e-commerce"
Larissa Picoli
"Contínuo e limite entre expressões cristalizadas e construções com verbo suporte à luz do Léxico-Gramática"
Ryan Marçal Saldanha Magaña Martinez
"Padrões transformacionais da relação predicado argumento dos substantivos predicativos em português brasileiro"
Roana Rodrigues
"Contribuições para um léxico-gramática das construções locativas do espanhol"
Guilherme Cazzini Cardoso
"Análise de sentimentos para detecção de noticias potencialmente falsas"
Guilherme Cazzini Cardoso
"Uma análise da polarização adjetival para identificação de notícias potencialmente falsas: Como a análise de sentimentos pode identificar fake news"
Gabriela Wick Pedro
"ComentCorpus: identificação e pistas linguísticas para detecção de ironia no português do Brasil"
Renata Maria Odorissio
"Variação denominativa nas modalidades oral e escrita: o léxico da culinária na Internet"
Simeia Rafaela Nunes Casati
"Diminutivos como indicadores de ironia em um corpus do português brasileiro"
Adriele Beatriz Kucinskas
"Comparação entre léxicos do português e do castelhano"
Amanda dos Santos Carneiro
"Descrição e classificação das expressões cristalizadas com ser e estar no português do Brasi"
Roana Rodrigues
"Análise contrastiva dos verbos locativos do português do Brasil e do português europeu"
Nathália Perussi Calcia
"Descrição e classificação das construções conversas no português do Brasil"
Maria Cristina Andrade dos Santos
"Descrição dos predicados nominais com o verbo-suporte"
Amanda Pontes Rassi
"Descrição, classificação e processamento automático das construções com o verbo dar em português brasileiro"
Cláudia Dias de Barros
"Descrição e classificação de predicados nominais com o verbo-suporte fazer no português do Brasil"
Amanda Enei Francatto
"Língua Estrangeira: Equivalências entre construções nominais com os verbos- suporte dar/fazer/ter e verbos plenos"
Adriele Beatriz Kucinskas
"Revisão de Grafos do sistema Unitex"
Amanda dos Santos Carneiro
"Expressões adjetivais do português do Brasil"
Nathália Perussi Calcia
"Revisão de grafos de flexão nominal do Unitex"
Roana Rodrigues
"Dificuldades apresentadas por hispanofalantes na produção de textos acadêmicos em língua portuguesa: a questão dos heterogenéricos"
Amanda dos Santos Carneiro
"Polaridade das expressões adjetivais do português do Brasil"
Nathalia Perussi Calcia
"O acordo ortográfico aplicado aos grafos e dicionários do Unitex"
Camila de Araújo Azevedo
"Construção de corpora de domínio específico: efeito estufa"
Ana Carolina Siani Lopes
"Identificação e classificação das construções com o verbo-suporte"
Roana Rodrigues
"Falsos aumentativos nos substantivos do português do Brasil"
Maria Beatriz Escanhuela Sajovic
"Construções com nomes de doenças em português do Brasil"
Debora Scopim
"Estudo de padrões lexicais em textos opinativos"
Renata Maria Odorissio
"As Classes de Objeto na construção de equivalências para glossário francês-português: o verbo na cozinha"
Maria Cristina Andrade dos Santos
"Proposta de construção de uma ontologia do domínio do futebol com base no modelo de classes de objeto"
Cláudia Dias de Barros
"Antonímia nos adjetivos descritivos: proposta de uma análise nos adjetivos do português do Brasil"
Roana Rodrigues
"Falsos diminutivos nos substantivos do português do Brasil"
Zenilde Nunes Batista
"Estrutura linguística e informação: uma introdução à abordagem de Zellig S. Harris sobre os fenômenos da língua"
Amanda Pontes Rassi
"Estatuto sintático-semântico do verbo fazer no português escrito do Brasil."
Parla Camila dos Reis de Souza
"Aquisição de entradas para um dicionário eletrônico da língua latina"
Zenilde Nunes Batista
"Expressões cristalizadas de matriz comparativa"
Amanda Pontes Rassi
"Análise da acepções do verbo fazer em dicionários de língua portuguesa"
Maria Cristina Morais Carvalho
"Preliminares para uma tipologia das expressões cristalizadas construidas com o verbo ter"
Amanda Pontes Rassi
"Expressões cristalizadas construidas com o verbo FAZER"
Maria Cristina Morais Carvalho
"Expressões cristalizadas com verbo TER"
Marina Silveira de Melo
"Expressões cristalizadas com o verbo dizer"
Fabrício José dos Santos Brito
"Considerações preliminares no estudo do léxico da musicoterapia"
Isis Gardênia Kato de Sousa
"Expressões cristalizadas com verbos de comunicação"
Ana Debora Rodrigues Silva
"Monitoria da disciplina Português II"
Roberta Rocha Ribeiro
"Expressões cristalizadas construidas com o verbo DAR"
Fernanda Avelina de Jesus
"Monitoria da disciplina Lingüística I"
Lilian Virginia Porto
"Estudo preliminar para a construção de um dicionário eletrônico de doenças bovinas do cerrado"
Luciene Gomes Marçal
"Estudo preliminar para a construção de um dicionário eletrônico de plantas medicinais do cerrado"
Miguel Raimundo de Oliveira Neto
"Construção de um Dicionário Eletrônico para o Português do Brasil"
Layane Garcia de Souza
"Construção de um Dicionário Eletrônico para o Português do Brasil"
Rodrigo de Oliveira Caldas
"Os prefixos re- e des- nos verbos do português do Brasil"
Joana Plaza Pinto
"O Prefixo en-/em- nos verbos do português do Brasil"
Rodrigo de Oliveira Caldas
"O prefixo des- nos verbos do português do Brasil"
Rodrigo de Oliveira Caldas
"O prefixo re- nos verbos do português do Brasil"
Orientações em Andamento (10)
4 Doutorado • 1 Mestrado • 1 TCC/Graduação • 4 PIBIC
Isabelli Hernandes Leite
"Anotação e gramática"
João Pedro Gonçalves Munhoz
"Uma rede de entidades nomeadas no córpus de entrevistas do Roda Viva"
Velamina Fernando Paulo
"Multilinguismo na Guiné Bissau"
Valéria Vieira dos Santos
"Tipologia da Hesitação em Entrevistas Jornalísticas"
Gabriela Langame Oliveira
"Um manual de transcrição de entrevistas televisivas"
Brenda Raphaela Fernandes de Oliveira
"Análise diacrônica da variação lexical nas entrevistas de economia do Roda Viva"
Isabella Martins Belchior
"Transcrição e anotação de entrevistas"
Elza Scapin da Silva
"Anotação em entrevistas"
Isaac Souza de Miranda Junior
"O Escopo da Negação no Português: taxonomia, sistematização e implementação"
Marcella Monteiro Lemos Couto
"Construção de um NomBank para o português brasieiro"
Projetos de Pesquisa, Extensão & Desenvolvimento (14)
Dicionário eletrônico de formas verbais compostas do português do Brasil: tipologia das expressões construídas com os verbos estar, ser, ficar, ter, dar, levar e fazer
O projeto visa dar continuidade à construção de um dicionário eletrônico das formas verbais compostas do português do Brasil, ao fazer uma classificação das expressões construídas com os verbos estar, ser, ficar, ter, dar, levar e fazer. Essa classificação será feita de acordo com as características sintático-semânticas de cada expressão.
Projeto para uma descrição das estruturas sintáticas dos verbos do português do Brasil
O trabalho desenvolvido é o início de uma classificação sistemática das construções verbais do português do Brasil, com vistas à construção de seu Léxico-Gramática
Projeto DALILA - A constituição de um Dicionário Automático da Língua Latina
Este projeto tem como objetivo a construção de um dicionário eletrônico que deverá conter todas as formas flexionadas da língua latina a partir de um estudo preciso de sua morfologia e sintaxe. O dicionário deverá ter o formato DELA (Paumier, 2004) e será construído com o auxílio do software Unitex. A lista de palavras será obtida inicialmente a partir de manuais e, em seguida, a partir de textos reais de autores latinos do período helenístico e clássico. Serão construídos os autômatos de flexão para o Sistema Nominal e para o Sistema Verbal para dar conta de todas as ocorrências das listas obtidas. Com esse trabalho, esperamos elaborar uma ferramenta eficaz na aquisição do latim por meio do tratamento automático de seu vocabulário, morfologia e sintaxe, como também aprofundamento para os que já têm um conhecimento das estruturas do idioma. Por outro lado, enfim, tencionamos também proporcionar, com base em teorias lingüísticas contemporâneas, estudos concernentes aos diferentes campos lexicais e semânticos do latim, conforme o encaminhamento da pesquisa.
O modelo das Classes de Objeto: aplicação aos léxicos da culinária, do futebol e das finanças
O projeto tem como finalidade o estudo do modelo das classes de objeto com vistas a sua aplicação no português do Brasil. Tal estudo visa estabelecer um tipo de descrição semântica do léxico para aplicações em Processamento de Linguagem Natural, tais como: busca automática, tradução automática e web semântica.
Léxico-Gramática dos verbos do português do Brasil: proposta de uma classificação sistemática
projeto tem como objetivo estabelecer uma classificação sistemática dos verbos do português do Brasil por meio da metodologia da teoria do Léxico-Gramática em tabelas binárias nas quais as linhas são as entradas e as colunas as propriedades sintático-semânticas de cada entrada. O projeto leva em conta o fato de já existir para o português do Brasil um bom número de descrições de diversos pontos de vista teóricos sobre a estrutura argumental, tanto dos verbos quanto de outros elementos predicativos. Tais estudos serão levados em conta quando da classificação Pretende-se assim sistematizar em classes relativamente homogêneas esse conhecimento já desenvolvido para que essa classificação possa ser utilizada tanto na produção de novos trabalhos quanto no processamento de linguagem natural.
Um ou dois retratos da predicação no português
No presente projeto busca-se estabelecer uma visão de síntese da predicação na língua portuguesa. A partir de diversos trabalhos já realizados que tiveram por objeto a descrição da sistemática da estrutura da predicação de verbos, substantivos predicativos (e seus respectivos verbos-suporte) e adjetivos predicativos, pretende-se estabelecer uma perspectiva geral de como essa predicação se estrutura em termos de conjuntos de predicados relativamente extensos e semanticamente homogêneos. De fato, existe a necessidade de se estabelecer uma trabalho comparativo que sintetize, a partir de conjuntos homogêneos já identificados (como, por exemplo, predicados que nomeiam atos violentos, esportes, expressão de opinião, dentre outros), tanto do português europeu como do português do Brasil. Nesse sentido, é possível notar que esses conjuntos não se restringem a apenas uma classe gramatical, e que um trabalho de síntese poderia dar uma nova luz de como a predicação se organiza. A comparação sistemática de propriedades léxico-sintáticas e semânticas parece ser o caminho mais adequado para o estabelecimento de um repertório de semelhanças e fraturas entre as duas variantes do português estudadas aqui. Para tanto, é necessária a interação constante entre pesquisadores que tenham competência nativa de cada uma das variantes para identificar as grandes e pequenas diferenças entre construções semelhantes. Os resultados obtidos a partir desse trabalho serão objeto de ampla divulgação em revistas científicas. Os dados obtidos deverão ser utilizados em aplicações informatizadas e também, espera-se, em materiais didáticos destinados sobretudo ao ensino de português como língua estrangeira. A partir dos dados espera-se também a criação de um marco para novos trabalho que avancem sobre outros temas em outros níveis de descrição.
ReSGaT - Representação do Significado e Gramática Transformacional
Neste projeto pretende-se explorar e desenvolver um método de representação do significado baseado na perspectiva da gramática transformacional de operadores, estabelecendo a ponte entre a análise sintática linear expressa por relações de dependência (dependency parsing) e a determinação das formas de frase da base da gramática (as frases elementares, expressão de predicados semânticos) e dos processos que presidem à sua concatenação num discurso, incluindo os processos de transformação e redução. Um dos objetivos do projeto é a constituição de um corpus de textos anotados com essa informação linguística sob a forma de semilattices (grafos acíclicos), a partir da representação da análise sintática automática (dependency parse tree), na forma de dependências sintático-semânticas (sujeito, complemento, modificador, determinante, etc.). Tal recurso pretende abrir caminho a: (i) uma perspectiva sistemática dos principais fenómenos de concatenação das formas de base do léxico-gramática da língua nas formas efetivamente observadas nas frases dos discursos (ii) a aplicação de métodos de aprendizagem automática a partir dos grafos de dependências produzidos pelos analisadores sintáticos (parse tree) à construção destas representações em lattice; (iii) o cálculo semântico do significado das expressões linguísticas (frases) e sua exploração em diversas aplicações de processamento de língua natural.
Roda Viva: a construção de um córpus
O Roda Viva é um programa de entrevistas da TV Cultura que existe desde 1986. Trata-se do principal programa de entrevistas da televisão brasileira. Em 2007, foram transcritas integralmente 713 entrevista e foram disponibilizadas no Portal Roda Viva. O córpus Roda Viva é um córpus multimodal, abrangendo um subcórpus escrito e um subcórpus de fala, proporcionando assim duas modalidades de análise linguística.Esse corpus é construído, inicialmente, a partir do Portal Roda Viva. Pretende-se tornar disponíveis versões diferentes do córpus, como: (a) o texto transcrito, nos formatos json e CSV; (b) o texto com anotação de POS; (c) uma anotação sintática do córpus dentro do quadro das Universal Dependencies. A partir desse córpus, poderão ser realizados diferentes tipos de estudos linguisticos e dentro do campo das Humanidades Digitais.
NegScopePT- Negation Scope in Portuguese: taxonomy, systematization and implementation
Automatic detection of negation clues in an utterance and the elements that are modified by them, its scope, has become extremely relevant for Natural Language Processing (NLP). This importance has been demonstrated specifically in clinical health corpus (JIMÉNEZ-ZAFRA et. al, 2020, p,190). Concerning Portuguese, there are still a fell works on this subject: usually, the negation processing is made due to another activity that requires this type of detection (SAIAS et al, 2015; SAIAS et al, 2018; ANCHIÊTA, 2018; ALMEIDA NETO et al, 2021; OLIVEIRA et al, 2022, among others). Thus, this project aims to develop a linguistic-computational method capable of automatically identifying the negation scope in Portuguese sentences through dependency rules using the Universal Dependencies methodology (UNIVERSAL DEPENDENCIES, 2021), a morphosyntactic annotation. For this, it is intended to annotate the elements that indicate negation in the Porttinari corpus (PARDO et al, 2021) so that will serve as a language model for the UDPipe parser (STRAKA et al, 2016, STRAKA 2018). Finally, the automatic analysis of the parser will be used by the method so that, based on a set of rules, it can identify the scope negation through the syntax of the utterances.
NegScopePT- Negation Scope in Portuguese: taxonomy, systematization and implementation
Automatic detection of negation clues in an utterance and the elements that are modified by them, its scope, has become extremely relevant for Natural Language Processing (NLP). This importance has been demonstrated specifically in clinical health corpus (JIMÉNEZ-ZAFRA et. al, 2020, p,190). Concerning Portuguese, there are still a fell works on this subject: usually, the negation processing is made due to another activity that requires this type of detection (SAIAS et al, 2015; SAIAS et al, 2018; ANCHIÊTA, 2018; ALMEIDA NETO et al, 2021; OLIVEIRA et al, 2022, among others). Thus, this project aims to develop a linguistic-computational method capable of automatically identifying the negation scope in Portuguese sentences through dependency rules using the Universal Dependencies methodology (UNIVERSAL DEPENDENCIES, 2021), a morphosyntactic annotation. For this, it is intended to annotate the elements that indicate negation in the Porttinari corpus (PARDO et al, 2021) so that will serve as a language model for the UDPipe parser (STRAKA et al, 2016, STRAKA 2018). Finally, the automatic analysis of the parser will be used by the method so that, based on a set of rules, it can identify the scope negation through the syntax of the utterances.
Quem fala o quê no Roda Viva? - Identificação de temas e opiniões num córpus de entrevistas
O projeto busca analisar, organizar e expandir um conjunto-base de 713 entrevistas do programa Roda Viva, transmitido desde 1986, para construir um corpus multimodal que combine texto, áudio e vídeo. O estudo almeja ampliar o acesso e a utilidade dessas entrevistas, utilizando ferramentas de processamento de linguagem natural (PLN) e linguística de corpus. A pesquisa propõe identificar temas, entidades nomeadas e padrões discursivos nas entrevistas, abordando desafios como a anotação linguística, a análise semântica e a variação lexical ao longo do tempo. A partir de transcrições disponíveis no portal Memória Roda Viva e vídeos associados, o projeto organiza os dados em um repositório estruturado, contendo formatos como JSON e CSV, com metadados detalhados. Também são empregadas ferramentas baseadas no modelo Universal Dependencies, como um etiquetador de elementos lexicais e um parser treinado especificamente para o português brasileiro. O cronograma de três anos envolve etapas como a avaliação de modelos de linguagem de código aberto e a identificação de temas usando grandes modelos de linguagem (LLMs). A pesquisa prevê ainda o desenvolvimento de um portal interativo para facilitar o acesso público às entrevistas, com funcionalidades avançadas de busca e visualização de dados.
Rich Text Analysis through Enhanced Tools based on Lexical Resources
The objective of the project is the development of tools for the syntactico-semantic analysis of Spanish and Portuguese. To do this, we aim to build a framework to integrate the different capabilities and resources of the groups involved. In particular, we want to integrate different lines of work on compositional semantics and enriched lexica: the Lexicon-Grammar tables, verbal subcategorization frames, multiword expressions, grammatical formalisms with enough expressivity to integrate this information, and learning mechanisms capable of building complex models from examples at these levels of analysis. For more information see: http://lauraalonsoalemany.wix.com/rita.
OpinExpress: um léxico de expressões de opinião em forma de Gramáticas Locais
O projeto tem como objetivo a construção de um léxico de unidades multipalavras que expressam opinião no português do Brasil. Pretende-se estabelecer listas de expressões que possuam elevado grau de polaridade, e que, por isso, expressam mais fortemente a opinião do enunciador. Essa classificação será realizada a partir da observação dessas expressões em uso real, ou seja, a partir de corpus de textos reais e sua representação será feita por meio de gramáticas locais.
Acervo Linguístico do Mato Grosso do Sul
ste projeto apresenta como proposta principal a construção de um banco de dados online do português falado em zonas urbanas do estado do Mato Grosso do Sul. Trata-se de uma realização conjunta entre pesquisadores da linguística, da história, da geografia e de sistemas da informação, de diferentes instituições de ensino e pesquisa brasileiras, todos reunidos pelo interesse comum em construir um acervo da variedade sul mato-grossense do português brasileiro de modo a documentar a identidade linguística e sociocultural do Estado. A variedade do português falado no Mato Grosso do Sul tem sido objeto de descrição de estudos ligados principalmente à dialetologia, como se vê, por exemplo, em Isquerdo (2000), Sgarbi (2006), Oliveira (2007), Ebling (2014), Freitas (2021). Em especial o projeto Atlas Linguístico do Mato Grosso do Sul, assentado sobre uma perspectiva dialetológica e geolinguística, tem contribuído para a descrição de aspectos dialetais da fala de diferentes regiões do estado do Mato Grosso do Sul. No entanto, os dados usados para essas análises encerram-se em suas pesquisas, o que dificulta descrições mais amplas e comparações com outras variedades do português e até mesmo o acesso de pesquisadores de diferentes regiões e de outros países. É nesse sentido que se apresenta o presente projeto. Para ampliar o acesso a amostras do português falado no estado do Mato Grosso do Sul e para ampliar as possibilidades de pesquisa dessas variedades, é fundamental um banco de dados sistematizado e de acesso irrestrito..
Atuação Profissional e Vínculos Institucionais
Cargo / Enquadramento: Professor Assistente
Vínculo: Servidor público (40h semanais)
Dedicação Exclusiva (DE)
Cargo / Enquadramento: Professor Adjunto
Vínculo: Servidor público (40h semanais)
Dedicação Exclusiva (DE)
Vínculo: Estagiário
Cargo / Enquadramento: Avaliador de Cursos de Letras
Vínculo: COLABORADOR
Avaliador de condições de ensino de cursos de letras.
Cargo / Enquadramento: Professor Adjunto
Vínculo: Servidor público (40h semanais)
Dedicação Exclusiva (DE)
Cargo / Enquadramento: Professor Associado
Vínculo: Servidor público (40h semanais)
Dedicação Exclusiva (DE)
Vínculo: Membro de corpo editorial
Vínculo: Membro de corpo editorial
Vínculo: Membro de corpo editorial
Cargo / Enquadramento: Visiting Scholar - Bolsista
Vínculo: PROFESSOR_VISITANTE (40h semanais)
Professor visitante do Mestrado Internacional Erasmus Mundus em Processamento de Linguagem Natural e Linguagem Humana e Tecnologia, promovido pela União Europeia.
Vínculo: Revisor de periódico
Vínculo: Membro de comitê assessor
Vínculo: Membro de comitê assessor
Vínculo: Revisor de projeto de fomento
Cargo / Enquadramento: Colaborador
Vínculo: Avaliador
Cargo / Enquadramento: Colaborador
Vínculo: Avaliador
Cargo / Enquadramento: Pesquisador Convidado
Vínculo: PROFESSOR_VISITANTE (40h semanais)
Dedicação Exclusiva (DE)
Vínculo: Membro de corpo editorial
Vínculo: Membro de comitê assessor
Vínculo: Revisor de projeto de fomento
Vínculo: Membro de comitê assessor
Vínculo: Revisor de periódico
Vínculo: Revisor de periódico
Vínculo: Revisor de periódico
Vínculo: Revisor de periódico
Vínculo: Membro de corpo editorial
Cargo / Enquadramento: Membro do Conselho
Vínculo: Membro do Conselho
Formação Acadêmica / Titulação & Pós-Doutorado
Maitrise en Sciences du Langage
Título: "Dictionnaire électronique de conjugaison des verbes du portugais du Brésil"
Orientador(a): Mireille Piot
DEUG- Sociologie Et Linguistique
Licence en Sciences du Langage
Sciences du Langage (DEA)
Título: "Transitivité-intransitivité en portugais du Brésil: les verbes météorologiques"
Linguística e Língua Portuguesa
Título: "Expressões cristalizadas do português do Brasil: uma proposta de tipologia"
Université Catholique de Louvain
Formação Complementar & Cursos de Extensão
Capacitação de Avaliadores das Condições de Ensino
Carga horária: 15h
Participação em Bancas Julgadoras e Comissões (41)
Candidato(a): Marcelo Caetano Martins Muniz
"A construção de recursos lingüístico-computacionais para o português do Brasil: o projeto Unitex-PB"
Universidade de São Paulo
Candidato(a): Camila Gebrim de Paula Costa
"Prefixos em textos opinativos do jornal Folha de S.Paulo: uma análise morfossemântica e sintática"
Universidade Federal de Uberlândia
Candidato(a): Leosmar Aparecido da Silva
"Os usos do até na língua falada na cidade de Goiás: funcionalidade e gramaticalização"
Universidade Federal de Goiás
Candidato(a): Alexandre Ribeiro Afonso
"Um Método Evolucionário na Tradução da Linguagem Natural para a SQL"
Universidade Federal de Goiás
Candidato(a): Tadeu Rossato Bisognin
"Do Internetês ao léxico da escrita dos jovens no Orkut"
Universidade Federal do Rio Grande do Sul
Candidato(a): Karoll Ribeiro e Silva Ferreira
"O anglicismo na terminologia de mineração"
Universidade Federal do Rio Grande do Sul
Candidato(a): Marcos Aninkvicius Gazzana
"A contribuição semântica das partículas nas verb-particle constructions: Um estudo sobre ?away?, ?out? e ?over? através da Lingüística de Corpus"
Universidade do Vale do Rio dos Sinos
Candidato(a): Amanda Pontes Rassi
"Estatuto sintático-semântico do verbo 'fazer' no português"
Universidade Federal de Goiás
Candidato(a): Zenilde Nunes Batista
"Estrutura lingüística e informação. Uma introdução à abordagem de Zellig Harris sobre os fenômenos da Língua."
Universidade Federal de Goiás
Candidato(a): Cristina Palma
"Expressões fixas adverbiais:descrição léxico-sintáctica e subsídios para um estudo contrastivo Português-Espanhol"
Universidade do Algarve
Candidato(a): Solange Cristina Maida Bazzon
"Terminologia da indústria de artefatos de borracha: proposta de um vocabulário"
Universidade Federal de São Carlos
Candidato(a): Douglas Henrique Perez Pino
"Aspectos semânticos da terminologia do biodiesel"
Universidade Federal de São Carlos
Candidato(a): Jacqueline Aparecida de Souza
"Tipologia de traços linguísticos de textos do português do Brasil dos séculos XVI, XVII e XVIII: uma proposta para a classificação automática de gêneros textuais"
Universidade Federal de São Carlos
Candidato(a): Cláudia Dias de Barros
"Antonímia nos adjetivos descritivos do Português do Brasil: uma proposta de análise e representação"
Universidade Federal de São Carlos
Candidato(a): Maria Cristina Andrade dos Santos
"Abordagem linguística no desenvolvimento de ontologias: proposta de construção de uma ontologia do domínio futebo"
Universidade Federal de São Carlos
Candidato(a): Beatriz Facincani Camacho
"Estudo comparativo de expressões idiomáticas do português do Brasil e de Portugal e do francês da França e do Canadá"
Universidade Estadual Paulista Júlio de Mesquita Filho
Candidato(a): Renata Maria Odorissio
"As classes de objeto na construção de equivalências para glossário francês-português: o verbo na cozinha"
Universidade Federal de São Carlos
Candidato(a): Vangevaldo Cardoso dos Santos
"Descrição de expressões fixas do português do Brasil para processamento automático de linguagem natural"
Universidade Federal do Espírito Santo
Candidato(a): Joel Sossai Coleti
"Base de dados morfológicos de terminologias do português do Brasil. Descrição e análise morfológica com vistas à disponibilização on-line"
Universidade Federal de São Carlos
Candidato(a): Debora Scopim
"Estudos de Padrões Lexicais em Textos Opinativos"
Universidade Federal de São Carlos
Candidato(a): Roger Alfredo de Marci Rodrigues Antunes
"Formação de Gentílicos a partir de Topônimos: Proposta de geração automática"
Universidade Federal de São Carlos
Candidato(a): Rosana de Vilhena Lima
"Descrição de topônimos compostos e formalização para o processamento automático de linguagem natural"
Universidade Federal do Espírito Santo
Candidato(a): Aucione das Dôres Smarsaro
"Descrição de palavras compostas do português do Brasil para elaboração de um dicionário eletrônico"
Pontifícia Universidade Católica do Rio de Janeiro
Candidato(a): Helio Roberto de Moraes
"Aspectos sintaticamente relevantes do significado lexical: estudo dos verbos de movimento"
Universidade Estadual Paulista Júlio de Mesquita Filho
Candidato(a): Huélinton Cassiano Riva
"Dicionário onomasiológico de expressões da língua portuguesa"
Universidade Estadual Paulista Júlio de Mesquita Filho
Candidato(a): Deni Yuzo Kasama
"Etnofaulismos e os dicionários monolíngues brasileiros"
Universidade Estadual Paulista Júlio de Mesquita Filho
Candidato(a): Lianet Sepúlveda Torres
"Escrita científica em português por hispano falantes: recursos linguísticos- computacionais baseados em métodos de alinhamento de textos paralelos"
Universidade de São Paulo
Candidato(a): Ely Edison da Silva Matos
"LUDI: Um framework para desambiguação lexical com base no enriquecimento da Semântica de Frames"
Universidade Federal de Juiz de Fora
Candidato(a): Débora Domiciano Garcia
"PrepNet.Br: uma proposta de representação semântica para as preposições do português"
Universidade Federal de São Carlos
Candidato(a): Jackson Wilke da Cruz Souza
"Aprofundamento da caracterização linguístico-computacional da complementaridade em um corpus jornalístico multidocumento"
Universidade Federal de São Carlos
Candidato(a): Amanda Maraschin Bruscato
"A aprendizagem à distância de anáfora em inglês e espanhol como línguas estrangeiras"
Universidade do Algarve
Candidato(a): Alexandre Diniz da Costa.
"A Tradução por Máquina Enriquecida Semanticamente com Frames e Papéis Qualia"
Universidade Federal de Juiz de Fora
Candidato(a): Joana Plaza Pinto
"O mal-entendido: um problema de sentido e referência"
Universidade Federal de Goiás
Candidato(a): Aline Okidoi
"Descrição fonológica preliminar da língua indígena Nukini-Pano."
Universidade Federal de Goiás
Candidato(a): Suety Líbia Alves Borges
"Signo lingüístico: da Grécia aos contemporâneos"
Universidade Federal de Goiás
Candidato(a): Rômulo da Silva Vargas Rodrigues
"O recorte de sentido nas relações paradigmáticas"
Universidade Federal de Goiás
Candidato(a): Rodrigo de Oliveira Caldas
"Os prefixos re- e des- nos verbos do português do Brasil"
Universidade Federal de Goiás
Candidato(a): Fabrício José dos Santos Brito
"Considerações preliminares no estudo do léxico da musicoterapia"
Universidade Federal de Goiás
Candidato(a): Amanda Pontes Rassi
"Análise da acepções do verbo fazer em dicionários de língua portuguesa"
Universidade Federal de Goiás
Candidato(a): Zenilde Nunes Batista
"Expressões cristalizadas de matriz comparativa"
Universidade Federal de Goiás
Candidato(a): Maria Cristina Morais de Carvalho
"Preliminares pra uma tipologia das expressões cristalizadas construidas com o verbo ter"
Universidade Federal de Goiás
Participação em Eventos, Congressos e Exposições (3)
Abralin Em Cena 2019
Apresentação: "TIPOLOGIA DAS NOTÍCIAS ENGANOSAS: COMO DISTINGUIR UMA VERDADEIRA FAKE NEWS?"
Propor 2020
Apresentação: "Linguistic Analysis Model for Monitoring User Reaction on Satirical News for Brazilian Portuguese"
Abralin Em Cena Espírito Santo
Apresentação: "Quais são as fronteiras entre as expressões cristalizadas e as construções composicionais?"
Áreas de Atuação do CNPq
Lingüística
Subárea: Teoria e Análise Lingüística
Especialidade: Linguística Computacional
Lingüística
Subárea: Teoria e Análise Lingüística
Especialidade: Lexicografia
Lingüística
Subárea: Lingüística Aplicada
Especialidade: Lingüística de Corpus
Letras
Subárea: Língua Portuguesa
Letras
Subárea: Língua Portuguesa
Especialidade: Ensino do Português
Lingüística
Subárea: Descrição do Português