Logo CECH UFSCar
Portal de Produção CECH — UFSCar
Ariani Di Felippo

Ariani Di Felippo

LE

Nomes em Citação: DI FELIPPO, Ariani; FELIPPO, ARIANI; FELIPPO, ARIANI DI; Di Felippo, A.

Departamento de Letras

🇧🇷Brasil No CECH desde 2009 Centro de Educação e Ciências Humanas • São Carlos/SP Atualização Lattes: 26/06/2026
Idiomas: ES (Lê: razoavelmente) EN (Lê: bem)

Resumo do Currículo Lattes

Possui graduação em Licenciatura em Letras pela Universidade Federal de São Carlos (UFSCar) (2000), mestrado (2004) e doutorado (2008) em Linguística e Língua Portuguesa pela Universidade Estadual Paulista Júlio de Mesquita Filho (UNESP/Araraquara). Desde 2009, é docente do Departamento de Letras (DL) da UFSCar, onde atualmente ocupa o cargo de Professora Associada (Nível 4). Desde 2011, integra o corpo docente do Programa de Pós-Graduação em Linguística (PPGL/UFSCar), orientando pesquisas em diferentes áreas do Processamento de Línguas Naturais (PLN). É pesquisadora do Núcleo Interinstitucional de Linguística Computacional (NILC) o mais antigo e um dos maiores grupos de pesquisa em PLN no Brasil , que se aproxima de três décadas de atuação e reúne pesquisadores de diversas instituições. Realizou pós-doutorado (20152016) no Department of Computer and Information Science da Universidade da Pensilvânia (UPenn, Filadélfia/EUA), onde investigou questões de correferência aplicadas à Sumarização Automática Multidocumento. Coordenou projetos científicos com diferentes fontes de financiamento e, atualmente, integra um projeto de cooperação universidadeempresa em parceria com a Motorola. É também pesquisadora sênior do Centro de Inteligência Artificial da USP (C4AI), um Centro de Pesquisa em Engenharia financiado pela FAPESP e pela IBM. Participa ativamente da comunidade nacional e internacional de PLN, publicando regularmente nos principais eventos da Sociedade Brasileira de Computação (SBC), como o Simpósio em Tecnologia da Informação e da Linguagem Humana (STIL), o Encontro Nacional de Inteligência Artificial e Computacional (ENIAC) e workshops associados, bem como em fóruns da área de Linguística, como o Encontro de Linguística de Corpus (ELC) e a Jornada de Descrição do Português (JDP), sendo também membro frequente de seus comitês de programa. No cenário internacional, tem presença constante em eventos de destaque, como o International Conference on Computational Processing of Portuguese Language (PROPOR). Destaca-se, ainda, sua atuação na Comissão Especial de PLN da SBC, da qual fez parte por mais de um mandato., e na organização das primeiras edições de eventos que permanecem ativos até hoje, entre eles a JDP e o Workshop de Iniciação Científica em Tecnologia da Informação e da Linguagem Humana (TILic).

Artigos Periódicos
24
66.7% com DOI
Livros / Capítulos
12
0 livros, 12 cap.
Em Congressos
88
Trabalhos e Anais
Produção Técnica
11
Técnicos, Softwares, Pat.
Orientações Concl.
54
2 Dout, 12 Mest, 17 TCC
Total Acervo
162
Média: ~6 / ano

Painel de Gráficos e Inteligência de Produção

Análise cronológica da produção científica, intelectual e formação de recursos humanos ao longo dos anos.

Evolução da Produção por Categoria (Histórico Anual)

2000 - 2026

Distribuição por Categoria

162 itens

Histórico de Orientações Concluídas por Nível

54 concluídas, 8 em andamento
Bases Científicas & Indexação Visibilidade Internacional

Produção Científica Indexada em Bases Internacionais

Cruzamento entre os artigos publicados pelo docente, as revistas científicas e as bases internacionais de indexação.

11 de 24 artigos indexados (45.8%)
Artigos Indexados
11
45.8% de todos os artigos
Scopus Scopus
#1
8
72.7% das produções indexadas
Web of Science Web of Science
#2
6
54.5% das produções indexadas
SciELO SciELO
#3
3
27.3% das produções indexadas
Latindex
#4
1
9.1% das produções indexadas
PubMed PubMed
#5
1
9.1% das produções indexadas
Figura 15 Bases Científicas Internacionais

Trabalhos por Base de Indexação

Distribuição dos artigos publicados pelo docente nas bases de dados indexadoras.

Figura 16 Séries Históricas

Evolução Temporal da Indexação por Base (2000–2026)

Histórico comparativo do número anual de artigos publicados em periódicos indexados.

Principais Colaboradores e Rede de Coautoria

Pesquisadores e docentes com maior volume de trabalhos e produções em parceria

12 colaboradores em destaque
TH
Thiago A. S. Pardo Colaborador externo
36 pub.
Período: 2001–2024
Evento: 22 Outra: 7 Artigo: 4 Capitulo: 3
BE
Bento Carlos Dias da Silva Colaborador externo
29 pub.
Período: 2001–2010
Evento: 18 Artigo: 9 Capitulo: 1 Outra: 1
JA
JACKSON WILKE DA CRUZ SOUZA Colaborador externo
23 pub.
Período: 2009–2024
Evento: 12 Outra: 5 Artigo: 4 Capitulo: 2
MA
Maria das Graças Volpe Nunes Colaborador externo
12 pub.
Período: 2001–2024
Evento: 7 Outra: 4 Artigo: 1
NO
Norton Trevisan Roman Colaborador externo
12 pub.
Período: 2022–2026
Evento: 6 Artigo: 3 Outra: 3
VE
VERÔNICA AGOSTINI Colaborador externo
11 pub.
Período: 2012–2015
Outra: 4 Capitulo: 3 Artigo: 2 Evento: 2
FE
Fernando Antônio Asevedo Nóbrega Colaborador externo
10 pub.
Período: 2012–2021
Evento: 5 Artigo: 2 Outra: 2 Capitulo: 1
LU
Lucia Helena Machado Rino Colaborador externo
9 pub.
Período: 2001–2014
Outra: 4 Evento: 3 Artigo: 1 Capitulo: 1
MA
Mauricio Santana Dias Colaborador externo
9 pub.
Período: 2012–2021
Evento: 4 Outra: 3 Artigo: 1 Capitulo: 1
PA
Paula C. F. Cardoso Colaborador externo
9 pub.
Período: 2011–2021
Evento: 4 Outra: 3 Artigo: 1 Capitulo: 1
ER
Erick G. Maziero Colaborador externo
9 pub.
Período: 2008–2017
Evento: 5 Outra: 3 Capitulo: 1
TH
Thiago Alexandre Salgueiro Pardo Colaborador externo
8 pub.
Período: 2005–2024
Evento: 4 Artigo: 2 Outra: 2

Palavras-chave dos Trabalhos

Cadastradas pelo autor nos artigos e produções no Lattes

Lattes Oficial
Clique em qualquer termo para filtrar produções 24 termos

Temas e Termos Frequentes

Sintagmas e conceitos mais recorrentes nos títulos

Mineração
Clique em qualquer termo para filtrar produções 24 temas
Produção Científica & Técnica (162) Orientações (62) Projetos (28) Atuação Profissional (9) Formação Acadêmica (4) Formação Complementar (19) Bancas (38) Eventos (81) Prêmios e Títulos (3) Áreas de Atuação (2)

Artigos em Periódicos (24)

2025 Qualis A1 ScopusScopus SciELOSciELO COMPLETO

DANTEStocks: A Multi-Layered Annotated Corpus of Stock Market Tweets for Brazilian Portuguese

Revista Brasileira de Linguística Aplicada v. 25, p. 2-32, ISSN: 19846398
Autores: DI FELIPPO, Ariani; ROMAN, N. T.
DOI: 10.1590/1984-6398202549802
2024 Qualis A2 COMPLETO

The DANTEStocks Corpus: an analysis of the distribution of Universal Dependencies-based Part-of-Speech tags

Palavras-chave:
REVISTA DA ABRALIN v. 22, p. 249-271, ISSN: 01027158
Autores: DI FELIPPO, Ariani; ROMAN, N. T.; PARDO, T. A. S.; MOURA, L. P.
DOI: 10.25189/rabralin.v22i2.2119
2024 Qualis A4 COMPLETO

Termos do mercado financeiro: um estudo do corpus DANTEStocks

TRADTERM v. 46, p. 6-30, ISSN: 23179511
Autores: RODRIGUES, R.; DI FELIPPO, Ariani; ROMAN, N. T.; SEMCOVICI, P.; SOUZA, J. W. C.; PARDO, Thiago Alexandre Salgueiro
DOI: 10.11606/issn.2317-9511.v46p6-30
2023 Qualis A1 ScopusScopus COMPLETO

The AMR-PT corpus and the semantic annotation of challenging sentences from journalistic and opinion texts

DELTA. Documentação de Estudos em Lingüística Teórica e Aplicada v. 39, p. 1-31, ISSN: 1678460X
Autores: INACIO, M. L.; CABEZUDO, M. A. S.; RAMISCH, R.; DI FELIPPO, Ariani; PARDO, T. A. S.
DOI: 10.1590/1678-460x202339355159
2022 Qualis A2 Latindex COMPLETO

Evaluating a typology of signals for automatic detection of complementarity

DOMÍNIOS DE LINGU@GEM v. 16, p. 1517-1543, ISSN: 19805799
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani
DOI: 10.14393/dl
2021 Qualis A2 ScopusScopus Web of ScienceWeb of Science COMPLETO

An investigation of linguistic problems in automatic multi-document summaries / Uma investigação de problemas linguísticos em sumários automáticos multidocumento

Revista de Estudos da Linguagem v. 29, p. 859-907, ISSN: 22372083
Autores: DIAS, M. S.; DI FELIPPO, ARIANI; RASSI, A. P.; CARDOSO, P. C. F.; NOBREGA, F. A. A.; PARDO, T. A. S.
DOI: 10.17851/2237-2083.29.2.859-907
2018 Qualis A1 COMPLETO

CARACTERIZAÇÃO DA COMPLEMENTARIDADE TEMPORAL: SUBSÍDIOS PARA SUMARIZAÇÃO AUTOMÁTICA MULTIDOCUMENTO

ALFA: REVISTA DE LINGUÍSTICA (UNESP. ONLINE) v. 62, p. 125-150, ISSN: 19815794
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani
DOI: 10.1590/1981-5794-1804-6
2017 Qualis A2 ScopusScopus Web of ScienceWeb of Science COMPLETO

Exploring content selection strategies for Multilingual Multi-Document Summarization based on the Universal Network Language (UNL)

Revista de Estudos da Linguagem v. 26, p. 45-71, ISSN: 22372083
Autores: CHAUD, MATHEUS RIGOBELO; Di Felippo, Ariani
DOI: 10.17851/2237-2083.26.1.45-71
2016 Qualis A1 ScopusScopus Web of ScienceWeb of Science COMPLETO

The agility construct on project management theory

INTERNATIONAL JOURNAL OF PROJECT MANAGEMENT v. 34, p. 660-674, ISSN: 02637863
Autores: CONFORTO, E. C.; AMARAL, D. C.; SILVA, S. L.; DI FELIPPO, Ariani; Kamikawachi, D. S. L.
DOI: 10.1016/j.ijproman.2016.01.007
2015 Qualis A2 ScopusScopus Web of ScienceWeb of Science COMPLETO

Anotação de Sentidos de Verbos em Textos Jornalísticos do Corpus CSTNews

Revista de Estudos da Linguagem v. 23, p. 797-832, ISSN: 22372083
Autores: SOBREVILLA CABEZUDO, MARCO ANTONIO; MAZIERO, ERICK GALANI; SOUZA, JACKSON WILKE DA CRUZ; DIAS, MÁRCIO DE SOUZA; CARDOSO, PAULA CHRISTINA FIGUEIRA; BALAGE FILHO, PEDRO PAULO; AGOSTINI, VERÔNICA; Nóbrega, Fernando Antônio Asevedo; DE BARROS, CLÁUDIA DIAS; Di Felippo, Ariani; PARDO, Thiago Alexandre Salgueiro
DOI: 10.17851/2237-2083.23.3.797-832
2014 SciELOSciELO COMPLETO

A survey of automatic term extraction for Brazilian Portuguese

JOURNAL OF THE BRAZILIAN COMPUTER SOCIETY (ONLINE) v. 20, p. 12-, ISSN: 16784804
Autores: DA SILVA CONRADO, MERLEY; FELIPPO, ARIANI; SALGUEIRO PARDO, THIAGO; REZENDE, SOLANGE
DOI: 10.1186/1678-4804-20-12
2013 Web of ScienceWeb of Science PubMedPubMed COMPLETO

Manual Typification of Source Texts and Multi-document Summaries Alignments

PROCEDIA: SOCIAL AND BEHAVIORAL SCIENCES v. 95, p. 498-506, ISSN: 18770428
Autores: CAMARGO, RENATA T.; AGOSTINI, VERÔNICA; DI FELIPPO, ARIANI; PARDO, THIAGO A.S.
DOI: 10.1016/j.sbspro.2013.10.674
2010 Qualis A1 ScopusScopus SciELOSciELO COMPLETO

As abordagens teóricas e os formalismos para o tratamento computacional do significado lexical

Revista Brasileira de Linguística Aplicada v. 10, p. 43-69, ISSN: 19846398
Autores: DI FELIPPO, Ariani
DOI: 10.1590/S1984-63982010000100004
2010 Qualis A4 COMPLETO

Uma metodologia para o desenvolvimento de Wordnets terminológicas em português do Brasil

TRADTERM v. 16, p. 365-, ISSN: 23179511
Autores: DI FELIPPO, Ariani; ALMEIDA, Gladis Maria de Barcelos
DOI: 10.11606/issn.2317-9511.tradterm.2010.46325
2010 Qualis A2 COMPLETO

A interlíngua e o alinhamento léxico-conceitual da base de dados bilíngue REBECA

ESTUDOS LINGUÍSTICOS (SÃO PAULO. 1978) v. 39, p. 545-556, ISSN: 14130939
Autores: DI FELIPPO, ARIANI; DIAS-DA-SILVA, Bento Carlos
2009 Qualis A1 COMPLETO

O desenvolvimento de uma base léxico-conceitual bilíngue (inglês norte-americano/português brasileiro)

Alfa: Revista de Linguística (UNESP. Online) v. 53, p. 77-97, ISSN: 19815794
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2009 Qualis A1 COMPLETO

A interlíngua da base lexical bilíngue REBECA

VEREDAS - REVISTA DE ESTUDOS LINGUÍSTICOS v. 13, p. 50-67, ISSN: 19822243
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2009 COMPLETO

O processamento automático de línguas naturais enquanto engenharia do conhecimento linguístico

CALIDOSCÓPIO (UNISINOS) v. 7, p. 183-191, ISSN: 16798740
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
DOI: 10.4013/cld.2009.73.02
2008 Qualis B1 COMPLETO

Uma introdução à engenharia do conhecimento linguístico

REVISTA DE LETRAS (TAGUATINGA) v. 01, p. 58-72, ISSN: 1982842X
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2006 Qualis A3 COMPLETO

Extração de informações lógico-conceituais de dicionários para a elaboração de léxicos computacionais

Intercâmbio (CD-ROM) v. 15, p. 01-09, ISSN: 1806275X
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2005 Qualis A3 COMPLETO

Os adjetivos valenciais do português e sua representação lingüístico-computacional

Palavras-chave:
Revista do GEL (Araraquara) v. 02, p. 55-81, ISSN: 18064906
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2005 Qualis A2 ScopusScopus Web of ScienceWeb of Science COMPLETO

Representação formal dos adjetivos valenciais com vistas ao Processamento Automático do Português

Palavras-chave:
Revista de Estudos da Linguagem v. 13, n. 2, p. 117-144, ISSN: 22372083
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
DOI: 10.17851/2237-2083.13.2.117-144
2005 Qualis A2 COMPLETO

Modelo lingüístico-computacional da estrutura argumental de adjetivos valenciais do português do Brasil

Palavras-chave:
ESTUDOS LINGUÍSTICOS (SÃO PAULO. 1978) v. 34, p. 857-862, ISSN: 14130939
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2002 Qualis A2 COMPLETO

Aspectos da construção de um revisor gramatical automático para o português

Palavras-chave:
ESTUDOS LINGUÍSTICOS (SÃO PAULO. 1978) v. 31, p. 01-06, ISSN: 14130939
Autores: RINO, L. H. M.; DI FELIPPO, Ariani; PINHEIRO, G. M.; MARTINS, R. T.; FILLIÉ, V. M.; HASEGAWA, R.; NUNES, Maria das Graças Volpe

Capítulos de Livros Publicados (12)

2016 Capítulo

Applying Lexical-Conceptual Knowledge for Multilingual Multi-document Summarization

In: Lecture Notes in Computer Science. Editora: Springer International Publishing. p. 38-49.
Autores: Di Felippo, Ariani; Tosta, Fabrício E. S.; Pardo, Thiago A. S.
DOI
2014 Capítulo

Corpus annotation of textual aspects in multi-document summaries

In: New language technologies and linguistic research: a two-way road. Editora: Cambridge: Cambridge Scholars Publishing. p. 171-193.
Autores: DI FELIPPO, Ariani; RINO, L. H. M.; CARDOSO, P. C. F.; SENO, E. R.; BALAGE FILHO, P. P.; RASSI, A. P.; JORGE, M. L. C.; DIAS, M. S.; MAZIERO, E. G.; ZACARIAS, A. C. I.; SOUZA, J. W. C.; CAMARGO, R. T.; Agostini, V.
2014 Capítulo

Manual Alignment of News Texts and their Multi-document Human Summaries

In: New language technologies and linguistic research: a two-way road. Editora: Cambridge: Cambridge Scholars Publishing. p. 148-170.
Autores: Agostini, V.; CAMARGO, RENATA T.; DI FELIPPO, Ariani; PARDO, T. A. S.
2014 Capítulo

Alignment-Based Sentence Position Policy in a News Corpus for Multi-document Summarization

In: Computational Processing of the Portuguese Language. Editora: Springer International Publishing. p. 286-291.
Autores: NOBREGA, F. A. A.; Agostini, V.; CARMARGO, R. T.; DI FELIPPO, Ariani; PARDO, T. A. S.
2013 Capítulo

Anotação e descrição de corpus para a investigação de estratégias de sumarização humana multidocumento

In: Dialogar é preciso Linguistica para processamento de linguas. Editora: PPGEL/UFES. p. 57-72.
Autores: CARMARGO, R. T.; DI FELIPPO, Ariani
2013 Capítulo

Extração automática de termos a partir de corpus e sua validação para a construção de wordnets terminológicas em português do Brasil

In: Corpora na terminologia. Editora: HUB Editorial. p. 63-85.
Autores: DI FELIPPO, Ariani
2012 Capítulo

O projeto do corpus para a construção de uma wordnet terminológica

In: Caminhos da Linguística de Corpus. Editora: Mercado de Letras. p. 225-246.
Autores: DI FELIPPO, Ariani; SOUZA, J. W. C.
2011 Capítulo

Glossário de Revestimento Cerâmico

In: Glossários de Revestimento Cerâmico. Editora: FFLCH-USP. p. 03-56.
Autores: ALMEIDA, Gladis Maria de Barcelos; Kamikawachi, D. S. L.; MANFRIM, A. M. P.; SOUZA, I. P.; IZUMIDA, F. H.; DI FELIPPO, Ariani; ZAUBERAS, R. T.; MELCHIADES, F. G.; BOSCHI, A. O.
2010 Capítulo

Processamento Automático das Línguas Naturais (PLN) para iniciantes

In: Letras em Jornada: 15 anos ensinando-aprendendo a ensinar. p. 113-131.
Autores: DI FELIPPO, Ariani
2008 Capítulo

Ontologias lingüísticas aplicadas ao processamento automático das línguas naturais: o caso das redes wordnets

In: Múltiplas perspectivas em Linguística. Editora: Edufu. p. 469-479.
Autores: DI FELIPPO, Ariani
2008 Capítulo

Compilação de corpus em língua portuguesa na área de Nanociência/Nanotecnologia: problemas e soluções.

In: Avanços da Linguística de Corpus no Brasil. Editora: Humanitas. p. 1-18.
Autores: COLETI, Joel Sossai; MATTOS, Daniela Ferreira de; GENOVES JR, Luis Carlos; CANDIDO JR., A.; DI FELIPPO, ARIANI; ALMEIDA, Gladis Maria de Barcelos; ALUÍSIO, Sandra Maria; OLIVEIRA JR, Osvaldo Novais de
2006 Capítulo

Dos olhares sobre o léxico: diferenças e semelhanças

Palavras-chave:
In: A construção de dicionários e bases de conhecimento lexical. Editora: Laboratório Editorial (FCL/UNESP). p. 169-185.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos

Trabalhos em Anais de Congressos & Apresentações (88)

2026 COMPLETO

Lexical and Orthographic Variation in Portuguese Financial Tweets: Annotation, Analysis, and Implications for Embedding Models

In: 17th International Conference on Computational Processing of Portuguese (Propor´26). Local: Salvador/BA.
Autores: DI FELIPPO, ARIANI; ROMAN, N. T.; BARBOSA, B. K. S.; OLIVEIRA, G. P.; SCANDAROLLI, C. L.
2025 COMPLETO

NounBank.DS: a Lexical Repository of Nominal Frames from Stock Market Tweets in Brazilian Portuguese

In: Simpósio Brasileiro de Tecnologia da Informação e da Linguagem Humana. Local: Fortaleza.
Autores: DI FELIPPO, Ariani; BARBOSA, B. K. S.
DOI
2025 COMPLETO

DANTEStocks-AMR em Construção: Avanços e Desafios na Anotação Semântica de Tweets Financeiros

In: Simpósio Brasileiro de Tecnologia da Informação e da Linguagem Humana. Local: Brasil.
Autores: CEREGATTO, GABRIEL; Di Felippo, Ariani
DOI
2025 COMPLETO

Named Entities in Stock Market Tweets: A Fine-Grained and Linguistically-Motivated Annotation

In: Simpósio Brasileiro de Tecnologia da Informação e da Linguagem Humana. Local: Fortaleza.
Autores: PIAI, L.; DI FELIPPO, Ariani; ROMAN, N. T.
DOI
2024 COMPLETO

Bringing Pragmatics to Porttinari - Adding Speech Acts to News Texts

In: 16th International Conference on Computational Processing of Portuguese. Local: Santiago de Compostela.
Autores: SILVA, N. L. P.; ROMAN, N. T.; DI FELIPPO, Ariani
2024 COMPLETO

A Corpus of Stock Market Tweets Annotated with Named Entities

In: 16th International Conference on Computational Processing of Portuguese. Local: Santiago de Compostela.
Autores: ZERBINATI, M. M.; ROMAN, N. T.; DI FELIPPO, Ariani
2024 COMPLETO

Genipapo - a Multigenre Dependency Parsing for Brazilian Portuguese

In: 15th Symposium in Information and Human Language Technology. Local: Belém.
Autores: DI FELIPPO, Ariani; BARBOSA, B. K. S.; ROMAN, N. T.; PARDO, T. A. S.
2024 COMPLETO

A Dependency Treebank of Tweets in Brazilian Portuguese: Syntactic Annotation Issues and Approach

In: 15th Symposium in Information and Human Language Technology. Local: Belém.
Autores: DI FELIPPO, Ariani; NUNES, Maria das Graças Volpe; BARBOSA, B. K. S.
2023 COMPLETO

Em direção à anotação sintática-UD de tweets do mercado financeiro

Palavras-chave:
In: 2nd Edition of the Universal Dependencies Brazilian Festival (UDFest-BR). Local: Belo Horizonte.
Autores: BARBOSA, B. K. S.; DI FELIPPO, Ariani
2023 COMPLETO

Tipologia de fenômenos ortográficos e lexicais em CGU: o caso dos tweets do mercado financeiro

Palavras-chave:
In: VIII Workshop on Portuguese Description (JDP). Local: Belo Horizonte.
Autores: SCANDAROLLI, C. L.; DI FELIPPO, Ariani; ROMAN, N. T.; PARDO, T. A. S.
2022 COMPLETO

Implicit opinion aspect clues in Portuguese texts: analysis and categorization.

In: International Conference on Computational Processing of Portuguese (PROPOR) (LNAI 13208).
Autores: MACHADO, M. T.; PARDO, T. A. S.; RIBEIRO, E. M. S.; DI FELIPPO, Ariani; VARGAS, F. A.
2021 COMPLETO

PorTinari - a large multi-genre treebank for Brazilian Portuguese

In: XIV Symposium in Information and Human Language Technology (STIL).
Autores: PARDO, T. A. S.; DURAN, M. S.; DI FELIPPO, Ariani; ROMAN, N.; NUNES, Maria das Graças Volpe
2021 COMPLETO

Descrição preliminar do corpus DANTEStocks: diretrizes de segmentação para anotação segundo Universal Dependencies

In: VII Workshop on Portuguese Description (JDP).
Autores: DI FELIPPO, Ariani; POSTALI, C.; CEREGATTO, G.; GAZANA, L. S.; SILVA, E. H.; PARDO, Thiago Alexandre Salgueiro
2021 COMPLETO

Learning rules for automatic identification of implicit aspects in Portuguese

In: XIV Symposium in Information and Human Language (STIL).
Autores: MACHADO, M. T.; PARDO, Thiago Alexandre Salgueiro; DI FELIPPO, Ariani; RUIZ, E. E. S.
2021 COMPLETO

Universal Dependencies for tweets in Brazilian Portuguese: Tokenization and Part of Speech Tagging.

In: 18th National Meeting on Artificial and Computational Intelligence (ENIAC).
Autores: SILVA, E. H.; PARDO, Thiago Alexandre Salgueiro; ROMAN, N.; DI FELIPPO, Ariani
2019 COMPLETO

Caracterização de desvios sintáticos em um corpus de redações: o processo de anotação

In: 6th Workshop on Portuguese Description. Local: Salvador.
Autores: RAMISCH, R.; DI FELIPPO, Ariani
2019 COMPLETO

Enriquecendo o corpus CM2News: construção e anotação de coleções bilíngues de notícias

In: 6th Workshop on Portuguese Description. Local: Salvador.
Autores: CAMARGO, Y. V.; DI FELIPPO, Ariani
2019 COMPLETO

Violações linguísticas em referências a entidades do tipo ?pessoa? em extratos automáticos multidocumento

In: 6th Workshop on Portuguese Description. Local: Salvador.
Autores: CRISTINI, L. F.; DI FELIPPO, Ariani
2019 COMPLETO

Subsídios linguístico-computacionais para a revisão gramatical de redações do ensino médio

In: 6th Workshop on Portuguese Description. Local: Salvador.
Autores: DI FELIPPO, Ariani; Kamikawachi, D. S. L.; FRANCA, M.; MARTINS, P. F.
2019 RESUMO_EXPANDIDO

Desempenho do corretor LanguageTool em um corpus de redações do ensino médio: o caso das regras da categoria ?gramática?

In: XXVI Congresso de Iniciação Científica e XI Congresso de Iniciação em Desenvolvimento Tecnológico e Inovação. Local: São Carlos.
Autores: DI FELIPPO, Ariani; FRANCA, M. C.
2019 RESUMO_EXPANDIDO

Desempenho do corretor LanguageTool em um corpus de redações do ensino médio: o caso das regras da categoria ?miscelânea?

In: XXVI Congresso de Iniciação Científica e XI Congresso de Iniciação em Desenvolvimento Tecnológico e Inovação,. Local: São Carlos.
Autores: DI FELIPPO, Ariani; RIBEIRO, L. L.
2018 COMPLETO

Source Texts Annotation for Rewriting References to People in Automatic Multi-Document Extracts

In: PROPOR 2018 Student Research Workshop. Local: Canela.
Autores: CRISTINI, L. F.; DI FELIPPO, Ariani
2017 COMPLETO

The Coreference Annotation of the CSTNews Corpus

In: 2dn Workshop on Evaluation of Human Language Technologies for Iberian Languages (IberEval). Local: Murcia/Spain.
Autores: PARDO, T. A. S.; BAPTISTA, J.; DURAN, M. S.; NUNES, Maria das Graças Volpe; NOBREGA, F. A. A.; ALUÍSIO, Sandra Maria; DI FELIPPO, ARIANI; SENO, E. R.; SILVA, R. R.; ANCHIÊTA, R. T.; BRUM, H. B.; DIAS, M. S.; MARTINS, R. S. O.; MAZIERO, E. G.; SOUZA, J. W. C.; VARGAS, F. A.
2016 COMPLETO

CM2News: Towards a Corpus for Multilingual Multi-document Summarization

In: Corpora and Tools for Processing Corpora Workshop (CTPC). Local: Tomar (Portugal).
Autores: DI FELIPPO, Ariani
2016 COMPLETO

Phrase Generalization: a Corpus Study in Multi-Document Abstracts and Original News Alignments

In: LAW X - Linguistic Annotation Workshop. Local: Berlim.
Autores: DI FELIPPO, Ariani; NENKOVA, A.
2015 COMPLETO

Qualitative analysis of a corpus of opinion summaries based on aspects

In: The 9th Linguistic Annotation Workshop (LAW IX). Local: Denver.
Autores: LOPEZ, R. E.; AVANCO, L. V.; BALAGE FILHO, P. P.; BOKAN, A. Y.; CARDOSO, P. C. F.; DIAS, M. S.; NOBREGA, F. A. A.; SOBREVILLA CABEZUDO, M. A.; SOUZA, J. W. C.; ZACARIAS, A. C. I.; SENO, E. R.; DI FELIPPO, Ariani; PARDO, T. A. S.
2015 COMPLETO

On strategies of Human Multi-Document Summarization

In: The 10th Brazilian Symposium in Information and Human Language Technology (STIL).
Autores: CAMARGO, R. T.; DI FELIPPO, Ariani; PARDO, T. A. S.
2015 COMPLETO

Em direção à caracterização da complementaridade no corpus multidocumento CSTNews

In: The 4th Workshop on Portuguese Description (JDP). Local: Natal.
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani
2015 COMPLETO

Explorando hierarquias conceituais para a seleção de conteúdo na sumarização automática multidocumento

In: The 4th Workshop on Portuguese Description (JDP). Local: Natal.
Autores: ZACARIAS, A. C. I.; DI FELIPPO, Ariani
2014 COMPLETO

Anotação de sentidos de verbos em notícias jornalísticas em Português do Brasil

In: XII Encontro de Linguística de Corpus - ELC. Local: Uberlândia.
Autores: SOBREVILLA CABEZUDO, M. A.; MAZIERO, E. G.; SOUZA, J. W. C.; DIAS, M. S.; CARDOSO, P. C. F.; BALAGE FILHO, P. P.; Agostini, V.; NOBREGA, F. A. A.; BARROS, C. D.; DI FELIPPO, ARIANI; PARDO, T. A. S.
2014 COMPLETO

O Corpus CSTNews e sua Complementaridade Temporal

In: I Workshop on Tools and Resources for Automatically Processing Portuguese and Spanish. Local: São Carlos.
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani
2014 COMPLETO

Enriquecendo o corpus CSTNews - A criação de novos sumários multidocumento

In: I Workshop on Tools and Resources for Automatically Processing Portuguese and Spanish. Local: São Carlos.
Autores: DIAS, M. S.; GARAY, A. Y. B.; CHUMAN, C.; BARROS, C. D.; MAZIERO, E. G.; NOBREGA, F. A. A.; SOUZA, J. W. C.; CABEZUDO, M. A. S.; DELEGE, M.; JORGE, M. L. C.; SILVA, N. L.; CARDOSO, P. C. F.; BALAGE FILHO, P. P.; CONDORI, R. E. L.; MARCASSO, V.; DI FELIPPO, Ariani; NUNES, Maria das Graças Volpe; PARDO, T. A. S.
2013 RESUMO

Delimitação de subontologias com base na indexação léxico-ontológica: primeiras investigações

In: V Congresso de Iniciação em Desenvolvimento Tecnológico e Inovação da UFSCar. Local: São Carlos.
Autores: DI FELIPPO, Ariani; ZACARIAS, A. C. I.; PARDO, T. A. S.
2013 COMPLETO

Em busca de métodos de detecção da complementaridade para a Sumarização Automática Multidocumento

In: 3a Jornada de Descrição do Português. Local: Fortaleza.
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani
2013 COMPLETO

Insights for better RST segmentation of texts in Portuguese?

In: 4th Workshop ?RST and Discourse Studies?. Local: Fortaleza.
Autores: RINO, L. H. M.; DI FELIPPO, Ariani; PARDO, T. A. S.
2013 RESUMO_EXPANDIDO

Identificação da redundância na Sumarização Automática Multidocumento: explorando métodos superficiais

In: 3rd Student Workshop on Information and Human Language Technology (TILic). Local: Fortaleza.
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani; PARDO, T. A. S.
2013 RESUMO_EXPANDIDO

Estudo de métodos clássicos de sumarização no cenário multidocumento multilíngue.

In: 3rd Student Workshop on Information and Human Language Technology (TILic). Local: Fortaleza.
Autores: TOSTA, F. E. S.; DI FELIPPO, Ariani; PARDO, T. A. S.
2013 RESUMO_EXPANDIDO

Delineamento conceitual de corpus via indexação léxico-conceitual: primeiros resultados

In: 3rd Student Workshop on Information and Human Language Technology (TILic). Local: Fortaleza.
Autores: ZACARIAS, A. C. I.; DI FELIPPO, Ariani; PARDO, T. A. S.
2012 COMPLETO

Alinhamento manual de textos e sumários em um corpus jornalístico multidocumento

In: XI Encontro de Linguística de Corpus (ELC). Local: São Carlos.
Autores: Agostini, V.; CAMARGO, R. T.; DI FELIPPO, Ariani; PARDO, T. A. S.
2012 COMPLETO

Analysis of ascpects in a corpus of human multi-document summaries of 'sport' news

In: XI Encontro de Linguística de Corpus (ELC). Local: São Carlos.
Autores: JORGE, M. L. C.; DI FELIPPO, Ariani; NOBREGA, F. A. A.; PARDO, T. A. S.
2012 RESUMO

Grupo de Linguagem Humana e Tecnologia ? LHTec

In: I Seminário de Produção em Linguística. Local: São Carlos.
Autores: DI FELIPPO, Ariani
2012 RESUMO_EXPANDIDO

Anotação e descrição de corpus para a investigação de estratégias de Sumarização Humana Multidocumento

In: Colóquio de Linguística para o Processamento Automático de Linguagem Natural (LiPraL). Local: Vitória.
Autores: CAMARGO, R. T.; DI FELIPPO, Ariani
2011 RESUMO

Descrição morfológica dos termos da Educação a Distância no projeto Terminet

In: 19o Congresso de Iniciação Científica/ 4o Congresso de Iniciação em Desenvolvimento Tecnológico e Inovação. Local: São Carlos.
Autores: GIANOTI, A. C.; DI FELIPPO, Ariani
2011 RESUMO

Os termos nas wordnets: estratégias de identificação automática da sinonímia em corpus especializado

In: I Congresso Internacional de Estudos do Léxico (CIEL). Local: Salvador.
Autores: DI FELIPPO, Ariani
2011 RESUMO

Terminologia baseada em corpus: a extração de candidatos a termo segundo a abordagem estatística no projeto TermiNet

In: 59o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo. Local: Bauru.
Autores: DI FELIPPO, Ariani
2011 RESUMO

A construção de wordnets terminológicas a partir de corpora e a extração automática de termos

In: 18o Intercâmbio de Pesquisas em Linguística Aplicada (Inpla). Local: São Paulo.
Autores: DI FELIPPO, Ariani
2011 COMPLETO

CSTNews: A discourse-annotated corpus for single and multi-document summarization of news texts in Brazilian Portuguese

In: RST Brazilian Meeting. Local: Cuiabá.
Autores: CARDOSO, P. C. F.; MAZIERO, E. G.; JORGE, M. L. C.; SENO, E. R.; DI FELIPPO, Ariani; RINO, L. H. M.; NUNES, Maria das Graças Volpe; PARDO, T. A. S.
2011 COMPLETO

Em direção à caracterização de sumários humanos multidocumento

In: Workshop on Portuguese Description. Local: Cuiabá.
Autores: CAMARGO, R. T.; DI FELIPPO, Ariani; PARDO, T. A. S.
2011 COMPLETO

Investigação da Identificação da Redundância na Sumarização Multidocumento

In: STIL Student Workshop on Information and Human Language Technology. Local: Cuiabá.
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani; PARDO, T. A. S.
2011 COMPLETO

Estudo de Métodos Clássicos de Sumarização no Cenário Multidocumento Multilíngue

In: STIL Student Workshop on Information and Human Language Technology. Local: Cuiabá.
Autores: TOSTA, F. E. S.; DI FELIPPO, Ariani; PARDO, T. A. S.
2011 COMPLETO

Proposta de Delineamento Conceitual de Corpus Via Indexação Ontológica

In: STIL Student Workshop on Information and Human Language Technology. Local: Cuiabá.
Autores: ZACARIAS, A. C. I.; DI FELIPPO, Ariani; PARDO, T. A. S.
2011 RESUMO

O projeto TermiNet e a extração de candidatos a termos com base no paradigma linguístico

In: 59o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo. Local: Bauru.
Autores: GIANOTI, A. C.; DI FELIPPO, Ariani
2010 COMPLETO

REBECA: Turning WordNet Databases into

In: 7th International Conference on Language Resources and Evaluation (LREC'10). Local: Malta.
Autores: DIAS-DA-SILVA, Bento Carlos; DI FELIPPO, Ariani
2010 COMPLETO

The TermiNet Project: an Overview

In: NAACL HLT 2010 Young Investigators Workshop on Computational Approaches to Languages of the Americas. Local: Los Angeles.
Autores: DI FELIPPO, Ariani
2010 RESUMO

Delimitação do domínio da Educação a Distância com vistas à construção da base lexical WordNet.EaD

In: 58o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo. Local: São Carlos.
Autores: DI FELIPPO, Ariani
2010 COMPLETO

A construção de wordnets terminológicas com base em corpus

In: Seminário de Pesquisa em Ontologia no Brasil. Local: Florianópolis.
Autores: DI FELIPPO, Ariani
2010 COMPLETO

An introduction to the TermiNet project

In: Groupe de Linguistique Appliquées des Télécommunications (GLAT). Local: Lisboa.
Autores: DI FELIPPO, Ariani
2010 RESUMO_EXPANDIDO

O Corpus.EaD no projeto TermiNet: estratégias de construção

In: IX Encontro de Linguística de Corpus/ IV Escola de Linguística Computacional. Local: Porto Alegre.
Autores: DI FELIPPO, Ariani; SOUZA, J. W. C.
2010 RESUMO

Corpus.EaD: construção e descrição

In: 18o Congresso de Iniciação Científica. Local: São Carlos.
Autores: SOUZA, J. W. C.; DI FELIPPO, Ariani
2009 RESUMO

O alinhamento léxico-conceitual na base de dados REBECA

Palavras-chave:
In: 57o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo. Local: Ribeirão Preto.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2009 RESUMO

Projetando o corpus para a construção de uma wordnet terminológica

In: VIII Encontro de Linguística de Corpus. Local: Rio de Janeiro.
Autores: DI FELIPPO, Ariani; SOUZA, J. W. C.
2009 RESUMO

O léxico sob o olhar do Processamento Automático das Línguas Naturais e o projeto TermiNet

In: I Seminário de Estudos do Léxico - SELEX. Local: São Carlos.
Autores: DI FELIPPO, Ariani
2008 COMPLETO

The Automatic Mapping of Princeton WordNet Lexical-Conceptual Relations onto the Brazilian Portuguese WordNet Database

In: International Conference on Language Resources and Evaluation. Local: Marrakech.
Autores: DIAS-DA-SILVA, Bento Carlos; DI FELIPPO, Ariani; NUNES, Maria das Graças Volpe
2008 COMPLETO

OntoMethodus - A Methodology to Build Domain-Specific Ontologies and its Use in a System to Support the Generation of Terminographic Products

In: VI Workshop em Tecnologia da Informação e da Linguagem Humana. Local: Vila Velha.
Autores: DI FELIPPO, Ariani; ALUÍSIO, Sandra Maria; OLIVEIRA, Leandro Henrique Mendonça de; ALMEIDA, Gladis Maria de Barcelos
2008 COMPLETO

A Base de dados lexical e a interface web do TeP 2.0 - Thesaurus Eletrônico para o Português do Brasil

In: VI Workshop em Tecnologia da Informação e da Linguagem Humana. Local: Vila Velha.
Autores: MAZIERO, E. G.; PARDO, T. A. S.; DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2008 COMPLETO

REBECA ? uma Base de Dados Léxico-Conceitual Bilíngüe Inglês-Português

In: IV Workshop on MSc Dissertation and PhD Thesis in Artificial Intelligence. Local: Salvador.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2007 COMPLETO

Towards an automatic strategy for acquiring the WordNet.Br hierarchical relations

Palavras-chave:
In: Workshop em Tecnologia da Informação e da Linguagem Humana (TIL). Local: Rio de Janeiro.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2007 COMPLETO

Compilação de corpus em língua portuguesa na área de Nanociência/ Nanotecnologia: problemas e soluções

Palavras-chave:
In: VI Encontro de Lingüística de Corpus. Local: São Paulo.
Autores: COLETI, Joel Sossai; MATTOS, Daniela Ferreira de; GENOVES JR, Luis Carlos; CANDIDO JR., A.; DI FELIPPO, Ariani; ALMEIDA, Gladis Maria de Barcelos; ALUÍSIO, Sandra Maria; OLIVEIRA JR, Osvaldo Novais de
2006 COMPLETO

Metodologia semi-automática baseada em corpus para a construção de ontologias de domínio

Palavras-chave:
In: 4 Workshop em Tecnologia da Informação e da Linguagem Humana (TIL). Local: Ribeirão Preto.
Autores: DI FELIPPO, Ariani; ALUÍSIO, Sandra Maria; ALMEIDA, Gladis Maria de Barcelos; OLIVEIRA, Leandro Henrique Mendonça de; GENOVES JR, Luis Carlos; ANTIQUEIRA, Lucas; OLIVEIRA JR, Osvaldo Novais de
2006 COMPLETO

Methods and Tools for Encoding the WordNet.Br Sentences, Concept Glosses, and Conceptual-Semantic Relations

Palavras-chave:
In: 7th Workshop on Computational Processing of Written and Spoken Language (PROPOR). Local: Itatiaia.
Autores: DIAS-DA-SILVA, Bento Carlos; DI FELIPPO, Ariani; HASEGAWA, R.
2006 RESUMO

Ontologias Lingüísticas aplicadas ao Processamento Automático de Líguas Naturais: o caso das redes wordnets

Palavras-chave:
In: XI Simpósio Nacional de Letras e Lingüística / I Simpósio Internacional de Letras e Lingüística (SILEL). Local: Uberlândia.
Autores: DI FELIPPO, Ariani
2005 RESUMO

Padrões de lexicalização e a indexação da base da rede Wordnet.Br.

Palavras-chave:
In: 53o Gel - Grupo de Estudos do Estado de São Paulo. Local: São Carlos.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2005 RESUMO

Proposta de uma metodologia para a identificação dos argumentos dos adjetivos de valência 1 da língua portuguesa a partir de córpus

Palavras-chave:
In: V Encontro de Corpora. Local: São Carlos.
Autores: DI FELIPPO, Ariani; PARDO, Thiago Alexandre Salgueiro; ALUÍSIO, Sandra Maria
2005 RESUMO

Extração de informações semânticas de dicionários com vistas à elaboração de léxicos lingüístico- computacionais

Palavras-chave:
In: 15o Intercâmbio de Pesquisas em Lingüística Aplicada - Inpla. Local: São Paulo.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2005 RESUMO

Estudo e Mapeamento dos Padrões de Lexicalização de Conceitos Codificados em Nomes Concretos do Inglês e do Português

Palavras-chave:
In: V Seminário de Pesquisa do Programa de Pós-Graduação em Lingüística e Língua Portugesa. Local: Araraquara.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2005 RESUMO

Inserção da estrutura de argumentos na rede Wordnet.Br

Palavras-chave:
In: IV Congresso Internacional da ABRALIN. Local: Brasília.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2004 RESUMO

Modelo lingüístico-computacional da estrutura valencial de adjetivos do Português

Palavras-chave:
In: 52o Seminário do GEL - Grupo de Estudos Lingüísticos do Estado de São Paulo. Local: Campinas.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2004 COMPLETO

Inclusão de informação semântica dos adjetivos na base da rede Wordnet para o português do Brasil

Palavras-chave:
In: Taller de Herramientas y Recursos Linguisticos para el Espanõl y el Português (HyRL). Local: Puebla.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2004 COMPLETO

Edição de informações sintático-semânticas dos adjetivos na base da rede Wordnet.Br.

Palavras-chave:
In: II Worshop em Tecnologia da Informação e da Linguagem Humana - TIL. Local: Salvador.
Autores: DI FELIPPO, Ariani; DIAS-DA-SILVA, Bento Carlos
2003 RESUMO

Classificações e Tipologias semânticas dos adjetivos: uma breve revisão comparativa

Palavras-chave:
In: 51o Seminário do GEL - Grupo de Estudos Lingüísticos do Estado de São Paulo. Local: Taubaté - São Paulo.
Autores: DI FELIPPO, Ariani
2003 RESUMO

Representação linguístico-computacional dos adjetivos valenciais do português

In: Seminário do Programa de Pós-Graduação em Linguística e Língua Portuguesa. Local: Ararquara.
Autores: DI FELIPPO, ARIANI; DIAS-DA-SILVA, Bento Carlos
2002 RESUMO

Etiquetagem morfossintática de 1 milhão de palavras: relatos da experiência lingüística em um processo semi-automático

In: 12 Intercâmbio de Pesquisas em Lingüística Aplicada (Inpla). Local: São Paulo.
Autores: DI FELIPPO, Ariani; SILVA, D. C.; AIRES, R. V. X.; FILLIÉ, V. M.
2002 RESUMO

Concepções de léxico e o processamento automático das línguas naturais

In: 50o GEL - Grupo de Estudos Lingüísticos do Estado de São Paulo. Local: São Paulo.
Autores: DIAS-DA-SILVA, Bento Carlos; DI FELIPPO, Ariani
2002 RESUMO

Representação linguístico-computacional dos adjetivos valenciais no léxico do processamento automático do português

In: II Seminário do Programa de Pós-Graduação em Linguística e Língua Portuguesa. Local: Araraquara.
Autores: DI FELIPPO, ARIANI; DIAS-DA-SILVA, Bento Carlos
2001 RESUMO

Representação lingüístico-computacional dos adjetivos valeciais no léxico do processamento automático do português

Palavras-chave:
In: 4a Jornada Científica da UFSCAR - encontro de conhecimentos diálogo e saberes. Local: São Carlos.
Autores: DI FELIPPO, Ariani
2001 RESUMO

Tudo o que você sempre quis saber sobre a ferramenta de revisão gramatical do seu WORD e não tinha a oportunidade de perguntar

Palavras-chave:
In: XLIX Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo. Local: Marília.
Autores: RINO, L. H. M.; DI FELIPPO, Ariani; PINHEIRO, Gisele Montilha; MARTINS, Ronaldo Teixeira; FILLIÉ, V. M.; HASEGAWA, R.; NUNES, Maria das Graças Volpe
2001 RESUMO

Representação lingiístico-computacional dos adjetivos valenciais no léxico para o processamento automático do português

In: I Seminário do Programa de Pós-Graduação em Linguística e Língua Portuguesa. Local: Araraquara.
Autores: DI FELIPPO, ARIANI; DIAS-DA-SILVA, Bento Carlos
2000 RESUMO

Especificação dos traços semânticos dos itens lexicais

Palavras-chave:
In: VIII Congresso de Iniciação Científica da UFSCar. Local: São Carlos.
Autores: DI FELIPPO, Ariani

Trabalhos Técnicos, Pareceres e Consultorias (11)

2011 TRABALHO-TECNICO

Revisor de resumos submetidos ao 59o Seminário do Gel

2011 TRABALHO-TECNICO

Revisor de resumos submetidos ao X Encontro de Linguística de Corpus

2011 TRABALHO-TECNICO

Revisor de resumos submetidos à II Jornada de Descrição do Português

2010 TRABALHO-TECNICO

Revisor de resumos submetidos ao IX Encontro de Linguística de Corpus

2010 TRABALHO-TECNICO

Revisor de artigos submetidos à revista Estudos Linguísticos (volume 39)

2010 TRABALHO-TECNICO

Revisor de resumos submetidos ao 58o Seminário do Gel

2009 TRABALHO-TECNICO

Revisor de artigos submetidos ao 7th Brazilian Symposium in Information and Human Language Technology

2009 TRABALHO-TECNICO

Revisor de resumos submetidos à I Jornada de Descrição do Português

2009 TRABALHO-TECNICO

Revisor de artigos submetidos à revista Calidoscópio

2007 TRABALHO-TECNICO

Revisor de artigos submetidos ao V TIL (Workshop em Tecnologia da Informação e da Linguagem Humana)

2007 TRABALHO-TECNICO

Revisor de resumos submetidos ao VI EC (Encontro de Lingüística de Córpus)

Demais Tipos de Produção (27)

2025

Guia de anotação de entidades nomeadas em tweets do mercado financeiro: adaptação da taxonomia hierárquica do segundo HAREM

Palavras-chave:
2024

Diretrizes de anotação de relações de dependência em tweets do mercado financeiro.

Palavras-chave:
2023

Manual de Anotação do corpus Porttinari-base com Atos de Fala

2022

Diretrizes de anotação de PoS tags em tweets do mercado financeiro: orientações para anotação em língua portuguesa segundo a abordagem Universal Dependencies (UD)

Palavras-chave:
2020

CM3News: Corpus Multidocumento Trilíngue de Textos Jornalísticos

Palavras-chave:
2014

Identificação das operações linguísticas nos alinhamentos com especialização do corpus CSTNews

2014

Anotação de sentidos de verbos no córpus CSTNews

2014

Identificação das operações linguísticas nos alinhamentos com generalização do corpus CSTNews

2014

Descrição de características lexicais estatísticas dos textos-fonte e sumários do corpus CSTNews

2014

Geração de subsídios linguísticos para a detecção automática de aspectos informacionais

2014

Primeiras investigações sobre o fenômeno da contradição no corpus CSTNews

2013

Anotação de aspectos textuais em sumários do córpus CSTNews

2012

Alinhamento manual dos sumários humanos e dos textos-fonte do corpus multidocumento CSTNews

2012

Investigação do fenômeno da redundância na Sumarização Automática Multidocumento

2012

Anotação de subtópicos do corpus multidocumento CSTNews

2012

Aplicação de métodos clássicos de sumarização automática no contexto multidocumento multilíngue: primeiras aproximações

2012

Em direção ao delineamento conceitual de corpus via indexação léxico-conceitual

2011

Extração de conhecimento terminológico no projeto TermiNet

2011

Descrição morfológica preliminar dos termos da Educação a Distância

2010

Um exercício em Linguística de Corpus no âmbito do projeto TermiNet

2008

Delimitação e alinhamento de conceitos lexicalizados no inglês norte-americano e no português brasileiro

Palavras-chave:
2006

Desenvolvimento de uma estrutura conceitual (ontologia) para a área de Nanociência e Nanotecnologia

2005

Identificação das estruturas argumentais dos adjetivos: uma abordagem semi-automática baseada em corpus

2004

Representação lingüístico-computacional dos adjetivos valenciais do Português

Palavras-chave:
2004

Modelo de entrada lexical (psico)linguístico-computacional

2001

Projeto TraSem: A investigação empírica sobre o problema da ambiguidade categorial

2001

Projeto TraSem: A investigação teórica sobre o problema da ambiguidade categorial

Orientações Concluídas (54) 2 Doutorado • 12 Mestrado • 17 TCC/Graduação • 17 PIBIC • 6 Outras

Mestrado 2025

Gabriel Ceregatto

"Representação formal do significado: o caso dos tweets do mercado de ações em português"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Mestrado 2025

Laís Piai

"Caracterização de entidades nomeadas em um corpus de tweets: contribuição para o processamento automático do português"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2025

Isabela Santos de Freitas

"Refinamento da anotação sintática segundo o modelo Universal Dependencias do córpus DANTEStocks e investigação da relação de"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2025

Clarissa Lenina Scandarolli

"Tweets do mercado financeiro: proposta de tipologia de fenômenos ortográficos e lexicais de CGU"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2025

Gabriela Pinheiro de Oliveira

"Caracterização de aspectos ortográficos e lexicais de um corpus de tweets do mercado financeiro"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2025

Bianca Couto Vincenzi

"Enriquecendo o corpus Portinari-base com anotação de entidades nomeadas clássicas"

Linguística • Universidade Federal de São Carlos
TCC / Graduação 2025

Isabela Santos de Freitas

"Descrição da fragmentação estrutural de tweets do mercado financeiro via relação de ?parataxis? do modelo Universal Dependencies"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2025

Breno da Costa Caricchio Aguiar

"Revisão da anotação sintática segundo modelo Universal Dependencies do corpus DANTEStocks e investigação da relação de "modificação nominal""

Bacharelado em Linguística • Universidade Federal de São Carlos
Mestrado 2024

Bryan Khelven da Silva Barbosa

"Descrição sintático-semântica de nomes predicadores em tweets do mercado financeiro"

Pós-graduação em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2023

Lucas Lopes Ribeiro

"Análise de regras linguísticas para o aperfeiçoamento de anotação automática de part-of-speech"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2023

Clarissa Lenina Scandarolli

"Descrição de fênomenos linguísticos em um corpus de tweets do mercado financeiro"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2022

Gabriel Ceregatto

"Caracterização Morfossintática de um Corpus de Tweets e Análise Preliminar de Erros de Tagging"

Bacharelado em Linguística • Universidade Federal de São Carlos
Outra Natureza 2022

Laura Santos Gazana

"DANTEStockes: um corpus de tweets em português da bolsa de valores anotado segundo o modelo Universal Dependencies"

Letras - Espanhol • Universidade Federal de São Carlos
Mestrado 2020

Darlan Xavier Nascimento

"Explorando a avaliação de sumários automáticos multidocumento multilíngue"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Mestrado 2020

Yasmin Vizeu

"Sumarização Automática Multilíngue Multidocumento: seleção de conteúdo e tratamento da redundância com base em conhecimento léxico-conceitual"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Mestrado 2020

Renata Ramisch

"Caracterização de desvios sintáticos em redações de estudantes do ensino médio: subsídios para o Processamento Automático das Línguas Naturais"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Mestrado 2019

Rejeane Cassia de Luca

"Aplicação de conhecimento léxico-conceitual na Sumarização Automática Multidocumento"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Doutorado 2019

Jackson Wilke da Cruz Souza

"Aprofundamentos da descrição linguístico-computacional do fenômeno da complementaridade"

Programa de Pós-graduação em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2019

Bruna Franco

"Anotação de cadeias de correferência compostas por entidades do tipo ?organização? para a Sumarização Automática Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
Outra Natureza 2019

Lucas Lopes Ribeiro

"Aplicação do corretor LanguageTool em corpus de redações do ensino médio e proposta de refinamento se suas regras"

Bacharelado em Linguística • Universidade Federal de São Carlos
Outra Natureza 2019

Milena Cardoso França

"Investigação de desempenho do LanguageTool em corpus de redações do ensino médio: as regras da categoria "miscelânea""

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2019

Milena Cardoso França

"Desempenho do corretor LanguageTool na análise gramatical de redações do ensino médio em português"

Bacharelado em Linguística • Universidade Federal de São Carlos
Doutorado 2018

Débora Domiciano Garcia

"Modelagem linguístico-computacional da semântica das preposições do português"

Programa de Pós-graduação em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2018

Luana Fonseca Cristini

"Avaliação de Regras de Reescrita para Referências a Pessoas em Sumários Automáticos Multidocumento"

Letras - Alemão • Universidade Estadual Paulista Júlio de Mesquita Filho
TCC / Graduação 2018

Felipe Lima Cury

"Investigação comparativa da complexidade textual entre originais e graded readers"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2018

Pedro Ferreira Martins

"Análise de desempenho do corretor gramatical CoGroo quanto à concordância nominal em redações de ensino médio"

Bacharelado em Linguística • Universidade Federal de São Carlos
Outra Natureza 2018

Pedro Ferreira Martins

"Investigação de desempenho do corretor gramatical CoGroo em corpus de redações do ensino médio"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2017

Luana Fonseca Cristini

"Avaliação de Regras de Reescrita para Referências a Pessoas em Sumários Automáticos Multidocumento"

Letras - Alemão • Universidade Estadual Paulista Júlio de Mesquita Filho
Mestrado 2015

Jackson Wilke da Cruz Souza

"Investigação do fenômeno da complementaridade para a Sumarização Automática Multidocumento"

Pós-graduação em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2015

Marina Delege

"Estudo preliminar da operação de generalização na Sumarização Humana Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2015

Vanessa Marcasso

"Descrição de características lexicais dos textos-fonte e sumários humanos multidocumento do corpus CSTNews"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2015

Naira Licia da Silva

"Primeiras investigações sobre o fenômeno da contradição em um corpus multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
Mestrado 2014

Fabricio Elder da Silva Tosta

"Aplicação de conhecimento léxico-conceitual na sumarização automática multidocumento multilíngue"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Mestrado 2014

Matheus Rigobelo Chaud

"Investigação de Estratégias de Sumarização Automática Multidocumento Multilíngue Baseadas em Interlíngua"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Mestrado 2014

Andressa Caroline Inácio Zacarias

"Investigação de Métodos de Sumarização Automática Multidocumento Baseados em Hierarquias Conceituais"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2014

Vinícius Felix dos Santos

"Análise linguística de aspectos textuais para a Sumarização Automática Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2014

Marina Delege

"Análise linguística da operação de generalização na Sumarização Humana Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2014

Vanessa Marcasso

"Caracterização linguística de sumários humanos multidocumento: explorando o nível lexical"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2014

Carla Chuman

"Análise linguística da operação de especialização na Sumarização Humana Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2014

Naira Lícia da Silva

"Descrição e análise do fenômeno da contradição para a Sumarização Automática Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
Mestrado 2013

Renata Tironi Camargo

"Investigação de estratégias de sumarização humana multidocumento"

Pós-graduação em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2013

Andressa Caroline Inácio Zacarias

"Delineamento conceitual de corpora via delimitação de subontologias"

Bacharelado em Linguística • Centro de Educação e Ciências Humanas
TCC / Graduação 2013

Andressa Caroline Inácio Zacarias

"Delineamento conceitual de corpus via indexação léxico-conceitual: primeiros resultados"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2012

Jackson Wilke da Cruz Souza

"Investigação de métodos de identificação de redundância para Sumarização Multidocumento"

Bacharelado em Linguística • Centro de Educação e Ciências Humanas
Iniciação Científica (PIBIC) 2012

Fabrício Elder da Silva Tosta

"Investigação de métodos clássicos de sumarização no cenário multidocumento multilíngue"

Bacharelado em Linguística • Centro de Educação e Ciências Humanas
Iniciação Científica (PIBIC) 2012

Arthur Pompílio Astrogildo da Silva

"Extração semiautomática da relação de hiponímia no projeto TermiNet"

Licenciatura em Letras • Centro de Educação e Ciências Humanas
TCC / Graduação 2012

Ana Catarina Gianoti

"Descrição e Análise Morfológica da Terminologia do Domínio da ?Educação à Distância?"

Bacharelado em Linguística • Centro de Educação e Ciências Humanas
TCC / Graduação 2012

Jackson Wilke da Cruz Souza

"Identificação da redundância com base em conhecimento linguístico profundo para a Sumarização Automática Multidocumento"

Bacharelado em Linguística • Universidade Federal de São Carlos
TCC / Graduação 2012

Arthur Pompilio Astrogildo da Silva

"Refinamento da hierarquia conceitual da base de dados lexicais Wordnet.EaD"

Licenciatura em Letras • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2012

Andressa Caroline Inácio Zacarias

"Delimitação de subontologias a partir da indexação de unidades lexicais provenientes de corpora"

Bacharelado em Linguística • Universidade Federal de São Carlos
Outra Natureza 2011

Leonardo Sameshima Taba

"Extração automática de termos e de relações semânticas e conceituais para o desenvolvimento de wordnets terminológicas em português do Brasil"

Ciência da Computação • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2011

Ana Catarina Gianoti

"Extração automática de termos segundo o paradigma linguístico no projeto TermiNet"

Bacharelado em Linguística • Universidade Federal de São Carlos
Outra Natureza 2010

Fernanda Cristina Guerra

"Praticando as ênfases do Bacharelado em Linguística"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) 2010

Jackson Wilke da Cruz Souza

"Construção do corpus para o desenvolvimento de uma wordnet terminológica em português do Brasil"

Bacharelado em Linguística • Universidade Federal de São Carlos

Orientações em Andamento (8) 2 Doutorado • 4 TCC/Graduação • 2 PIBIC

TCC / Graduação Início: 2026

Isabela Cristina Rodrigues

"Anotação Semiautomática de Metáforas em Saúde Mental com LLMs"

Linguística • Universidade Federal de São Carlos
TCC / Graduação Início: 2026

Isabella de Sousa Monteiro

"Argumentos modificadores em tweets do mercado financeiro: mapeamento sintático-semântico."

Linguística • Universidade Federal de São Carlos
TCC / Graduação Início: 2026

Pedro Henrique Silva

"Avaliação da concordância na anotação de argumentos modificadores em predicações nominais de tweets do mercado financeiro em português"

Linguística • Universidade Federal de São Carlos
TCC / Graduação Início: 2026

Breno da Costa Caricchio Aguiar

"Identificação de emoções e sinalizadores linguísticos em mídias sociais do domínio esportivo"

Linguística • Universidade Federal de São Carlos
Doutorado Início: 2025

Maria Julia Bernardo Comarim

"Exploração de Métodos Automáticos para Anotação de Corpus segundo o modelo Abstract Meaning Representation"

Programa de Pós-graduação em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) Início: 2025

Pedro Henrique Silva

"Anotação de papéis semânticos em tweets do mercado financeiro: definição de formatos e reutilização de recurso lexical"

Bacharelado em Linguística • Universidade Federal de São Carlos
Iniciação Científica (PIBIC) Início: 2025

Isabella de Sousa Monteiro

"Anotação de papéis semânticos no corpus DANTEStocks: os argumentos modificadores em tweets do mercado financeiro"

Bacharelado em Linguística • Universidade Federal de São Carlos
Doutorado Início: 2024

Bryan Khelven da Silva Barbosa

"NomBank.Br: um Banco de Proposições Nominais para o Português"

Programa de Pós-graduação em Linguística • Universidade Federal de São Carlos

Projetos de Pesquisa, Extensão & Desenvolvimento (28)

PESQUISA CONCLUIDO
1999 — 2000

TraSem - Especificação de Traços Semânticos dos Itens Lexicais

Investigação e especificação dos traços semânticos dos itens lexicais com vistas ao aprimoramento do Revisor Gramatical - ReGra.

Financiador(es): Financiadora de Estudos e Projetos
PESQUISA EM ANDAMENTO
2020 — Atual

POeTiSA - POrtuguese processing - Towards Syntactic Analysis and parsing

POeTiSA is a long term project that aims at growing syntax-based resources and developing related tools and applications for Brazilian Portuguese language, looking to achieve world state-of-the-art results in this area. On the resource side, we focus on the production of a large and comprehensive multi-genre corpus of Universal Dependencies-based part of speech and syntactically annotated texts, including mainly news texts and user-generated content (tweets and online comments). Regarding the tools, we aim to investigate recent neural and distributional-based methods for training robust parsing models for Portuguese. The project also envisions the production of applications on opinion mining and sentiment analysis tasks that may benefit from syntactic knowledge, as opinion summarization, helpfulness prediction, aspect idetification, deception detection and emotion classification. This project is part of the Natural Language Processing initiative (NLP2) of the Center for Artificial Intelligence (C4AI) of the University of São Paulo, sponsored by IBM and FAPESP (grant #2019/07665-4). The center is part of the FAPESP Engineering Research Centers Program and is committed to state-of-the-art research in Artificial Intelligence, exploring both foundational issues and applied research.

Financiador(es): IBM
PESQUISA EM ANDAMENTO
2023 — Atual

Computação Heterogênea para Visão Computacional e Processamento de Linguagem Natural

Trata-se de um projeto de pesquisa no âmbito das Ciências da Computação, em subáreas inter-relacionadas de grande destaque atual e de interesse acadêmico e industrial, a saber: Processamento de Imagens e Processamento de Língua Natural. Com a análise, a modelagem e o tratamento computacional de dados de imagens e de língua, prevê-se o avanço da fronteira de conhecimento nessas frentes e, consequentemente, das aplicações relacionadas a essas duas modalidades complementares de dados.

Financiador(es): Sociedade para Promoção da Excelência do Software Brasileiro
EXTENSAO CONCLUIDO
2021 — 2021

Python para Processamento de Linguagem Natural: Edição Comemorativa dos 50 anos do ICMC

O curso foi inteiramente virtual, com aulas transmitidas ao vivo pelo canal do ICMC no Youtube (http://tv.icmc.usp.br/), com os links para as gravações sendo disponibilizados posteriormente na página a seguir (https://cursosextensao.usp.br/course/view.php?id=2721). O curso teve 12.500 inscritos e 2.500 aprovados. A mesa de abertura teve mais de 14.000 visualizações.

PESQUISA CONCLUIDO
2009 — 2017

Sucinto - summarization for clever information access

The sucinto project aims at investigating and exploring generic and topic-focused multi-document summarization strategies for providing a more feasible and intelligent access to on-line information provided by news agencies. This commitment brings back old and well-known scientific challenges from the first studies in summarization in the 50s as well as introduces several new and exciting challenges, e.g., to deal with redundant, complementary and contradictory information, to normalize different writing styles and referring expression choices, to balance different perspectives and sides of the same events and facts, to properly deal with evolving events and their narration in different moments, and to arrange information pieces from different texts to produce coherent and cohesive summaries, among several others. An ultimate goal of this project is to pull the developed tools together as on-line applications for final users. This project takes into consideration not only classical approaches to single and multi-document summarization, but also new ones, following different paradigms and using knowledge of varied nature ranging from empirical and statistical data to semantic and discourse models. Research interests include (i) the modeling of the summarization process (content selection, planning, aggregation, generalization, substitution, information ordering, etc.) by means of Cross-document Structure Theory (CST), Rhetorical Structure Theory (RST), ontologies, and language and summarization statistical models, (ii) the investigation of related tasks as discourse parsing, topic detection, temporal annotation and resolution, coreference resolution, text-summary alignment, and multilingual processing, and (iii) the linguistic characterization of multi-document summaries and their manual production.

PESQUISA CONCLUIDO
2009 — 2011

TermiNet - Instanciação e Aplicação de uma Metodologia para o Desenvolvimento de Wordnets Terminológicas em Português do Brasil

Neste documento, propõe-se uma pesquisa no âmbito do Processamento Automático das Línguas Naturais (PLN), área interdisciplinar que busca desenvolver sistemas que processam as línguas naturais (p.ex.: sistemas de sumarização). Para o desenvolvimento de vários sistemas de PLN, são necessários certos recursos lingüísticos (os lingwares) que desempenham papel central na arquitetura dos sistemas, p.ex.: as ?bases de conhecimento lexical?. Dada a necessidade crescente de se processar textos especializados, bases de conhecimento lexical especializado (ou terminológico) passaram a ser desenvolvidas para várias línguas, principalmente no formato wordnet. Embora exista um número razoável de wordnets terminológicas em diversas línguas, observa-se a carência de uma metodologia suficientemente clara que facilite e, sobretudo, estimule a criação dessas bases. Para o português do Brasil (PB), aliás, não há bases de conhecimento especializado no formato wordnet. Assim, propõe-se (i) a instanciação de uma metodologia para o desenvolvimento de wordnets terminológicas e (ii) a sua aplicação na construção de uma base desse tipo em PB. Tal metodologia, proposta para a realização de quaisquer pesquisas no PLN, destaca-se por conciliar a face lingüística e a computacional dessa área. Com isso, acredita-se que o projeto pode beneficiar não só o PLN, mas também a Terminologia/ Terminografia em PB, pois o formato wordnet é um modelo elegante e eficaz para a representação do conhecimento léxico-conceitual, fundamental também para o desenvolvimento de produtos terminográficos tradicionais.

Financiador(es): Fundação de Amparo à Pesquisa do Estado de São Paulo
PESQUISA CONCLUIDO
2012 — 2016

Sustento1 - Geração de conhecimento linguístico para a Sumarização Automática Multidocumento

Dada a grande quantidade de informação disponível em várias línguas, sobretudo na web, a Sumarização Automática Multidocumento (SAM) tem ocupado lugar de centralidade no Processamento Automático das Línguas Naturais (PLN) na medida em que facilita o acesso à informação. Originada em meados de 1990, a SAM objetiva produzir automaticamente um único sumário (resumo) a partir de uma coleção de textos sobre um mesmo tópico. Para o português do Brasil (PB), as pesquisas começaram somente nos últimos anos. Apesar de incipientes, os sistemas/métodos que envolvem o PB igualam-se ao estado da arte e, em alguns casos, superam os resultados obtidos para outras línguas. Mesmo diante de cenário tão promissor, a SAM, de um modo geral, carece de subsídios linguísticos que permitam aproximar a tarefa automática à humana. Assim, neste projeto, objetiva-se gerar subsídios linguísticos para avançar o estado da arte em SAM, principalmente que envolve o PB. Para tanto, investigar-se-ão 3 frentes de pesquisa correlatas: (i) caracterização linguística de sumários multidocumento produzidos por humanos, (ii) investigação aprofundada dos fenômenos multidocumento (p.ex.: redundância), e (iii) descrição e formalização de conhecimento semântico-conceitual. As frentes (i) e (ii) justificam-se pelo fato de que a SAM, ao contrário da monodocumento, pauta-se apenas em indícios sobre a sumarização humana (multidocumento) e em estudos superficiais de seus fenômenos. A frente (iii) justifica-se pelo fato de que os métodos de SAM para o PB poderão ser enriquecidos ou totalmente baseados nesse tipo de conhecimento. Tendo em vista a geração de descrições e formalizações linguísticas nas três frentes, acredita-se que este projeto tem potencial para contribuir com a SAM e a Linguística Descritiva. Ademais, salienta-se a formação de recursos humanos no PLN, área ainda pequena no Brasil.

Financiador(es): Conselho Nacional de Desenvolvimento Científico e Tecnológico
PESQUISA CONCLUIDO
2018 — 2019

Ancora - Desenvolvimento de Algortimo de Interpretação de Escrita no Contexto de Avaliação, alinhada à Base Nacional Comum Curricular

O objetivo do projeto é desenvolver anotação e análise de corpus, regras e modelos de linguagem que subsidiem a construção de uma ferramenta de devolutiva pedagógica em tempo real e um algoritmo de avaliação alinhado aos critérios da matriz de avaliação da Base Nacional Comum Curricular. O produto do projeto será incorporado a um serviço pedagógico de escrita e letramento a ser oferecido a alunos e professores de escolas públicas e privadas como um componente-chave para a avaliação e melhoria do letramento no Brasil.

Financiador(es): Instituto Euvaldo Lodi - DF
PESQUISA CONCLUIDO
2016 — 2021

Sustento2 - Geração de conhecimento linguístico para a Sumarização Automática

Dada a grande quantidade de informação disponível em várias línguas, sobretudo na web, a Sumarização Automática Multidocumento (SAM) tem ocupado lugar de centralidade no Processamento Automático das Línguas Naturais (PLN) na medida em que facilita o acesso à informação. Originada em meados de 1990, a SAM objetiva produzir automaticamente um único sumário (resumo) a partir de uma coleção de textos sobre um mesmo tópico. Para o português do Brasil (PB), as pesquisas começaram somente nos últimos anos. Apesar de incipientes, os sistemas/métodos que envolvem o PB igualam-se ao estado da arte e, em alguns casos, superam os resultados obtidos para outras línguas. Mesmo diante de cenário tão promissor, a SAM, de um modo geral, carece de subsídios linguísticos que permitam aproximar a tarefa automática à humana. Assim, neste projeto, objetiva-se gerar subsídios linguísticos para avançar o estado da arte em SAM, principalmente que envolve o PB. Para tanto, investigar-se-ão 3 frentes de pesquisa correlatas: (i) caracterização linguística de sumários multidocumento produzidos por humanos, (ii) investigação aprofundada dos fenômenos multidocumento (p.ex.: redundância), e (iii) descrição e formalização de conhecimento semântico-conceitual. As frentes (i) e (ii) justificam-se pelo fato de que a SAM, ao contrário da monodocumento, pauta-se apenas em indícios sobre a sumarização humana (multidocumento) e em estudos superficiais de seus fenômenos. A frente (iii) justifica-se pelo fato de que os métodos de SAM para o PB poderão ser enriquecidos ou totalmente baseados nesse tipo de conhecimento. Tendo em vista a geração de descrições e formalizações linguísticas nas três frentes, acredita-se que este projeto tem potencial para contribuir com a SAM e a Linguística Descritiva. Ademais, salienta-se a formação de recursos humanos no PLN, área ainda pequena no Brasil.

PESQUISA EM ANDAMENTO
2024 — Atual

AIM-Health - AI-Based Support for Mental Health Communication

Depression is a mental health disorder that affects a large portion of the global population, being the second largest contributor to decrease in healthy life expectancy. Depression is characterized by a clinically significant form of psychological suffering that leads to significant impairment in someone's functionality, reduced quality of life and, in severe cases, can lead to death due to the risk of suicide. However, according to the World Health Organization, only a quarter of individuals suffering from mental health disorders receive proper care. Advances in Artificial Intelligence (AI) and Natural Language Processing (NLP) research have been developed to a level that can be used for proposing computational solutions that assist in the detection and intervention in mental health conditions. AI and NLP based solutions that aid in the identification of signs of depression can be useful both in individual treatment and in making public policy decisions. Similarly, solutions that offer autonomous, ethical, reliable, controlled, and engaging intervention, in real time, can help mitigate the damage caused by depression. This project works on proposing and developing AI and NLP based solutions for the detection and intervention of mental health conditions that can have a broader reach and allow mental health support to individuals and populations that would not otherwise have access to it. Furthermore, as social determinants are frequently mentioned as risk factors for mental health conditions, this project also aims at furthering the understanding about them in two contexts (Brazil and the United Kingdom). This project aims to address scientific challenges that are still present and very relevant in this context: (i) dealing with more abstract language (such as figurative language) commonly used in mental health self-narratives, and (ii) outputting personalized interventions suitable for an individual's context. (AU)

EXTENSAO CONCLUIDO
2009 — 2009

I Seminário de Estudos do Léxico (SELEX)

O Seminário de Estudos do Léxico (SELEX) foi proposto com o objetivo de reunir as pesquisaores, docentes e alunos da UFSCar, interessados no léxico sob diferentes perpectivas.

EXTENSAO CONCLUIDO
2009 — 2009

I Olimpíada Brasileira de Linguística Computacional (OlinCom)

A I Olimpíada Brasileira de Linguística Computacional (OlinCom) é uma competição acadêmica voltada à promoção do interesse e do conhecimento em Processamento de Linguagem Natural (PLN), reunindo estudantes para resolver desafios relacionados à análise automática da linguagem, como interpretação semântica, modelagem linguística e uso de recursos computacionais aplicados à língua.

Financiador(es): The North American Chapter of the Association for Computational Linguistics
EXTENSAO CONCLUIDO
2009 — 2009

I Workshop de Iniciação Científica em Tecnologia da Informação e da Linguagem Humana (TILic)

O I Workshop de Iniciação Científica em Tecnologia da Informação e da Linguagem Humana, o TILic, será o primeiro workshop de Iniciação Científica (IC) que busca agregar alunos de graduação das áreas de Ciências da Computação, de Lingüística, de Ciências da Informação e outras, engajados em pesquisas relacionadas ao processamento das línguas naturais. Tal evento integra o Simpósio Brasileiro de Tecnologia da Informação e da Linguagem Humana (STIL 2009), que será realizado entre os dias 7 e 11 de setembro de 2009 no Instituto de Ciências Matemáticas e de Computação (ICMC) da USP/São Carlos.

EXTENSAO CONCLUIDO
2011 — 2011

II Jornada de Descrição do Português (JDP)

A Jornada de Descrição do Português visa aproximar linguistas e pesquisadores da área de computação, integrando mais efetivamente essas duas áreas que precisam atuar de forma interdisciplinar para promover avanços no processamento automático da língua portuguesa.A Linguística Descritiva, em especial, tem enorme potencial para aportar conhecimentos ao Processamento Automático de Língua Natural (PLN), de maneira a colocar a língua portuguesa numa posição de destaque no cenário mundial, fazendo frente às demais línguas (inglês, francês, espanhol, etc.) que vislumbraram essa interdisciplinaridade já na década de 1960.

EXTENSAO CONCLUIDO
2022 — 2022

I Universal Dependencies Brazilian Festival (UDFest-BR)

O Universal Dependencies Brazilian Festival (UDFest-BR), realizado no âmbito do PROPOR 2022, é um fórum voltado à discussão do modelo Universal Dependencies (UD) e sua adaptação ao português. O UD é um modelo internacional de anotação gramatical que apoia estudos contrastivos e o desenvolvimento de tecnologias multilíngues em PLN. Apesar de sua ampla adoção com centenas de corpora anotados em mais de 100 línguas e de suas vantagens para aplicações como tradução automática e extração de informação, o uso do UD no português ainda é incipiente. O evento busca, assim, ampliar a visibilidade da área, promover boas práticas e incentivar colaborações e novas pesquisas.

EXTENSAO CONCLUIDO
2016 — 2016

16a Jornada de Letras da UFSCar

EXTENSAO EM ANDAMENTO
2025 — Atual

Brasileiras em Processamento da Linguagem Natural

O "Brasileiras em PLN" (BPLN: https://brasileiraspln.com) é um grupo criado em 2020 e atualmente (2025) é formado por cerca de 260 pessoas que se identificam com o gênero feminino, brasileiras, interessadas ou trabalhando ativamente na área de Processamento de Linguagem Natural (PLN) em diversos estados do Brasil e no exterior. O BPLN tem a missão de fortalecer a presença das mulheres no PLN no Brasil, destacando suas contribuições, promovendo a disseminação do conhecimento e inspirando e capacitando mais pessoas para trabalharem e pesquisarem nesta área. Neste sentido, este projeto visa abarcar atividades de divulgação científica (palestras), educação (cursos) e parcerias científicas (projetos e orientações) das integrantes atuais e futuras do BPLN.

EXTENSAO CONCLUIDO
2023 — 2023

II Jornada de Estudos Descritivos

O objetivo do evento é reunir os grupos de pesquisa dos/as docentes da linha de pesquisa Descrição, Análise e Processamento de Línguas Naturais do Programa de Pós-Graduação da UFSCar. Haverá apresentação dos grupos de pesquisa e dos trabalhos de pós-graduandas/os atuais e egressos. Além disso, está prevista uma sessão de apresentação de trabalhos de pós-graduandas/os de outras universidades, caso haja inscrições.

EXTENSAO EM ANDAMENTO
2025 — Atual

III Jornada de Estudos Descritivos

A III Jornada de Estudos Descritivos é um evento promovido pelo PPGL-UFSCar, Programa de Pós-Graduação em Linguística da Universidade Federal de São Carlos, e ocorrerá nos dias 21 e 22 de abril de 2026, com as inscrições abertas de 16 de março a 17 de abril do mesmo ano.O evento será realizado de forma presencial e tem como proposta a apresentação de pesquisas relacionadas à Linguagem, especificamente na linha de pesquisa descritiva.A linha de pesquisa dos trabalhos apresentados no evento tem como foco a investigação da forma e função de construções linguísticas, visando a explicação e compreensão da linguagem.A investigação é realizada através de diversos modelos teóricos que permitem a análise dos fenômenos linguísticos, sendo utilizadas por áreas que analisam, por exemplo, a fonética, semântica, pragmática e dados sociofuncionais das línguas humanas.

EXTENSAO EM ANDAMENTO
2026 — Atual

Lumos - Natural Language Processing for Social Media Monitoring

This project aims to develop Natural Language Processing (NLP) technologies for social listening monitoring, with a focus on social media and sports-related posts. The proposal integrates language technologies such as linguistic resources (lexicons and annotated corpora) and computational approaches based on symbolic and Large Language Model methods, targeting tasks such as sentiment analysis, topic identification, and named entity recognition. Ultimately, the project seeks to contribute to a better understanding of perceptions and trends in digital environments, as well as to advance robust NLP solutions tailored to Portuguese.

PESQUISA EM ANDAMENTO
2026 — Atual

Lumos - Natural Language Processing for Social Media Monitoring

This project aims to develop Natural Language Processing (NLP) technologies for social listening and monitoring, with a focus on social media and sports-related posts. The proposal integrates language technologies such as linguistic resources (lexicons and annotated corpora) and computational approaches based on symbolic and Large Language Model-based methods, targeting tasks such as sentiment analysis, topic identification, and named entity recognition. Ultimately, the project seeks to contribute to a better understanding of perceptions and trends in digital environments, as well as to advance robust NLP solutions tailored to Portuguese.

PESQUISA EM ANDAMENTO
2026 — Atual

SAPPo - Towards Semantic Analysis and Parsing for Portuguese

The interpretation of natural language is essential in a wide range of Natural Language Processing (NLP) applications, involving tasks such as Named Entity Recognition (NER), Semantic Role Labeling (SRL), and the representation of sentence meaning through formalisms such as Abstract Meaning Representation (AMR). Although extensively studied for standard English, these tasks remain challenging even in the presence of large annotated corpora for model development and evaluation. NER faces issues such as semantic ambiguity, entity boundaries, nested entities, and coreference; SRL must deal with syntactic ambiguity, polysemy, the distinction between arguments and adjuncts, and implicit arguments; and AMR, while inheriting these challenges, also involves graph-structuring, coreference, non-literal meaning, and typological variation across languages, given that it was originally designed for English. These problems are further exacerbated in user-generated content (UGC) (e.g., tweets, posts), which is characterized by non-standard language. Despite some important initiatives, resources for NER, SRL, and AMR in Portuguese remain limited, and annotation is still largely manual, time-consuming, and costly. Considering these three tasks, this project aims to create annotated corpora and lexical repositories and to develop automatic methods for both formal Portuguese and/or UGC. To this end, we propose to explore classical symbolic approaches, current techniques based on Large Language Models (LLMs), and/or hybrid methods that combine the interpretability of symbolic approaches with the generalization capacity of pre-trained neural models (LLMs), aiming at more robust and adaptable solutions.

PESQUISA CONCLUIDO
2006 — 2008

NanoTerm - Terminologia em Língua Portuguesa da Nanociência e Nanotecnologia: Sistematização do Repertório Vocabular e Elaboração de Dicionário-Piloto

A Nanotecnologia é atualmente uma das áreas centrais das atividades de pesquisa, desenvolvimento e inovação nos países industrializados. Investimentos aplicados nessa área de conhecimento por esses países têm sido crescentes e atingiram, em 2002, cerca de cinco bilhões de dólares. A previsão é de que, entre 2010 e 2015, o mercado mundial envolvendo a Nanotecnologia será de um trilhão de dólares. O cenário no Brasil para pesquisas em Nanociência e Nanotecnologia (NN) já é promissor, entretanto, ainda há uma grande defasagem dos países do Hemisfério Sul em relação aos países desenvolvidos, como mostra documento da OEA intitulado "Ciência, Tecnologia, Engenharia e Inovação para o Desenvolvimento: uma visão para as Américas no Século XXI" (nov/2005). Para acompanhar esse desenvolvimento científico e tecnológico que se deseja, é preponderante a sistematização de repertórios vocabulares em língua portuguesa. Sistematizar terminologias significa criar termos fiáveis de forma a facilitar a comunicação especializada, além de demonstrar que a língua portuguesa está apta para nomear conceitos técnicos e científicos. Em outras palavras, ao mesmo tempo em que se promove a disseminação de conhecimentos e de tecnologias, fomenta-se a língua nacional, posto que não há ainda qualquer glossário e/ou dicionário de NN em língua materna. O que se observa é presença maciça de produtos terminológicos em língua inglesa, mas, ainda assim, limitados em abrangência e profundidade. Esta proposta tem como objetivos: 1) constituição de um corpus em língua portuguesa; 2) busca de equivalentes em português - língua de chegada (LC) - a partir de uma nomenclatura em inglês - língua de partida (LP); 3) proposta de uma ontologia em língua portuguesa da área de NN; 4) elaboração do primeiro dicionário-piloto em NN em língua materna.Financiado pelo edital MCT/CNPq 61/2005 (Ciências Humanas, Sociais e Sociais Aplicadas). Vigência: jul/2006 a jul/2008). Valor concedido: R$ 7.000,00.

Financiador(es): Conselho Nacional de Desenvolvimento Científico e Tecnológico
EXTENSAO CONCLUIDO
2013 — 2013

III Jornada de Descrição do Português (JDP)

A Jornada de Descrição do Português visa aproximar linguistas e pesquisadores da área de computação, integrando mais efetivamente essas duas áreas que precisam atuar de forma interdisciplinar para promover avanços no processamento automático da língua portuguesa.A Linguística Descritiva, em especial, tem enorme potencial para aportar conhecimentos ao Processamento Automático de Língua Natural (PLN), de maneira a colocar a língua portuguesa numa posição de destaque no cenário mundial, fazendo frente às demais línguas (inglês, francês, espanhol, etc.) que vislumbraram essa interdisciplinaridade já na década de 1960.

PESQUISA CONCLUIDO
2006 — 2007

Glosagem da Base da WordNet.Br e sua Indexação à WordNet de Princeton

Neste projeto, propõe-se, especificamente, a ampliação qualitativa dessa base de verbos. Como na WordNet de Princeton em que se inspira, a base de verbos da WordNet.Br deverá conter a especificação de glosas (isto é, uma definição do significado do conceito implicitamente codificado em cada synset, que constitui também a definição de um ontologia recortada por uma língua natural) e das relações lógico-conceituais e hierárquicas que se estabelecem entre os synsets de verbos. Para isso, estabelece-se um dos seus objetivos: fazer a interligação entre a base da Wordnet.Br e a base da WordNet de Princeton, que se concretiza por meio da especificação da coindexação entre os synsets de verbos da base da WordNet.Br e os synsets de verbos semanticamente (quase-)equivalentes da Wordnet de Princeton.

PESQUISA CONCLUIDO
2015 — 2016

Revisa - Knowledge-based Revision for Transforming Multi-Document Extracts into Abstracts

Given the large volume of information available in multiple languages, particularly on the Web, Multi-Document Summarization (MDS) has become an important approach to mitigating information overload. Since its emergence in the mid-1990s, MDS has been an active research area within Natural Language Processing (NLP), aiming to automatically generate a single summary from a collection of documents describing the same topic. Research on MDS for Brazilian Portuguese began in 2011, and the resulting methods and systems have achieved, and in some cases surpassed, the state of the art for the language.Most MDS systems generate extractive summaries, i.e., summaries composed of sentences (or, more rarely, phrases or paragraphs) selected from the source documents. Although extractive approaches have achieved substantial improvements, the resulting summaries often suffer from limited informativeness and reduced linguistic quality.This project investigates, from a corpus-based perspective, rewriting strategies for automatic summary revision. The goal is to formulate rewriting rules that generalize and specialize the content of extractive summaries during a post-editing stage. These operations vary widely in scope (intra- and inter-sentential), linguistic level (lexical, phrasal, clausal, and sentential), and underlying mechanisms (e.g., lexical substitution and insertion, syntactic transformations, and discourse-level operations). By introducing an abstraction layer over extractive summaries, the project moves beyond purely extractive MDS toward partially abstractive summarization, producing summaries that are more natural, more informative, and linguistically more fluent.

Financiador(es): Fundação de Amparo à Pesquisa do Estado de São Paulo
PESQUISA EM ANDAMENTO
2021 — Atual

Converseiro - Linguistic Description and Automatic Processing of Social Media Content

The different genres of content produced on social media also referred to as user-generated content (UGC) are of particular interest due to the opinions, evaluations, and interactions they express, as well as the linguistic specificities associated with digital communication. This project is dedicated to the linguistic investigation of texts circulating primarily on the X platform (formerly Twitter). In this context, the project aims to describe different linguistic aspects of the tweet genre, covering lexical, morphosyntactic, syntactic, and semantic-discursive phenomena. The goal is to support the development of linguistic-computational resources (lingware) for the automatic processing of this type of UGC in Portuguese, including treebanks (i.e., linguistically annotated corpora), lexicons, and computational grammars.

Financiador(es): Softex/InovaUSP/MCTI
PESQUISA EM ANDAMENTO
2020 — Atual

C4AI - Centro de Inteligência Artificial

Esta proposta descreve um Centro de Pesquisa de Engenharia em Inteligência Artificial (IA) empenhado em conduzir pesquisas em tópicos centrais de IA e em aplicar técnicas de IA em áreas de aplicação selecionadas --- a saber, indústria de óleo e gás, agronegócios e saúde. O Centro também dará suporte a estudos sobre o impacto social e econômico da IA e conduzirá atividades de transferência de tecnologia e difusão do conhecimento. O Centro será construído com a convicção de que os próximos dez anos trarão avanços sem precedentes em IA, os quais dependerão da colaboração tanto entre áreas centrais da IA como destas áreas com as aplicações. O "Center for Artificial Intelligence" consistirá de dois grupos interligados de pesquisadores, ambos distribuídos na instituição anfitriã e em instituições associadas. Um grupo de pesquisadores, com significativa projeção internacional na comunidade de IA, cobrirá tópicos centrais de IA, de representação de conhecimento a aprendizado de máquina, com ênfase em processamento de texto e linguagem natural, particularmente em Português. Tendências da pesquisa internacional corrente sugerem que a próxima década testemunhará uma interação crescente entre representação de conhecimento, tomada de decisão e aprendizado de máquina; o "Center for Artificial Intelligence" focará sua atenção na combinação destas áreas da IA, já que elas não são tão intimamente conectadas quanto deveriam ser --- o Centro se posicionará como um participante fundamental na colaboração entre os principais tópicos da IA. Um segundo grupo de pesquisadores do Centro focará em três áreas de aplicação onde existe significativa experiência na instituição anfitriã: óleo e gás, agronegócio, e saúde. A conexão entre pesquisa em tópicos centrais da IA e áreas de aplicação ocorrerá em dupla direção: pesquisa em IA básica abordará problemas de grande escala nas áreas de aplicação selecionadas, e será direcionada pelos desafios nestas áreas de aplicação. Um pequeno grupo de pesqu

Financiador(es): Fundação de Amparo à Pesquisa do Estado de São Paulo

Atuação Profissional e Vínculos Institucionais

🇧🇷USP - Universidade de São Paulo
1999 — 2000

Cargo / Enquadramento: Pesquisador

Vínculo: COLABORADOR (20h semanais)

🇧🇷USP - Universidade de São Paulo
2005 — 2005

Cargo / Enquadramento: OUTRO

Vínculo: COLABORADOR

Universidade Federal De São Carlos
Atual 2009 — Atual

Cargo / Enquadramento: Professor Associado 4

Vínculo: Servidor público (40h semanais)

Dedicação Exclusiva (DE)

🇧🇷UNESP - UNIVERSIDADE ESTADUAL PAULISTA JÚLIO DE MESQUITA FILHO
2005 — 2011

Cargo / Enquadramento: OUTRO

Vínculo: COLABORADOR

Calidoscópio (UNISINOS)
Atual 2009 — Atual

Vínculo: Revisor de periódico

Estudos Lingüísticos (São Paulo)
Atual 2009 — Atual

Vínculo: Revisor de periódico

University of Pennsylvania
2015 — 2016

Cargo / Enquadramento: Pós-doutoranda

Vínculo: Pesquisador visitante

Dedicação Exclusiva (DE)

Softex/InovaUSP/MCTI
Atual 2021 — Atual
Centro de Inovação da Universidade de São Paulo/InovaUSP/USP
Atual 2020 — Atual

Formação Acadêmica / Titulação & Pós-Doutorado

GRADUACAO 1996 — 2000

Licenciatura em Letras

Universidade Federal De São Carlos
MESTRADO 2001 — 2004

Linguística e Língua Portuguesa

🇧🇷UNESP - UNIVERSIDADE ESTADUAL PAULISTA JÚLIO DE MESQUITA FILHO

Título: "Representação lingüístico-computacional dos adjetivos valenciais do português"

DOUTORADO 2005 — 2008

Linguística e Língua Portuguesa

🇧🇷UNESP - UNIVERSIDADE ESTADUAL PAULISTA JÚLIO DE MESQUITA FILHO

Título: "Delimitação e alinhamento de conceitos lexicalizados no inglês norte-americano e no português brasileiro"

POS-DOUTORADO 2015 — 2016

University of Pennsylvania

University of Pennsylvania

Formação Complementar & Cursos de Extensão

CURTA DURACAO 2003

Insvestigações sem., gram. e computacionais

🇧🇷Faculdade De Ciências E Letras
CURTA DURACAO 2012

Introdução ao R e algumas aplicações para LC

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 3h

CURTA DURACAO 2012

Aprendizado de máquina para tarefas de PLN

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 4h

CURTA DURACAO 2010

Automatic Speech Recognition

🇧🇷PUCRS - PONTIFÍCIA UNIVERSIDADE CATÓLICA DO RIO GRANDE DO SUL

Carga horária: 4h

CURTA DURACAO 2009

La terminología en las universidades españolas

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 4h

CURTA DURACAO 2009

Robust Wide-Coverage Parsing: Evaluations, Represe

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 2h

CURTA DURACAO 2009

Metáfora

🇧🇷UERJ - UNIVERSIDADE DO ESTADO DO RIO DE JANEIRO

Carga horária: 1h

CURTA DURACAO 2009

Getting to grips with key words and key clusters

🇧🇷UERJ - UNIVERSIDADE DO ESTADO DO RIO DE JANEIRO

Carga horária: 2h

CURTA DURACAO 2009

Terminologia

🇧🇷UERJ - UNIVERSIDADE DO ESTADO DO RIO DE JANEIRO

Carga horária: 2h

CURTA DURACAO 2009

Fast and Practical Corpus Processing using Standar

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 2h

CURTA DURACAO 2010

Approaches to Statistical Machine Translation

🇧🇷PUCRS - PONTIFÍCIA UNIVERSIDADE CATÓLICA DO RIO GRANDE DO SUL

Carga horária: 4h

CURTA DURACAO 2012

Complexidade de Textos

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 3h

CURTA DURACAO 2004

Recursos para o processamento de línguas naturais

Iinstituto de Ciências Matemáticas e de Computação
CURTA DURACAO 2002

Workshop de Lexicologia/Lexicografia e Córpus

🇧🇷Faculdade De Ciências E Letras
CURTA DURACAO 2006

Corpus-based approaches to lexicon development

🇧🇷IME - INSTITUTO MILITAR DE ENGENHARIA
CURTA DURACAO 2005

Workshop em Semântica Lexical

Universidade Federal De Santa Catarina
CURTA DURACAO 2006

Machine Learning for Natural Languages

🇧🇷IME - INSTITUTO MILITAR DE ENGENHARIA
CURTA DURACAO 2004

Workshop de Ontologias

Iinstituto de Ciências Matemáticas e de Computação
CURTA DURACAO 2012

Anotação semântica na prática

Iinstituto de Ciências Matemáticas e de Computação

Carga horária: 3h

Participação em Bancas Julgadoras e Comissões (38)

Mestrado 2009

Candidato(a): Cláudia Dias de Barros

"Antonímia nos adjetivos descritivos do português do Brasil: uma proposta de análise"

Universidade Federal de São Carlos

Mestrado 2009

Candidato(a): Douglas Henrique Perez Pino

"Terminologia do Biodiesel: aspectos semânticos e morfológicos"

Universidade Federal de São Carlos

Mestrado 2010

Candidato(a): Cláudia Dias de Barros

"Antonímia nos adjetivos descritivos do português do Brasil: uma proposta de análise"

Universidade Federal de São Carlos

Mestrado 2010

Candidato(a): Érick Galani Maziero

"Detecção automática de relações multidocumento para o Português do Brasil"

Iinstituto de Ciências Matemáticas e de Computação

Mestrado 2010

Candidato(a): Maria Paula Fiorim Piruzelli

"Estudo exploratório das ambiguidades linguísticas no inglês e de como elas podem comprometer a adequação da TA do inglês para o português"

Universidade Estadual Paulista Júlio de Mesquita Filho

Mestrado 2011

Candidato(a): Maria Paula Fiorim Piruzelli

"Ambiguidades linguísticas no inglês e a tradução automática inglês-português: um estudo exploratório"

Universidade Estadual Paulista Júlio de Mesquita Filho

Mestrado 2012

Candidato(a): Veronica Agostini

"Alinhamento Automático de Textos e Sumários Multidocumento"

Iinstituto de Ciências Matemáticas e de Computação

Mestrado 2012

Candidato(a): Bianca Franco Pasqualini

"Medidas de complexidade textual e a tradução de contos em inglês para leitores brasileiros com nível de letramento básico"

Universidade Federal do Rio Grande do Sul

Mestrado 2013

Candidato(a): Raphael Mendes

"Aspectos comparativos da regência verbal em português e inglês para a elaboração de um dicionário bilíngue"

Instituto de Biociências, Letras e Ciências Exatas

Mestrado 2015

Candidato(a): Alessandro Yovan Bokan Garay

"Sumarização multidocumento com base em aspectos informativos"

Iinstituto de Ciências Matemáticas e de Computação

Mestrado 2018

Candidato(a): Georges Basile Stávracas Neto

"Reescrita sentencial baseada em traços de personalidade"

Escola de Artes, Ciências e Humanidades

Mestrado 2021

Candidato(a): Lucas Pimenta Porto

"Pós-processamento de textos de tradução automática baseado em teoria de grafos"

Universidade de São Paulo

Mestrado 2020

Candidato(a): Andressa Vieira

"Um modelo de classificação para o Reconhecimento de Entidades Nomeadas"

Faculdade de Filosofia, Letras e Ciências Humanas

Mestrado 2021

Candidato(a): Marcio Lima Inacio

"Sumarização de Opinião com base em Abstract Meaning Representation"

Iinstituto de Ciências Matemáticas e de Computação

Mestrado 2024

Candidato(a): Matheus José Garcia Fagundes

"Combinando características léxicas e morfossintáticas para a detecção de notícias falsas em português"

Escola de Artes, Ciências e Humanidades

Mestrado 2024

Candidato(a): Diego Pedro Gonçalves da Silva

"Indução gramatical automática para o português"

Iinstituto de Ciências Matemáticas e de Computação

Mestrado 2026

Candidato(a): Germano Antonio Zani Jorge

"An Investigation of Multilingual and Multigenre Summarization Methods"

Iinstituto de Ciências Matemáticas e de Computação

Mestrado 2012

Candidato(a): Erick Galani Maziero

"Identificação automática de relações multidocumento"

Iinstituto de Ciências Matemáticas e de Computação

Doutorado 2011

Candidato(a): Valdirene Pereira da Conceição

"Modelagem léxico-ontológica do domínio "patrimônio cultural de São Luís do Maranhão""

Universidade Estadual Paulista Júlio de Mesquita Filho

Doutorado 2013

Candidato(a): Felipe Iszlaji de Albuquerque

"Modelagem linguístico-computacional para o Dicionário Analógico Digital do Dicionário Criativo"

Universidade Estadual Paulista Júlio de Mesquita Filho

Doutorado 2014

Candidato(a): Cláudia Dias de Barros

"Descrição e classificação de predicados nominais com verbo fazer no português"

Universidade Federal de São Carlos

Doutorado 2014

Candidato(a): Merley da Silva Conrado Laguna

"Extração automática de termos baseada em Aprendizado de Máquina"

Iinstituto de Ciências Matemáticas e de Computação

Doutorado 2014

Candidato(a): Dayse Simon Landim Kamikawachi

"Identificação e extração semiautomática de contextos definitórios em corpus com vistas à redação da definição terminológica: proposta de sistematização linguística para a língua portuguesa"

Universidade Federal de São Carlos

Doutorado 2015

Candidato(a): Maria Lucía del Rosario Castro Jorge

"Modelagem gerativa para sumarização automática multidocumento"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2009

Candidato(a): Valdirene Pereira da Conceição

"Modelagem léxico-ontológica do "Patrimônio Cultural""

Universidade Estadual Paulista Júlio de Mesquita Filho

Exame de Qualificação 2010

Candidato(a): Merley da Silva Conrado

"Método híbrido de extração de termos aplicado na mineração de textos"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2011

Candidato(a): Paula C. F. Cardoso

"Exploração de métodos de Sumarização Automática Multidocumento com base em conhecimento semântico-discursivo"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2012

Candidato(a): Felipe Iszlaji de Albuquerque

"Modelo para um dicionário analógico digital disponível na Internet"

Universidade Estadual Paulista Júlio de Mesquita Filho

Exame de Qualificação 2017

Candidato(a): Fábio Henrique de Carvalho Bertonha

"Proposta lexicográfica sinonímica: locuções adverbais e preposicionais em "a", "de" e "em""

Universidade Estadual Paulista Júlio de Mesquita Filho

Exame de Qualificação 2019

Candidato(a): Marco Antonio Sobrevilla Cabezudo

"Geração de língua natural por meio de representação semântica abstrata para o português brasileiro"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2023

Candidato(a): Diego Pedro Gonçalves da Silva

"Indução gramatical automática para o português"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2024

Candidato(a): Germano Antonio Zani Jorge

"An Investigation of Multilingual and Multigenre Summarization Methods"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2025

Candidato(a): Elvis Alves de Souza

"Investigação de métodos para a anotação automática de Dependências Universais Aprimoradas para o português"

Iinstituto de Ciências Matemáticas e de Computação

Exame de Qualificação 2026

Candidato(a): Luiz Carlos Alves Junior

"Avaliação do uso de Inteligência Artificial Generativa na validação de colocações: um estudo descritivo com ChatGPT"

Universidade Estadual Paulista

Exame de Qualificação 2020

Candidato(a): Márcio Lima Inácio

"Sumarização de Opinião com base em Abstract Meaning Representation"

Iinstituto de Ciências Matemáticas e de Computação

Graduação 2010

Candidato(a): Fernando de Paula Alves

"O ambiente computacional e-Termos como recurso para a elaboração da definição do Biodiesel"

Universidade Federal de São Carlos

Graduação 2012

Candidato(a): Arthur Pompilio Astrogildo da Silva

"A identificação semiautomática da hiponímia para a construção da hierarquia conceitual em wordnets terminológicas"

Universidade Federal de São Carlos

Graduação 2014

Candidato(a): Tiago Pereira Rodrigues

"A tradução de variantes da fala não-padrão na legendação de filmes"

Universidade Federal de São Carlos

Participação em Eventos, Congressos e Exposições (81)

Congresso (Poster / Painel)
2007

V Workshop em Tecnologia da Informação e da Linguagem Humana (TIL)

Apresentação: "Towards an Automatic Strategy for Acquiring the WordNert.Br Hierarchical Relations"

Congresso (Apresentação Oral)
2006

XI Simpósio Nacional de Letras e Lingüística/ / I Simpósio Internacional de Letras e Lingüística (SILEL)

Apresentação: "Ontologias Lingüísticas aplicadas ao Processamento Automático de Línguas Naturais: o caso das redes wordnets"

Congresso (Poster / Painel)
2010

IX Encontro de Linguística de Corpus (ELC)

Apresentação: "O Corpus.EaD no projeto TermiNet: estratégias de construção"

Congresso
2014

11th International Conference on Computational Processing of Portuguese

Congresso
2014

I Workshop on Tools and Resources for Automatically Processing Portuguese and Spanish

Congresso (Apresentação Oral)
2025

X Jornada de Descrição do Português (JDP)

Apresentação: "DANTEStocks-AMR em Construção: Avanços e Desafios na Anotação Semântica de Tweets Financeiros"

Congresso (Apresentação Oral)
2025

X Jornada de Descrição do Português (JDP)

Apresentação: "Named Entities in Stock Market Tweets: A Fine-Grained and Linguistically-Motivated Annotation"

Congresso
2025

35th Brazilian Conference on Intelligent Systems (BRACIS)

Congresso (Apresentação Oral)
2011

I Congresso Internacional de Estudos do Léxico (CIEL)

Apresentação: "Os termos nas wordnets: estratégias de identificação automática da sinonímia em corpus especializado"

Congresso (Apresentação oral)
2012

XI Encontro de Linguística de Corpus (XI ELC)

Apresentação: "Analysis of Aspects in a Corpus of Human Multi-document Summaries of Sports News"

Congresso (Apresentação Oral)
2012

XI Encontro de Linguística de Corpus (XI ELC)

Apresentação: "Alinhamento manual de textos e sumários em um corpus jornalístico multidocumento"

Congresso (Poster / Painel)
2016

10th Linguistic Annotation Workshop (LAW)

Apresentação: "Phrase Generalization: a Corpus Study in Multi-Document Abstracts and Original News Alignments"

Congresso (Apresentação oral)
2019

6th Workshop on Portuguese Description (JDP)

Apresentação: "Subsídios linguístico-computacionais para a revisão gramatical de redações do ensino médio"

Congresso
2019

12th Brazilian Symposium in Information and Human Language Technology

Congresso (Apresentação Oral)
2008

IV Workshop on MSc Dissertation and PhD Thesis in Artificial Intelligence (WTDIA)

Apresentação: "REBECA ? uma Base de Dados Léxico-Conceitual Bilíngüe Inglês-Português"

Congresso (Poster / Painel)
2008

VI Workshop em Tecnologia da Informação e da Linguagem Humana (TIL)

Apresentação: "OntoMethodus - A methodology to build domain-specific ontologies and its use in a system to generation of terminographic products"

Congresso (Apresentação Oral)
2011

59o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo (Gel)

Apresentação: "Terminologia baseada em corpus: a extração de candidatos a termo segundo a abordagem estatística no projeto TermiNet"

Congresso (Apresentação Oral)
2010

58o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo (Gel)

Apresentação: "Delimitação do domínio da Educação a Distância com vistas à construção da base lexical WordNet.EaD"

Congresso (Apresentação Oral)
2011

18o Intercâmbio de Pesquisas em Linguística Aplicada (Inpla)

Apresentação: "A construção de wordnets terminológicas a partir de corpora e a extração automática de termos"

Congresso (Apresentação Oral)
2010

Groupe de Linguistique Appliqué des Telecommunications (GLAT)

Apresentação: "An introduction ot the TermiNet project"

Congresso
2010

9th International Conference on Computational Processing of the Portuguese Language (PROPOR)

Congresso (Poster / Painel)
2010

Young Investigators Workshop on Computational Approaches to Languages of the Americas

Apresentação: "The TermiNet project: an overview"

Congresso (Poster / Painel)
2013

Student Workshop on Information and Human Language Technology (TILic)

Apresentação: "Identificação da redundância na Sumarização Automática Multidocumento: explorando métodos superficiais"

Congresso
2013

IX Brazilian Symposium in Information and Human Language Technology

Congresso
2006

The International Joint Conference IBERAMIA/SBIA/SBRN

Congresso (Poster / Painel)
2001

4a Jornada Científica da UFSCAR - encontro de conhecimentos diálogo e saberes

Apresentação: "Representação lingüístico-computacional dos adjetivos valeciais no léxico do processamento automático do português"

Congresso (Apresentação Oral)
2002

12o Intercâmbio de Pesquisas em Lingüística Aplicada (Inpla)

Apresentação: "Etiquetagem morfossintática de 1 milhão de palavras: relatos da experiência lingüística em um processo semi-automático"

Congresso (Poster / Painel)
2001

VIII Congresso de Iniciação Científica da UFSCar

Apresentação: "Especificação dos traços semânticos dos itens lexicais"

Congresso
1999

I Encontro de Estudos Diacrônicos do Português (EDiP)

Congresso
2000

7th Iberoamerican Conference on Artificial Inteligence (IBERAMIA)

Congresso
2000

15th Brazilian Conference on Artificial Inteligence (SBIA)

Congresso
2001

II Encontro de Estudos Diacrônicos do Português (EDiP)

Congresso (Poster / Painel)
2005

15o Intercâmbio de Pesquisas em Lingüística Aplicada (Inpla)

Apresentação: "Extração de informações semânticas de dicionários com vistas à elaboração de léxicos lingüístico-computacionais"

Congresso (Apresentação Oral)
2009

VIII Encontro de Linguística de Corpus (ELC)

Apresentação: "Projetando o corpus para a construção de uma wordnet terminológica"

Congresso
2011

II Jornada de Descrição do Português (JDP)

Congresso
2011

8th Brazilian Symposium in Information and Human Language Technology (STIL)

Congresso
2013

III Jornada de Descrição do Português

Congresso (Apresentação oral)
2023

VIII Jornada de Descrição do Português (JDP)

Apresentação: "Tipologia de fenômenos ortográficos e lexicais em CGU: o caso dos tweets do mercado financeiro"

Congresso (Apresentação oral)
2021

VII Workshop on Portuguese Description (JDP)

Apresentação: "Descrição preliminar do corpus DANTEStocks: diretrizes de segmentação para anotação segundo Universal Dependencies"

Congresso
2021

XIV Symposium in Information and Human Language (STIL)

Congresso
2023

12th Brazilian Conference on Intelligent Systems (BRACIS)

Congresso
2023

14th Symposium in Information and Human Language Technology (STIL)

Congresso
2021

10th Brazilian Conference on Intelligent System (BRACIS)

Congresso
2023

2nd Edition of the Universal Dependencies Brazilian Festival (UDFest-BR)

Congresso
2024

IX Jornada de Descrição do Português (JDP)

Congresso (Apresentação oral)
2024

15th Symposium in Information and Human Language Technology (STIL)

Apresentação: "A dependency treebank of tweets in Brazilian Portuguese: syntactic annotation issues and approach"

Congresso
2024

34th Brazilian Conference on Intelligent Systems (BRACIS)

Congresso (Outras Formas)
2025

16th Brazilian Symposium on Information and Human Language Technology (STIL 2025)

Apresentação: "NounBank.DS: a Lexical Repository of Nominal Frames from Stock Market Tweets in Brazilian Portuguese"

Congresso (Apresentação oral)
2026

17th International Conference on Computational Processing of Portuguese (PROPOR)

Apresentação: "Lexical and Orthographic Variation in Portuguese Financial Tweets: Annotation, Analysis, and Implications for Embedding Models"

Seminário (Apresentação Oral)
2009

57o Seminário do Grupo de Estudos Linguísticos do Estado de São Paulo (Gel)

Apresentação: "O alinhamento léxico-conceitual na base de dados REBECA"

Seminário (Apresentação Oral)
2001

I Seminário de Pesquisa do Porgrama de Pós-Graduação em Lingüística e Língua Portuguesa da FCL/UNESP/Ar.

Apresentação: "Representação lingüístico-computacional dos adjetivos valeciais"

Seminário (Apresentação Oral)
2002

II Seminário de Pesquisa do Porgrama de Pós-Graduação em Lingüística e Língua Portuguesa da FCL/UNESP/Ar.

Apresentação: "Representação lingüístico-computacional dos adjetivos valeciais"

Seminário (Apresentação Oral)
2003

III Seminário de Pesquisa do Programa de Pós-graduação em Lingüística e Língua Portuguesa da FCL - UNESP/Ar.

Apresentação: "Representação lingüístico-computacional dos adjetivos valeciais"

Seminário (Apresentação Oral)
2004

II Worshop em Tecnologia da Informação e da Linguagem Humana (TIL)

Apresentação: "Edição de informações sintático-semânticas dos adjetivos na base da rede Wordnet.Br"

Seminário (Apresentação Oral)
2001

XLIX Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (Gel)

Apresentação: "Tudo o que você sempre quis saber sobre a ferramenta de revisão gramatical do seu WORD e não tinha a oportunidade de perguntar"

Seminário (Apresentação Oral)
2002

50o Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (Gel)

Apresentação: "Concepções de léxico e o processamento automático das línguas naturais"

Seminário (Poster / Painel)
2000

XLVIII Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (GEL)

Apresentação: "Especificação dos traços semânticos dos itens lexicais"

Seminário (Apresentação Oral)
2003

51o Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (Gel)

Apresentação: "Classificações e Tipologias semânticas dos adjetivos: uma breve revisão comparativa"

Seminário
1999

XLVII Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (GEL)

Seminário
2003

I Workshop em Tecnologia da Informação e da Linguagem Humana (TIL)

Seminário
2005

53o Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (Gel)

Seminário
2005

III Workshop em Tecnologia da Informação e da Linguagem Humana (TIL)

Seminário (Poster / Painel)
2005

V Seminário de Pesquisa do Programa de Pós-Graduação em Lingüística e Língua Portugesa

Apresentação: "Estudo e Mapeamento dos Padrões de Lexicalização de Conceitos Codificados em Nomes Concretos do Inglês e do Português"

Seminário (Apresentação Oral)
2004

52o Seminário do Grupo de Estudos Lingüísticos do Estado de São Paulo (Gel)

Apresentação: "Modelo lingüístico-computacional da estrutura valencial de adjetivos do português do Brasil"

Seminário (Apresentação Oral)
2009

I Seminário de Estudos do Léxico (SELEX)

Apresentação: "O léxico sob o olhar do Processamento Automático das Línguas Naturais e o projeto TermiNet"

Seminário (Poster / Painel)
2012

I Seminário de Produção em Linguística

Apresentação: "Grupo de Linguagem Humana e Tecnologia (LHTec)"

Simpósio
2009

7th Brazilian Symposium in Information and Human Language Technology (STIL)

Encontro (Poster / Painel)
2006

4 Workshop em Tecnologia da Informação e da Linguagem Humana (TIL)

Apresentação: "Metodologia semi-automática baseada em corpus para a construção de ontologias de domínio"

Encontro (Apresentação Oral)
2009

I Worskhop do Núcleo Interinstitucional de Linguística Computacional

Apresentação: "Trabalhos em Lexicografia e Terminografia Computacional"

Encontro
2000

V Encontro para o Processamento Computacional da Língua Portuguesa Escrita e Falada (PROPOR)

Encontro
2001

I Encontro dos alunos de Pós-Graduação em Lingüística Informática (ENAPOLINF)

Encontro
2004

IV Encontro de Corpora

Encontro (Apresentação Oral)
2005

V Encontro de Corpora

Apresentação: "Proposta de uma metodologia para a identificação dos argumentos dos adjetivos de valência 1 da língua portuguesa a partir de córpus"

Encontro (Apresentação Oral)
2006

7th Workshop on Computational Processing of Written and Spoken Language (PROPOR)

Apresentação: "Methods and Tools for Encoding the WordNet.Br Sentences, Concept Glosses, and Conceptual-Semantic Relations"

Encontro (Apresentação oral)
2024

Tarde de Semântica

Apresentação: "O corpus DanteStocks e as suas várias anotações semânticas"

Congresso (Conferencista)
2022

Painel "Pesquisas em sintaxe de dependências"

Apresentação: "Construção de Tweetbanks segundo o modelo Universal Dependencies: desafios de anotação"

Congresso
2012

VI Escola Brasileira de Linguística Computacional

Congresso (Apresentação oral)
2018

Workshop Comemorativo de 25 anos do NILC

Apresentação: "O Projeto SUSTENTO"

Congresso
2010

IV Escola de Linguística Computacional (EBRALC)

Congresso
2009

III Escola Brasileira de Linguística Computacional (EBRALC)

Congresso (Outras formas)
2025

1a Semana das Ciências da Linguagem (SeCiL)

Apresentação: "Minicurso "Linguística e IA: anotação de corpus na era dos LLMs""

Prêmios e Distinções

Prêmio de 2o melhor artigo no 10th Symposium in Information and Human Language Technology (STIL 2015).

2015

Sociedade Brasileira de Computação

Prêmio de 3o melhor artigo no 6th Workshop of Portuguese Description (collocated event of the 12th Brazilian Symposium in Information and Human Language Technology (STIL 2019)

2019

Sociedade Brasileira de Computação

Prêmio de 3o melhor artigo no 16th Symposium in Information and Human Language Technology (STIL 2025)

2025

Sociedade Brasileira de Computação

Áreas de Atuação do CNPq

LINGUISTICA_LETRAS_E_ARTES

Lingüística

LINGUISTICA_LETRAS_E_ARTES

Lingüística

Subárea: Teoria e Análise Lingüística

Especialidade: Processamento Automático das Línguas Naturais

Citação copiada para a área de transferência!