
Compilação e análises do LEX-BR-Ius, um corpus representativo da linguagem legal do português brasileiro.
Este projeto tem como objetivo analisar as estruturas da linguagem jurídica no português do Brasil (PB) do ponto de vista lexical e morfossintático. O estudo é baseado em corpora e compilará o corpus BR-Ius, corpus representativo da linguagem jurídica do português do Brasil. A primeira etapa, apresentada no presente projeto, prevê a compilação, descrição e análise do LEX-BR-Ius, que verte sobre as normas jurídicas em vigor no país. Serão utilizados recursos e ferramentas da linguística de corpus e da linguística computacional para disponibilizar o corpus anotado em diferentes versões: (a) texto simples limpo; (b) com anotação textual em uma versão personalizada do Modest XLM (HARDIE, 2014); (c) completo de lematização e anotação POS (a definir). Contemporaneamente à compilação serão conduzidas investigações qualitativas e quantitativas sobre: (a) o léxico e os padrões lexicais do gênero; (b) os padrões morfossintáticos recorrentes; (c) comparações intralinguísticas (outros gêneros de escrita e/ou fala do PB relacionados ou não ao mundo jurídico) e interlinguísticas sobre terminologia jurídica e seus usos em línguas diferentes (a princípio, mas não exclusivamente, italiano e inglês).
O projeto pretende também testar metodologias e ferramentas diferentes nas análises implementadas em vista de sua continuação (etapa II: compilação e análise do JUR-BR-Ius, corpus do PB representativo da jurisprudência; etapa III: compilação e análise do DOC-BR-Ius, corpus do PB representativo da doutrina jurídica).
Integrante dos projetos C-ORAL-BRASIL e C-ORAL-ESQ (http://www.c-oral-brasil.org/)
