• Nenhum resultado encontrado

REVISÃO DAS ETIQUETAS 250 6.5 QUANTIFICAÇÃO DOS DADOS E O MODO DE EXPOSIÇÃO

1 INTRODUÇÃO 34 1.1 JUSTIFICATIVA DE PESQUISA

6.4. REVISÃO DAS ETIQUETAS 250 6.5 QUANTIFICAÇÃO DOS DADOS E O MODO DE EXPOSIÇÃO

6.6. REFLEXÕES SOBRE O ESTUDO PILOTO ... 255 7 CONSIDERAÇÕES FINAIS ... 258 8 BIBLIOGRAFIA ... 270 9 ANEXOS ... 286 Anexo 1: Lista Assis (2012) ... 286 Anexo 2: Lista Alves e Vasconcellos (no prelo)... 287 Anexo 3: Resumos de teses e dissertaçoes coletadas ... 288 Anexo 4: Orientações de Dra. Maria Lúcia Vasconcellos até 2011 ... 336 Anexo 5: Orientações de Dra. Adriana Pagano até 2011 ... 353 Anexo 6: Orientações de Célia Magalhães até 2011 ... 373 Anexo 7: Emails trocados com Ariana Zanella ... 393 Anexo 8: Perguntas no Fórum MS Office ... 395 Anexo 9: Macros, fórmulas e shortcuts Template Corpus Paralelo ... 411 Anexo 10: Macros e Shortcuts Template MS Work ... 419

1 INTRODUÇÃO

Uma nova forma de fazer pesquisa em Estudos da Tradução (ET) iniciou-se no Brasil em 1997 com a publicação da tese de Maria Lúcia Vasconcellos (VASCONCELLOS, 2004) e (VASCONCELLOS, 2009), que utilizou o arcabouço teórico da Linguística Sistêmico-Funcional (LSF) para se analisar textualizações e suas novas construções em retextualizações1. O projeto CORDIALL2 (Corpus Discursivo para

Análises Linguísticas e Literárias), criado em 1999, incorporou a Metodologia de Corpusaos Estudos da Tradução em análises descritivas sistêmico-funcionais. A primeira dissertação nessa interface foi defendida por Osilene Cruz em 2003, orientada por Adriana S. Pagano da Universidade Federal de Minas Gerais. A partir de então, a interface entre os Estudos da Tradução (ET), a Linguística Sistêmico-Funcional (LSF) e a Linguística de Corpus (LC) ou Metodologia de Corpus (MC)3 começa

a se consolidar como uma tendência de se fazer pesquisa no Brasil, principalmente no âmbito do projeto CORDIALL. Nesta tese, para fins de distinguir dos trabalhos em ETBC e ESFT4, utilizo o termo Estudos Sistêmico-Funcionais da Tradução Baseados em Corpus (ESFTBC),

indicando trabalhos realizados na interface simultânea entre ET, LC e LSF. Identifica-se até 2010 no Brasil a publicação de 24 pesquisas (20 dissertações de mestrado e 4 teses de doutorado) que operam nos ESFTBC, desenvolvidas principalmente em duas universidades

1 Segundo Fleuri (2006, p.13): “Através da leitura de qualquer texto original, denominado nesta dissertação de textualização, constroem-se imagens e ideias de um determinado evento a partir do modo como esse evento é textualizado (cf. HALLIDAY; MATHIESSEN, 2004, p. 168-305). Ao se traduzir a textualização para uma outra língua, essas imagem e/ou ideias (o perfil ideacional) ganham uma especificidade nova. Por essa razão, adotou-se o termo trazido inicialmente por Coulthard, (1987) e Costa (1992) — “retextualização” — e assim se concebeu que, ao se traduzir um texto para outra língua, há um novo processo de textualização e neste processo novas imagens de um mesmo evento podem ser (re)construídas”.

2 O projeto CORDIALL será explicado na seção 1.2.

3 Em alguns casos o termo ‘abordagem baseada em corpus’ e ‘metodologia baseada em corpus’ são utilizados nesta tese com mesmo significado. 4 ETBC - Estudos da Tradução Baseados em Corpus—que estabelecem uma interface exclusiva entre os ET e a LC

ESFT - Estudos Sistêmico-Funcionais da Tradução —que estabelecem uma interface exclusiva entre ET e LSF

brasileiras: a Universidade Federal de Santa Catarina (UFSC) e a Universidade Federal de Minas Gerais (UFMG).

Nesta tese descrevo e analiso os procedimentos metodológicos das vinte dissertações5 em ESFTBC publicadas entre 2003 e 2010 no

Brasil. Nesta análise observo o perfil e as necessidades metodológicas dessas dissertações em relação aos processos de compilação de corpus. A partir desta identificação, proponho um método de compilação de corpus, passível de ser adotado, reproduzido e adaptado por pesquisas em ETBC.

Tal método não apenas visa a oferecer uma alternativa de se trabalhar eletronicamente com corpora bilíngues de pequena dimensão, como também, visa a tornar acessível economicamente a manipulação automática de corpus e de dados – visto que todos os softwares de processamento de corpus comumente utilizados apresentam um custo relativamente elevado. Por privilegiar a análise metodológica e por propor um método, esta é uma pesquisa essencialmente de cunho metodológico, considerando método “um procedimento regular, explícito e passível de ser repetido" (Bunge apud Moresi, 2003, p.12-15). A menção ao cunho metodológico desta tese, significa também dizer que a investigação se apoia no referencial teórico-metodológico dos ETBC, ou seja, do Método de Corpus voltados a estudos de traduções (cf. Baker, 1995; Olohan, 2004; Vasconcellos, 2009; Assis, 20126; Feitosa, 2005; Fernandes, 2006).

O método proposto busca apresentar uma possível alternativa de lidar com as dificuldades apontadas nas dissertações durante o processo de compilação do corpus relacionados ao: tempo gasto, ao elevado número de etapas executadas em cada processo, às transições entre programas diferentes e à geração de inúmeros documentos. A proposta metodológica se fundamenta na programação de Macros e de Fórmulas em Processadores de Textos (i.e. MS Word) e Aplicativos de Planilhas (i.e. MS Excel). Tal programação é gerada em dois Templates7: um chamado Template Editor, criado nesta tese no MS Word, e outro chamado Template Corpus Paralelo, criado no MS Excel. Ambos os

Templates desempenham a função de automatizar:

5 Por limitação de tempo de pesquisa, principalmente, as 4 teses das 24 pesquisas identificadas não são analisadas. Dá-se preferência às

dissertaçõese exclusivamente por serem mais numerosas e, portanto, mais representativas.

6Fonte online:

http://seer.bce.unb.br/index.php/traduzires/article/view/6655/5371 7 Disponíveis para download gratuito no site:

(i) A correção e a formatação dos textos a serem alinhados (no Template Editor);

(ii) O alinhamento e a correção de pares desalinhados em um corpus paralelo (no Template Corpus Paralelo), (iii) A organização da rotulação dos termos analisados (no

Template Corpus Paralelo);

(iv) A quantificação simultânea dos dados (no Template

Corpus Paralelo);

(v) A organização de uma tabela que auxilia no processo de revisão dos elementos rotulados, arranjando automática e paralelamente os termos e os rótulos correspondentes (no Template Corpus Paralelo).

Tal método é testado em um Estudo Piloto com um corpus criado a partir do utilizado por Fleuri (2006). Além de testar o funcionamento dos Templates, o Estudo Piloto compara seus resultados aos métodos utilizados por Fleuri (2006) em relação ao tempo, ao número de etapas e de transições entre programas e à quantidade de documentos gerados durante o processo de formatação de textos, alinhamento do corpus, rotulação/correção das etiquetas e quantificação dos dados.

Esta tese apresenta os resultados da pesquisa desenvolvidos em sete capítulos: (i) a introdução, (ii) o referencial teórico, (iii) a metodologia, (iv) a análise, (v) a proposta metodológica, (vi) o estudo piloto e (vii) as considerações finais.

Esta introdução justifica e contextualiza a presente pesquisa e expõe os objetivos e as perguntas que a guiaram. A seção 1.1 expõe a justificativa da pesquisa; a 1.2 apresenta o contexto deste estudo, explicando o projeto CORDIALL, assim como o PROCAD e o TRACOR, que situam esta tese na tradição de pesquisas desenvolvidas em ESFTBC; a 1.3 apresenta os objetivos e as perguntas de pesquisas, explicitando os objetivos geral e específicos, bem como as perguntas que guiaram o desenvolver da pesquisa.

O referencial teórico é organizado em duas partes. A primeira apresenta um debate teórico sobre a Metodologia de Corpuse os ETBC. A segunda parte apresenta um debate sobre o planejamento e execução de pesquisas em ETBC, explorando os elementos envolvidos na execução de pesquisas em metodologia de corpus, tais como o projeto, o desenho do corpus, as etapas de compilação e os programas de processamento de corpus.

No capítulo de metodologia se descrevem os procedimentos de análise. Para poder realizar a análise de 20 dissertações em ESFTBC foi necessário primeiramente coletar essas dissertações, em seguida

descrevê-las buscando traçar seu perfil metodológico, para se planejar e elaborar a proposta metodológica e finalmente testar tal proposta. Da mesma forma, o capítulo de metodologia se configura em quatro etapas que visam a explicar o modo como se deu cada uma dessas etapas de análise e da proposta metodológica. Em 3.1 explicam-se os procedimentos de coleta do objeto de estudo desta tese, ou seja, as dissertações em ESFTBC publicadas até 2010 no Brasil. Em 3.2 expõem- se os procedimentos de descrição e de análise destas dissertações. Em 3.3 descrevem-se os procedimentos de criação dos Template Editor e

Template Corpus Paralelo. Em 3.4 explicam-se os procedimentos de

execução do estudo piloto.

O capítulo de análise se configura em três seções. Na seção 4.1 se apresentam e se descrevem as dissertações brasileiras em ESFTBC em relação às informações gerais, ao objetivo geral da pesquisa, ao objeto de análise, ao corpus utilizado na pesquisa, ao método de compilação desse corpus e de seu processamento e ao código de anotação adotado. Na seção 4.2 traça-se o perfil metodológico das pesquisas em ESFTBC. Neste momento se observa a proporção, exposta em gráficos, entre as pesquisas em relação à metafunção adotada para a análise do corpus, ao objeto de análise escolhido, ao desenho do corpus, ao modo de alinhamento dos corpora paralelos bilíngues, ao modo de anotação do corpus, ao programa e às ferramentas adotadas no processamento do corpus e ao modo de proceder com relação à quantificação dos dados. Na seção 4.3 se analisa o desenvolvimento diacrônico em relação aos métodos adotados nas dissertações analisadas.

O capítulo de proposta metodológica apresenta os Templates propostos nesta tese, com explicação detalhada do funcionamento do

Template Editor e do Template Corpus Paralelo para se proceder com a

correção automática de textos (no Template Editor) e para se alinhar textos em paralelo, assim como para rotular elementos textuais e quantificá-los automaticamente, organizando-os simultaneamente em listas e gráficos (no Template Corpus Paralelo).

O capítulo de estudo piloto testa os Templates propostos e compara os resultados dos testes com os procedimentos adotados por Fleuri (2006) durante a compilação de corpus. Este capítulo é composto por seis seções. As cinco primeiras seções correspondem aos procedimentos testados no estudo piloto e observado em Fleuri (2006), sendo a última seção dedicada às considerações finais de comparação entre ambos os estudos. As seções são: 6.1 Preparação para o alinhamento; 6.2 Execução do Alinhamento; 6.3 Anotação do corpus / Classificação dos objetos de análise; 6.4 Revisão das etiquetas; 6.5

Quantificação dos dados e o modo de exposição e 6.6 Reflexões sobre o Estudo Piloto.

O capítulo de considerações finais encerra a tese resgatando as conclusões de cada capítulo e respondendo pontualmente às perguntas de pesquisa, apontando futuras perspectivas de investigação nesta área.

Nesta tese opto por: (i) traduzir as citações originalmente escritas em inglês, sendo todas as traduções realizadas por mim, (ii) manter alguns termos computacionais em inglês tais como Wildcards, shortcuts,

Template etc., destacando-os em itálico; e (iii) expor fórmulas e as

programações em VBA e em Macros em anexo.