Inicio
todoELE
  • Inicio
  • Materiales
    • πŸ“‹ Actividades
    • πŸ“ Conjugación
    • πŸ“Š Corpus
    • πŸ“” Diccionarios
    • βœ… Evaluación
    • βš™οΈ Gramática
    • πŸ“— Manuales
    • ✍️ Ortografía
    • πŸ“… Programación
    • πŸ—£οΈ Pronunciación
    • πŸ“ Recursos
    • πŸ”€ Vocabulario
  • Formación
    • πŸ“š Bibliografía
    • πŸ‘₯ Congresos
    • πŸŽ“ Cursos
    • 🏫 Centros
    • 🏒 Organizaciones
    • πŸ“° Revistas
    • 🌍 Atlas de ELE
  • Trabajo
    • πŸ’Ό Ofertas de trabajo
    • ℹ️ Trabajo - Recursos
  • En la red
    • 🌐 Sitios ELE
    • πŸ“° Agregador
    • πŸ“§ Formespa
  • Tecnología
    • πŸ’» Herramientas digitales
  • Comunidad
    • πŸ“° Actualidad ELE
    • 😊 Anécdotas ELE
    • πŸ“ Blog
    • πŸ“ŒTablón de anuncios
  • Buscar

Ruta de navegación

  • Inicio
  • πŸ“š Bibliografía
  • Herramientas para la codificación, el análisis y la explotación de un corpus oral de aprendices francófonos de español

Herramientas para la codificación, el análisis y la explotación de un corpus oral de aprendices francófonos de español

Cristina Muñoz
2024
TEISEL.Tecnologías para la investigación en segundas lenguas
3
https://revistes.ub.edu/index.php/teise…
artículo
corpus
corpus de estudiantes
análisis de datos
herramientas
investigar

Texto completo

En este trabajo se analiza el uso de tres herramientas digitales para la codificación, el análisis y la explotación de un corpus oral de aprendices de L2. En primer lugar, se presenta la creación, codificación y actualización del corpus, que se compiló con el objetivo de analizar los errores cometidos en el plano oral por parte de un grupo compuesto por 51 informantes franceses, estudiantes de segundo año de Lenguas Extranjeras Aplicadas de la Universidad François Rabelais de Tours (Francia). Una vez conseguido el material auditivo, se procedió a la transcripción y anotación textual codificada, siguiendo la normativa que marca Text Encoding Initiative.

Esta investigación se valió de ciertas herramientas digitales, como XML Formatter (https://jsonformatter.org/xml-formatter), XML Validator (https://codebeautify.org/xmlvalidator), VS Studio (https://code.visualstudio.com/), Git (https://git-scm.com/), GitHub (https://github.com/), SpaCy (https://SpaCy.io/), CATMA (https://catma.de/) y Google Colaboratory (https://colab.google/), que contribuyeron al desarrollo del análisis y la explotación del corpus oral, sirviendo para la configuración y validación de la cabecera del corpus (XML Formatter - Validator), para el etiquetado del corpus (VS Studio), para el control y almacenaje de las versiones (Git-GitHub) y para la actualización del corpus (SpaCy permite nuevos análisis, Google Colaboratory es un instalador de software usado junto a SpaCy, y con CATMA se desarrolla el nuevo etiquetado).

  • Inicie sesión para enviar comentarios

Enviar publicación

Contenidos relacionados

  • El corpus de aprendices japoneses CELEN y su aplicación a la docencia y la investigación en ELE
  • Investigar a partir de corpus de clases de español L2 con Sketch Engine y de manera manual: ejemplos de estudios sobre el léxico
  • La precisión gramatical en un corpus de escritura académica de aprendientes africanos de ELE
  • Learner corpora as a research tool for the investigation of lexical competence in L2 Spanish
  • Los corpus de aprendices de español LE/L2: panorama actual y perspectivas futuras
  • Pasado, presente y futuro de los corpus de aprendices de ELE. Una revisión bibliográfica
Sobre Todoele Índice Publica Contacto: todoele@gmail.com
Política de privacidad Créditos