Inicio
todoELE
  • Inicio
  • Materiales
    • πŸ“‹ Actividades
    • πŸ“ Conjugación
    • πŸ“Š Corpus
    • πŸ“” Diccionarios
    • βœ… Evaluación
    • βš™οΈ Gramática
    • πŸ“— Manuales
    • ✍️ Ortografía
    • πŸ“… Programación
    • πŸ—£οΈ Pronunciación
    • πŸ“ Recursos
    • πŸ”€ Vocabulario
    • πŸ’» Herramientas digitales
  • Formación
    • πŸ“š Bibliografía
    • πŸ‘₯ Congresos
    • πŸŽ“ Cursos
    • 🏫 Centros
    • 🏒 Organizaciones
    • πŸ“° Revistas
    • 🌍 Atlas de ELE
  • Trabajo
    • πŸ’Ό Ofertas de trabajo
    • ℹ️ Trabajo - Recursos
  • En la red
    • 🌐 Sitios ELE
    • πŸ“° Agregador
    • πŸ“§ Formespa
  • IA
    • ✨ Nuevos contenidos
    • πŸ“š Bibliografía IA
    • 🧰 Herramientas IA
    • πŸ’¬ Prompts
    • πŸ§ͺ Experiencias IA
    • 🌐 Sitios web IA
    • πŸ“° Actualidad IA
  • Comunidad
    • πŸ“° Actualidad ELE
    • 😊 Anécdotas ELE
    • πŸ“ Blog
    • πŸ“ŒTablón de anuncios
  • Buscar

Ruta de navegación

  • Inicio
  • Corpus

Corpus

Nº de entradas: 54
Paginación
  • Primera página «
  • Página anterior ‹
  • Página 1
  • Página 2
  • Página 3
  • Página actual 4
RedPajama-Data-v2
https://github.com/togethercomputer/Red…
Detalles Cerrar βœ•

Etiquetas: modelos de lenguaje corpus escrito

Descripción: RedPajama-Data-v2 es un corpus multilingüe de acceso abierto para el entrenamiento de modelos de lenguaje, que está formado por 30 billones de formas léxicas (tokens), repartidos en 20.000 millones de documentos de texto. RedPajama incluye cinco subcorpus multilingües de textos, respectivamente, en alemán, español, francés, inglés e italiano. El subcorpus del español tiene casi 3 billones de palabras (2.800.000.000.000).  RedPajama está disponible en GitHub y también se...

Ver ficha completa

Corpus Escrito del Español L2 (CEDEL2)
http://cedel2.learnercorpora.com/
Detalles Cerrar βœ•

Etiquetas: corpus de estudiantes corpus sonoro

Descripción: CEDEL2 es un corpus lingüístico de aprendices de español que empezó a desarrollarse en 2006. La versión actual, versión 2, que incluye los datos de la 1, recoge las producciones de 4399 participantes y 1 105 936 words.

Ver ficha completa

Corpus de textos escritos para el análisis de errores de aprendices de E/LE (CORANE)
https://mele.web.uah.es/materiales-ele/
Detalles Cerrar βœ•

Etiquetas: corpus escrito corpus de estudiantes corpus para el análisis de errores

Descripción: Cuadernillo del corpus  Muestras de textos para descargar: Nivel A2 - Plataforma Nivel B1 - Umbral Nivel B2 - Avanzado Nivel C1 - Dominio operativo eficaz "[...] el análisis de errores cometidos por los estudiantes extranjeros que aprenden español es un campo de investigación que todavía no ha alcanzado en España el desarrollo y la amplitud que serían deseables, entre otras razones tal vez por la no existencia de corpus lingüísticos que permitan analizar de manera sistemática los errores...

Ver ficha completa

Corpus SEAH
https://www.seahproject.eu/resources.php
Detalles Cerrar βœ•

Etiquetas: español para fines específicos arquitectura corpus multilingüe

Descripción: Corpus de arquitectura y construcción que recoge un millón de palabras, en cada uno de estos idiomas: español, francés, italiano, alemán y ruso. Es un corpus dirigido a estudiantes de lenguas extranjeras. Este corpus se ha elaborado dentro del proyecto SEAH (Sharing European architectural heritage), proyecto en el que participan varias universidades europeas y que además de la creación del corpus tiene como objetivo s la explotación didáctica del mismo con la elaboración cinco...

Ver ficha completa

DIACOM-es
https://dh.dlls.univr.it/corpora/diacom…
Detalles Cerrar βœ•

Etiquetas: corpus sonoro ámbito comercial

Descripción: El corpus DIACOM-es es un corpus diacrónico especializado que reúne textos de ámbito comercial en lengua española. Se publicó en 2022 en el seno del Depto. de Lenguas y Literaturas Extranjeras de la Universidad de Verona (Italia) y ha continuado alimentándose anualmente. Recientemente (octubre de 2024), también se han ampliado sus posibilidades de explotación para los usuarios externos. El corpus se ha diseñado y estructurado siguiendo tres ejes: temporal, geográfico y funcional. - En cuanto al...

Ver ficha completa

Corpus del Español en los Estados Unidos (CORPEEU)
https://corpeeu.org/
Detalles Cerrar βœ•

Etiquetas: español de Estados Unidos

Descripción: El Corpus del Español en los Estados Unidos (CORPEEU) es un proyecto iniciado en el ?Observatorio de la lengua española y las culturas hispánicas? del Instituto Cervantes en la Universidad de Harvard, con la colaboración de la Academia Norteamericana de la Lengua Española (ANLE). Los trabajos para la construcción del CORPEEU comenzaron en el otoño de 2017, dentro de la Universidad de Harvard, pero previamente se hizo necesaria una detenida reflexión sobre las implicaciones y dificultades,...

Ver ficha completa

Corpus CALMER (Corpus comparable para el estudio de la Adquisición y de las Lenguas: Multilingüe, Emoción, Relato)
https://www.ortolang.fr/market/corpora/…
Detalles Cerrar βœ•

Etiquetas: corpus multilingüe estudiantes universitarios narrativa

Descripción: El corpus CALMER (Corpus comparable para el estudio de la Adquisición y de las Lenguas: Multilingüe, Emoción, Relato) está compuesto por relatos narrativos manuscritos inspirados en un mismo relato gráfico de temática emocional. Este corpus pretende constituir una base de datos para la exploración de cuestiones particulares sobre el uso y la adquisición lingüísticas. El dispositivo de recogida de datos se inspira en los estudios tipológicos sobre la conceptualización y expresión del movimiento...

Ver ficha completa

Corpus de español hablado y escrito por sinohablantes (CorSinoELE)
http://corsinoele.usal.es
Detalles Cerrar βœ•

Etiquetas: corpus oral corpus escrito sinohablantes

Descripción: El corpus CorSinoELE. Corpus de español hablado y escrito por sinohablantes consta de 395 textos orales y escritos producidos por 99 hablantes chinos estudiantes de la Universidad de Beihua, situada en la región china de Jilin, con un nivel de español A2 y B1. Cada estudiante ha elaborado cuatro textos, dos orales y dos escritos, que suponen un total de 15:43:15 de grabación y 55.276 palabras. En cada modalidad de producción (oral y escrita) hay textos descriptivos y narrativos motivados a...

Ver ficha completa

Columbia Corpus de Conversaciones para ELE
https://edblogs.columbia.edu/corpusdeco…
Detalles Cerrar βœ•

Etiquetas: corpus sonoro corpus de vídeo corpus para la enseñanza

Descripción: Este sitio contiene grabaciones en vídeo de conversaciones naturales entre hablantes de español para ser usadas como fuentes de lengua en enseñanza y aprendizaje de esta lengua. Las grabaciones han sido hechas abordando a hablantes en lugares públicos o aprovechando reuniones de amigxs y familiares, sin guion ni ningún requerimiento previo. Bajo cada grabación, en la misma página, hay una breve descripción, una transcripción ortográfica, una lista de los elementos de lengua interesantes que...

Ver ficha completa

Paginación
  • Primera página «
  • Página anterior ‹
  • Página 1
  • Página 2
  • Página 3
  • Página actual 4
Volver arriba ↑

Enviar corpus

Etiquetas

  • corpus oral (25)
  • corpus sonoro (11)
  • corpus escrito (10)
  • variedades del español (10)
  • corpus de estudiantes (9)
  • inmigrantes (8)
  • estudiantes universitarios (6)
  • español para fines específicos (5)
  • interacciones conversacionales (5)
  • corpus de vídeo (4)
  • corpus general (4)
  • humor (4)
  • sinohablantes (4)
  • actos de habla (3)
  • hablantes de herencia (3)
ver todas »
Sobre Todoele Índice Publica Contacto: todoele@gmail.com
Política de privacidad Créditos