Humanidades

Crean la mayor base de datos del mundo sobre el aprendizaje del español como lengua extranjera

Investigadores de la Universidad de Granada han desarrollado una aplicación web llamada CEDEL2 (Corpus Escrito del Español como segunda lengua), que nace para dar respuesta a la necesidades investigadoras y docentes del español como lengua extranjera a nivel internacional.

Fuente: Universidad de Granada

Granada |

16 de mayo de 2022

Investigadores de la Universidad de Granada (UGR) dirigidos por el profesor Cristóbal Lozano, han desarrollado una aplicación web llamada CEDEL2 (Corpus Escrito del Español como segunda lengua), que nace para dar respuesta a la necesidades investigadoras y docentes del español como lengua extranjera a nivel internacional.

CEDEL2 es un corpus lingüístico de aprendices de español, es decir, una gran base de datos que contiene el lenguaje producido por aprendices de español (personas que están aprendiendo español como su segunda lengua). Contiene, además, el lenguaje de hablantes nativos de español de España y de otras variedades de Latinoamérica (Méjico, Argentina, Colombia, etc.). De esta forma, los investigadores usan los datos de los nativos de español como referencia para ver si el lenguaje de los aprendices se acerca (o se aleja) del lenguaje de los nativos.

Interfaz web de CEDEL2 (motor de búsqueda).

Por ejemplo, es bien sabido que los aprendices cometen errores básicos de concordancia entre el artículo y el nombre: “la clima”, “la problema”. CEDEL2 es una herramienta informática potentísima que sirve a los investigadores de “ventana” para comprender cómo funciona el lenguaje en la mente de los aprendices. Asimismo, los docentes de español pueden usarlo en clase para que los estudiantes exploren y aprendan de los errores cometidos por otros aprendices como ellos.

CEDEL2 es gratuito, y está alojado en el portal web cedel2.learnercorpora.com. La aplicación informática cuenta con un potente buscador y una interfaz intuitiva y accesible. Ofrece múltiples posibilidades para la investigación y la docencia. Permite hacer tanto búsquedas sencillas de palabras como búsquedas de estructuras lingüísticas complejas. Las búsquedas y los textos completos se pueden descargar para analizarlos posteriormente. Además de textos escritos, CEDEL2 contiene grabaciones orales. Ya se han llevado a cabo más de medio centenar de estudios internacionales y tesis doctorales con datos procedentes de CEDEL2.

Los investigadores del IberLab de la Universidad de Granada que han realizado este trabajo.

El corpus tiene una larga trayectoria pues lleva en desarrollo desde el año 2006 y ha sido financiado por numerosos proyectos de investigación I+D nacionales, como el último proyecto ANACOREX. En CEDEL2 ha colaborado un equipo internacional de 30 investigadores procedentes de 11 universidades. Dado este carácter internacional, CEDEL2 incluye datos de aprendices de español de hasta 11 lenguas maternas distintas (y muy variopintas), como el inglés, japonés, chino, árabe, ruso, alemán, etc. Actualmente, la segunda versión del corpus contiene el lenguaje producido por unos 4.400 hablantes y más de 1 millón de palabras, lo que lo convierte en el corpus más extenso de su categoría.

CEDEL2 está en constante crecimiento y los investigadores siguen recogiendo datos para la futura 3ª versión del corpus. Cualquiera puede participar en el corpus CEDEL2 a través de su portal web (learnercorpora.com). Sólo hay que escribir/narrar una breve historia en español y proporcionar información sobre el perfil lingüístico. La participación está remunerada.

Paralelamente, el equipo también ha desarrollado un corpus de inglés como lengua extranjera: COREFL (Corpus of English as a Foreign Language), que sigue los mismos principios de diseño que CEDEL2, lo que permite hacer múltiples comparaciones del lenguaje producido por, por ejemplo, nativos de español que aprenden inglés (COREFL) vs. nativos de inglés que aprenden español (CEDEL2). COREFL está disponible gratuitamente en la web (corefl.learnercorpora.com).

Logotipo de CEDEL2.

En definitiva, este proyecto es una aportación innovadora en el ámbito de la lingüística, el bilingüismo, el aprendizaje de lenguas y las humanidades digitales.

Más información:

Aplicación online de CEDEL2: learnercorpora.com
Portal web para participar: learnercorpora.com
Video promocional de CEDEL2: https://wpd.ugr.es/~cristoballozano/divulgacion
Publicación científica: Lozano, C. (2021). CEDEL2: Design, compilation and web interface of an online corpus for L2 Spanish acquisition research. Second Language Research, first published online. https://doi.org/10.1177/02676583211050522

Últimas publicaciones

Investigación

Nueva diana terapéutica para recuperar la capacidad locomotora tras una lesión medular

Sevilla | 17 de julio de 2025

Investigadores de la Universidad Pablo de Olavide colaboran en un estudio pionero liderado por el Centro de Investigación Príncipe Felipe que acelera la recuperación en animales tras una lesión medular y que tiene su base en la molécula AMPc.

Sigue leyendo

Investigación

Investigadores desarrollan compuestos con potencial terapéutico contra el cáncer de mama tripe negativo

Granada | 16 de julio de 2025

El estudio, publicado en la revista Bioorganic Chemistry, identifica moléculas capaces de bloquear una interacción clave en la progresión de este tipo de tumor. La investigación se ha centrado en el cáncer de mama triple negativo, un subtipo que no responde a los tratamientos hormonales convencionales ni a terapias dirigidas a otros receptores habituales, lo que limita gravemente las opciones terapéuticas.

Sigue leyendo

Ciencias del Mar, Geología

Un estudio explica la paradoja del Mediterráneo, un mar vacío y lleno a la vez hace más de 5 millones de años

Almería | 16 de julio de 2025

Investigadores del CSIC señalan que los cambios climáticos y el aporte de agua desde ríos y lagos explicarían los datos que muestran una cuenca marina casi vacía y, al mismo tiempo, llena de agua a finales del Mioceno.

Sigue leyendo

#CienciaDirecta

Tu fuente de noticias sobre ciencia andaluza

Más información Suscríbete

¿ERES CIENTÍFICO/A Y QUIERES DIFUNDIR TUS RESULTADOS? CONTÁCTANOS

¿QUIERES CONTACTAR CON UN CIENTÍFICO/A? CONSULTA LA GUÍA EXPERTA

Política de cookies

Este sitio web utiliza cookies para mejorar su experiencia mientras navega por el sitio web. De estas, las cookies que se clasifican como necesarias se almacenan en su navegador, ya que son esenciales para el funcionamiento de las funcionalidades básicas del sitio web. También utilizamos cookies de terceros que nos ayudan a analizar y comprender cómo utiliza este sitio web. Estas cookies se almacenarán en su navegador solo con su consentimiento. También tiene la opción de optar por no recibir estas cookies. Pero la exclusión voluntaria de algunas de estas cookies puede afectar su experiencia de navegación.

Necesarias

Siempre activado

Las cookies necesarias son absolutamente esenciales para que el sitio web funcione correctamente. Esta categoría solo incluye cookies que garantizan funcionalidades básicas y características de seguridad del sitio web. Estas cookies no almacenan ninguna información personal.

Cookie	Duración	Descripción
CONSENT	16 años 7 meses	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. La cookie se utiliza para almacenar el consentimiento del usuario para las cookies.
cookielawinfo-checkbox-advertisement	1 año	La cookie se establece mediante el consentimiento de cookies de GDPR para registrar el consentimiento del usuario para las cookies en la categoría "Publicidad".
cookielawinfo-checkbox-analytics	1 año	Estas cookies están configuradas por el complemento de WordPress de consentimiento de cookies de GDPR. La cookie se utiliza para recordar el consentimiento del usuario para las cookies en la categoría "Análisis".
cookielawinfo-checkbox-necessary	1 año	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. Las cookies se utilizan para almacenar el consentimiento del usuario para las cookies en la categoría "Necesarias".
cookielawinfo-checkbox-performance	1 año	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. La cookie se utiliza para almacenar el consentimiento del usuario para las cookies en la categoría "Rendimiento".
JCS_INENREF	1 hora	La cookie es parte de las medidas de seguridad del sitio web y se utiliza con fines antispam.
JCS_INENTIM	1 hora	La cookie es parte de las medidas de seguridad del sitio web y se utiliza con fines antispam.
PHPSESSID	sessión	Esta cookie es nativa de las aplicaciones PHP. La cookie se utiliza para almacenar e identificar la identificación de sesión única de un usuario con el fin de administrar la sesión del usuario en el sitio web. La cookie es una cookie de sesión y se elimina cuando se cierran todas las ventanas del navegador.

Rendimiento

Las cookies de rendimiento se utilizan para comprender y analizar los índices de rendimiento clave del sitio web, lo que ayuda a brindar una mejor experiencia de usuario a los visitantes.

Cookie	Duración	Descripción
_gat	1 minuto	Google Universal Analytics instala estas cookies para acelerar la tasa de solicitud y limitar la recopilación de datos en sitios de alto tráfico.
YSC	sessión	Estas cookies son establecidas por Youtube y se utilizan para rastrear las vistas de videos incrustados.

Analítica

Las cookies analíticas se utilizan para comprender cómo los visitantes interactúan con el sitio web. Estas cookies ayudan a proporcionar información sobre métricas, el número de visitantes, la tasa de rebote, la fuente de tráfico, etc.

Cookie	Duración	Descripción
_ga	2 años	Esta cookie es instalada por Google Analytics. La cookie se utiliza para calcular los datos de visitantes, sesiones y campañas y realizar un seguimiento del uso del sitio para el informe de análisis del sitio. Las cookies almacenan información de forma anónima y asignan un número generado aleatoriamente para identificar visitantes únicos.
_gid	1 día	Esta cookie es instalada por Google Analytics. La cookie se utiliza para almacenar información sobre cómo los visitantes usan un sitio web y ayuda a crear un informe analítico de cómo está funcionando el sitio web. Los datos recopilados, incluido el número de visitantes, la fuente de donde provienen y las páginas visitadas de forma anónima.

Las cookies publicitarias se utilizan para proporcionar a los visitantes anuncios y campañas de marketing relevantes. Estas cookies rastrean a los visitantes en los sitios web y recopilan información para proporcionar anuncios personalizados.

Cookie	Duración	Descripción
IDE	1 año 24 días	Utilizado por Google DoubleClick y almacena información sobre cómo el usuario utiliza el sitio web y cualquier otro anuncio antes de visitar el sitio web. Se utiliza para presentar a los usuarios anuncios que son relevantes para ellos de acuerdo con el perfil del usuario.
ms-uid	1 año	Estas cookies tienen una finalidad publicitaria. Contienen un valor único generado aleatoriamente que permite a la Plataforma distinguir navegadores y dispositivos. Esta información se utiliza para medir el rendimiento de los anuncios y proporcionar recomendaciones de productos basadas en datos.
NID	6 meses	Esta cookie se utiliza para crear un perfil en función del interés del usuario y mostrar anuncios personalizados a los usuarios.
test_cookie	15 minutos	Esta cookie la establece doubleclick.net. El propósito de la cookie es determinar si el navegador del usuario admite cookies.
VISITOR_INFO1_LIVE	5 meses 27 días	Youtube establece esta cookie. Se utiliza para rastrear la información de los videos de YouTube incrustados en un sitio web.