Tecnologías de la Información y Telecomunicaciones

Development of a smart tracker that identifies offensive tweets against women and migrants

A research team from the University of Jaén is applying a system to recognise misogynist and xenophobic racist comments on Twitter. This technology learns and distinguishes the nuances of a wide range of phrases, words and insults in Spanish. Experts are utilizing this artificial intelligence to detect hate messages on this social network.

Jaén |

01/18/2021

The research group SINAI (Sistemas de Acceso Inteligente a la Información, i.e. Intelligent Access to Information Systems) of the University of Jaén has developed a system based on artificial intelligence to identify misogynist and xenophobic messages on Twitter. This method can be used in areas such as policing and the application of the law to detect hate messages, as well as to moderate the language of the tweets generated on this social network. The program is based on machine learning algorithms, including neural networks, structures that mimic the functioning of the human brain and ‘learn’ to capture the nuances of messages.

Artificial intelligence identifies hate speech aimed specifically against women and migrants.

Experts point out that this system identifies Spanish offensive content and language ambiguities in order to catch hate messages on Twitter. They add that this system could be used as a warning mechanism to detect comments that incite hatred and violence towards women and migrants.

To identify offensive statements, researchers use neural networks that behave just like the human brain: they connect nodes that interpret information and order it. It is an intelligent system that uses training data made up of insults, terms and derogatory expressions to ‘learn’ the patterns and structure of language in order to predict new tweets and detect those that are offensive. «Some phrases include essential pronouns or determinants that can completely change the meaning of a wording. With our system and with the help of linguistic resources, we can identify expressions related to hate speech,» explains the researcher Flor Miriam Plaza at the University of Jaén to Fundación Descubre.

In the study, entitled ‘Detecting Misogyny and Xenophobia in Spanish Tweets Using Language Technologies’ and published in ACM Transactions on Internet Technology, the researchers explain that in order to ‘instruct’ the system they semi-automatically generated four lists of words in Spanish consisting of offensive and insulting expressions and words against women and migrants.

On this basis and after detecting the tweet, artificial intelligence identifies hate speech aimed specifically against these two demographic groups. «Currently, we continue to integrate new lexical resources into this technology, such as dictionaries and word lists, so that the system will increasingly distinguish nuances in tweets; in this way we increase its accuracy and effectiveness,» explains María Teresa Martín, researcher at the University of Jaén.

Message collection and analysis

During the research process, experts collected tweets using offensive terms such as ‘zorra’ (‘bitch’) or ‘negrata’ (‘nigger’). The system identifies the context in which these words are used and recognises whether they are being applied as insults. Thereby the program detects and collects pejorative messages towards women or migrants.

María Dolores Molina, Flor Miriam Plaza del Arco, María Teresa Valdivia and L. Alfonso Ureña, authors of the study.

The researchers explain that this technology is suitable for application in various areas, such as legal processes or marketing, since collecting and analysing each message manually is a process requiring time and dedication from a specialist, while the program performs it automatically. «This system can be useful for the police or agencies that currently work with complaints of bullying or hate speech,» explains María Dolores Molina, researcher at the University of Jaén.

In previous studies, the research group SINAI focused its efforts on the detection of anorexia and bulimia cases on social media, as well as the recognition of the emotions of Twitter users. «We want to improve technology based on artificial intelligence and machine learning by applying techniques focused on sentiment analysis. This will allow it to be applied in a wider variety of areas and to offer support to organisations that could need it», says L. Alfonso Ureña, researcher at the University of Jaén.

This research work was supported through the University of Jaén SINAI (Sistemas de Acceso Inteligente a la Información, i.e. Intelligent Access to Information Systems) research group’s own funds, the European Regional Development Fund (FEDER), the LIVING-LANG project, the REDES project and a grant for FPI pre-doctoral contracts (under reference PRE2019-089310) awarded by the Spanish Ministry of Science, Innovation and Universities.

Spanish version: Desarrollan un rastreador inteligente que identifica tuits ofensivos contra mujeres y migrantes

References

Plaza-del-Arco, F.M; Molina-González, M.D; Ureña-López, L.A. & Martín- Valdivia, M.T. (2020). “Detecting Misogyny and Xenophobia in Spanish Tweets Using Language Technologies”. ACM Trans. Internet Technol. 20, 2, Article 12, 19 pages.

Más información:

#CienciaDirecta, agencia de noticias de ciencia andaluza, financiada por la Consejería de Transformación Económica, Industria, Conocimiento y Universidades de la Junta de Andalucía.

Teléfono: 954 232 349

E-mail: comunicacion@fundaciondescubre.es

Additional documentation

Authors of the study

Woman using her mobile

Woman reading tweets

Últimas publicaciones

#CienciaDirecta

Divulgación

La Fundación Descubre y la Asociación de Biotecnólogos de Andalucía firman un convenio de colaboración para impulsar la comunicación y difusión de la biotecnología

Andalucía | 08 de agosto de 2025

Ambas entidades promoverán acciones conjuntas, especialmente en proyectos como Clíckmica, Biodiversidad. Los enlaces de la vida y Ciencia al Fresquito

Sigue leyendo

#CienciaDirecta

Ciencias del Mar

Revelan el impacto de las cremas solares sobre las praderas marinas de la Bahía de Cádiz

Cádiz | 02 de agosto de 2025

Un equipo de investigación de la Universidad de Cádiz ha demostrado que los ingredientes de los fotoprotectores afectan a la salud de una planta marina propia del ecosistema costero gaditano. El experimento ha evidenciado cómo estos productos alteran tanto su capacidad para absorber carbono como el equilibrio de las bacterias que la rodean, lo que podría comprometer su papel en la protección del litoral y en la lucha contra el cambio climático.

Sigue leyendo

Educación

Demuestran como la ‘gamificación’ motiva a los adolescentes al ejercicio físico

Málaga | 31 de julio de 2025

Un trabajo basado en una gamificación de la serie de ficción de ‘Los Vengadores’ realizado por expertos de la Universidad de Málaga ha concluido que a través de pequeñas franjas de quince minutos durante las clases de Educación Física se ha logrado mejorar los hábitos saludables de los adolescentes.

Sigue leyendo

#CienciaDirecta

Tu fuente de noticias sobre ciencia andaluza

Más información Suscríbete

¿ERES CIENTÍFICO/A Y QUIERES DIFUNDIR TUS RESULTADOS? CONTÁCTANOS

¿QUIERES CONTACTAR CON UN CIENTÍFICO/A? CONSULTA LA GUÍA EXPERTA

Política de cookies

Este sitio web utiliza cookies para mejorar su experiencia mientras navega por el sitio web. De estas, las cookies que se clasifican como necesarias se almacenan en su navegador, ya que son esenciales para el funcionamiento de las funcionalidades básicas del sitio web. También utilizamos cookies de terceros que nos ayudan a analizar y comprender cómo utiliza este sitio web. Estas cookies se almacenarán en su navegador solo con su consentimiento. También tiene la opción de optar por no recibir estas cookies. Pero la exclusión voluntaria de algunas de estas cookies puede afectar su experiencia de navegación.

Necesarias

Siempre activado

Las cookies necesarias son absolutamente esenciales para que el sitio web funcione correctamente. Esta categoría solo incluye cookies que garantizan funcionalidades básicas y características de seguridad del sitio web. Estas cookies no almacenan ninguna información personal.

Cookie	Duración	Descripción
CONSENT	16 años 7 meses	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. La cookie se utiliza para almacenar el consentimiento del usuario para las cookies.
cookielawinfo-checkbox-advertisement	1 año	La cookie se establece mediante el consentimiento de cookies de GDPR para registrar el consentimiento del usuario para las cookies en la categoría "Publicidad".
cookielawinfo-checkbox-analytics	1 año	Estas cookies están configuradas por el complemento de WordPress de consentimiento de cookies de GDPR. La cookie se utiliza para recordar el consentimiento del usuario para las cookies en la categoría "Análisis".
cookielawinfo-checkbox-necessary	1 año	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. Las cookies se utilizan para almacenar el consentimiento del usuario para las cookies en la categoría "Necesarias".
cookielawinfo-checkbox-performance	1 año	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. La cookie se utiliza para almacenar el consentimiento del usuario para las cookies en la categoría "Rendimiento".
JCS_INENREF	1 hora	La cookie es parte de las medidas de seguridad del sitio web y se utiliza con fines antispam.
JCS_INENTIM	1 hora	La cookie es parte de las medidas de seguridad del sitio web y se utiliza con fines antispam.
PHPSESSID	sessión	Esta cookie es nativa de las aplicaciones PHP. La cookie se utiliza para almacenar e identificar la identificación de sesión única de un usuario con el fin de administrar la sesión del usuario en el sitio web. La cookie es una cookie de sesión y se elimina cuando se cierran todas las ventanas del navegador.

Rendimiento

Las cookies de rendimiento se utilizan para comprender y analizar los índices de rendimiento clave del sitio web, lo que ayuda a brindar una mejor experiencia de usuario a los visitantes.

Cookie	Duración	Descripción
_gat	1 minuto	Google Universal Analytics instala estas cookies para acelerar la tasa de solicitud y limitar la recopilación de datos en sitios de alto tráfico.
YSC	sessión	Estas cookies son establecidas por Youtube y se utilizan para rastrear las vistas de videos incrustados.

Analítica

Las cookies analíticas se utilizan para comprender cómo los visitantes interactúan con el sitio web. Estas cookies ayudan a proporcionar información sobre métricas, el número de visitantes, la tasa de rebote, la fuente de tráfico, etc.

Cookie	Duración	Descripción
_ga	2 años	Esta cookie es instalada por Google Analytics. La cookie se utiliza para calcular los datos de visitantes, sesiones y campañas y realizar un seguimiento del uso del sitio para el informe de análisis del sitio. Las cookies almacenan información de forma anónima y asignan un número generado aleatoriamente para identificar visitantes únicos.
_gid	1 día	Esta cookie es instalada por Google Analytics. La cookie se utiliza para almacenar información sobre cómo los visitantes usan un sitio web y ayuda a crear un informe analítico de cómo está funcionando el sitio web. Los datos recopilados, incluido el número de visitantes, la fuente de donde provienen y las páginas visitadas de forma anónima.

Las cookies publicitarias se utilizan para proporcionar a los visitantes anuncios y campañas de marketing relevantes. Estas cookies rastrean a los visitantes en los sitios web y recopilan información para proporcionar anuncios personalizados.

Cookie	Duración	Descripción
IDE	1 año 24 días	Utilizado por Google DoubleClick y almacena información sobre cómo el usuario utiliza el sitio web y cualquier otro anuncio antes de visitar el sitio web. Se utiliza para presentar a los usuarios anuncios que son relevantes para ellos de acuerdo con el perfil del usuario.
ms-uid	1 año	Estas cookies tienen una finalidad publicitaria. Contienen un valor único generado aleatoriamente que permite a la Plataforma distinguir navegadores y dispositivos. Esta información se utiliza para medir el rendimiento de los anuncios y proporcionar recomendaciones de productos basadas en datos.
NID	6 meses	Esta cookie se utiliza para crear un perfil en función del interés del usuario y mostrar anuncios personalizados a los usuarios.
test_cookie	15 minutos	Esta cookie la establece doubleclick.net. El propósito de la cookie es determinar si el navegador del usuario admite cookies.
VISITOR_INFO1_LIVE	5 meses 27 días	Youtube establece esta cookie. Se utiliza para rastrear la información de los videos de YouTube incrustados en un sitio web.