HumanModel: Estrategias lingüísticas para humanizar los grandes modelos del lenguaje

El proyecto HumanModel investiga estrategias lingüísticas para mejorar los grandes modelos de lenguaje (LLMs) y acercarlos a un funcionamiento más próximo al aprendizaje humano. La propuesta aborda problemas clave de estos modelos (como la falta de transparencia, la fiabilidad limitada, los sesgos y el predominio del inglés) mediante métodos basados en lingüística, corpus de tamaño humano, conocimiento externo y evaluación lingüística. Además, presta especial atención al diasistema gallego-portugués, con el objetivo de desarrollar modelos más inclusivos, interpretables y socialmente responsables.

Objetivos

El objetivo general de HumanModel es desarrollar modelos de lenguaje más fiables, transparentes e inclusivos mediante la integración de conocimientos lingüísticos en su diseño y entrenamiento. Para ello, el proyecto propone crear corpus de tamaño comparable al aprendizaje humano, explorar mecanismos composicionales basados en información sintáctica, desarrollar modelos para el diasistema gallego-portugués, mejorar la fiabilidad mediante conocimiento externo, reducir sesgos en los datos y diseñar nuevos conjuntos de evaluación lingüística que permitan analizar con mayor precisión las capacidades de los modelos.