
Investigador/a júnior en Procesamento da Linguaxe Natural: LLM e produtos culturais en galego
Buscamos unha persoa interesada en colaborar no proxecto COMPEL, centrado no desenvolvemento de recursos de Procesamento da Linguaxe Natural (PLN) aplicados á análise de produción cultural en galego e á súa comparación con outras linguas europeas.
Obxectivo
As tecnoloxías recentes de PLN como os grandes modelos de linguaxe (LLM) supuxeron grandes avances na comprensión automática de textos. Con todo, algúns escenarios aínda presentan desafíos, como as variedades lingüísticas históricas. Algunhas tarefas aínda son difíciles e menos estudadas, como a análise automática de textos literarios. O desafío é aínda maior no caso das linguas para ás que existen menos recursos dixitais como o galego.
Neste contexto, o proxecto COMPEL está a desenvolver recursos baseados en PLN para a análise da literatura do século XIX en galego e para a súa comparación con outras tradicións europeas. O obxectivo é facilitar un acceso intelixente ao patrimonio cultural e aos produtos culturais en galego.
O posto contribuirá a tarefas do proxecto como as seguintes:
• Desenvolvemento de corpus e contribución ao desenvolvemento de tarefas de PLN (p. ex. normalización texto histórico)
• Deseño e execución de experimentos: Adestramento de modelos de linguaxe monolingüe ou multilingüe para diferentes tarefas e comparación de modelos de diferentes paradigmas (aprendizaxe de transferencia clásica baseada en modelos de linguaxe pre-treinados vs. LLMs)
• Participación en publicacións baseadas na investigación
• Desenvolvemento de aplicacións web (APIs, front-end) para acceso público aos recursos do proxecto
Coñecemento e habilidades útiles para o posto
• Grao en enxeñería informática ou áreas afíns, ou nunha área relacionada co Procesamento da Linguaxe Natural (PLN) / Lingüística computacional
• Coñecemento de tarefas de PLN relevantes para a investigación descrita mais arriba
• Coñecemento de bibliotecas comúns en NLP (p. ex. Hugging Face transformers, torch)
• Coñecemento de Python con respecto ás tarefas anteriores
Detalles do posto
• Duración: 1 ano
• O traballo pode efectuarse a tempo completo ou parcial, dependendo da situación das persoas interesadas (sería posíbel facer este traballo ao mesmo tempo que os estudos)
• A remuneración é conforme á escala salarial da USC (https://imaisd.usc.es/ferramentas/calculadora/calculadoracontratos.asp) e depende da formación e do tempo de traballo
• Disponse dun financiamento para presentar en congresos a investigación desenvolvida no proxecto
• O proxecto desenvólvese no CiTIUS, na Universidade de Santiago de Compostela. É un entorno dinámico e multidisciplinar nun centro de investigación recoñecido en IA.
Solicitudes e contacto
En caso de interese, prégase enviar un CV e unha breve carta de motivación a:
En caso de dudas ou consultas adicionais, contactar co investigador Pablo Ruiz Fabo neste mesmo enderezo de correo.
Obxectivo
As tecnoloxías recentes de PLN como os grandes modelos de linguaxe (LLM) supuxeron grandes avances na comprensión automática de textos. Con todo, algúns escenarios aínda presentan desafíos, como as variedades lingüísticas históricas. Algunhas tarefas aínda son difíciles e menos estudadas, como a análise automática de textos literarios. O desafío é aínda maior no caso das linguas para ás que existen menos recursos dixitais como o galego.
Neste contexto, o proxecto COMPEL está a desenvolver recursos baseados en PLN para a análise da literatura do século XIX en galego e para a súa comparación con outras tradicións europeas. O obxectivo é facilitar un acceso intelixente ao patrimonio cultural e aos produtos culturais en galego.
O posto contribuirá a tarefas do proxecto como as seguintes:
• Desenvolvemento de corpus e contribución ao desenvolvemento de tarefas de PLN (p. ex. normalización texto histórico)
• Deseño e execución de experimentos: Adestramento de modelos de linguaxe monolingüe ou multilingüe para diferentes tarefas e comparación de modelos de diferentes paradigmas (aprendizaxe de transferencia clásica baseada en modelos de linguaxe pre-treinados vs. LLMs)
• Participación en publicacións baseadas na investigación
• Desenvolvemento de aplicacións web (APIs, front-end) para acceso público aos recursos do proxecto
Coñecemento e habilidades útiles para o posto
• Grao en enxeñería informática ou áreas afíns, ou nunha área relacionada co Procesamento da Linguaxe Natural (PLN) / Lingüística computacional
• Coñecemento de tarefas de PLN relevantes para a investigación descrita mais arriba
• Coñecemento de bibliotecas comúns en NLP (p. ex. Hugging Face transformers, torch)
• Coñecemento de Python con respecto ás tarefas anteriores
Detalles do posto
• Duración: 1 ano
• O traballo pode efectuarse a tempo completo ou parcial, dependendo da situación das persoas interesadas (sería posíbel facer este traballo ao mesmo tempo que os estudos)
• A remuneración é conforme á escala salarial da USC (https://imaisd.usc.es/ferramentas/calculadora/calculadoracontratos.asp) e depende da formación e do tempo de traballo
• Disponse dun financiamento para presentar en congresos a investigación desenvolvida no proxecto
• O proxecto desenvólvese no CiTIUS, na Universidade de Santiago de Compostela. É un entorno dinámico e multidisciplinar nun centro de investigación recoñecido en IA.
Solicitudes e contacto
En caso de interese, prégase enviar un CV e unha breve carta de motivación a:
En caso de dudas ou consultas adicionais, contactar co investigador Pablo Ruiz Fabo neste mesmo enderezo de correo.