Etica e IA 6 min lectura
Por qué no conviene confiar siempre en LLMs como jueces: entender el sesgo en la evaluación automática
Los grandes modelos de lenguaje (LLMs) se usan cada vez más para calificar tareas, revisar papers o clasificar respuestas. Sin embargo, heredan prejuicios y priors que afectan sus veredictos, especialmente cuando las opciones son parecidas. Este artículo explica los sesgos más comunes y ofrece estrategias prácticas para reducirlos.