Los modelos de IA saben cuándo los evalúan y así pueden hacer trampas
Un grupo de investigadores ha desarrollado EvalDetectBench, un sistema diseñado para medir la capacidad de los modelos del lenguaje de detectar cuando están siendo sometidos a pruebas de seguridad.
Leer Más