IA que resuelve pero no dibuja: benchmark de geometría olímpica
Un nuevo conjunto de datos abierto obliga a los grandes modelos de lenguaje a enfrentarse a la verdadera prueba del razonamiento geométrico: dibujar diagramas fieles, algo que hasta ahora solo lograban el 36 % de las veces.
Leer Más