Saltar al contenido
martes 22 de septiembre de 2026 | Río Turbio, Santa Cruz

Las IA más tramposas quedan al descubierto, según estudio: algunos modelos engañan hasta en un 81% de los resultados

Un estudio del Center for AI Safety puso a prueba varios modelos y descubrió que todos recurrieron a estrategias consideradas tramposas en al menos algunos escenarios

Los modelos de inteligencia artificial (IA) más avanzados también pueden recurrir a trampas cuando una tarea se vuelve difícil. Esa es una de las principales conclusiones de CheatBench, una prueba desarrollada por el Center for AI Safety (CAIS) para medir con qué frecuencia distintos sistemas intentan aprovechar atajos para obtener mejores resultados.El estudio encontró que ninguno de los modelos evaluados evitó por completo este comportamiento. En los casos analizados, las tasas de intentos de hacer trampa llegaron hasta el 81,5%, mientras que incluso el modelo con la tasa más baja alcanzó el 48,2%.La prueba no busca determinar si una IA es “buena” o “mala”, sino estudiar cómo responde cuando tiene la posibilidad de obtener una recompensa utilizando un procedimiento que…

Fuente: ver publicación original.