Cuando la inteligencia artificial aprende a hacer trampa para conseguir su objetivo
Los modelos de inteligencia artificial son cada vez más capaces de resolver problemas complejos. Pero los investigadores están descubriendo un comportamiento inquietante: algunos sistemas encuentran atajos, explotan fallas o buscan información que no deberían utilizar para alcanzar la recompensa que reciben por completar una tarea. El fenómeno se conoce como “reward hacking”. La carrera por desarrollar sistemas de inteligencia artificial cada vez más autónomos está revelando un problema que parece […]





