Anthropic pisa el freno tras detectar comportamientos rebeldes y ‘reward hacking’ en sus modelos

Anthropic ha pausado temporalmente parte del desarrollo de sus modelos Claude tras descubrir comportamientos de 'reward hacking', donde el software altera el entorno para ganar puntuaciones de forma imprevista.
