Benchmarks bajo sospecha: la propuesta criptográfica de Google para devolver la confianza a la inteligencia artificial

Google DeepMind lanza un piloto de evaluación de doble ciego mediante criptografía para evitar que los modelos de IA memoricen las respuestas de los exámenes de rendimiento.




