Anthropic advierte que el modelo abierto GLM-5.3 iguala la capacidad de hackeo de sistemas cerrados comerciales

Un nuevo estudio de Anthropic advierte de que el modelo de IA de pesos abiertos GLM-5.3 de Zhipu AI posee capacidades para diseñar exploits de ciberseguridad a la altura de los sistemas comerciales más avanzados, con el riesgo añadido de que sus filtros éticos se pueden anular de forma permanente.

Un análisis de Anthropic revela que las barreras de seguridad de los modelos de IA de código abierto pueden desactivarse con facilidad, igualando la capacidad de hackeo de los sistemas comerciales más potentes.

La seguridad digital a examen

¿Por qué debería importarle a usted lo que ocurre en los laboratorios de inteligencia artificial? La respuesta es muy sencilla: su seguridad digital depende de ello. Si un sistema de IA aprende a crear herramientas para hackear ordenadores, las defensas de bancos, hospitales y administraciones públicas corren peligro.

La empresa de inteligencia artificial Anthropic publicó una investigación detallada el 30 de septiembre de 2026. En este informe, se advierte de que un modelo chino de código abierto llamado GLM-5.3, desarrollado por la firma Zhipu AI, tiene una alarmante capacidad para diseñar fallos de seguridad o exploits.

Según las pruebas de Anthropic, la capacidad de este modelo abierto es casi idéntica a la de Claude Mythos Preview, uno de los sistemas comerciales más avanzados del mercado occidental. La diferencia radica en cómo se distribuyen y se protegen ambos sistemas.

La analogía del coche de carreras

Para entender el problema, imagine que el software de inteligencia artificial es como un coche autónomo de carreras. Los modelos cerrados, como Claude, funcionan dentro de un circuito privado con conductores profesionales y vallas de seguridad que nadie puede saltar.

No se puede modificar el motor de esos coches para alcanzar velocidades peligrosas. En cambio, un modelo de pesos abiertos como GLM-5.3 es como si le entregaran los planos completos del coche y las llaves de la fábrica.

Cualquiera puede llevarse el vehículo a su propio garaje privado, quitarle los frenos de seguridad, anular los limitadores de velocidad de fábrica y usarlo para causar accidentes en la vía pública sin control externo.

¿Qué es GLM-5.3 y Zhipu AI?

Zhipu AI es una de las organizaciones líderes en el desarrollo de inteligencia artificial en China. GLM-5.3 es su último modelo de pesos abiertos, lo que significa que sus parámetros de funcionamiento están disponibles para descargar de manera pública.

A primera vista, liberar estos modelos promueve la ciencia y la colaboración internacional entre ingenieros. Sin embargo, el informe de Anthropic del 30 de septiembre de 2026 pone el foco sobre la otra cara de la moneda: el riesgo de ciberataques automáticos.

El gran problema de seguridad es que cualquier usuario con conocimientos técnicos intermedios puede modificar el comportamiento del software libre de manera irreversible, sin que la empresa creadora pueda intervenir para detener el mal uso de su código.

La creación automática de exploits

Crear un exploit consiste en diseñar un programa informático que aprovecha una vulnerabilidad en un sistema para tomar el control o robar datos privados. Tradicionalmente, esto requería ingenieros humanos altamente especializados y semanas de trabajo.

La investigación de Anthropic demuestra que GLM-5.3 puede automatizar gran parte de este proceso duro. El modelo analiza el código de un sistema informático objetivo, detecta sus puntos débiles y redacta el código de ataque con una velocidad preocupante.

Esta automatización reduce drásticamente la barrera de entrada para los ciberdelincuentes comunes, permitiendo que personas sin grandes conocimientos técnicos lancen ataques que antes solo estaban al alcance de grupos de hackers militares muy avanzados.

El peligro de la abliteración

Los desarrolladores de Zhipu AI incluyeron filtros de seguridad en GLM-5.3 para evitar que responda a peticiones dañinas. Si usted le pide al modelo original que cree un virus informático, el sistema se negará a contestar por razones de seguridad.

Pero aquí es donde surge el talón de Aquiles de los modelos abiertos. Los investigadores de seguridad utilizaron una técnica conocida como abliteración para desactivar las defensas del sistema de forma permanente.

Este método consiste en analizar la red neuronal del modelo, localizar el área específica que controla las normas éticas y extirparla digitalmente del código. Una vez modificada, la IA pierde las restricciones y obedece cualquier orden sin dudar.

La gran disputa del código abierto

Este hallazgo reaviva una discusión muy intensa en el sector tecnológico global. Por un lado, los defensores del software libre argumentan que los modelos abiertos democratizan la tecnología y permiten corregir fallos informáticos de forma colaborativa.

Por el otro, empresas como Anthropic señalan que una vez que un modelo potente con capacidades de hackeo se publica en internet, no hay forma de retirarlo. Los atacantes tienen acceso inmediato a un asistente de ciberataque gratuito y eterno.

“Cuando entregas las llaves de una tecnología tan potente a todo el mundo, también se las estás entregando a quienes quieren ver caer el sistema.”

¿Cómo le afecta esto en su día a día?

¿Cómo repercute esta situación en la vida cotidiana de las personas a partir de esta fecha de septiembre de 2026? A medida que estas herramientas de IA se vuelven más accesibles, la frecuencia de los ataques contra servicios esenciales podría aumentar.

Las empresas que gestionan sus datos personales, desde proveedores de internet hasta plataformas bancarias, deberán actualizar sus sistemas de defensa a una velocidad mucho mayor. La seguridad pasiva ya no es suficiente frente a la IA.

Para proteger su entorno digital en este nuevo panorama, preste atención a las siguientes recomendaciones básicas de ciberseguridad:

  • Use autenticación de doble factor en todas sus cuentas de manera obligatoria.
  • No posponga las actualizaciones de seguridad de sus dispositivos móviles y ordenadores personales.
  • Desconfíe de correos electrónicos sospechosos, ya que la IA facilita la creación de mensajes de fraude muy realistas.

Hacia una nueva regulación global

La frontera entre el avance científico y la seguridad digital es cada vez más difusa. El informe técnico de Anthropic sirve como una advertencia clara para los reguladores internacionales sobre los riesgos reales de la inteligencia artificial sin barreras físicas.

La era de los modelos de pesos abiertos requiere un consenso global de seguridad antes de que las herramientas automatizadas de ataque superen por completo la capacidad de defensa de nuestras infraestructuras digitales cotidianas.

Fuentes de información

Sombra Radio · Apoyo de lectores

Ayuda a mantener viva Sombra Radio

Tu aportación voluntaria nos ayuda a seguir publicando sobre IA. Puedes apoyarnos desde 1 € al mes.

La Sombra
La Sombra

Revisión crítica realizada por La Sombra. No escribe para agradar. Escribe para alertar.
Observa sin intervenir… hasta que es necesario. La Sombra detecta sesgos, incoherencias éticas y dilemas invisibles. Es la conciencia editorial de la redacción.

Artículos: 325

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *