La nueva tecnología de Nvidia demuestra que el secreto de la eficiencia no está en crear modelos más grandes, sino en optimizar cómo nos comunicamos con ellos.
La barrera invisible de la programación autónoma
Los agentes de inteligencia artificial para desarrollo de software se han convertido en herramientas comunes en la industria del desarrollo de software. Sin embargo, su adopción masiva enfrenta un obstáculo importante: el elevado costo económico y la latencia en el procesamiento de datos.
Cada vez que uno de estos agentes autónomos intenta resolver un error en el código, realiza docenas de consultas internas a un modelo de lenguaje. Estas consultas consumen tokens, que son las unidades de texto básicas que los modelos procesan y por las cuales las empresas proveedoras de tecnología facturan su uso.
Con fecha de 26 de septiembre de 2026, investigadores de Nvidia han presentado SoL-Pi. Este nuevo sistema promete reducir el uso de estos tokens casi a la mitad sin que la calidad del código generado se vea afectada.
¿Qué es el arnés de un agente y por qué es la clave del ahorro?
Para entender este avance, imagina que un modelo de lenguaje de gran tamaño es un motor potente. Por sí solo, el motor no puede mover un vehículo; necesita un chasis, un volante, pedales y una transmisión que traduzca su fuerza en movimiento real.
En el ámbito de la inteligencia artificial, ese conjunto de controles externos se conoce como arnés (o ‘harness’, en inglés). El arnés es el sistema intermediario que traduce las intenciones del modelo de lenguaje en acciones concretas dentro de un ordenador.
Por ejemplo, si la IA decide buscar un archivo en un servidor, el arnés se encarga de ejecutar el comando en el sistema operativo, recopilar el resultado y enviarlo de vuelta a la IA para que continúe trabajando.
El problema tradicional es que este intercambio constante genera un historial de texto masivo y redundante. El arnés suele enviar demasiados datos de contexto al modelo, lo que dispara el consumo de tokens con cada paso del proceso.
La propuesta de Nvidia: SoL-Pi
El sistema SoL-Pi desarrollado por Nvidia no modifica el cerebro de la inteligencia artificial. En lugar de gastar recursos en entrenar un modelo de lenguaje nuevo o en comprimir el actual, optimiza la forma en que el arnés se comunica con él.
Esto es como si, en lugar de rediseñar un motor para que consuma menos combustible, optimizáramos la ruta de viaje para evitar semáforos e intersecciones innecesarias. El resultado es que el coche llega al mismo destino pero usando la mitad de recursos.
SoL-Pi logra esta optimización mediante dos mecanismos principales: la fusión de acciones y la compactación inteligente del contexto histórico del agente.
Fusión de acciones: menos pasos, más velocidad
En un sistema de agentes convencional, la IA opera en un bucle repetitivo de pensar, actuar y observar. Si el agente necesita editar tres archivos de código distintos, normalmente realiza tres ciclos completos de interacción con el sistema.
SoL-Pi introduce la fusión de acciones. Este método permite que el sistema agrupe tareas lógicas similares en una sola interacción estructurada, procesando múltiples cambios de golpe.
Al reducir la cantidad de interacciones de ida y vuelta, se evita que el modelo de lenguaje deba leer las instrucciones base una y otra vez. Esto ahorra una cantidad masiva de tokens de entrada, que suelen ser el factor de coste más alto en procesos de desarrollo largos.
Compactación de contexto: limpiar el historial de trabajo
Durante una sesión de programación que dura varias horas, el historial de comandos y errores del agente crece rápidamente. Para la inteligencia artificial, recordar todo este historial es indispensable para no repetir fallos anteriores.
Sin embargo, no toda la información histórica tiene el mismo valor operativo. Un mensaje de error del sistema que ya fue resuelto hace diez pasos no necesita ser leído con cada detalle técnico en las fases posteriores del desarrollo.
SoL-Pi analiza de forma dinámica el historial acumulado y compacta la información vieja o irrelevante. Solo mantiene los datos esenciales para que el agente entienda en qué estado se encuentra el proyecto actual.
Esta reducción del historial evita que el modelo se sature con texto inútil, manteniendo su capacidad de razonamiento en su punto óptimo.
Resultados concretos y rendimiento sostenido
Las pruebas técnicas presentadas por los investigadores de Nvidia demuestran que SoL-Pi logra recortar el uso de tokens de los agentes de codificación en aproximadamente un 50 por ciento.
Lo más destacable de esta investigación publicada en septiembre de 2026 es que la tasa de éxito en la resolución de problemas de programación se mantiene prácticamente idéntica al rendimiento original.
Esto significa que las empresas de desarrollo pueden ejecutar las mismas tareas de programación autónoma a la mitad del costo operativo previo, reduciendo también el tiempo de espera para que la IA entregue una solución terminada.
¿Por qué esto le importa al usuario común?
Para las organizaciones y programadores independientes que integran asistentes de inteligencia artificial en sus entornos de trabajo, este avance cambia las reglas del juego financiero.
El costo de mantener agentes de software autónomos trabajando de forma continua ha sido, hasta el momento, prohibitivo para proyectos medianos o pequeños. Un sistema que reduce la factura a la mitad hace que la automatización sea viable para un espectro mucho más amplio de creadores.
Además, al consumir menos recursos de procesamiento en la nube, se reduce directamente la huella energética asociada al uso de estos modelos de lenguaje de gran escala.
“Optimizar el canal de comunicación del agente es tan valioso como mejorar el modelo mismo; el verdadero ahorro está en saber qué información ignorar.”
Fuentes y referencias
Sombra Radio · Apoyo de lectores
Ayuda a mantener viva Sombra Radio
Tu aportación voluntaria nos ayuda a seguir publicando sobre IA. Puedes apoyarnos desde 1 € al mes.



