
El rol del Red Team en la era de la IA agéntica
La ofensiva a velocidad de máquina cambia el pentesting. El modelo híbrido (agentes + criterio humano) se impone en 2026.
El red teaming (la simulación de adversarios reales para poner a prueba las defensas) está viviendo su mayor transformación en años. La causa es doble: por un lado, los atacantes empiezan a usar agentes autónomos que operan a "velocidad de máquina"; por otro, las propias defensas incorporan IA para responder al mismo ritmo. El resultado no es la sustitución del pentester humano, sino un modelo híbrido en el que los agentes aportan escala y los expertos aportan criterio.
La ofensiva a velocidad de máquina
Google Cloud ha descrito cómo integra capacidades agénticas en su portafolio de seguridad para defenderse de adversarios que reescriben código y ejecutan ataques de forma autónoma. Su enfoque, detallado en la cobertura de RSAC sobre defensa agéntica, incluye un "SOC agéntico" con agentes de triage e investigación que analizan alertas de forma autónoma, y herramientas como Model Armor y Security Command Center para detectar amenazas agénticas (envenenamiento de herramientas, prompt injection, exfiltración).
Cómo cambia la metodología del red team
El propio equipo de AI Red Team de Google explica que evaluar sistemas de IA exige una "mentalidad probabilística": a diferencia del código determinista, los sistemas de IA son más susceptibles a ataques de estilo ingeniería social. Su metodología, descrita en cómo Google construye un AI Red Team efectivo, se centra en simular escenarios realistas (prompt injection, envenenamiento de datos) bajo reglas de enfrentamiento estrictas que impiden usar datos reales de clientes.
El modelo híbrido gana
Durante un tiempo se especuló con pentests "totalmente autónomos". La evidencia de 2026 matiza esa expectativa. Herramientas autónomas han demostrado capacidad de resolver retos y operar mucho más rápido que un humano en tareas acotadas, pero siguen teniendo dificultades con la lógica de negocio compleja y los exploits de múltiples pasos, que requieren razonamiento contextual y creativo. El consenso emergente es claro: los agentes cubren amplitud y velocidad; las personas cubren la "brecha de criterio", las vulnerabilidades de alto impacto que exigen entender el contexto del negocio.
Qué implica para una empresa que contrata un pentest
Primero, que la automatización no sustituye la autorización ni el alcance. Todo ejercicio serio parte de un permiso expreso y reglas de enfrentamiento acordadas. Segundo, que el valor de un red team ya no está solo en "encontrar la falla", sino en demostrar el impacto real de encadenar varias fallas, algo que la IA por sí sola todavía no hace bien. Tercero, que evaluar sistemas que incorporan IA requiere marcos específicos; el OWASP GenAI Security Project ofrece guía estructurada para el red teaming de IA y sistemas agénticos.
Nuestra postura
En Ingenio 360 entendemos el pentesting como un proceso que descubre, verifica, demuestra, corrige y valida, no como una simple exploración automatizada. Usamos herramientas modernas para ganar cobertura, pero el criterio humano sigue siendo el que traduce un hallazgo técnico en riesgo de negocio priorizado. Trabajamos siempre bajo autorización y con entregables accionables: informe ejecutivo, informe técnico con evidencias, clasificación por severidad y plan de remediación.
Opiniones y comentarios
Comparte tu punto de vista sobre este artículo. Tu comentario ayuda a otros lectores.
Sé el primero en comentar este artículo.
