¿Cómo sabe FortressAI que una herramienta de IA no ha sido manipulada?
Respuesta breve: Antes de conceder a cualquier herramienta de IA acceso a los datos, FortressAI evalúa si esa herramienta ha sido manipulada, comprobando la integridad de su proceso y de las bibliotecas cargadas mediante los mismos análisis de comportamiento de memoria en los que se apoya el resto de la plataforma. Una herramienta aprobada que ha sido comprometida no obtiene sus datos por el simple hecho de figurar en la lista de permitidas.
La aprobación no es lo mismo que la confianza
La mayoría de los marcos de gobernanza de IA se detienen en la lista de permitidas: ¿está autorizada esta aplicación? Eso es necesario, pero no suficiente, porque la identidad de una aplicación y su integridad son preguntas distintas.
claude.exe, un cliente de Copilot, una aplicación de escritorio de ChatGPT o un navegador que ejecuta Gemini pueden estar legítimamente aprobados, y aun así ser explotados. Un atacante que compromete un cliente de IA aprobado hereda el acceso a los datos que se le concedió a ese cliente. Una lista de permitidas por sí sola se lo entrega.
Por ello, FortressAI evalúa dos aspectos antes de conceder acceso a los datos:
- ¿Está autorizada esta herramienta? (evaluación y política por herramienta)
- ¿Sigue siendo esta herramienta la misma? (si el proceso o sus bibliotecas han sido manipulados)
Ambas condiciones deben cumplirse.
Qué significa "manipulada" en este contexto
La comprobación se basa en análisis de memoria, la misma capa de sensores fundamental que sustenta la protección de datos e identidad. Examina el estado del programa en ejecución y de las bibliotecas cargadas en busca de indicios de inyección, modificación en memoria o explotación.
Esto importa porque las técnicas de ataque modernas apuntan específicamente a procesos de confianza. El código inyectado en una aplicación aprobada hereda sus permisos y su reputación. Comprobar el archivo en disco no demuestra nada sobre en qué se ha convertido el proceso en memoria.
Qué ocurre cuando falla la comprobación
La respuesta sigue el mismo modelo escalonado utilizado en toda la plataforma:
- Autorizada y sin manipular, dentro de la política — el acceso continúa.
- Autorizada y sin manipular, pero fuera de la política — se bloquea, se redacta o se proporcionan datos falsos, según sus reglas. La herramienta sigue funcionando.
- Manipulada o desconocida — se rechaza o se suspende, según el motor de comportamiento y su configuración.
El efecto práctico: un cliente de IA comprometido se trata como un atacante, no como una aplicación aprobada que atraviesa un mal momento.