Un agente de código no manda «un trozo de contexto»: manda ficheros enteros, salidas de terminal, variables de entorno que aparecen por pantalla y todo lo que lee mientras investiga —lo que de verdad ocupa su contexto rara vez es lo que tú crees—. Eso convierte cualquier proyecto de cliente en una transferencia de datos a un tercero, con las consecuencias legales que trae (RGPD, encargado de tratamiento, ubicación de los servidores) y con una lista clara de cosas que no deberían salir de la red del cliente: datos personales de sus usuarios, volcados de base de datos de producción, credenciales, claves y contratos. El malentendido más caro es creer que .gitignore protege: solo dice a git qué no versionar, no impide que el agente abra el fichero y lo mande. Los límites de verdad son técnicos y contractuales a la vez: denegar rutas y comandos con permisos, aislar en sandbox, poner guardarraíles, anonimizar o generar datos de prueba, y dejar por escrito con el cliente qué herramientas de IA se usan y con qué alcance. Súmale que el contenido que el agente lee puede volverse contra ti vía inyección de prompts. El modelo local es una opción legítima cuando el dato no puede salir, y una excusa cuando se usa para no tener la conversación incómoda. Los casos ya existen —los informes de Cyberhaven sobre datos corporativos pegados en herramientas de IA, la filtración de Samsung— y por eso esto va en el mismo cajón que la seguridad del código: checklist antes de abrir el agente en un repo ajeno, no después.
Antes de abrir un agente en «<proyecto de cliente>», hazme el inventario: qué ficheros, volcados, claves y salidas de terminal podrían acabar enviándose al proveedor. Dime qué no debe salir, qué límites técnicos poner (rutas denegadas, sandbox, datos de prueba) y qué conviene dejar por escrito con el cliente.
Fuentes en Web Reactiva
- Qué datos no compartir con un agente de IA (y por qué)post2026-08-06
Sin Momentos: la fuente es un `post` y el índice de huellas solo cubre audio/vídeo (`wr`, `wrp`, `step`). Las búsquedas sobre privacidad y datos de clientes devuelven chunks tangenciales (bots de Telegram, MCP); no se citan de relleno.
Artículo creado por Daniel Primo con ayuda de la IA en base a lo compartido en el podcast, vídeos y textos de Web Reactiva.