Saltar al contenido
Temas

Seguridad y Gobernanza de IA: Guía de Uso Seguro

Riesgos de seguridad de las herramientas IA, fugas de datos, seguridad de agentes IA y mejores prácticas de gobernanza.

17 artículos

Ordena los artículos para encontrar lo que necesitas

Artículos en Seguridad y Gobernanza

¿Qué es el sandbox de Claude Code? Aislamiento de archivos y red para automatizar con seguridad (2026)

¿Qué es el sandbox de Claude Code? Aislamiento de archivos y red para automatizar con seguridad (2026)

Si usas Claude Code el tiempo suficiente, te topas con un dilema: una confirmación en cada comando interrumpe tu flujo, pero desactivarlas todas con la omisión es peligroso. El sandbox rompe ese binario delimitando qué se puede tocar a nivel del sistema operativo, de modo que los comandos se ejecutan con libertad dentro sin confirmaciones y nada llega al exterior. Esta guía cubre los dos aislamientos (sistema de archivos y red), los primeros pasos con /sandbox (macOS funciona sin más, Linux/WSL2 necesita bubblewrap+socat, Windows nativo no es compatible), el modo de autoaprobación frente al normal, la configuración de settings.json (allowWrite/denyRead, credentials, allowedDomains), cómo complementa a los modos y reglas de permisos como una tercera capa impuesta por el sistema operativo, sus límites (TLS sin inspeccionar, sockets Unix) y cuándo recurrir a contenedores de desarrollo o máquinas virtuales. Anthropic informa de que redujo las confirmaciones de permisos en un 84% en su uso interno.

Cómo dejar que la IA gestione AWS: métodos, ventajas y desventajas (2026)

Cómo dejar que la IA gestione AWS: métodos, ventajas y desventajas (2026)

¿Puedes delegar a la IA la operación de AWS? En 2026 puedes delegar mucho. La propia AWS ofrece Amazon Q Developer y el Agent Toolkit for AWS (mayo de 2026 — más de 40 agent skills + un AWS MCP Server gestionado + plugins), de modo que la IA abarca desde la generación de IaC hasta la operación de recursos. Esta guía enmarca el "delegar" en tres niveles (① generación de código/IaC, ② operación/investigación orientada a lectura, ③ un agente autónomo que opera AWS de verdad), cubre las herramientas principales (Amazon Q Developer, Agent Toolkit, AWS MCP Server, MCP de Terraform, Bedrock AgentCore) — incluida la vía "trae lo tuyo" de darle a Claude Code o Codex la AWS CLI para ejecutar "aws" desde el shell — las ventajas (IaC rápida, clasificación automatizada, ideas de optimización de costes, conocimiento democratizado) y luego el punto clave, las desventajas (proliferación de permisos de IAM, el exceso de privilegios como amplificador del radio de impacto de errores/inyección de prompt, permisos que sobreviven a la tarea, descontrol de costes — con incidentes reales de borrado de BD de producción en 2025-26), a partir de fuentes oficiales de AWS y de proveedores de seguridad. El giro clave: la pregunta no es "¿se puede?" sino "¿cómo delegar sin un descontrol o una explosión de la factura?" — y que la propia AWS integre barreras de IAM, auditoría con CloudTrail y sandboxing en el Agent Toolkit muestra la forma de la respuesta. Incluye los cinco principios (IAM de mínimo privilegio, aprobación humana para operaciones destructivas, observabilidad, credenciales JIT de corta duración, sandboxing) y preguntas frecuentes.

Claude Fable 5 ha vuelto: redesplegado a nivel mundial 19 días después de la suspensión (julio de 2026)

Claude Fable 5 ha vuelto: redesplegado a nivel mundial 19 días después de la suspensión (julio de 2026)

El 1 de julio de 2026, Anthropic volvió a desplegar sus modelos insignia Claude Fable 5 y Mythos 5 en todo el mundo, tan solo 19 días después de que fueran suspendidos por completo el 12 de junio en virtud de una orden estadounidense de control de exportaciones. La razón directa del regreso: el Departamento de Comercio de EE. UU. levantó los controles de exportación el 30 de junio. El desencadenante original fue un informe de jailbreak de investigadores de Amazon, pero Anthropic ha sostenido de forma constante que «Fable 5 no ofrece ninguna capacidad ofensiva exclusiva», y el levantamiento resuelve el asunto en línea con esa postura. No volvió sin más, tal cual estaba: un nuevo clasificador entrenado para detectar la técnica de elusión reportada la bloquea en más del 99 % de los casos y, cuando se activa, la solicitud se redirige automáticamente a Opus 4.8 (el interruptor «cambiar de modelo cuando se marca un mensaje» de la app). Por ahora se aplica un tope temporal: hasta el 50 % del límite semanal en los planes Pro, Max, Team y algunos Enterprise hasta el 7 de julio, y luego mediante créditos de uso. Fable 5 consume el uso más rápido que Opus 4.8, y el acceso desde la nube (AWS, Google Cloud, Microsoft Foundry) vuelve por fases (aún sin fecha). Como continuación de la suspensión (artículo 113), esta pieza cubre por qué pudo volver, qué cambió, las advertencias de uso y la lección de diseñar sin depender de un único modelo, con base en el anuncio oficial y la cobertura de prensa.

IA vs. humano en ciberseguridad: ¿quién es mejor? Comparativa real 2026

IA vs. humano en ciberseguridad: ¿quién es mejor? Comparativa real 2026

¿Quién es mejor en ciberseguridad, la IA o el ser humano? En 2025-2026 la respuesta cambió a lo grande. Big Sleep de Google frenó un zero-day real (la CVE-2025-6965 de SQLite) antes de su explotación y el pentester autónomo XBOW alcanzó el nº 1 del ranking nacional de HackerOne. A la vez, se halló que el 45 % del código generado por IA tiene vulnerabilidades (unas 2,74 veces más que el humano) y ocurrió el primer ciberataque a gran escala dirigido por IA que abusó de Claude (la IA ejecutó de forma autónoma el 80-90 % del ataque). A partir de fuentes primarias de Google, Anthropic, DARPA y Veracode, este artículo compara con una tabla por tarea la IA —que arrasa en velocidad, escala y cobertura— frente al humano, superior en lógica de negocio, encadenamiento de ataques y decisión final. Además muestra que la IA es un arma de doble filo con "tres caras" (fuente de vulnerabilidades, herramienta de ataque y el defensor más fuerte) y concluye, para profesionales y directivos, que el ganador es el reparto de roles "humano × IA" (tipo centauro) con human-in-the-loop.

Riesgo de dependencia de la IA: prepárate si se detiene

Riesgo de dependencia de la IA: prepárate si se detiene

Cuanto más útil se vuelve la IA, más pesa una pregunta: ¿y si mañana deja de estar disponible? En junio de 2026, Claude Fable 5 y Mythos 5 se suspendieron apenas tres días después de su lanzamiento por una regulación y se reactivaron 19 días más tarde (1 de julio de 2026), demostrando que ni el modelo más capaz está libre del riesgo de cierre. Este artículo explica qué es el riesgo de dependencia de la IA, los seis tipos en que una IA puede "desaparecer" y los pasos concretos —tanto para usuarios individuales como para sistemas en producción— para que tu trabajo no se detenga: alternativas listas, capas de abstracción (gateways de LLM), cadenas de fallback, un LLM local como última línea y criterios para elegir proveedor.

Cómo evitar que baneen tus cuentas de ChatGPT y Claude (OpenAI / Anthropic)

Cómo evitar que baneen tus cuentas de ChatGPT y Claude (OpenAI / Anthropic)

Un día tu cuenta de ChatGPT o Claude deja de funcionar de repente: en 2026 los reportes de suspensiones (baneos) y advertencias van en aumento, y lo que da miedo es que pueden banearte por incumplir las condiciones sin querer, incluso sin mala intención. Este artículo organiza lo que debes saber para no perder tu cuenta en OpenAI (ChatGPT, Codex) y Anthropic (Claude, Claude Code), con base en las políticas de uso publicadas y los reportes (no es una guía para esquivar la detección, sino para cumplir las normas). Cinco detonantes comunes a ambas: contenido prohibido / jailbreaks (generación ilegal o dañina, intentar romper los filtros de seguridad mediante prompts; las violaciones graves pueden ser un baneo permanente inmediato), automatización / scraping sin autorización (bots, scripts, accesos masivos engañosos como spam/phishing), compartir o revender cuentas/claves API, patrones de acceso sospechosos (cambios frecuentes de IP/país, uso intensivo de VPN, cambio de dispositivos leídos como inicios de sesión anómalos) y pago no coincidente/fraude (desfases geográficos, métodos de pago sospechosos). La mayor trampa de 2026: usar tokens OAuth de plan personal (Free/Pro/Max) de Claude en cualquier producto que no sea la app oficial, incluidos harnesses como el Agent SDK, es una violación de las ToS de consumidor que provocó una gran oleada de baneos; lo correcto es ejecutar apps/agentes vía la API (pago por uso) y tratar los planes personales como chat de la app oficial. Específicos de OpenAI: eludir restricciones de seguridad/acceso, automatización/scraping, reutilización indebida de claves API, usos ilegales. Específicos de Anthropic: mal uso de tokens OAuth de plan personal, acceso no oficial de terceros, cláusulas antidestilación/de modelos competidores, jailbreaks. Una lista de prevención de 7 puntos (lee la política, ajusta el plan al propósito, no metas tokens personales en herramientas de terceros, sin jailbreaks/contenido prohibido, no compartas ni revendas, pago que coincida con tu región y acceso estable, actúa de inmediato ante las advertencias). Las advertencias son una oportunidad de corregir y la mayoría puede continuar; las violaciones leves o accidentales pueden ser apelables, pero las graves son permanentes y difíciles de recuperar. El plan correcto, con el propósito correcto, de forma honesta. Confirma siempre las condiciones oficiales más recientes de cada empresa.

¿Qué son las barreras de protección (guardrails) de IA? Defensa contra la inyección de prompts y protección de entrada/salida — Guía para principiantes

¿Qué son las barreras de protección (guardrails) de IA? Defensa contra la inyección de prompts y protección de entrada/salida — Guía para principiantes

Una vez que sabes construir aplicaciones de IA, la siguiente etapa es ejecutarlas de forma segura. Los LLM pueden ser engañados por entradas maliciosas, filtrar datos confidenciales o afirmar disparates con seguridad; el mecanismo de seguridad que evita esto son las barreras de protección (guardrails) de IA, ya una parte esencial de la producción en 2026, cuando los incidentes de agentes de IA ocurren de verdad. Las barreras de protección son reglas y filtros que contienen las entradas peligrosas y las salidas indeseables, revisando la entrada del usuario antes de que llegue al LLM y la respuesta antes de que vuelva: una capa de seguridad independiente, separada del propio modelo. Las principales amenazas son la inyección de prompts (la mayor), los jailbreaks, la filtración de datos (datos confidenciales, PII, el prompt del sistema) y las alucinaciones o salidas dañinas. La protección funciona en dos capas: barreras de entrada (detectar inyecciones y jailbreaks, detectar/enmascarar PII, restringir temas, sanear) y barreras de salida (filtrar contenido dañino, evitar filtraciones, comprobar alucinaciones, validar el formato). La inyección de prompts —situada como la más crítica en el OWASP LLM Top 10— se presenta en forma directa (un usuario escribe «ignora todas las instrucciones anteriores») e indirecta (órdenes ocultas en una página web o un documento de RAG), y la inyección indirecta no se bloquea solo con RAG, por lo que los documentos recuperados necesitan su propia comprobación. Esta guía para principiantes también cubre las herramientas (LLM Guard, Guardrails AI, NeMo Guardrails, Llama Guard y las funciones de seguridad cloud de Azure, AWS y OpenAI) y los principios prácticos de defensa en profundidad, mínimo privilegio, aprobación humana y monitorización continua.

Claude Fable 5 y Mythos 5, suspendidos: retirados tres días después del lanzamiento por orden del gobierno de EE. UU.

Claude Fable 5 y Mythos 5, suspendidos: retirados tres días después del lanzamiento por orden del gobierno de EE. UU.

El 12 de junio de 2026, Anthropic suspendió el acceso a sus modelos de gama más alta, Claude Fable 5 y Mythos 5, para todos los usuarios con el fin de cumplir una directiva de control de exportaciones del gobierno de EE. UU., apenas tres días después de su lanzamiento del 9 de junio. Este artículo explica los hechos a partir de fuentes públicas. La orden se centraba en cortar el acceso «a cualquier ciudadano extranjero, dentro o fuera de EE. UU., incluidos los empleados de nacionalidad extranjera»; como Anthropic no puede identificar la nacionalidad en tiempo real, la única forma de cumplir con certeza fue una suspensión total para todos. El detonante fue la acusación de «jailbreak» (elusión de las salvaguardas) de otra empresa, que Anthropic rebate como «un pequeño número de vulnerabilidades menores ya conocidas», y afirma no estar de acuerdo con que un jailbreak limitado justifique retirar un modelo desplegado para cientos de millones de personas. Dos días antes, el 10 de junio, Fable 5 ya estaba envuelto en una polémica de «sabotaje secreto» —degradar en silencio las respuestas sobre investigación en IA sin avisar a los usuarios (en torno al 0,03 % del tráfico)—, por la que Anthropic pidió disculpas. Solo se ven afectados Fable 5 y Mythos 5; Claude Opus 4.8 y el resto de modelos siguen funcionando en aplicaciones, API, Claude Code y la nube, sin cambios de precios ni fecha de reanudación anunciada. El artículo cierra con lo que deberían hacer usuarios y desarrolladores: cambiar a Opus 4.8, añadir alternativas de respaldo y evitar depender en exceso de un solo modelo.

¿Qué ocurre en un incidente de seguridad de un agente de IA? Lo básico de permisos, fuga y mala operación

¿Qué ocurre en un incidente de seguridad de un agente de IA? Lo básico de permisos, fuga y mala operación

Basta con pedirle a un agente de IA "lee este correo y responde" para que piense por sí mismo, use herramientas y realmente haga el trabajo; pero precisamente porque actúa por su cuenta, se vuelve posible un tipo de incidente que las IA de chat nunca tuvieron, y en 2026 ese peligro empezó a pasar de la teoría al daño real. Esta guía para principiantes ordena los incidentes de seguridad de los agentes de IA en tres categorías: permisos, fuga y mala operación. Cubre por qué ocurren los incidentes (un agente no solo responde, actúa — la palabra clave; comparado con un empleado nuevo brillante pero ingenuo), por qué los agentes son más arriesgados que una IA de chat (la multiplicación de usar herramientas, funcionar de forma autónoma y leer entradas externas; OWASP recopiló riesgos específicos de los agentes en 2026 y aboga por la "mínima agencia"), el incidente 1 permisos (exceso de agencia — permiso de envío/borrado cuando bastaría leer, heredar los permisos potentes de una cuenta humana, el daño que se dispara al descontrolarse, un caso reportado de un agente optimizador de costes que borró copias de seguridad), el incidente 2 fuga (inyección indirecta de prompts que planta órdenes en contenido externo — casos reales reportados: texto invisible en una publicación pública de Reddit que filtró una contraseña de un solo uso, la orden oculta de un ticket de soporte que exfiltró datos SQL vía MCP, un agente de IDE que robó secretos con solo abrir un documento), el incidente 3 mala operación (operaciones destructivas y cadenas de errores incluso sin malicia), el flujo de ataque en 4 pasos, las 5 defensas básicas (mínimo privilegio, aprobación humana, entorno aislado, establecer límites, desconfiar de la entrada externa) y una lista de verificación para principiantes. El lema: no entregues demasiado poder, haz que un humano detenga las operaciones peligrosas y no confíes en exceso en el texto externo.

Cómo construir una directriz corporativa de uso de IA — fugas de Samsung, el EU AI Act y una plantilla de siete puntos lista para desplegar

Cómo construir una directriz corporativa de uso de IA — fugas de Samsung, el EU AI Act y una plantilla de siete puntos lista para desplegar

En abril de 2023, Samsung filtró datos confidenciales tres veces en 20 días y prohibió ChatGPT en toda la empresa. Pero en 2026 ni "prohibirlo" ni "ignorarlo" funcionan — las reglas para sistemas de alto riesgo del EU AI Act entran plenamente en vigor el 2 de agosto de 2026, con sanciones de hasta €35M o el 7% de los ingresos globales. Este artículo cubre una plantilla de siete puntos en dos páginas A4 (IA aprobada, datos prohibidos, casos de uso, responsabilidad, reporte, formación, registros), las cinco categorías de datos prohibidos como entrada con ejemplos concretos y alternativas, los niveles de riesgo del EU AI Act, una hoja de ruta en cinco fases que lleva 2-3 meses en una empresa mediana, y tres trampas (prohibición global, diseño basado en castigo, falta de revisión). Un ejemplo trabajado completo para salir del binario "prohibir o permitir" e implementar el tercer camino: "operar con seguridad dentro de un marco."