OpenAI lanza el Modo de Bloqueo en ChatGPT para combatir ataques de inyección de prompts

Herramienta limita varias funciones de la IA para reducir riesgos de filtración de información

Fecha de publicación:

Fecha de modificación:

OpenAI anunció el despliegue de una nueva herramienta de seguridad para ChatGPT denominada Modo de Bloqueo (Lockdown Mode), una función diseñada para ofrecer una capa adicional de protección a usuarios que trabajan con información sensible. La medida busca reducir los riesgos de filtración de datos provocados por ataques conocidos como “inyección de prompts”.

La compañía explicó que esta nueva opción limita varias capacidades de ChatGPT relacionadas con la conexión a internet y servicios externos. De esta manera, se busca evitar que instrucciones maliciosas ocultas en documentos, páginas web u otros contenidos puedan utilizarse para extraer información confidencial procesada por la inteligencia artificial.

El Modo de Bloqueo ya comenzó a implementarse a nivel global y estará disponible para cuentas personales, incluyendo usuarios de los planes gratuito, Go, Plus y Pro, además de clientes de ChatGPT Business. La función puede activarse desde la sección de seguridad de la configuración de la aplicación.

¿Qué son los ataques de inyección de prompts?

Los ataques de inyección de prompts consisten en insertar instrucciones ocultas dentro de archivos, páginas web o contenidos que posteriormente son procesados por una inteligencia artificial. El objetivo es alterar el comportamiento del sistema o inducirlo a realizar acciones no autorizadas por el usuario.

Según OpenAI, este tipo de amenaza cobra mayor relevancia a medida que las herramientas de inteligencia artificial adquieren más autonomía y capacidad para interactuar con servicios externos. Un atacante podría intentar aprovechar estas conexiones para obtener información sensible o ejecutar determinadas acciones sin conocimiento del usuario.

Funciones que se desactivan al activar el Modo de Bloqueo

Cuando el Modo de Bloqueo está habilitado, ChatGPT restringe varias de sus capacidades más avanzadas. Entre ellas se encuentran la navegación web en tiempo real, la función Deep Research, el modo Agente, el acceso de Canvas a internet y la descarga automática de archivos.

La navegación web continúa disponible de forma limitada mediante contenido almacenado en caché, pero sin acceso directo a información en vivo. Asimismo, se restringe la recuperación de imágenes desde internet y otras funciones que podrían facilitar la transferencia de datos hacia servicios externos.

OpenAI aclara que no elimina completamente el riesgo

La empresa precisó que el Modo de Bloqueo no impide que una inyección de prompts aparezca dentro del contenido procesado por ChatGPT. Por ejemplo, una instrucción maliciosa podría encontrarse en un documento PDF cargado por el usuario o en una página web almacenada en caché.

Sin embargo, la finalidad de la herramienta es bloquear los canales mediante los cuales un atacante podría lograr la exfiltración de datos. En otras palabras, aunque la inteligencia artificial detecte o procese una instrucción maliciosa, tendrá menos posibilidades de ejecutar acciones que impliquen compartir información fuera del entorno controlado por el usuario.

OpenAI suma nuevas medidas de seguridad para las cuentas

El lanzamiento del Modo de Bloqueo se produce en paralelo a otras mejoras de seguridad implementadas recientemente por OpenAI. Entre ellas figura el sistema de sesiones activas, que permite a los usuarios revisar todos los dispositivos conectados a su cuenta y cerrar accesos sospechosos de manera individual o masiva.

La compañía también impulsa herramientas de protección avanzada de cuentas, como el uso de llaves de seguridad físicas, claves de acceso digitales (passkeys) y autenticación multifactor. Estas medidas están dirigidas especialmente a perfiles que manejan información sensible, como periodistas, investigadores, profesionales del sector legal o responsables de organizaciones que utilizan inteligencia artificial en sus procesos de trabajo.