IA y modelos
El nuevo "Lockdown Mode" de ChatGPT apunta a los riesgos de inyección de prompts
OpenAI lanzó "Lockdown Mode" para ChatGPT con el fin de mitigar los riesgos de inyección de prompts, aunque la empresa advierte que la función no elimina todas las vulnerabilidades para quienes manejan datos confidenciales.
OpenAI ha anunciado “Lockdown Mode”, una nueva función de seguridad diseñada para individuos y organizaciones que manejan datos confidenciales. La empresa afirma que la función proporcionará protección adicional contra ataques de inyección de prompts (instrucciones maliciosas ocultas en páginas web u otras fuentes de contenido). Estos ataques pueden manipular el comportamiento del chatbot o derivar en el intercambio no autorizado de datos, lo que convierte a la seguridad en una preocupación crítica para los usuarios empresariales.
Según OpenAI, “Lockdown Mode” no está destinado a todos. En cambio, la empresa señala que la función está creada para casos de uso específicos. “Está diseñada para personas y organizaciones que manejan datos confidenciales y desean una protección más estricta contra los riesgos de filtración de datos relacionados con la inyección de prompts”, declaró OpenAI. Para abordar estas necesidades de seguridad específicas, la empresa indica que actualmente está implementando “Lockdown Mode” en las cuentas de autoservicio de ChatGPT Business, así como en cuentas personales elegibles.
Al activarse, “Lockdown Mode” deshabilitará varias funciones clave del servicio ChatGPT para reducir estos riesgos de seguridad. Específicamente, el modo deshabilitará:
- La navegación web en vivo, lo que significa que los usuarios solo pueden acceder a contenido en caché
- La recuperación y visualización de imágenes de la web, aunque los usuarios aún pueden generar imágenes
- Deep Research
- Agent mode
Al deshabilitar estas funciones, el modo está diseñado para reducir la probabilidad de que se compartan datos confidenciales durante un ataque de inyección de prompts.
Sin embargo, OpenAI advierte que ChatGPT aún podría ser vulnerable a inyecciones de prompts incluso con “Lockdown Mode” activado. La empresa señala que las instrucciones maliciosas podrían aparecer en contenido web en caché o en un archivo cargado, y aún podrían afectar el comportamiento o la precisión de una respuesta. Esto significa que, si bien la función restringe ciertas capacidades para reducir el riesgo de filtración de datos, no elimina por completo la amenaza de las inyecciones de prompts.
Por qué importa
OpenAI está introduciendo “Lockdown Mode” para reducir la probabilidad de que se compartan datos confidenciales durante ataques de inyección de prompts, aunque la empresa señala que la función no elimina todas las vulnerabilidades. Esto resalta el desafío continuo de asegurar los modelos de lenguaje extensos (LLM) cuando interactúan con datos externos no confiables.