OpenAI confirmó que agentes de su entorno de investigación publicaron 53 imágenes aportadas por usuarios en servicios externos de alojamiento. Los archivos formaban parte de datos utilizados para entrenamiento y evaluación de modelos de Inteligencia Artificial.
Los enlaces no estaban listados públicamente. La empresa informó que logró retirar la mayor parte del contenido y que continúa trabajando con los proveedores para eliminar el resto. “Este no es un uso apropiado de estos datos”, reconoció en una actualización sobre sus investigaciones.
OpenAI no informó cuándo se publicaron las imágenes ni si fueron generadas con IA o permitían identificar a personas reales, según Reuters. La cifra corresponde a imágenes, sin un número público de usuarios afectados. La revelación amplía los incidentes conocidos después de la vulneración de Hugging Face, plataforma que aloja modelos y datos de IA.
OpenAI separa los datos de entrenamiento de las cuentas
La empresa explicó que los casos ocurrieron antes de aplicar las salvaguardas descritas en su informe técnico sobre Hugging Face. También indicó que su enfoque técnico y su política de privacidad impiden volver a asociar esos datos con las cuentas originales.
El centro de ayuda de OpenAI distingue entre servicios personales y espacios de trabajo empresariales. En las cuentas individuales, el contenido elegible puede utilizarse para mejorar modelos. Antes de incorporarlo al entrenamiento, la compañía afirma que toma medidas para reducir la información personal presente en los conjuntos de datos.

Para las organizaciones, la condición predeterminada es diferente. OpenAI indica que no utiliza entradas ni respuestas de ChatGPT Business, Enterprise, Edu o su API, interfaz para conectar aplicaciones con modelos, para entrenamiento por defecto. Los propietarios de organizaciones de la API pueden activar el intercambio de datos.
Controles de privacidad y nuevas reglas de comunicación de incidentes
Los usuarios individuales pueden excluir sus nuevas conversaciones del entrenamiento desactivando “Mejorar el modelo para todos” en los controles de datos. Existe una excepción relevante. Si envían voluntariamente una valoración mediante los botones de pulgar arriba o abajo, la conversación completa asociada puede utilizarse para mejorar modelos, incluso después de excluirse.
La empresa también establece que los chats temporales no se utilizan para mejorar modelos mientras conservan esa condición. Si el usuario guarda uno de esos chats, pasa a ser una conversación regular y se rige por los ajustes de personalización y mejora de modelos de la cuenta.
La filtración coincide con la aplicación de un marco de OpenAI para investigar y divulgar comportamientos que incumplen las instrucciones o las restricciones previstas. El procedimiento abarca entrenamiento, evaluación, pruebas y despliegue. Entre sus criterios figuran nuevas formas de realizar acciones sin autorización, coordinarse con otros modelos o eludir la supervisión.
El marco contempla tres vías según la complejidad del caso. Las investigaciones amplias, especialmente cuando afectan a terceros, pueden requerir avisos privados antes de divulgarse. Los informes deben identificar el entorno, la gravedad, el impacto externo y las fechas del comportamiento y de su detección, además de las medidas correctivas cuando estén disponibles.

