¿Puede OpenAI leer tus chats de ChatGPT? Project Lily revela cómo los revisan humanos
Project Lily usa revisores humanos para evaluar una parte de los chats de ChatGPT. OpenAI explica quién puede acceder y cómo desactivar el entrenamiento.
Una investigación de 404 Media ha aportado nuevos detalles sobre Project Lily, un programa en el que cientos de contratistas evalúan conversaciones reales de ChatGPT para valorar la calidad de las respuestas y ayudar a mejorar el comportamiento de los modelos. El hallazgo no significa que empleados de OpenAI estén leyendo todos los chats: la propia compañía ya reconoce públicamente que un número limitado de personal autorizado y proveedores de confianza puede acceder a contenido de usuarios para determinados fines.
La novedad de Project Lily está en conocer con mayor detalle cómo funciona una de esas tareas de evaluación humana. Según 404 Media, los revisores pueden recibir conversaciones completas, resumir lo que pretendía conseguir el usuario, comparar respuestas generadas por el modelo y calificarlas siguiendo instrucciones proporcionadas para el proyecto.
Qué es Project Lily
Según la investigación publicada por 404 Media, Project Lily es el nombre interno de un programa que utiliza a cientos de trabajadores contratados para evaluar respuestas de ChatGPT a partir de interacciones reales de usuarios.
El medio asegura haber consultado documentación interna, instrucciones para evaluadores, canales de comunicación relacionados con el proyecto y ejemplos de las tareas asignadas.
Los trabajadores no se limitan a marcar una respuesta como buena o mala. Según la investigación, entre sus tareas se encuentra identificar la intención del usuario, revisar varias respuestas producidas por el sistema, señalar errores o comportamientos problemáticos y puntuar los resultados en una escala.
Parte del trabajo estaría destinada a reducir comportamientos como la adulación excesiva o sycophancy, la imitación forzada del estilo del usuario y las respuestas en las que el modelo se expresa como si tuviera experiencias o características humanas.
Los revisores pueden ver conversaciones completas
404 Media sostiene que algunas tareas proporcionan a los contratistas no solo una pregunta aislada, sino el contexto de una conversación completa necesario para evaluar correctamente la respuesta de ChatGPT.
OpenAI utiliza sistemas automáticos destinados a reducir la cantidad de información personal antes de que determinados contenidos lleguen a los evaluadores. Según la investigación, las conversaciones procesadas por Project Lily pasan por una versión de una herramienta denominada Privacy Filter, diseñada para detectar y ocultar información identificativa.
Sin embargo, ese proceso no garantiza que desaparezcan todos los datos sensibles. La investigación señala que los filtros pueden dejar pasar información personal incluida en el propio texto de la conversación, especialmente cuando resulta difícil identificarla automáticamente por el contexto.
Esto no significa que los revisores reciban necesariamente el nombre de la cuenta asociado a cada conversación. La cuestión de privacidad está en que el propio contenido escrito por un usuario puede contener datos suficientes para revelar información personal aunque los identificadores de la cuenta se hayan eliminado.
OpenAI ya reconoce oficialmente que humanos pueden acceder a algunos chats
La existencia de revisión humana no era completamente desconocida antes de Project Lily. En su documentación oficial sobre el uso de datos en los servicios para consumidores, OpenAI explica que un número limitado de empleados autorizados y proveedores de servicios de confianza puede acceder al contenido de los usuarios cuando sea necesario.
OpenAI enumera cuatro motivos para ese acceso:
- Investigar abuso o incidentes de seguridad.
- Prestar soporte al usuario o solucionar problemas del producto.
- Gestionar asuntos legales.
- Mejorar el rendimiento de los modelos cuando el usuario no haya desactivado ese uso.
La compañía afirma que estos accesos están sujetos a controles técnicos y se limitan a personal autorizado que necesita la información para cumplir su función. También asegura que registra y supervisa los accesos al contenido y que las personas autorizadas deben recibir formación de seguridad y privacidad previamente.
Por tanto, la conclusión correcta no es que OpenAI haya reconocido ahora por primera vez que seres humanos pueden ver conversaciones. Project Lily aporta detalles sobre la escala y el procedimiento concreto de una operación de evaluación de modelos basada en chats reales.
No todos los chats de ChatGPT son revisados manualmente
Ni la documentación oficial de OpenAI ni la investigación de 404 Media sostienen que cada conversación enviada a ChatGPT termine delante de un revisor humano.
OpenAI habla de acceso por un número limitado de personas y únicamente cuando resulta necesario para los fines especificados. Project Lily, por su parte, utiliza una selección de conversaciones como material de evaluación.
Por ello, afirmar que “OpenAI lee todos tus chats” sería incorrecto. Lo que sí está documentado es que determinados contenidos de usuarios pueden formar parte de procesos donde interviene personal humano.
ChatGPT puede utilizar conversaciones personales para mejorar sus modelos
Para los servicios dirigidos a consumidores, OpenAI indica que puede utilizar el contenido de ChatGPT para mejorar y entrenar sus modelos dependiendo de la configuración de la cuenta.
Ese contenido puede incluir los mensajes enviados por el usuario, las respuestas generadas por ChatGPT y otros elementos compartidos dentro de una conversación, como imágenes o archivos.
OpenAI señala además que antes de incorporar datos a sus procesos de mejora intenta reducir la cantidad de información personal presente en los conjuntos utilizados.
Cómo impedir que los nuevos chats se utilicen para entrenar ChatGPT
Los usuarios de cuentas personales pueden desactivar el uso de sus nuevas conversaciones para mejorar los modelos desde los controles de privacidad de ChatGPT.
En la versión web, la ruta oficial es:
- Abre tu perfil.
- Entra en Configuración.
- Selecciona Controles de datos.
- Desactiva Mejorar el modelo para todos.
En la aplicación móvil, la opción se encuentra dentro del menú lateral, accediendo al perfil y después a Controles de datos.
La preferencia se sincroniza con toda la cuenta, por lo que no es necesario desactivarla independientemente en cada teléfono u ordenador.
Al apagar esta opción, las conversaciones continúan apareciendo normalmente en el historial, pero las nuevas conversaciones dejan de utilizarse para entrenar los modelos de OpenAI.
Desactivar el entrenamiento no actúa retroactivamente
La modificación afecta a las conversaciones nuevas después de cambiar la configuración. Desactivar el entrenamiento no significa que se retire automáticamente contenido que ya hubiera sido utilizado anteriormente en procesos de mejora de modelos.
También existe una excepción relacionada con los comentarios voluntarios. OpenAI explica que, incluso después de desactivar el entrenamiento, si un usuario envía feedback sobre una respuesta mediante herramientas como los botones de valoración, la conversación asociada a ese feedback puede utilizarse para mejorar los modelos.
Temporary Chat ofrece otra opción para conversaciones que no deben entrenar modelos
ChatGPT dispone además de Temporary Chat. Mientras una conversación permanezca como temporal, OpenAI indica que no se utiliza para entrenar sus modelos y no aparece normalmente en el historial ni crea nuevos recuerdos.
OpenAI puede conservar una copia durante un máximo de 30 días por motivos relacionados con seguridad y prevención del abuso.
Si posteriormente el usuario decide guardar una conversación temporal en su historial, esta se convierte en un chat normal y pasa a seguir las preferencias generales de la cuenta, incluida la opción sobre mejora de modelos.
Business, Enterprise y Edu funcionan de forma diferente
Las políticas predeterminadas no son iguales para las cuentas personales y los productos destinados a organizaciones.
OpenAI afirma que no utiliza por defecto los datos de ChatGPT Business, Enterprise, Edu y su plataforma API para entrenar sus modelos. Una organización puede disponer de opciones específicas para compartir datos voluntariamente, pero el entrenamiento no está activado de forma predeterminada como parte del servicio empresarial.
Esto no debe confundirse con las capacidades del administrador de una cuenta corporativa. En un espacio de trabajo administrado, la organización puede disponer de controles propios sobre conservación, auditoría y acceso a los datos asociados a las cuentas de sus empleados.
Qué cambia realmente con Project Lily
Project Lily no descubre que ChatGPT funcione sin ningún tipo de intervención humana y que OpenAI haya comenzado repentinamente a leer conversaciones. La compañía llevaba tiempo indicando en su documentación que personal autorizado y determinados proveedores podían acceder a contenido para mejorar modelos, seguridad, soporte y cuestiones legales.
Lo que revela la investigación de 404 Media es cómo se materializa uno de esos procesos: cientos de contratistas evaluando una selección de conversaciones reales y puntuando las respuestas del modelo mediante instrucciones estructuradas.
Para un usuario de ChatGPT, la consecuencia práctica es comprobar qué configuración de uso de datos tiene activada y evitar introducir información especialmente sensible que no querría que fuera procesada dentro de estos sistemas. OpenAI recomienda expresamente no introducir contenido sensible que el usuario no querría que pudiera ser revisado o utilizado.