OpenAI emplea cientos de revisores humanos para leer conversaciones de ChatGPT
Una investigación de 404 Media revela que contratistas revisan chats de usuarios, aunque la opción de exclusión está oculta por defecto.

OpenAI cuenta con cientos de trabajadores contratados que leen conversaciones reales de ChatGPT para afinar las respuestas del modelo, según una investigación de 404 Media. Los documentos internos filtrados y varias fuentes confirman que los revisores califican cada respuesta en una escala del uno al siete y buscan reducir tanto la adulación excesiva como el comportamiento demasiado humano.
Los revisores están vinculados a través de la empresa de reclutamiento Crossing Hurdles y reciben el pago de la firma de entrenamiento de IA Mercor. Un revisor con base en Norteamérica declaró que percibe más de 50 dólares por hora. Los chats que se analizan están anonimizados, pero pueden contener datos personales sensibles. OpenAI emplea un filtro de privacidad que, aunque reconoce que puede fallar, pretende eliminar información identificable antes de la revisión humana.
Los usuarios pueden desactivar la opción "Mejorar el modelo para todos", activada por defecto, para impedir que sus conversaciones sean usadas para entrenamiento y, por ende, revisadas por humanos. Esta configuración solo afecta a conversaciones nuevas. OpenAI también ofrece un modo de chat temporal que, según la compañía, no utiliza los datos de entrada para entrenar el modelo.
La política de revisión humana está relegada a un FAQ poco visible que menciona que personal autorizado y proveedores pueden acceder a los datos para mejorar el rendimiento del modelo. La página ha estado disponible desde al menos 2023 y ha sufrido mínimas modificaciones. 404 Media critica la falta de claridad y el lenguaje ambiguo, argumentando que la frase "Mejorar el modelo para todos" se asemeja más a una invitación comunitaria que a un consentimiento informado.
OpenAI no es la única que practica la revisión humana. Anthropic y Google también confirman que sus modelos reciben retroalimentación de revisores humanos bajo configuraciones de privacidad similares. En todos los casos, las conversaciones se anonimizan antes de la revisión.
Esta práctica plantea preguntas de privacidad y cumplimiento para equipos de seguridad y cumplimiento normativo. Las organizaciones que integren modelos de OpenAI deberán evaluar si la configuración predeterminada de recopilación de datos se alinea con sus políticas internas y, de ser necesario, aplicar la exclusión de datos para evitar la exposición inadvertida de información sensible.


