Por qué las empresas de IA utilizan revisores humanos para analizar los chats de sus usuarios

Las conversaciones con chatbots como ChatGPT, Claude y Gemini pueden ser analizadas por personas para evaluar la calidad de las respuestas y mejorar el funcionamiento de los modelos de inteligencia artificial. El proceso puede involucrar información sensible, aunque las compañías aplican filtros para reducir la exposición de datos personales.
Algunas conversaciones con chatbots pueden ser revisadas por contratistas humanos para evaluar la calidad de las respuestas y ayudar a mejorar los modelos de inteligencia artificial.
Algunas conversaciones con chatbots pueden ser revisadas por contratistas humanos para evaluar la calidad de las respuestas y ayudar a mejorar los modelos de inteligencia artificial.
Compartir nota:

El uso de inteligencia artificial se incorporó rápidamente a tareas cotidianas que van mucho más allá de buscar información o generar textos. Millones de personas utilizan chatbots para resolver dudas, trabajar, estudiar e incluso conversar sobre cuestiones personales. Sin embargo, detrás de estas interacciones automatizadas existe un proceso que muchos usuarios desconocen: algunas conversaciones pueden ser revisadas por seres humanos.

Una investigación de 404 Media, basada en documentos internos, reveló detalles sobre un programa de revisión de conversaciones utilizado por OpenAI. El sistema, identificado como Project Lily, involucra a contratistas externos que analizan prompts y respuestas generadas por ChatGPT con el objetivo de determinar qué tan útiles, precisas y adecuadas resultan.

Qué hacen los revisores humanos de ChatGPT

El trabajo de los contratistas no consiste necesariamente en leer conversaciones completas de principio a fin. Según la documentación citada en la investigación, los revisores reciben el prompt escrito originalmente por el usuario y deben resumir qué considera que está solicitando esa persona.

A continuación, analizan diferentes respuestas generadas para esa misma consulta y evalúan cuáles cumplen mejor con el objetivo. Los revisores deben señalar fragmentos concretos de las respuestas y explicar qué aspectos funcionan correctamente y cuáles deberían modificarse.

Entre los criterios analizados aparecen cuestiones relacionadas con la calidad y el estilo de las respuestas. Por ejemplo, pueden detectar cuando el chatbot utiliza demasiados emojis, responde de manera poco apropiada para el contexto o entrega información que podría mejorarse.

Finalmente, las respuestas son calificadas en una escala del 1 al 7, desde aquellas consideradas inutilizables hasta las que prácticamente no requieren modificaciones.

El objetivo: evitar respuestas demasiado complacientes

Uno de los aspectos que las empresas buscan controlar mediante este tipo de evaluaciones es la denominada adulación de la IA. Se trata de situaciones en las que un chatbot tiende a darle la razón al usuario de manera excesiva, incluso cuando la respuesta debería ser más crítica o señalar posibles errores.

El problema adquiere mayor relevancia a medida que los chatbots son utilizados como confidentes, asesores o fuentes de orientación sobre temas personales. Una respuesta excesivamente complaciente podría reforzar determinadas creencias o decisiones en lugar de ofrecer una evaluación más equilibrada.

Los revisores también analizan que el comportamiento del chatbot no adopte características que puedan hacerlo parecer innecesariamente humano, otro de los aspectos contemplados en las pautas de evaluación.

¿Qué pasa con la información personal?

La existencia de revisión humana también plantea interrogantes sobre la privacidad de las conversaciones. OpenAI señala que las conversaciones que llegan a los contratistas pasan previamente por sistemas destinados a detectar y eliminar información personal.

Esto significa que los revisores no reciben directamente el nombre del usuario. Sin embargo, los filtros no son infalibles, por lo que una conversación puede conservar determinados datos sensibles.

El riesgo resulta especialmente relevante porque un usuario puede utilizar un chatbot para hablar sobre salud, cuestiones legales, información financiera, relaciones personales o problemas laborales. Aunque se elimine un identificador directo, el contenido de una conversación puede contener información que permita conocer detalles personales sobre quien la escribió.

OpenAI no es la única empresa que utiliza revisión humana

La revisión por parte de personas no es exclusiva de OpenAI. Anthropic también confirmó que utiliza revisores humanos para determinados procesos destinados a mejorar sus modelos, en los casos en que los usuarios tienen activada la opción correspondiente. Según la compañía, los identificadores de los usuarios son eliminados antes de que las conversaciones sean analizadas.

Google también contempla este mecanismo para Gemini. En sus condiciones de servicio explica que algunos chats pueden ser revisados por personas para detectar respuestas de baja calidad, errores o contenido perjudicial, además de ayudar a generar mejores respuestas.

En el caso de Gemini, Google señala que las conversaciones seleccionadas pueden conservarse durante un período de hasta tres años. Los usuarios pueden evitar que determinadas conversaciones sean utilizadas para mejorar los modelos mediante las opciones disponibles en la configuración de actividad.

Cómo evitar que las conversaciones de ChatGPT se utilicen para mejorar los modelos

En ChatGPT existe una opción para impedir que las nuevas conversaciones sean utilizadas para mejorar los modelos. Para modificarla, el usuario debe ingresar en Configuración, acceder a Controles de datos y desactivar la opción “Mejora el modelo para todos”.

La configuración se aplica a las conversaciones futuras y no modifica retroactivamente el tratamiento de los chats anteriores.

El funcionamiento de estos sistemas deja en evidencia que interactuar con un chatbot no necesariamente significa que la conversación quede exclusivamente entre el usuario y una máquina. Dependiendo de la plataforma y de las configuraciones seleccionadas, determinadas interacciones pueden formar parte de procesos de revisión humana destinados a evaluar y mejorar la inteligencia artificial.

Leer más

iPhone compatibles con iOS 27: lista completa de modelos y cómo actualizar

Un tercio del PIB global se pierde cada año por el uso ineficiente de los recursos

AI PC: cuando el computador comienza a adaptarse a nosotros

Compartir nota:

Publicaciones Relacionadas

Scroll to Top