OpenAI despide a contratistas por usar IA para corregir los modelos del desarrollo de ChatGPT

Actualidad y herramientas de Inteligencia Artificial leídas en CIBERED tu blog de Informática y Tecnología en Español Favorito

Existe algo profundamente irónico en ser despedido de una empresa de inteligencia artificial por usar inteligencia artificial..

openai-comic-ia-despidos

Pero eso es, según un nuevo informe, exactamente lo que les ha ocurrido a varios contratistas que trabajaban para OpenAI revisando y mejorando las respuestas de sus modelos.

La historia revela una paradoja incómoda: incluso las empresas que construyen la IA siguen necesitando humanos.

Despedidos por hacer su trabajo con la herramienta que ayudan a crear

Contratistas encargados de revisar y mejorar las respuestas generadas por los modelos de OpenAI han sido despedidos o apartados de sus proyectos después de utilizar IA para hacer su propio trabajo, según un informe de 404 Media.

La norma, que a primera vista puede parecer contradictoria, tiene una lógica aplastante. Estos trabajadores son contratados específicamente por su juicio humano, una cualidad que se vuelve considerablemente menos útil si es ChatGPT u otro chatbot quien emite ese juicio en su lugar.

Uno de los contratistas afectados declaró a 404 Media que ve a compañeros usando IA “todo el tiempo” y que los trabajadores son retirados con regularidad por hacerlo. Otro compartió lo que, según él, era una carta de despido que citaba problemas con la “autenticidad” de su trabajo.

¿Por qué la prohibición de la IA para corregir a la IA? El valor irremplazable del juicio humano

Los modelos de IA no aprenden únicamente extrayendo texto de libros o de internet. OpenAI reconoce que la información proporcionada o generada por entrenadores e investigadores humanos es una de las fuentes utilizadas para desarrollar sus modelos fundacionales.

La retroalimentación humana, lleva mucho tiempo siendo clave para enseñar a los modelos qué respuestas prefieren las personas y cómo deben comportarse. Eso hace que la calidad de esa retroalimentación humana sea verdaderamente importante.

La propia OpenAI ha admitido en sus investigaciones que los modelos entrenados con retroalimentación humana pueden verse influidos por las personas que etiquetan los datos. Los contratistas descritos por 404 Media trabajan en diversos proyectos de OpenAI, algunos de los cuales pueden implicar a miles de trabajadores.

Sus tareas, incluyen leer respuestas de la IA, calificarlas y decidir cuáles son mejores. Según documentos internos obtenidos por el medio, los revisores no tienen permitido delegar ese juicio de vuelta a una IA. Un conjunto de instrucciones, prohíbe expresamente el uso de IA para escribir comentarios o retroalimentación y menciona específicamente herramientas como Grammarly y la traducción automática.

Mercor, una empresa de entrenamiento de IA que emplea a contratistas que trabajan en proyectos de OpenAI, confirmó a 404 Media que sus contratos prohíben a los trabajadores utilizar modelos de lenguaje para realizar sus proyectos.

¿Cómo los atraparon?

Uno podría suponer que una empresa de IA detectaría a los trabajadores que usan IA con un detector de IA. Más, al parecer, no fue así.. 404 Media no revela exactamente cómo fueron descubiertos los contratistas despedidos.

Pero, las instrucciones internas obtenidas por la publicación ofrecen una mirada fascinante a cómo se enseña a los revisores a detectar el uso sospechoso de IA. Y los detectores de IA no forman parte del proceso.

Las instrucciones indican a los revisores no utilizar herramientas como GPTZero porque NO se consideran fiables. En su lugar, se les dice que juzguen el patrón general de las entregas de un trabajador y busquen pistas como redacción repetitiva, tiempos de finalización inusualmente rápidos y patrones de escritura asociados a la IA.

Además, el uso excesivo de guiones largos debe levantar sospechas. Los revisores, también tienen prohibido decir a los trabajadores exactamente qué hizo sospechar del uso de IA, porque hacerlo facilitaría ocultarlo en el futuro.

Esto es, sorprendentemente revelador: puesto que demuestra el hecho de que, las personas que verifican si los humanos están usando IA a escondidas para ayudar a entrenar ChatGPT reciben instrucciones explícitas de no confiar en el software de detección de IA para hacerlo.

La paradoja final es que, realmente la IA necesita humanos que la corrijan

OpenAI utiliza muchos datos sintéticos (información generada con ayuda de modelos de IA) como parte de algunos procesos de entrenamiento. La compañía afirma que los datos sintéticos pueden mejorar el rendimiento del modelo y rellenar lagunas donde otros datos de entrenamiento escasean.

Pero, eso es diferente de sustituir en secreto un modelo de IA por una persona contratada específicamente para proporcionar retroalimentación humana. Si un evaluador debe decirle a OpenAI, qué respuesta prefiere un humano, el pedirle a otra IA que tome esa decisión anula gran parte del propósito de contratar al evaluador.

No significa que estos incidentes hayan empeorado a ChatGPT, y no existe evidencia de que el trabajo generado por IA haya causado un daño medible a un modelo de OpenAI. Pero, la situación expone una de las realidades más extrañas del auge de la IA, incluso las empresas que construyen los sistemas de inteligencia artificial siguen necesitando humanos que les digan cuándo han acertado.

Vistas: 3

Descubre más desde CIBERED

Suscríbete y recibe las últimas entradas en tu correo electrónico.

Scroll al inicio