In agosto 2026 è emersa una vicenda che mette in luce le difficoltà di conciliare intelligenza artificiale e giudizio umano nella fase di addestramento dei grandi modelli linguistici. Diverse realtà esterne, impiegate da OpenAI per valutare le conversazioni generate da ChatGPT, sono state licenziate dopo che l’azienda ha scoperto l’uso di chatbot per svolgere il proprio compito.
Le persone coinvolte operano dietro le quinte, leggendo le interazioni reali degli utenti e attribuendo un punteggio alle risposte del modello. Questa attività, definita indispensabile per inserire un controllo di qualità umano è regolamentata da contratti che proibiscono espressamente l’ausilio di qualsiasi strumento basato su IA durante la valutazione.
Licenziamenti in seguito all’uso di chatbot durante la valutazione
Secondo le informazioni ottenute, più di diecimila persone sono state impegnate in progetti di revisione per OpenAI. Tuttavia, la normativa contrattuale di aziende come Mercor – una delle principali società di training AI – vieta l’impiego di modelli linguistici per completare i compiti richiesti. Un collaboratore ha dichiarato che “succede in continuazione, ed praticamente l’unica cosa che ti fa cacciare all’istante”, sottolineando la frequenza con cui alcuni ricorrono a strumenti di IA per accelerare la valutazione.
Le clausole contrattuali di Mercor
Mercor ha confermato che i contratti dei propri revisori includono una sezione denominata “autenticità”, utilizzata internamente per individuare possibili sostituzioni del giudizio umano con produzioni generate dall’IA. Le linee guida fornite ai valutatori descrivono metodi manuali per riconoscere testi prodotti da un algoritmo, ma esplicitamente escludono l’uso di rilevatori automatici come GPTZero ritenuti insufficienti per giustificare un licenziamento.
Reazioni dei collaboratori e casi di sabotaggio
Alcuni dei revisori intervistati hanno condiviso le proprie esperienze. Uno ha mostrato la lettera di licenziamento, in cui si accusa di aver violato la clausola “autenticità”. Un altro collaboratore, impiegato per più aziende di training AI, ha ammesso di aver deliberatamente scelto le risposte peggiori per ostacolare l’addestramento: “All’inizio mi sentivo in colpa”, racconta, “ora o ignoro i risultati e scelgo a caso, oppure scelgo apposta l’output peggiore”. La sensazione descritta è “di essere pagato per peggiorare l’IA”, evidenziando una frattura etica tra la missione del progetto e le pratiche individuali.
Rischi per Mercor e l’investimento di NVIDIA
La notizia assume un’importanza strategica perché, sempre nello stesso periodo, NVIDIA avrebbe valutato un investimento in Mercor con una valutazione di 20 miliardi di dollari. Mercor, costruita su un modello basato su migliaia di valutatori umani, rischia di vedere la propria proposta di valore – il giudizio umano autentico – erosa da pratiche nascoste di automazione. Non è ancora chiaro quanti dei licenziamenti siano dovuti a un uso realmente scorretto dell’IA versus l’uso di strumenti di supporto senza alterare il risultato finale, ma la sfocatura tra i due scenari rende la gestione dei contratti e la supervisione più complessa che mai.
Il caso evidenzia la tensione tra la necessità di velocizzare i processi di addestramento e la volontà di mantenere un controllo di qualità affidabile. Se le regole interne non riescono a distinguere in modo netto tra assistenza lecita e violazione, il rischio è che la stessa intelligenza artificiale venga utilizzata per minare la sua evoluzione, creando un circolo vizioso difficile da spezzare.



