OpenAI introduce la filigrana invisibile per i testi di ChatGPT e Codex in Europa
OpenAI ha illustrato il proprio approccio alla filigrana per i testi generati dall’intelligenza artificiale, una scelta dettata dall’AI Act europeo, che richiede ai fornitori di IA generativa di rendere riconoscibili i contenuti prodotti dall’AI. L’azienda di Altman riconosce che la tecnologia è ancora immatura e piena di limiti, e per questo procede per fasi.
Da subito i clienti dell’API di tutto il mondo possono attivare la filigrana su alcuni modelli, ma resta disattivata di default. Nelle prossime settimane un segno invisibile verrà aggiunto ai testi idonei di ChatGPT e Codex, soltanto nell’Unione Europea e su tutti i piani. Il sistema di rivelazione, invece, non sarà pubblico: l’accesso è riservato a ricercatori e organizzazioni esperte, che potranno farne richiesta e saranno valutati caso per caso. Restano liberi per tutti gli strumenti di verifica di immagini e audio, come la pagina openai.com/verify e la Content Provenance API.
TextGrain è il nome di questa tecnologia, e inserisce un segnale statistico invisibile nella scelta delle parole del modello; il rilevatore cerca poi quella traccia. Secondo OpenAI il sistema eguaglia o supera gli altri approcci provati, SynthID per i testi compreso, e verrà reso disponibile anche in open source. Ma prestazioni ottime in condizioni ideali, avverte l’azienda, non garantiscono affidabilità nell’uso quotidiano.
I numeri lo dimostrano. Con una soglia di falsi positivi fissata all’1%, il rilevatore individua la filigrana in circa l’80% dei brani da 200 token e nel 95% di quelli da 400, per temi come la psicologia. Per la matematica, dove la scelta delle parole è meno libera, i risultati sono nettamente inferiori. Anche le modifiche pesano: sostituendo il 10% delle parole con sinonimi in un brano da 400 token, il rilevamento scende dal 92% al 66%; con il 25% si arriva al 17%.
Sulla qualità, OpenAI non vede differenze significative nei test del suo ultimo modello di punta, Astra, con e senza filigrana. In GPQA Diamond si passa dal 94,44% al 93,94%, in Terminal-Bench 4.0 dal 53,90% al 56,06%.
L’azienda precisa anche ciò che la filigrana non può dire. Non misura il contributo umano, non stabilisce proprietà o responsabilità del testo, non identifica l’utente, non verifica l’esattezza dei contenuti. E se non viene rilevata, non significa che il testo sia scritto da una persona: può essere troppo breve, modificato o tradotto, venire da un modello non supportato o da un’altra azienda.
OpenAI ricorda infine di seguire un approccio a più livelli, con le Content Credentials, la conformità allo standard C2PA e le filigrane invisibili SynthID su immagini e audio, e promette di rivedere ogni parte man mano che evolveranno tecnologia, standard e norme.
🕸️ La Ragnatela di Spider-Mac 🕸️
C’è del merito nell’ammettere i limiti senza girarci intorno, ma il quadro resta deludente. OpenAI presenta come scelta di trasparenza un adempimento imposto dalla legge, e lo applica solo in Europa: altrove i testi continuano a circolare senza alcun segno. Il segnale sparisce con qualche sinonimo, dunque chi vuole eluderlo ci riesce senza fatica, mentre un rilevatore chiuso al pubblico impedisce a chiunque di verificare. Più che una garanzia, per ora è una dichiarazione d’intenti, e la domanda “l’ha scritto un’IA?” resta senza risposta.


