ChatGPT avrà un watermark invisibile nei testi: arriva textGrain

OpenAI introdurrà nell’Unione Europea un sistema capace di lasciare nei testi di ChatGPT e Codex una traccia statistica invisibile, pensata per rendere riconoscibili i contenuti generati dall’IA.
Capire se un testo è stato prodotto con l’intelligenza artificiale potrebbe diventare più semplice, almeno in alcuni casi. OpenAI ha annunciato textGrain, una tecnologia di watermarking che verrà applicata nelle prossime settimane agli output testuali idonei di ChatGPT e Codex nell’Unione Europea.
La novità nasce in risposta alle disposizioni dell’AI Act europeo sulla riconoscibilità dei contenuti generati dall’intelligenza artificiale. Non bisogna però immaginare una firma nascosta tradizionale: textGrain non inserisce caratteri segreti, spazi invisibili o simboli particolari all’interno delle frasi.
Come funziona il watermark textGrain di ChatGPT
Il sistema interviene direttamente durante la generazione. Quando il modello deve scegliere la parola o la porzione di parola successiva, textGrain modifica leggermente le probabilità associate alle diverse alternative disponibili. Ripetuta lungo un testo sufficientemente esteso, questa procedura produce uno schema statistico invisibile al lettore.
Un rilevatore dotato della chiave e delle impostazioni corrette può successivamente analizzare il testo e verificare se quello schema compare con una frequenza superiore a quella che ci si aspetterebbe casualmente. Il watermark, quindi, risiede nella scelta delle parole stesse e continua a essere presente quando il contenuto viene semplicemente copiato e incollato.
OpenAI sottolinea però un aspetto importante: rilevare il watermark non permette di identificare l’utente, il suo account, il prompt utilizzato o la conversazione dalla quale proviene il contenuto. Non consente neppure di stabilire quanto del testo sia stato scritto da una persona oppure modificato successivamente.
In Europa arriverà automaticamente nelle prossime settimane
Il rollout riguarderà gli output testuali idonei di ChatGPT e Codex nell’Unione Europea e interesserà tutti i piani supportati. OpenAI ha precisato che il watermark non diventerà, almeno inizialmente, uno standard automatico a livello mondiale.
La situazione è diversa per chi utilizza le API. I clienti OpenAI API possono attivare volontariamente il watermarking per i modelli supportati, indipendentemente dal Paese in cui si trovano. L’opzione rimane però disabilitata per impostazione predefinita.
Esistono inoltre alcune categorie di contenuti per le quali la tecnologia incontra maggiori difficoltà. Le risposte molto brevi forniscono pochi elementi statistici da analizzare, mentre testi estremamente vincolati, formule matematiche e codice lasciano al modello meno libertà nella scelta delle parole.
Leggi anche:
Modificare il testo può rendere il watermark più difficile da rilevare
Il limite principale di textGrain emerge quando il contenuto viene riscritto. Il segnale dipende infatti dalla sequenza di scelte effettuate dal modello durante la generazione e modifiche sostanziali, parafrasi o traduzioni possono ridurne la rilevabilità.
Nei test pubblicati da OpenAI, la sostituzione di una parte delle parole con sinonimi ha prodotto un forte calo della capacità del detector. Su testi di circa 400 token, sostituendo il 10% delle parole la percentuale di rilevamento è scesa indicativamente dal 92% al 66%. Modificando il 25% delle parole, il valore è precipitato intorno al 17%.
Anche l’assenza del segnale non può quindi essere considerata una prova che un testo sia stato scritto da una persona. Il contenuto potrebbe essere troppo breve, essere stato modificato o tradotto, provenire da un modello non supportato oppure essere stato creato prima dell’introduzione del sistema.
Il rilevatore non sarà subito disponibile per tutti
OpenAI adotterà un approccio graduale anche per il detector. Inizialmente l’accesso sarà concesso, previa approvazione, a ricercatori e organizzazioni specializzate che potranno contribuire a studiare l’affidabilità del sistema, i falsi positivi e i falsi negativi.
L’azienda prevede inoltre di rendere textGrain disponibile come tecnologia open source, consentendo ad altri sviluppatori e ricercatori di lavorare sul metodo e contribuire al miglioramento dei sistemi di provenienza dei testi.
Il watermark resta comunque un indicatore e non una certificazione assoluta. Può suggerire che un sistema OpenAI abbia generato o elaborato almeno una parte del contenuto, ma non dimostra chi ne sia l’autore, chi lo possieda, quanto sia intervenuta una persona o se le informazioni contenute siano corrette. È proprio questa distinzione a rendere textGrain uno strumento di provenienza, piuttosto che un sistema infallibile per stabilire se un testo sia “umano” oppure generato dall’intelligenza artificiale.
Ti potrebbe interessare:
Segui guruhitech su:
- Google News: bit.ly/gurugooglenews
- Telegram: t.me/guruhitech
- Facebook: facebook.com/guruhitechfb
- Instagram: instagram.com/guruhitech_official/
- X (Twitter): x.com/guruhitech1
- Bluesky: bsky.app/profile/guruhitech.bsky.social
- Rumble: rumble.com/user/guruhitech
- VKontakte: vk.com/guruhitech
- MeWe: mewe.com/i/guruhitech
- Skype: live:.cid.d4cf3836b772da8a
- WhatsApp: bit.ly/whatsappguruhitech
Esprimi il tuo parere!
Che ne pensi di questa notizia? Lascia un commento nell’apposita sezione che trovi più in basso e se ti va, iscriviti alla newsletter.
Per qualsiasi domanda, informazione o assistenza nel mondo della tecnologia, puoi inviare una email all’indirizzo [email protected].
Scopri di più da GuruHiTech
Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.
