Come Claude segnala i contenuti generati dall’AI
Anthropic spiega i metodi per segnare i contenuti generati da Claude con watermark e metadati.

Transparenza e segnalazione dei contenuti generati dall’AI
Anthropic ha firmato il Codice di Pratica sull’AI generata del Regolamento AI Act dell’UE, come fornitore di modelli e sistemi generativi di AI. L’azienda ha adottato misure per garantire la trasparenza dei contenuti generati da Claude, utilizzando due tecniche complementari: marcatura digitale e metadati di provenienza. Questi strumenti permettono di identificare con maggiore precisione i contenuti generati dall’AI, senza alterare il significato o la qualità del testo.
La marcatura digitale e i metadati di provenienza sono due strumenti chiave per la trasparenza.
Claude utilizza due approcci per segnare i contenuti generati: (1) watermark incorporati nel testo e (2) metadati di provenienza digitalmente firmati. I watermark sono impercettibili e non influiscono sulla leggibilità o sull’integrità del testo. Questi vengono integrati nel testo stesso e si trasmettono quando il testo viene copiato o modificato. I metadati di provenienza, invece, vengono applicati ai file come .svg, .png o .jpg, seguendo lo standard aperto C2PA, che registra informazioni sulla provenienza del contenuto.
Limitazioni e contesto legale
La marcatura digitale non è sempre disponibile su tutti i dispositivi o piattaforme, a seconda delle funzionalità offerte. Inoltre, alcuni contenuti generati da Claude potrebbero non presentare un segnale rilevabile, ad esempio se il testo è stato modificato, tradotto o se i metadati sono stati rimossi. L’azienda ha anche spiegato che i modelli lanciati in Europa a partire dal 2 agosto 2026 supporteranno la marcatura digitale fin dall’inizio.
La trasparenza è un obiettivo chiave per rispettare gli obblighi legali.
Anthropic ha chiarito che i modelli lanciati in Europa a partire dal 2 agosto 2026 supporteranno la marcatura digitale fin dall’inizio. I contenuti generati da Claude potranno essere segnalati con watermark e metadati di provenienza, ma non tutti i contenuti saranno sempre segnalati. Ad esempio, i testi molto brevi o i file con metadati rimossi potrebbero non presentare un segnale rilevabile. L’azienda sta anche lavorando per aggiungere supporto alla marcatura a modelli lanciati prima di questa data.
La marcatura digitale e i metadati di provenienza sono strumenti utili, ma non sempre sufficienti a garantire la piena trasparenza. La rilevazione dei segni di Claude non conferma la provenienza completa del contenuto, poiché il testo potrebbe essere stato modificato o utilizzato da altre fonti. L’obiettivo di Anthropic è supportare gli utenti e i terzi nella rilevazione dei segni, condividendo dettagli tecnici in documentazione futura. La trasparenza rimane un tema centrale per Anthropic, in linea con gli obblighi legali derivanti dal Codice di Pratica sull’AI generata. L’azienda si impegna a fornire informazioni dettagliate sui metodi di segnalazione e rilevazione, anche se alcuni limiti sono inevitabili. La marcatura digitale e i metadati di provenienza sono solo due degli strumenti utilizzati per migliorare la trasparenza dei contenuti generati da Claude.
