Skip to content
Artwork for PointerPodcast
PointerPodcast · Sunday · 32 min

Pointer[304]: Il Watermark Di Claude

🤖 Anthropic ha annunciato qualche giorno fa che Claude inserirà un watermark invisibile nei testi generati. Non si tratta di caratteri nascosti né di un codice riconducibile all’utente: la firma nasce invece dalle parole scelte dal modello durante la generazione e da una chiave segreta. Ma come funziona questo sistema e cosa cambierà per noi utenti? 🎲 Per capirlo siamo partiti dal normale funzionamento di un LLM, per arrivare poi a SynthID-Text, il metodo adottato da Claude. Questo sistema interviene sul campionamento del token successivo, orientando la scelta tra parole ugualmente plausibili e introducendo così un pattern statistico all’interno dei testi generati. 🔍 Ma come possiamo usare questo pattern per capire se un testo è stato generato con Claude? Durante la fase di rilevamento, una chiave segreta permette ad Anthropic di verificare la presenza del watermark senza conoscere il prompt originale né dover generare nuovamente l’output. A questo punto, però, una domanda sorge spontanea: è possibile rimuovere il watermark? Supporta il PointerPodcast Acquista il prodotto della settimana o parti da uno dei link qui sotto per fare acquisti su Amazon! Iscriviti ad Audible dal nostro link per ricevere 1 mese di ascolto gratuito, 60 giorni se sei già utente Amazon Prime La nostra pagina supportaci Unitevi al nostro gruppo Telegram per discutere della puntata Lascia una recensione su Spotify Lascia una recensione su Apple Podcast Prodotto della settimana Dungeon Crawler Carl: 1 - Libro Dungeon Crawler Carl - Audiolibro Note Puntata Iscriviti ad Audible dal nostro link per ricevere 1 mese di ascolto gratuito, 60 giorni se sei già utente Amazon Prime How Claude’s text watermark works How Claude’s Text Watermarking Works I nostri contatti: Gruppo Telegram LinkedIn Twitch YouTube Instagram Twitter Mail

0:00-32:22

transcript

No transcript — this publisher did not publish one.

show notes

🤖 Anthropic ha annunciato qualche giorno fa che Claude inserirà un watermark invisibile nei testi generati. Non si tratta di caratteri nascosti né di un codice riconducibile all’utente: la firma nasce invece dalle parole scelte dal modello durante la generazione e da una chiave segreta. Ma come funziona questo sistema e cosa cambierà per noi utenti? 🎲 Per capirlo siamo partiti dal normale funzionamento di un LLM, per arrivare poi a SynthID-Text, il metodo adottato da Claude. Questo sistema interviene sul campionamento del token successivo, orientando la scelta tra parole ugualmente plausibili e introducendo così un pattern statistico all’interno dei testi generati. 🔍 Ma come possiamo usare questo pattern per capire se un testo è stato generato con Claude? Durante la fase di rilevamento, una chiave segreta permette ad Anthropic di verificare la presenza del watermark senza conoscere il prompt originale né dover generare nuovamente l’output. A questo punto, però, una domanda sorge spontanea: è possibile rimuovere il watermark?

Supporta il PointerPodcast

Prodotto della settimana

Note Puntata

I nostri contatti:

links15