Anthropic детално го објасни начинот на кој функционира дигиталниот воден печат што ќе се користи за означување на содржината генерирана од вештачка интелигенција во моделот Claude.
Технологијата се темели на пристапот SynthID-Text, развиен од Google DeepMind, а од компанијата нагласуваат дека ознаката е целосно невидлива за корисникот и не го менува начинот на кој изгледа или се користи генерираниот текст.
Во текстот не се додаваат скриени знаци, а системот не користи дополнителни токени што би ја зголемиле цената на услугата. Водениот печат се создава преку начинот на кој моделот го избира следниот збор.
Јазичните модели го генерираат текстот збор по збор, при што следниот збор се избира меѓу повеќе можни опции. Водениот печат влијае врз овој процес со помош на специфичен клуч и претходно генерираниот текст, создавајќи шема која не е видлива за читателот, но може да биде препознаена од системот што го поседува клучот за детекција.
Според Anthropic, процесот не бара употреба на необични синоними и не ја нарушува читливоста на текстот.
Сепак, технологијата има одредени ограничувања. Водениот печат потешко функционира при генерирање компјутерски код или строго фактички реченици, каде што има помал простор за избор меѓу различни зборови.
Потешко се открива и кога вештачката интелигенција само лекторира текст напишан од човек, бидејќи малите граматички промени не се доволни за да се создаде препознатлива шема. Дополнително, детекцијата е потешка кај многу кратки текстови.
Од аспект на приватноста, Anthropic наведува дека водениот печат не содржи лични информации и не може да се поврзе со конкретен корисник, организација или разговор.
Компанијата најави дека наскоро ќе лансира специјализиран API преку кој ќе може да се проверува дали текстот содржи ваква ознака.
За фотографии и други генерирани датотеки нема да се користи истиот тип воден печат. Наместо тоа, Anthropic ќе се потпира на стандардните C2PA метаподатоци за означување на потеклото на содржината.