Anthropic paskaidro, kā darbosies Claude jaunā ūdenszīme tekstos
Anthropic emuāra ierakstā izklāstījusi tehniskās detaļas par to, kā Claude tērzēšanas robots iezīmēs savus ģenerētos tekstus ar neredzamu ūdenszīmi. Solis saistīts ar ES Mākslīgā intelekta akta pārredzamības kodeksa prasībām.

Anthropic piektdien publicēja emuāra ierakstu, kurā skaidroja, kā tehniski darbosies tās Claude tērzēšanas robota ģenerētā teksta marķēšana ar ūdenszīmi. Šī nedēļa uzņēmums jau bija paziņojis, ka ieviesīs ūdenszīmes, lai izpildītu Eiropas Savienības Mākslīgā intelekta akta pārredzamības kodeksa prasību — ļaut identificēt ar mākslīgo intelektu radītu saturu. Ziņa izraisīja diskusijas lietotāju vidū, daži to dēvējuši par uzņēmuma vēršanos pret saviem klientiem, citi to atbalstījuši kā godīguma jautājumu. Daži lietotāji, kā ziņo Business Insider, sociālajā platformā X paziņojuši par abonementa atcelšanu šī iemesla dēļ.
Kā darbojas metode
Anthropic skaidro, ka tad, kad Claude izvēlas starp vairākiem līdzvērtīgiem vārdiem — piemēram, aprakstot laikapstākļus kā "apmācies" vai "pelēks" — tas var izveidot lasītājam neredzamu, bet ar īpašu atslēgu nolasāmu vārdu izvēles modeli. Uzņēmums uzsver, ka ūdenszīme neietekmē atbildes kvalitāti un lasītājam nav pamanāma. Tiks izmantota Google DeepMind 2024. gadā aprakstītā metode SynthID-Text, un Anthropic plāno izlaist arī ūdenszīmes noteikšanas API. Šī pieeja atšķiras no citu uzņēmumu, piemēram, Pangram, izmantotajām metodēm, kas meklē tipiskas mākslīgā intelekta rakstīšanas pazīmes tekstā.
Rediģēšana un programmēšanas kods
Anthropic norāda, ka nelielas teksta rediģēšanas izmaiņas, visticamāk, ūdenszīmi pilnībā nenoņems, savukārt pilnīga teksta pārrakstīšana to izdzēsīs — taču tad rodas jautājums, vai tekstu vēl var uzskatīt par mākslīgā intelekta radītu. Ja Claude tikai korektēs cilvēka rakstītu tekstu, ūdenszīmes noteikšana būs atkarīga no rediģēšanas apjoma un teksta garuma. Programmēšanas kodam ūdenszīme būs mazāk izteikta, jo modelim jārada funkcionējošs kods ar mazāku izvēles brīvību, tomēr komentāros tā var būt klātesoša. Anthropic piebilda, ka arī citi lielie mākslīgā intelekta izstrādātāji, kas parakstījuši to pašu kodeksu, ieviesīs līdzīgas ūdenszīmju sistēmas.


