В ерата на генеративния изкуствен интелект разграничаването между човешкия текст и този, създаден от машина, става все по-трудно. За да се справи с този проблем, Anthropic въвежда иновативен подход за маркиране на съдържанието, генерирано от техния модел Claude. Вместо очевидни знаци, компанията залага на „невидим“ воден знак, който да гарантира прозрачност.
За разлика от традиционните методи, които разчитат на метаданни или скрити символи, които лесно могат да бъдат изтрити при простото копиране на текста, новата технология е вградена в самия процес на писане. Това означава, че идентификаторът не е просто добавен към текста, а е част от неговата вътрешна структура.
Механизмът работи чрез фино манипулиране на статистическите вероятности при избора на думи. Когато AI генерира изречение, той често има няколко варианта на думи или фрази с почти еднакво значение. Системата на Claude ще избира определени комбинации по специфичен начин, създавайки математически модел, който е напълно незабележим за човешкото око, но лесно разпознаваем за специализиран софтуер.
Този подход позволява на проверяващите инструменти да определят с висока степен на вероятност дали даден текст е дело на Claude, без да променя качеството или естествения поток на езика. Колкото по-дълъг е текстът, толкова по-ясно става разпознаване на този статистически „подпис“.
Въвеждането на тези механизми не е просто технологичен експеримент, а директен отговор на нарастващите регулаторни изисквания по целия свят. Целта е да се ограничи разпространението на дезинформация и да се осигури пълна яснота за произхода на информацията в дигиталното пространство.
