/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F434%2F72200215bb34b11991ff0923f564601d.jpg)
Anthropic розповів як працюватимуть нові водяні знаки Клода
Anthropic опублікував допис у блозі, намагаючись відповісти на деякі основні питання про те, як він додаватиме водяний знак до тексту, згенерованого його чат-ботом Claude. Наприклад: Як насправді працюватиме водяний знак? Чи можна його приховати за допомогою редагування? І як це впливає на код?
Користувачі Claude обговорюють цей крок з того часу, як компанія на початку цього тижня оголосила , що використовуватиме цей водяний знак для дотримання Кодексу прозорості Закону ЄС про штучний інтелект, який вимагає від компаній, що займаються штучним інтелектом, використовувати системи, що дозволяють ідентифікувати контент, створений штучним інтелектом.
Наприклад, на Reddit один користувач охарактеризував це як змову проти невинних користувачів Claude , тоді як інший заявив: «Єдина причина, чому ви б цього не хотіли, — це брехати людям». А Business Insider повідомляє , що «десятки» користувачів X заявили, що в результаті скасували свої підписки на Claude.
Нова публікація Anthropic починається із загального огляду концепції водяних знаків, пояснюючи, що під час «вибору з низькими ставками» — наприклад, вибору між словами «похмурий» та «сірий» для опису погоди — Клод може створити шаблон у своїх відповідях, який «непомітний для читача, але помітний для будь-кого, хто має ключ, який його кодує».
«Водяні знаки не впливають на якість роботи Клода», – заявила компанія. «Для читача відповідь із водяним знаком не відрізняється від відповіді без водяного знака».
Більш конкретно, Anthropic заявила, що використовуватиме підхід SynthID-Text, який команда Google DeepMind окреслила у 2024 році , і що планує випустити API для виявлення водяних знаків. Вона також зазначила, що водяні знаки відрізняються від підходів до виявлення за допомогою штучного інтелекту, пропонованих такими компаніями, як Pangram , які шукають «підказки» в тексті (наприклад, конструкція «це не [X], це [Y]»), щоб виявити використання ШІ: «Виявлення цих шаблонів принципово відрізняється від перевірки на наявність водяного знака».
Чи міг би хтось просто переписати текст, щоб приховати водяний знак? Anthropic сказав, що це можливо, але «легке редагування, ймовірно, не видалить водяний знак повністю», тоді як «повне переписування, де замінено кожне слово, зробить це».
Щодо того, чи буде водяний знак помітним у тексті, який був лише вичитаний або відредагований Клодом, Anthropic зазначив, що це залежатиме від «довжини тексту та того, наскільки сильно Клод його редагував». Якщо він був лише злегка відредагований, «майже всі слова» будуть написані автором-людиною, і «буде дуже мало (якщо взагалі щось) для водяного знака».
Тим часом код повинен мати менше водяного знака, ніж інший текст, оскільки модель потребуватиме створення робочого коду та не матиме свободи вибору між різноманітними однаково допустимими варіантами.
«З огляду на це, в областях, де є довільний вибір між певними словами чи термінами в коді, водяний знак можна використовувати, наприклад, як коментарі в коді», — сказав Anthropic. «Але за визначенням він матиме незначний вплив на фактично створений код».
Anthropic також зазначила, що Клод не буде єдиним чат-ботом зі штучним інтелектом, який генеруватиме текст із водяними знаками, оскільки «інші великі розробники моделей підписали той самий Кодекс практики та впроваджуватимуть власні водяні знаки».