Anthropic пояснила механізм невидимого водяного знака у текстах Claude

Anthropic розкрила принцип роботи невидимого водяного знака для текстів, згенерованих Claude. Технологія має допомогти визначати ШІ-контент і відповідає вимогам Закону ЄС про штучний інтелект.
Компанія Anthropic опублікувала пояснення щодо функціонування невидимого водяного знака, який маркуватиме тексти, створені її мовною моделлю Claude. Розробка покликана полегшити ідентифікацію ШІ-генерованого контенту та узгоджується з нормами європейського регулювання у сфері штучного інтелекту.
Водяний знак не буде видимим для читача, оскільки він не використовує спеціальні символи чи заміну слів. Натомість маркування відбувається на рівні вибору токенів — невеликих фрагментів тексту, які модель обирає під час генерації. У випадках, коли можливі кілька варіантів продовження речення, система може статистично віддавати перевагу певним токенам, а сам принцип вибору визначається секретним ключем Anthropic.
Наприклад, описуючи погоду, модель може обирати між словами «сірий» і «похмурий», надаючи перевагу одному з них. Проте у випадках, коли відповідь очевидна, як-от «Париж — столиця…», застосування водяного знака ускладнюється через брак варіативності.
Окремі подібні вибори непомітні для людини, але в довгих текстах їх накопичується достатньо, щоб спеціальний детектор міг визначити ймовірне походження матеріалу від Claude. Anthropic планує надавати цей інструмент через API.
За даними компанії, впровадження водяного знака майже не впливає на швидкість генерації та витрати токенів. Водночас у коротких текстах і програмному коді визначення походження може бути складнішим через меншу кількість неоднозначних варіантів. Система здатна спрацьовувати навіть тоді, коли Claude використовується лише для редагування людського тексту, а помітність сліду залежить від обсягу матеріалу та ступеня змін.
Технологія базується на підході, описаному в дослідженні SynthID 2024 року. Подібну систему маркування контенту вже використовує Google.
Пояснення з’явилося після того, як частина користувачів Claude у соцмережі X заявила про скасування платних підписок через нововведення. Деякі вказували, що не хочуть, аби клієнти, викладачі чи інші особи могли визначити використання ШІ. Водночас Anthropic повідомила Business Insider, що після оголошення про водяні знаки не зафіксувала зростання кількості скасувань підписок.
Читайте також
Ще в розділі «Штучний інтелект»
- Google випустила Gemini 3.7 Flash: вдвічі дешевша та продуктивніша
- Apple платитиме медіа за цитування в Siri: нова модель оплати
- Google пояснив помилкові дані про смерть Сема Альтмана у пошуку
- Google представила Gemini 3.7 Flash: швидкість і точність для щоденних задач
- Застосунок Gemini перетнув позначку в мільярд користувачів щомісяця






