Нові водяні знаки від Anthropic зникли за кілька днів: розробники вже представили програми для їх очищення.

Фото до статті

Дмитро Сімагін

Заступник головного редактора

Нещодавно компанія Anthropic впровадила метод прихованого маркування для текстів та коду, створених їхньою мовною моделлю Claude. Практично одразу після цього розробка стикнулася з протидією. В мережі вже з’явилися сервіси, які пропонують видаляти ці позначки, а запит на подібні інструменти стрімко зростає.

Згідно з даними Business Insider, пошуковий запит “AI watermark remover” за останній тиждень збільшив свою популярність у Google Trends у США на 60%. Водночас з’явилося кілька проєктів, які декларують можливість ослаблення або повного усунення маркування з текстів та файлів, створених штучним інтелектом.

П’ять годин роботи — і 15 тисяч зірок на GitHub

Один з найпомітніших прикладів — це відкритий проєкт Watermarks Remover, ініційований французьким підприємцем Гійомом Мейєром. За його словами, створення першої робочої версії інструменту зайняло приблизно п’ять годин. Незважаючи на короткий термін розробки, проєкт вже здобув понад 15 тисяч зірок на GitHub.

Технічно інструмент працює у два етапи:

  • Вилучення прихованих символів та метаданих з тексту.
  • Переписування тексту з метою руйнування статистичної закономірності вибору слів, яка лежить в основі технології водяних знаків Anthropic.

Сам розробник чесно зазначає, що інструмент не надає гарантії повного видалення позначки.

Критика спрямована не проти маркування, а проти конкретної технології

Мейєр підкреслює, що він не заперечує ідею зазначення походження контенту. Його претензії стосуються саме способу реалізації, запропонованого Anthropic. На думку розробника, поточний підхід компанії надмірно спрощує складне питання авторства, адже подібна позначка може з’явитися як у тексті, повністю згенерованому машиною, так і в матеріалі, який людина суттєво відредагувала, залишивши лише частку початкового чорновика від ШІ.

Раніше Anthropic пояснювала публічно: система маркування була розроблена не для однозначного визначення авторства тексту. Мета інструменту — оцінити ймовірність участі Claude у створенні матеріалу, а не видати остаточний вердикт.

Другий інструмент з’явився в день анонсу функції

Ще один розробник, Анш Анеджа, діяв ще швидше за Мейєра. Він представив власний засіб для видалення водяних знаків Claude того ж дня, коли Anthropic анонсувала функцію маркування. Пізніше Анеджа опублікував локальну відкриту версію свого інструменту під назвою MarkScrub. За його даними, лише за перші 24 години сервісом скористалися 8,5 тисяч осіб.

Наскільки надійні ці рішення — поки невідомо

Незалежних тестів ефективності подібних «ластиків» наразі не проводилося. Дослідник ETH Zurich Тібо Глоаген вказує на принципову вразливість самої концепції водяних знаків: якщо текст переписати достатньо радикально, статистичний патерн, що підтримує маркування, руйнується сам собою — незалежно від конкретного інструменту.

Правовий статус таких сервісів ще не визначений остаточно. Закон ЄС про штучний інтелект (AI Act) зобов’язує розробників моделей забезпечувати стійкість маркування до видалення та модифікації, але прямо не забороняє стороннім розробникам створювати інструменти для його усунення.

Проте, використання подібних сервісів з метою видати згенерований ШІ текст за створений людиною може порушувати внутрішні правила самої Anthropic, оскільки політика компанії прямо забороняє представляти результати роботи моделі як людську працю.

Нагадаємо, кілька днів тому компанія Anthropic надала роз’яснення щодо принципу роботи водяного знака в текстах і коді Claude.

Головна > Новини > Водяні знаки Anthropic протрималися лічені дні: розробники вже випустили інструменти для їх видалення

Джерело

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *