З’явився загальнодоступний інструмент, здатний усувати водяні знаки з контенту, створеного штучним інтелектом. Який механізм його роботи?

У відкритому доступі з’явився Watermarks Remover — програма, яка намагається усунути з текстів, зображень та документів ознаки того, що контент був створений або модифікований штучним інтелектом.

Залишити коментар

У відкритому доступі з’явився інструмент, що видаляє водяні знаки для ШІ-згенерованого контенту. Як він працює?

У відкритому доступі з’явився Watermarks Remover — програма, яка намагається усунути з текстів, зображень та документів ознаки того, що контент був створений або модифікований штучним інтелектом.

Програму опублікував користувач Guillaume Meyer.

Найпростішим способом маркування можуть бути нестандартні пробіли або Unicode-символи, які людина на екрані не бачить, але які залишаються всередині тексту. Watermarks Remover їх виявляє та усуває. Ще один тип «слідів» може бути прихований не в самому тексті чи зображенні, а всередині файлу. Наприклад, файли PNG або JPEG можуть містити метадані з інформацією про джерело контенту та його редагування. Watermarks Remover вміє очищати такі дані з PNG, JPEG, WebP, SVG, PDF, DOCX та інших форматів. 

Однак, коли водяний знак прихований не в невидимих символах чи метаданих, усунення водяних знаків стає складнішим. 

Сьогодні dev.ua повідомляв, що компанія Anthropic заявила, що буде використовувати саме такий спосіб маркування. Отже, Claude не вбудовує в текст секретний символ чи метадані. Натомість модель дещо змінює вибір слів під час генерації. Для читача текст виглядає звично. Але у великому уривку виникає статистичний патерн, який спеціальний детектор може розпізнати за секретним ключем. 

Наприклад, Claude пише: «Сьогодні було прохолодно і…». Продовжити можна як словом «похмуро», так і словом «хмарно» — обидва варіанти звучать природно, тому для суті тексту не настільки важливо, який саме вибере модель. Зазвичай у таких ситуаціях вибір частково визначається випадковістю. Але тепер умовний генератор випадкових чисел починає працювати за правилами, встановленими секретним ключем. Тож у згаданому сценарії, наприклад, ключ може встановити ймовірність «випадання» слова «хмарно» — 85%. Якщо таких збігів у тексті буде багато, він буде маркуватися як «оброблений ШІ». 

Тому Watermarks Remover пропонує переписування тексту за допомогою локальної LLM. Передбачається, що якщо маркування полягає у виборі слів початковою моделлю одне за одним, то після достатньо значного перефразування ця послідовність зміниться. Це й може зруйнувати статистичний патерн. Щоправда, розробник не гарантує обхід детекторів. Адже без самого детектора та секретного ключа неможливо перевірити, чи мітка справді зникла. 

Сама компанія Anthropic також зазначає, що її водяний знак не є невразливим, адже сильне редагування може його видалити. 

Раніше dev.ua повідомляв, що OpenAI випустила інструмент для визначення зображень, створених DALL-E 3. 

Source: dev.ua

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *