Головні звуки українського ІТ. Вгадаєш всі? 👉

У відкритому доступі з’явився інструмент, що видаляє водяні знаки для ШІ-згенерованого контенту. Як він працює?

У відкритому доступі з’явився Watermarks Remover — інструмент, який намагається прибрати з текстів, зображень і документів сліди того, що контент створював або обробляв ШІ.

Залишити коментар
У відкритому доступі з’явився інструмент, що видаляє водяні знаки для ШІ-згенерованого контенту. Як він працює?

У відкритому доступі з’явився Watermarks Remover — інструмент, який намагається прибрати з текстів, зображень і документів сліди того, що контент створював або обробляв ШІ.

Інструмент опублікував користувач Guillaume Meyer.

Найпростішим методом маркування можуть бути незвичайні пробіли чи Unicode-символи, яких людина на екрані не бачить, але які залишаються всередині тексту. Watermarks Remover їх знаходить і видаляє. Ще один тип «слідів» може ховатися вже не в самому тексті чи картинці, а всередині файлу. Наприклад, файли PNG або JPEG можуть містити метадані з інформацією про походження контенту та його редагування. Watermarks Remover уміє чистити такі дані з PNG, JPEG, WebP, SVG, PDF, DOCX та інших форматів. 

Але коли водяний знак ховається не в невидимих символах чи в метаданих, прибирання водяних знаків ускладнюється. 

Сьогодні dev.ua писав, що компанія Anthropic розповіла, що буде використовувати саме про такий спосіб маркування. Отже, Claude не вставляє в текст секретний символ чи метадані. Натомість модель трохи змінює те, які слова обирає під час генерації. Для читача текст виглядає звичайно. Але у великому фрагменті виникає статистичний патерн, який спеціальний детектор може розпізнати за секретним ключем. 

Наприклад, Claude пише: «Сьогодні було холодно і…». Продовжити можна і словом «похмуро», і словом «хмарно» — обидва варіанти звучать природно, тому для змісту не так важливо, який саме обере модель. Зазвичай у таких ситуаціях вибір частково визначає випадковість. Але тепер умовний рандомайзер починає працювати за правилами, які задає секретний ключ. Тож у згаданому сценарії, наприклад, ключ може поставити ймовірність «випадіння» слова «хмарно» — 85%. Якщо таких співпадінь у тексті буде багато, він буде маркуватися як «оброблений ШІ». 

Тому Watermarks Remover пропонує переписання тексту за допомогою локальної LLM. Передбачається, що якщо маркування полягає в тому, які слова початкова модель обирала одне за одним, то після достатньо сильного перефразування ця послідовність зміниться. Це й може зламати статистичний патерн. Щоправда, розробник не гарантує обхід детекторів. Адже без самого детектора та секретного ключа неможливо перевірити, чи мітка справді зникла. 

Сама компанія Anthropic також зазначає, що її водяний знак не є невразливим, адже сильне редагування може його видалити. 

Раніше dev.ua писав, що OpenAI запустила інструмент для визначення зображень, створених DALL-E 3. 

Як працюють водяні знаки Claude: нові подробиці від Anthropic
Як працюють водяні знаки Claude: нові подробиці від Anthropic
По темi
Як працюють водяні знаки Claude: нові подробиці від Anthropic
Тексти Claude отримають невидимі водяні знаки.  Хто зможе їх перевірити і що вони означають?
Тексти Claude отримають невидимі водяні знаки. Хто зможе їх перевірити і що вони означають?
По темi
Тексти Claude отримають невидимі водяні знаки. Хто зможе їх перевірити і що вони означають?
Читайте головні IT-новини країни в нашому Telegram
Читайте головні IT-новини країни в нашому Telegram
По темi
Читайте головні IT-новини країни в нашому Telegram

Хочете повідомити важливу новину? Пишіть у Telegram-бот

Головні події та корисні посилання в нашому Telegram-каналі

Обговорення
Коментарів поки немає.