НОВИНИ IT-PUB

Anthropic пояснила, як Claude маркуватиме текст

17.08.2026 11:03 • Автор: IT-PUB
Anthropic пояснила, як Claude маркуватиме текст

Anthropic розкрила деталі watermarking для Claude через вимоги ЄС. Компанія каже, що мітки не зіпсують текст, але повне переписування їх прибере.

Anthropic опублікувала нові подробиці про те, як Claude маркуватиме згенерований ним текст. Компанія відповіла на запитання, що з’явилися після анонсу цього тижня: чи можна буде приховати мітку після редагування, як це працюватиме з кодом і чи вплине механізм на якість відповіді. Тема швидко вийшла за межі суто технічного пояснення. Йдеться і про вимоги ЄС до прозорості ШІ, і про помітне невдоволення частини користувачів Claude.

Рішення одразу привернуло увагу, бо стосується не лише самого чатбота, а й того, як компанії позначатимуть AI-контент у майбутньому. Частина користувачів Claude вже публічно критикувала зміни, а дехто заявив про скасування підписки.

Anthropic прив’язує watermarking до вимог EU AI Act

У Anthropic пояснили, що впроваджують watermarking, аби відповідати EU AI Act’s Transparency Code. Цей кодекс вимагає від компаній, які працюють зі штучним інтелектом, використовувати системи, що дають змогу ідентифікувати контент, створений ШІ.

Після оголошення цієї вимоги в спільноті Claude почалися суперечки. На Reddit один користувач назвав це змовою проти «невинних» користувачів Claude, тоді як інший заявив, що єдина причина не хотіти такого маркування — бажання обманювати людей. Business Insider також повідомив, що «десятки» користувачів на X заявили про скасування своїх підписок на Claude через це рішення.

Новий пост Anthropic важливий не лише як технічне уточнення. Компанія фактично намагається одночасно виконати регуляторні вимоги й заспокоїти користувачів, які бояться, що новий механізм змінить роботу Claude.

Claude вбудовуватиме невидимий патерн у відповіді

Anthropic описує watermarking як підхід, за якого Claude під час створення «низькоризикових» варіантів тексту може формувати у відповіді певний патерн. Компанія навела приклад із вибором між словами на кшталт «overcast» і «grey» для опису погоди.

За словами Anthropic, така мітка буде «недетектованою для читача», але її зможе виявити той, хто має спеціальний ключ, який кодує цей патерн. Як повідомляють Новини IT-PUB, компанія також окремо наголосила, що watermarking не має впливати на якість відповідей Claude: для читача watermarked response буде «не відрізнити» від тексту без мітки.

Для цього Anthropic використовуватиме підхід SynthID-Text, який команда Google DeepMind описала у 2024 році. Також компанія планує випустити API для виявлення таких міток.

Anthropic окремо підкреслила, що watermarking — не те саме, що AI detection, яку пропонують деякі інші компанії, зокрема Pangram. Такі системи шукають характерні ознаки в самому стилі написання, тоді як watermarking працює інакше. У компанії прямо зазначили, що виявлення подібних патернів «фундаментально відрізняється» від перевірки водяного знака.

Повне переписування тексту може прибрати мітку

Одне з головних питань після анонсу стосувалося того, чи можна буде сховати watermark, якщо текст переписати або відредагувати. Anthropic визнає: так, це можливо, але не в кожному випадку однаково легко.

У компанії кажуть, що легке редагування, ймовірно, не прибере мітку повністю. Натомість повне переписування тексту, коли замінюється кожне слово, її зітре.

Anthropic додає, що в такому разі вже можна сперечатися, чи доречно взагалі називати такий текст згенерованим ШІ. Саме тут проходить важлива межа в цій дискусії: система має допомагати відстежувати походження тексту, але не перетворюватися на механізм, який неможливо обійти навіть після звичайного редагування.

Компанія також пояснила, що якщо Claude лише вичитує або трохи редагує текст, виявлення мітки залежатиме від його довжини та від того, наскільки глибоко модель втрутилася в матеріал. Якщо редагування було легким, майже всі слова залишаться за людиною, і тоді watermark буде «майже ні до чого» прив’язати.

Для коду watermarking працюватиме менш помітно

Окремо Anthropic пояснила, що для коду watermarking працюватиме інакше. За словами компанії, у коді мітка буде менш помітною, ніж у звичайному тексті, тому що модель має створювати робочий код і не може вільно обирати між багатьма рівнозначними варіантами.

Водночас Anthropic зазначає, що там, де в коді є довільний вибір між словами чи термінами, watermarking усе ж можна застосовувати. Як приклад компанія навела коментарі в коді.

У компанії підкреслили, що в будь-якому разі це матиме «незначний вплив» на сам код. Тобто користувачі не мають побачити погіршення результату, хоча частина текстових елементів у коді може бути позначена.

Інші розробники моделей теж готують свої мітки

Anthropic також дала зрозуміти, що Claude не стане винятком. У компанії заявили, що інші великі розробники моделей підписали той самий Code of Practice і теж впроваджуватимуть власні watermarking-рішення.

Це означає, що маркування згенерованого тексту може поступово стати ширшою практикою, а не лише окремою функцією Claude. Для користувачів це змінює підхід до текстів, створених ШІ, а для бізнесу — до перевірки походження контенту, особливо там, де важлива прозорість.

Реакція на крок Anthropic показує й інше: навіть технічна функція швидко стає предметом суперечки про довіру, контроль і межі використання штучного інтелекту.


Аудит Сайту для малого та середнього бізнесу за $50