Мирослав Трінько Випусковий редактор новин на "Межі". Geek, програміст за спеціальністю, але журналіст за професією. Вершник, тенісист та фанат Формули-1. Пишу про технології, бізнес, ШІ, смартфони та електромобілі. 17 серпня, 09:10 0
Anthropic оприлюднила подробиці нової системи маркування для контенту, що генерується чат-ботом Claude. Компанія заявила, що технологія не зашкодить якості відповідей і буде непомітною для звичайного читача, проте спеціальний механізм з ключем зможе ідентифікувати наявність такого маркування.
Впровадження водяних знаків Anthropic здійснює задля відповідності вимогам Європейського кодексу прозорості щодо ШІ. Цей кодекс передбачає використання інструментів, які дають змогу розпізнавати контент, створений штучним інтелектом.
Компанія застосовуватиме підхід SynthID-Text, який був розроблений командою Google DeepMind і представлений у 2024 році. Anthropic також має намір випустити API, що дозволить перевіряти тексти на наявність прихованих позначок.
Принцип дії полягатиме у виявленні певних закономірностей у тексті. Наприклад, коли Claude має можливість обирати між декількома словами з тотожним значенням, система може використовувати ці “низькоризикові” вибори для формування прихованого візерунка. Для читача текст із таким маркуванням не буде відрізнятися від стандартного.
При цьому, водяний знак може бути частково або повністю усунутий шляхом редагування. Anthropic стверджує, що незначні правки, ймовірно, не призведуть до повного його видалення. Натомість, повне переписування тексту зі зміною майже кожного слова дозволить позбутися маркування.
Якщо Claude лише незначно відредагував матеріал, написаний людиною, ідентифікувати водяний знак буде складніше. За словами представників компанії, у такому випадку більшість слів залишаються оригінальними, тому системі практично немає на чому формувати позначку.
Щодо програмного коду, водяний знак буде менш вираженим. Це пояснюється тим, що під час генерації коду модель має обмежені можливості вибору між рівнозначними варіантами. Водночас, маркування може бути застосоване до таких елементів, як коментарі.
Anthropic також наголосила, що Claude не буде єдиним чат-ботом зі штучним інтелектом, який використовуватиме водяні знаки. Інші великі розробники моделей, які підписали відповідний європейський Кодекс практики, також планують впроваджувати власні системи маркування.
До слова, така зміна не була сприйнята всіма користувачами позитивно. Деякі з них висловили невдоволення на Reddit, назвавши нові водяні знаки методом стеження за користувачами та безпідставного звинувачення. Інші вважають таке маркування лицемірним, особливо враховуючи, що сам Claude створює контент, використовуючи технології, розроблені іншими компаніями.
Джерело новини: mezha.ua
