Anthropic нашла способ разоблачать тексты Claude: пользователь ничего не заметит

Wait 5 sec.

Стартап выполняет требования законодательства ЕС Anthropic объяснила, как Claude обозначает текст, созданный ИИ. Система должна помочь отличать ответы чат-бота от текста, написанного человеком, и отвечать новым требованиям ЕС.Об этом пишет РБК-Украина со ссылкой на Anthropic.Как работать водяные знаки и защита анонимности?Для реализации маркировки Anthropic выбрала алгоритм SynthID-Text, ранее разработанный командой Google DeepMind.Как он работает?Принцип синтаксического выбора: при создании текста модель выбирает между синонимическими словами (например, "облачно" или "мрачно") на основе специального ключа генерации случайных чисел. Это образует скрытый математический паттерн.Отсутствие визуальных изменений: водяной знак полностью незаметен читателю, не добавляет скрытых символов или дополнительных токенов и не влияет на скорость генерации или стоимость услуг.Конфиденциальность: заверения разработчиков свидетельствуют, что паттерн не содержит персональных данных пользователей, информации об организациях или истории конкретных диалогов.C2PA для мультимедиа: для изображений и файлов (форматы .png, .jpg, .svg) будут использоваться криптографические метаданные стандарта C2PA без изменения самого содержимого.Читайте больше: Опасный сбой в ИИ: Claude проник в чужие системы, воспринимая их за симуляциюУстойчивость к редактированию и специфика работы с кодомПредставители Anthropic отдельно очертили границы применения и алгоритмические особенности технологии в разных рабочих сценариях.Редактирование и перефразирование: незначительное редактирование текста человеком не удалит водяной знак полностью. В то же время полная переписка с заменой каждого слова полностью уничтожает маркировку.Требования к точности и код: в ситуациях, где требуется строгая точность (фактические данные или программный код), водяной знак почти не применяется, поскольку модель не имеет свободы выбора синонимов.Исключение могут быть только произвольные названия переменных или комментарии в коде.Проверка наличия: компания планирует запустить специальный API для детекции водяных знаков.Инструмент будет определять только вероятность участия Claude в создании текста, но не будет идентифицировать автора или факт полного написания текста или кода человеком.Еще больше интересного:Claude будет оставлять невидимый след в текстах: его смогут распознать другие системы150-летняя загадка на миллион долларов: ИИ Anthropic испытал 650 идей