Sakhanda Wire
NVDA $229.57 -0.39% MSFT $534.30 +2.24% GOOGL $351.78 +1.00% META $722.98 +0.29% AMZN $260.18 +2.41%
← К новостям

Anthropic объясняет, как будут работать невидимые водяные знаки в тексте Claude

Возьмём предложение «Сегодня погода была холодной и…». Следующим словом с очень низкой вероятностью будет «сладкой». Но вполне вероятно, что это будет «пасмурной» или «серой». В большинстве случаев читателю не столь важно, какое из этих двух последних слов в итоге выберет модель, — смысл предложения в любом случае в основном остаётся тем же. В подобных случаях выбор определяется случайным числом.

Водяные знаки используют такие незначимые варианты выбора — они возникают множество раз в тексте, сгенерированном моделью, — чтобы оставлять в ответах Claude определённый паттерн. Читатель его не заметит, но его может обнаружить любой, у кого есть ключ, кодирующий этот паттерн. При использовании водяного знака выбор по-прежнему делается случайным образом, но источник случайности меняется. Вместо того чтобы использовать произвольный генератор случайных чисел для выбора следующего слова, водяной знак использует ключ и несколько предшествующих слов, чтобы определить, какое слово должна выбрать модель.

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием The Verge

Читать оригинал на The Verge ↗

Текст и изображения принадлежат The Verge и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости