Компания Anthropic объявила о внедрении системы маркировки для текстов и изображений, создаваемых её языковой моделью Claude. Это шаг навстречу требованиям Европейского союза, который стремится обеспечить прозрачность происхождения контента, генерируемого искусственным интеллектом. Маркировка будет незаметной для обычных пользователей, но позволит специальным инструментам определять, что материал создан нейросетью.
Как будет работать маркировка текстов
Для текстов Claude будет использовать так называемый «статистический шаблон». Во время генерации модель будет незаметно изменять вероятность выбора отдельных токенов — элементов текста. В результате в готовом тексте образуется определённый статистический рисунок, который можно выявить при последующем анализе. По заявлению Anthropic, даже если текст скопировать и слегка отредактировать, этот признак сохранится.
Однако у технологии есть ограничения: короткие фрагменты текста не смогут быть надёжно маркированы. Это означает, что для небольших отрывков определение происхождения может быть затруднено. Тем не менее, для полноценных статей и других объёмных материалов метод должен работать эффективно.
Маркировка изображений и планы на будущее
Для изображений подход будет иным. Claude будет добавлять к файлам данные о происхождении с использованием стандарта C2PA. Это означает, что каждый файл получит цифровой сертификат, который станет недействительным, если изображение будет изменено. Таким образом, можно будет проверить, было ли изображение создано ИИ и не подвергалось ли оно модификациям.
Примечательно, что Anthropic пока не упомянула о внедрении пиксельной водяной маркировки, которая также предусмотрена требованиями ЕС. Возможно, компания планирует добавить её позже. Сейчас Anthropic работает над интеграцией этих функций в существующие модели Claude. Маркировка будет применяться ко всем поддерживаемым моделям во всех странах, где доступен Claude, а не только в Евросоюзе.
Компания также обязалась предоставить инструменты для обнаружения таких меток, однако подробности обещает раскрыть позднее. Это важный шаг в сторону большей прозрачности в области ИИ-контента, который может повлиять на индустрию в целом.

Комментарии
Оставляйте комментарии, отвечайте другим пользователям и добавляйте быстрые реакции.