Главная / Новости / Индустрия
Индустрия18.09.2026, 00:33 МСКarstechnica.com

LLMs respond differently to harmful prompts when AI watermarking is used

LLMs respond differently to harmful prompts when AI watermarking is used

SynthID может заставить модели выполнять вредные инструкции, которые они в противном случае откажутся выполнять.

Материал собран автоматически из открытых RSS-источников. Пересказ приведён в информационных целях в соответствии со ст. 1274 ГК РФ с указанием первоисточника; полное воспроизведение не осуществляется. Мнения авторов оригинала не обязательно отражают позицию ООО «АЛТЕЯ». Все источники проверены по реестру СМИ-иноагентов Минюста РФ (255-ФЗ).

Мы используем файлы cookie для корректной работы сайта и сбора анонимной статистики посещаемости через сервис Яндекс Метрика (счётчик № 111617896, серверы в РФ). Продолжая использование сайта, вы даёте согласие на обработку персональных данных в соответствии с 152-ФЗ и принимаете пользовательское соглашение.