Исследовательница из компании Lasso Security обнаружила , что водяные знаки SynthID-Text могут влиять на безопасность больших языковых моделей. В некоторых случаях после включения маркировки контента LLM соглашались выполнять вредоносные инструкции, которые отклоняли без SynthID. Сильнее всего этот эффект проявился при атаках с использованием промпт-инжектов. Технология SynthID-Text была разработана специалистами Google, которые открыли ее исходный код. Вскоре ее планируют применять в моделях Claude, так как компания Anthropic внедряет маркировку ИИ-контента в связи с новым законодательством Евросоюза. По сути, SynthID-Text позволяет внедрить водяной знак в текст прямо в процессе его генерации