Когда Сценический текст привносит сцену: некрытая, эксплуатация и Смягчение рендерд-Текта Семантической утечки в модели поколения изображений
arXiv: 261 0.111286v1 Сообщение типа: новое резюме: надежность и подотчетность моделей регенерации изображения (МГМ) имеют важное значение для создания ответственных и надежных систем АИ. Последние МГМ, такие как Нано Банана и GPT-Immage, теперь поддерживают сложные инструкции после, реалистичное синтезирование изображений и контролируемую трансляцию текста сцен. По мере расширения этих возможностей при анализе безопасности необходимо также учитывать новые каналы контроля, вводимые сложными сигналами. В этой работе мы изучаем трансформированную семантическую утечку текста, явившуюся в значительной степени недооцененным явлением при отображении текстов открытого домена. Хотя переведенный текст призван служить местным визуальным ограничением, которое должно быть воспроизведено дословно в генерируемом имидже, он также содержит языковую семантику, которая может толковаться моделью как часть вводной инструкции. Это делает текст потенциальным каналом семантического контроля, последствия которого для безопасности остаются недостаточно понятными. Мы систематически характеризуем это явление по принципу " дикауплин &qt;