研究揭示图像生成模型渲染文本语义泄漏现象
Get the story
2026年10月9日,arXiv 计算机视觉论文《场景文本劫持场景:揭示、利用并缓解图像生成模型中的渲染文本语义泄漏》提出“渲染文本语义泄漏”现象:图像生成模型会把待渲染文本当作指令语义理解,而不仅是逐字复现的视觉约束。研究将主视觉提示词与渲染文本解耦,量化语义泄漏与渲染保真度,发现有害语义可经 LLM 提示词增强管道残留并引导非文本区域,即使主提示词无害。论文在 FLUX-2-dev 上给出初步缓解方案,降低不安全语义迁移且保留预期文本渲染。
Generated from reports · updated 3 hr ago
Timeline
Follow the coverage from different angles.
- arXiv · Computer Vision场景文本劫持场景:揭示、利用并缓解图像生成模型中的渲染文本语义泄漏
研究提出“渲染文本语义泄漏”现象:图像生成模型会把待渲染文本当作指令语义理解,而不仅是逐字复现的视觉约束。论文将主视觉提示词与渲染文本解耦,量化语义泄漏与渲染保真度,发现有害语义可经 LLM 提示词增强管道残留并引导非文本区域,即使主提示词无害。研究在 FLUX-2-dev 上给出初步缓解方案,降低不安全语义迁移且保留预期文本渲染。
Heat trend
Current heat 9·Comparable peak 10(Oct 9)·Comparable change over 24 hours –
The trend compares only the same participants observed continuously; its range may be smaller than the current heat count. Move or click on the chart to inspect hourly heat; use the left and right arrow keys to switch.