arrow
返回

Interactive Visual Assessment for Text-to-Image Generation Models

delete2026-01-28
delete0
PRE
AI
X
Xiaoyue Mi
唐
唐帆 (Fan Tang)
J
Juan Cao
Q
Qiang Sheng
Z
Ziyao Huang
黎
黎鹏 (Peng Li)
Y
Yang Liu
T
Tong‐Yee Lee
DOI:10.1109/TVCG.2026.3658714delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
视觉生成模型在计算机图形学应用中取得了显著进展,但在实际部署中仍面临重大挑战。当前视觉生成任务的评估方法通常遵循孤立的三阶段框架:测试输入收集、模型输出生成和用户评估。这些方法存在固定覆盖范围、难度演变和数据泄露风险等问题,限制了其全面评估日益复杂的生成模型的有效性。为解决这些局限性,我们提出DyEval,一个基于LLM的动态交互式视觉评估框架,该框架促进人与生成模型在文本到图像系统中的协作评估。DyEval具有直观的视觉界面,使用户能够交互式地探索和分析模型行为,同时根据反馈自适应地生成分层、细粒度和多样化的文本输入,以持续探测模型的能力边界。此外,为向用户提供可解释的分析以进一步改进测试模型,我们开发了一个上下文反思模块,该模块挖掘测试输入的失败触发因素并反映模型的潜在失败模式,利用LLM的逻辑推理能力支持深入分析。定性和定量实验表明,DyEval能有效帮助用户比传统方法多识别高达2.56倍的生成失败案例,并揭示复杂且罕见的失败模式,如代词生成问题和特定文化背景生成问题。我们的框架为改进生成模型提供了有价值的见解,并对推动视觉生成系统在各个领域的可靠性和能力提升具有广泛意义。
Keyword:
Visual assessment
dynamic testing
large language model
in-context learning
human-computer interaction

期刊

IEEE Transactions on Visualization and Computer Graphics 封面图
IEEE Transactions on Visualization and Computer Graphics
IF:
6.5
论文数:
346
被引数:
2.2W

机构

N
national cheng kung university
学者数:
3.6K
论文数: 1.4K
被引数: 0
T
tsinghua university
学者数:
11.9W
论文数: 10.0W
被引数: 137
C
Chinese Academy of Sciences
学者数:
3.9W
论文数: 1.5W
被引数: 58.4W
学者 查看更多机构
引用论文

引用论文

AGIQA-3K: An Open Database for AI-Generated Image Quality Assessment
err2024-08-01
err0
errOAAI
errChunyi Li; Zicheng Zhang; Haoning Wu; Wei Sun; Xiongkuo Min; Xiaohong Liu; Guangtao Zhai; Weisi Lin
err分享
err收藏
A Comprehensive Evaluation of Arbitrary Image Style Transfer Methods
err2025-09-01
err0
PREAI
errZhou,Zijun; Tang,Fan; Zhang,Yuxin; Deussen,Oliver; Cao,Juan; Dong,Weiming; Li,Xiangtao; Lee,Tong-Yee
err分享
err收藏
err分享
err收藏
学者 查看更多内容