返回
Generating vision-language navigation instructions incorporated fine-grained alignment annotations
DOI:10.1016/j.inffus.2025.104107.png)
摘要
En 中文
• 生成具有精细跨模态对齐的VLN指令的框架。
• FCA-R2R,首个带有精细对齐标注的大规模VLN数据集。
• FCA-R2R显著提升了VLN智能体的性能。
期刊
IF:
15.5
论文数:
4.2K
被引数:
2.7W

