arrow
返回

Knowledge Graph-Driven Reinforcement Learning for Zero-Shot Vision-Language Navigation

delete2026-04-28
delete0
delete
OA
AI
Z
Zhang, Ye
Z
Zhao, Yandong *
L
Liu, He
T
Tengfei Shi
W
Weitao Jia
L
Li, Shenghong
DOI:10.3390/math14091485delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
为解决视觉-语言导航(VLN)中零样本泛化能力的局限性,本文提出了一种新颖的知识图谱驱动的强化学习方法。该方法在智能体与环境进行实时交互时,在线构建层次化、动态更新的知识图谱,将外部语义先验与连续视觉感知无缝对齐。通过利用思维链(CoT)提示机制,智能体执行多跳推理以精确定位目标物体。此外,我们设计了一个端到端优化的强化学习框架,融合多模态特征并采用任务导向的复合奖励函数。在AI2-THOR仿真环境中的大量实验表明,所提出的方法显著提高了零样本设置下的导航成功率。结果表明其具有良好的泛化能力,尤其适用于未见过的物体类别和复杂场景布局。
Keyword:
embodied AI
Vision-Language Navigation
reinforcement learning
knowledge graph
Chain-of-Thought

期刊

Mathematics 封面图
Mathematics
IF:
2.2
论文数:
3.1K
被引数:
3.6W

机构

T
taiyuan university of technology
学者数:
6.8K
论文数: 2.1K
被引数: 0
引用论文

引用论文

Hierarchical Object-to-Zone Graph for Object Navigation
err2021-10-01
err0
errOAAI
errSixian Zhang; Xinhang Song; Yubing Bai; Weijie Li; Yakui Chu; Shuqiang Jiang
err分享
err收藏
End-to-End Object Detection with Transformers使用Transformers进行端到端对象检测
err2020-11-03
err0
PREAI
errNicolas Carion; Francisco Massa; Gabriel Synnaeve; Nicolas Usunier; Alexander Kirillov; Sergey Zagoruyko
err分享
err收藏
Visual Object Search by Learning Spatial Context
err2020-04-01
err0
PREAI
errRaphael Druon; Yusuke Yoshiyasu; Asako Kanezaki; Alassane Watt
err分享
err收藏
err分享
err收藏
err分享
err收藏
err分享
err收藏
学者 查看更多内容