arrow
返回

Vision-Based Driver Behavior Recognition using Multi-Modal Deep Learning for Autonomous Vehicles

delete2026-05-01
delete0
PRE
AI
G
Ge, Zhixing *
DOI:10.1142/s1469026826410075delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本研究提出了一种旨在提高自动驾驶车辆安全性与可靠性的多模态驾驶员行为识别框架,该框架利用传感器和视觉数据。框架收集与驾驶员活动相关的惯性信号(加速度计和陀螺仪)及视觉图像以观察驾驶员行为。处理阶段首先通过噪声滤波、归一化和插值预处理惯性数据,随后采用短时傅里叶变换(STFT)和连续小波变换(CWT)提取特征,生成互补的时间-频率数据表示。对于视觉数据,先进行对比度增强和归一化,再利用Vision Transformer(ViT)获取空间嵌入。两种模态的特征通过Swin Transformer进行编码以捕捉局部和全局依赖关系,然后通过交叉注意力和通道注意力组合进行融合,以增强特征交互。融合后的表示通过ResNet-18进行处理,生成最终行为表示,分为9个类别。实验结果表明,该框架在准确率、F1分数、召回率和精确率均超过99.6%,误报率和漏报率极低,展现出其鲁棒性及在自动驾驶系统驾驶员监控中的应用潜力。STFT与CWT的组合在频域提供了多样化的固定和多分辨率表示,而ViT与Swin Transformer的集成进一步深化了时空编码,较以往的多模态方法更为深入;ResNet-18分类器的应用增强了判别融合能力,使得行为识别比现有任何单分支或双分支系统组合都更为可信。
Keyword:
Multi-modal learning
driver behavior recognition
Vision Transformer
Swin Transformer
ResNet-18
STFT
CWT
sensor data
cross-attention
autonomous vehicles

期刊

I
International Journal of Computational Intelligence and Applications
IF:
1.3
论文数:
38
被引数:
0

机构

U
universiti malaya
学者数:
4.2K
论文数: 1.8K
被引数: 0
引用论文

引用论文

A Recognition Method of Aggressive Driving Behavior Based on Ensemble Learning一种基于集成学习的攻击性驾驶行为识别方法
errSENSORS
IF3.5
err2022-01-14
err10
errOAAI
errWang, Hanqing; Wang, Xiaoyuan; Han, Junyan; Xiang, Hui; Li, Hao; Zhang, Yang; Li, Shangqing
err分享
err收藏
Computational Approaches to Predict Protein–Protein Interactions in Crowded Cellular Environments
err2024-03-27
err0
errOAAI
errGreta Grassmann; Mattia Miotto; Fausta Desantis; Lorenzo Di Rienzo; Gian Gaetano Tartaglia; Annalisa Pastore; Giancarlo Ruocco; Michele Monti; Edoardo Milanetti
err分享
err收藏
Design of an Intelligent Vehicle Behavior Decision Algorithm Based on DGAIL
err2023-05-04
err0
errOAAI
errJunfeng Jiang; Yikang Rui; Bin Ran; Peng Luo
err分享
err收藏
Plant-CNN-ViT: Plant Classification with Ensemble of Convolutional Neural Networks and Vision Transformer
err2023-07-14
err22
errOAAI
errLee, Chin Poo; Lim, Kian Ming; Song, Yu Xuan; Alqahtani, Ali
err分享
err收藏
学者 查看更多内容