arrow
返回

An fMRI visual neural encoding method with multimodal large language model

delete2025-06-27
delete0
PRE
AI
S
Shuxiao Ma
L
Linyuan Wang
L
Libin Hou
S
Senbao Hou
B
Bin Yan
DOI:10.1016/j.knosys.2025.114049delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
• 总的来说,我们的贡献主要分为三个方面: • 据我们所知,我们建立了首个结合MLLM与fMRI视觉神经编码的多模态框架,引入了一种针对神经编码任务特别优化的系统性三阶段训练范式。 • 基于Vicuna架构,我们开发了一个80亿参数的基础模型,该模型在参数效率和任务性能方面均展现出双重优势。具体而言,我们的方法在Algonauts 2023中取得第5名,为大尺度视觉编码处理确立了新的基准。 • 去除分析表明,引入MLLM模块可带来2.87%的性能增益。通过我们的多阶段训练范式,我们仅通过参数高效微调(PEFT)微调1.33%的参数(Q-former),实现了2.61%的性能提升,从而在计算效率与性能增强之间取得了平衡。

期刊

K
Knowledge-Based Systems
IF:
7.6
论文数:
1.3W
被引数:
4.5W

机构

暂无机构信息
引用论文

引用论文

err分享
err收藏
Pycortex: an interactive surface visualizer for fMRI
err2015-09-29
err0
errOAAI
errJames S. Gao; Alexander G. Huth; Mark D. Lescroart; Jack L. Gallant
err分享
err收藏
Deep recurrent neural network reveals a hierarchy of process memory during dynamic natural vision
err2018-02-12
err29
errOAAI
errShi, Junxing; Wen, Haiguang; Zhang, Yizhen; Han, Kuan; Liu, Zhongming
err分享
err收藏
Large-scale parameters framework with large convolutional kernel for encoding visual fMRI activity information
err
IF0
err2024-07-12
err0
PREAI
errShuxiao Ma; Linyuan Wang; Senbao Hou; Chi Zhang; Bin Yan
err分享
err收藏
Variational autoencoder: An unsupervised model for encoding and decoding fMRI activity in visual cortex
err2019-09-01
err0
errOAAI
errKuan Han; Haiguang Wen; Junxing Shi; Kun-Han Lu; Yizhen Zhang; Di Fu; Zhongming Liu
err分享
err收藏
err分享
err收藏
Natural speech reveals the semantic maps that tile human cerebral cortex
errNATURE
IF48.5
err2016-04-27
err925
errOAAI
errHuth, Alexander G.; de Heer, Wendy A.; Griffiths, Thomas L.; Theunissen, Frederic E.; Gallant, Jack L.
err分享
err收藏
学者 查看更多内容