科言猫
学术研究的AI总结
首页
文献互助
订阅
我的收藏
科研工具
选题分析
论文总结
专利管理
未登录
返回
王
王超
(Chao Wang)
University of Science and Technology of China
22
H指数
164
论文数
2.2K
被引数
0
相关解读
订阅
收录论文
34
发表时间
发表时间
IF
被引数
CoQMoE: Co-Designed Quantization and Computation Orchestration for Mixture-of-Experts Vision Transformer on FPGA
CoQMoE:面向FPGA上专家混合型视觉变换器的协同设计量化与计算编排
EURO-PAR 2025: PARALLEL PROCESSING, PT II
IF
0
2026-01-01
0
PRE
AI
Dong, Jiale; Wu, Hao; Wang, Zihao; Lou, Wenqi; Zheng, Zhendong; Gong, Lei; Wang, Chao; Zhou, Xuehai
分享
收藏
UniSparTa: A Unified Sparse Tensor Program Tuning Framework
UniSparTa: 一种统一的稀疏张量程序调优框架
IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems
IF
2.9
2025-11-24
0
PRE
AI
Zihan Wang; Lei Gong; Xiangjun Qu; Cheng Tang; Wenqi Lou; Teng Wang; Qianyu Cheng; Xianglan Chen; Chao Wang; Xuehai Zhou
分享
收藏
Blueberry regional ripeness detection based on an improved YOLOv7tiny model
基于改进的YOLOv7tiny模型的蓝莓区域成熟度检测
Journal of Food Measurement and Characterization
IF
3.3
2025-11-09
0
PRE
AI
Jianian Li; Jiangfeng He; Chao Wang; Shuai Tan; Jiazhen Zhao
分享
收藏
Picasso: Analyzing Prompt Design for Text-to-Image Generative Diffusion Models from a Temporal-Spatial Perspective
Picasso: 从时空视角分析文本到图像生成扩散模型的提示设计
ACM Transactions on Multimedia Computing; Communications and Applications
IF
0
2025-11-07
0
PRE
AI
Haoyu Cai; Wenqi Lou; Chao Wang; Xuehai Zhou
分享
收藏
LORA: A Latency-Oriented Recurrent Architecture for Large Language Model on Multi-FPGA Platform With Communication Optimization
LoRA:一种面向延迟的、具有通信优化的多FPGA平台上的大语言模型循环架构
IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems
IF
2.9
2025-11-06
0
PRE
AI
Zhendong Zheng; Qianyu Cheng; Teng Wang; Wenqi Lou; Lei Gong; Xianglan Chen; Chao Wang; Xuehai Zhou
分享
收藏
UniCoX: A Unified Cost Model for Tensorized Program Tuning Across Ubiquitous Accelerators
UniCoX:一种适用于通用加速器的张量化程序调优的统一成本模型
IEEE Transactions on Computers
IF
3.8
2025-10-28
0
PRE
AI
Zihan Wang; Lei Gong; Wenqi Lou; Teng Wang; Qianyu Cheng; Xianglan Chen; Chao Wang; Xuehai Zhou
分享
收藏
QLlama: An FPGA-Based Microscaling Quantization Accelerator for Energy-Efficient Llama2 Inference
QLlama: 一种基于FPGA的微缩量化加速器,用于实现能效优化的Llama2推理
IEEE EMBEDDED SYSTEMS LETTERS
IF
2
2025-10-01
0
PRE
AI
Wen, Hongbing; Wang, Zihao; Dong, Jiale; Lou, Wenqi; Gong, Lei; Wang, Chao; Zhou, Xuehai
分享
收藏
Toward Efficient FPGA Accelerator DSE via Hierarchical and RM-Guided Methods
面向高效FPGA加速器DSE的层次化与RM引导方法
IEEE EMBEDDED SYSTEMS LETTERS
IF
2
2025-10-01
0
PRE
AI
Shi, Chao; Cheng, Qianyu; Wang, Teng; Wang, Chao; Zhou, Xuehai
分享
收藏
MoE-Sched: Enabling Efficient FPGA Deployment of Mixture-of-Experts Vision Transformers via Coordinated Scheduling
MoE-Sched:通过协调调度实现高效的FPGA部署Mixture-of-Experts Vision Transformers
IEEE Transactions on Very Large Scale Integration (VLSI) Systems
IF
3.1
2025-09-08
0
PRE
AI
Jiale Dong; Wenqi Lou; Hao Wu; Zhendong Zheng; Yunji Qin; Lei Gong; Chao Wang; Xuehai Zhou
分享
收藏
Enhancing Graph Random Walk Acceleration via Efficient Dataflow and Hybrid Memory Architecture
IEEE TRANSACTIONS ON COMPUTERS
IF
3.8
2024-03-01
2
PRE
AI
Gao, Yingxue; Wang, Teng; Gong, Lei; Wang, Chao; Hu, Yiqing; Yang, Yi; Liu, Zhongming; Li, Xi; Zhou, Xuehai
分享
收藏
Hardware Accelerated Vision Transformer via Heterogeneous Architecture Design and Adaptive Dataflow Mapping
通过异构架构设计和自适应数据流映射实现硬件加速视觉转换器
IEEE TRANSACTIONS ON COMPUTERS
IF
3.8
2024-01-01
0
PRE
AI
Gao, Yingxue; Wang, Teng; Gong, Lei; Wang, Chao; Dai, Dong; Yang, Yang; Chen, Xianglan; Li, Xi; Zhou, Xuehai
分享
收藏
Flexible and Efficient Memory Swapping Across Mobile Devices With LegoSwap
IEEE TRANSACTIONS ON PARALLEL AND DISTRIBUTED SYSTEMS
IF
6
2024-01-01
0
PRE
AI
Li, Changlong; Liang, Yu; Shi, Liang; Wang, Chao; Xue, Chun Jason; Zhou, Xuehai
分享
收藏
Enabling Fast and Memory-Efficient Acceleration for Pattern Matching Workloads: The Lightweight Automata Processing Engine
为模式匹配工作负载实现快速且内存高效的加速: 轻量级自动机处理引擎
IEEE TRANSACTIONS ON COMPUTERS
IF
3.8
2023-04-01
1
PRE
AI
Gong, Lei; Wang, Chao; Xia, Haojun; Chen, Xianglan; Li, Xi; Zhou, Xuehai
分享
收藏
Conv-inheritance: A hardware-efficient method to compress convolutional neural networks for edge applications
NEUROCOMPUTING
IF
6.5
2022-05-01
1
PRE
AI
Yang, Yang; Wang, Chao; Gong, Lei; Wu, Min; Zhou, Xuehai
分享
收藏
KDnet-RUL: A Knowledge Distillation Framework to Compress Deep Neural Networks for Machine Remaining Useful Life Prediction
Kdnet-rul: 压缩深度神经网络用于机器剩余使用寿命预测的知识蒸馏框架
IEEE TRANSACTIONS ON INDUSTRIAL ELECTRONICS
IF
7.2
2022-02-01
77
PRE
AI
Xu, Qing; Chen, Zhenghua; Wu, Keyu; Wang, Chao; Wu, Min; Li, Xiaoli
分享
收藏
LKSM: Light Weight Key-Value Store for Efficient Application Services on Local Distributed Mobile Devices
IEEE TRANSACTIONS ON SERVICES COMPUTING
IF
5.8
2021-07-01
1
OA
AI
Li, Changlong; Zhuang, Hang; Wang, Qingfeng; Wang, Chao; Zhou, Xuehai
分享
收藏
GenSeq plus : A Scalable High-Performance Accelerator for Genome Sequencing
GenSeq plus: 用于基因组测序的可扩展高性能加速器
IEEE-ACM TRANSACTIONS ON COMPUTATIONAL BIOLOGY AND BIOINFORMATICS
IF
3.4
2021-07-01
2
PRE
AI
Wang, Chao; Gong, Lei; Lei, Shiming; Fang, Haijie; Li, Xi; Wang, Aili; Zhou, Xuehai
分享
收藏
Improving HW/SW Adaptability for Accelerating CNNs on FPGAs Through A Dynamic/Static Co-Reconfiguration Approach
通过动态/静态协同重构方法提高硬件/软件适应性,以加速fpga上的cnn
IEEE TRANSACTIONS ON PARALLEL AND DISTRIBUTED SYSTEMS
IF
6
2021-07-01
20
PRE
AI
Gong, Lei; Wang, Chao; Li, Xi; Zhou, Xuehai
分享
收藏
An FPGA Based Accelerator for Clustering Algorithms With Custom Instructions
基于FPGA的具有自定义指令的聚类算法加速器
IEEE TRANSACTIONS ON COMPUTERS
IF
3.8
2021-05-01
13
OA
AI
Wang, Chao; Gong, Lei; Jia, Fahui; Zhou, Xuehai
分享
收藏
OctCNN: A High Throughput FPGA Accelerator for CNNs Using Octave Convolution Algorithm
OctCNN: 使用倍频程卷积算法的cnn高吞吐量FPGA加速器
IEEE TRANSACTIONS ON COMPUTERS
IF
3.8
2021-01-01
17
PRE
AI
Lou, Wenqi; Lei Gong; Chao Wang; Du, Zidong; Zhou Xuehai
分享
收藏
研究方向
智能计算机体系结构 深度学习处理器 FPGA 应用加速
合作学者
合作期刊
C
Ching‐Ping Wong
H 指数: 122 · 论文数: 1.2K
孙
孙蓉
(Rong Sun)
H 指数: 89 · 论文数: 993
W
Wei‐Hsin Liao
H 指数: 69 · 论文数: 550
D
De-Shuang Huang
H 指数: 68 · 论文数: 480
Xiaoli Li
(Xiaoli Li)
H 指数: 67 · 论文数: 896
查看更多