arrow
返回

Benchmarking Large Language Models for Embedded Systems Programming in Microcontroller-Driven IoT Applications

delete2026-02-12
delete0
delete
OA
AI
M
Marek Babiuch *
P
Pavel Smutný *
DOI:10.3390/fi18020094delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
大型语言模型(LLMs)在软件开发的自动代码生成方面显示出巨大潜力,但它们在嵌入式系统编程中的有效性——需要理解软件逻辑和硬件约束——尚未得到充分研究。现有的评估框架未能全面涵盖实际微控制器开发场景中的真实物联网(IoT)项目。本研究系统地评估了27个前沿LLMs在八个复杂度递增的嵌入式系统场景中的表现,从基本的传感器读取到完整的云数据库集成与可视化仪表板。我们使用ESP32微控制器与环境及运动传感器,采用包含四个加权标准的层次分析法(AHP):功能性、指令、输出和创造性,并由两位专家评审独立评估。表现最佳的模型为Claude Sonnet 4.5、Claude Opus 4.1和Gemini 2.5 Pro,得分在0.984至0.910之间。随着复杂度增加,性能下降:19至23个模型为简单应用生成了可编译代码,但仅有3至5个模型为涉及Grafana和云数据库的复杂场景提供了功能性解决方案。最常见的失败原因是虚构不存在的库或错误的API使用,其中功能性是主要障碍,而指令遵循质量是区分合格模型的关键因素。这些发现为嵌入式开发者提供了LLM选择的实证指导,并指出了零样本提示在硬件依赖型IoT开发中的局限性。
Keyword:
embedded system
ESP32
IoT
LLM
microcontroller
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

Future Internet 封面图
Future Internet
IF:
3.6
论文数:
1.2K
被引数:
6.5K

机构

V
VSB Technical University of Ostrava
学者数:
72
论文数: 42
被引数: 3.3K
引用论文

引用论文

A Qualitative Investigation into LLM-Generated Multilingual Code Comments and Automatic Evaluation Metrics
err2025-06-26
err0
PREAI
errKatzy,Jonathan; Huang,Yongcheng; Panchu,Gopal-Raj; Ziemlewski,Maksym; Loizides,Paris; Vermeulen,Sander; van Deursen,Arie; Izadi,Maliheh
err分享
err收藏
SciCode: A Research Coding Benchmark Curated by Scientists
err2024-01-01
err0
PREAI
errCallan,Jamie; Chen,Xinan; Du,Yufeng; Fan,Cunwei; Gao,Luyu; Guo,Xuefei; Haas,Roland; Huerta,Eliu; Ji,Pan; Krongchon,Kittithat; Li,Yao; Lieret,Kilian; Liu,Genglin; Liu,Shengyan; Lu,Yanxin; Luo,Di; Ma,Yutao; Peng,Hao; Press,Ofir; Tao,Tianhua; Tian,Chenyu; Tian,Minyang; Tong,Hao; Trinh,Kha; Wang,Zihan; Wu,Bohao; Xiong,Yanyu; Yin,Shengzhu; Zhang,Shizhuo; Zhu,Minhui
err分享
err收藏
A Survey on Evaluation of Large Language Models大型语言模型评价研究综述
err2024-03-29
err232
errOAAI
errChang, Yupeng; Wang, Xu; Wang, Jindong; Wu, Yuan; Yang, Linyi; Zhu, Kaijie; Chen, Hao; Yi, Xiaoyuan; Wang, Cunxiang; Wang, Yidong; Ye, Wei; Zhang, Yue; Chang, Yi; Yu, Philip S.; Yang, Qiang; Xie, Xing
err分享
err收藏
学者 查看更多内容