arrow
返回

Statistical Runtime Verification for LLMs via Robustness Estimation

delete2026-01-01
delete1
PRE
AI
N
Natan Levy
A
Adiel Ashrov *
G
Guy Katz
DOI:10.1007/978-3-032-05435-7_25delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
对抗鲁棒性验证对于确保大型语言模型(LLMs)在运行时关键应用中的安全部署至关重要。然而,由于现代LLMs的指数级运行时间和白盒访问要求,形式化验证技术仍然在计算上不可行。本文介绍了一个案例研究,通过调整和扩展RoMA统计验证框架,评估其在黑盒部署设置中作为在线运行时鲁棒性监控器的可行性。我们对RoMA的调整分析了语义扰动下的置信度分数分布,以提供具有统计验证边界的数据鲁棒性评估。我们针对形式化验证基线的经验验证表明,RoMA实现了可比的准确性(偏差在1%以内),并将验证时间从小时缩短到分钟。我们在语义、分类和正交扰动领域评估了该框架。结果表明RoMA在操作LLM部署中的鲁棒性监控方面的有效性。这些发现表明,当形式化方法不可行时,RoMA可能是一种可扩展的替代方案,对基于LLM的系统的运行时验证具有有前景的启示。
Keyword:
LLM safety
Neural Network Verification
LLM verification
Robustness

期刊

R
RUNTIME VERIFICATION, RV 2025
IF:
0
论文数:
27
被引数:
0

机构

H
hebrew university of jerusalem
学者数:
2.5K
论文数: 1.1K
被引数: 0
引用论文

引用论文

ChatGPT and Open-AI Models: A Preliminary ReviewChatGPT和Open-AI模型: 初步回顾
err2023-05-26
err0
errOAAI
errKonstantinos I. Roumeliotis; Nikolaos D. Tselikas
err分享
err收藏
Reluplex: a calculus for reasoning about deep neural networks
err2021-07-01
err0
PREAI
errGuy Katz; Clark Barrett; David L. Dill; Kyle Julian; Mykel J. Kochenderfer
err分享
err收藏
Reluplex: An Efficient SMT Solver for Verifying Deep Neural Networks
err2017-07-13
err0
errOAAI
errGuy Katz; Clark Barrett; David L. Dill; Kyle Julian; Mykel J. Kochenderfer
err分享
err收藏
学者 查看更多内容