arrow
返回

Condensed interior-point methods for scalable nonlinear programming on GPUs

delete2026-08-10
delete0
PRE
AI
F
François Pacaud *
S
Sungho Shin
A
Alexis Montoison
M
Michel Schanen
M
Mihai Anitescu
DOI:10.1007/s12532-026-00335-0delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本文探讨了针对GPU设计的两种压缩空间内点法变体——HyKKT和LiftedKKT,通过误差分析研究其数值性质,并利用完全GPU驻留的软件实现进行大量数值实验评估其实际性能。传统内点法(IPM)的实现涉及利用基于$$\hbox {LBL}^\top $$分解且采用复杂数值选主元策略的直接稀疏求解器反复求解不定增广KKT系统。尽管该方法在CPU上实现了高性能和鲁棒性,但数值选主元的串行特性给GPU上的有效实现带来了挑战。近期,多种压缩空间IPM策略应运而生,通过将KKT系统转化为对称正定矩阵来解决此问题,该形式更适用于GPU上的分解。然而,这些方法仅在最优潮流实例上得到验证,其数值性质目前理解不足。本研究表明,尽管压缩系统表现出更强的病态性,但压缩KKT系统的固有结构有效抵消了IPM中潜在的精度损失。此外,我们通过基准测试提供数值结果,全面评估了完全GPU驻留的非线性规划软件栈(包含MadNLP(滤线搜索IPM求解器)、cuDSS(利用Cholesky分解的直接稀疏求解器)和ExaModels(建模框架))的性能,将其与pglib-opf和CUTEst库进行比较。研究发现,GPU框架在求解高度稀疏的大规模非线性规划问题(如最优潮流实例)方面具有潜力,但在CUTEst实例中观察到对边缘案例的鲁棒性下降和加速受限。

期刊

Mathematical Programming Computation 封面图
Mathematical Programming Computation
IF:
3.6
论文数:
200
被引数:
1.9K

机构

A
argonne national laboratory
学者数:
960
论文数: 370
被引数: 0
M
massachusetts institute of technology
学者数:
4.1K
论文数: 1.5K
被引数: 0
引用论文

引用论文

Algorithm 837
err2004-09-01
err0
PREAI
errPatrick R. Amestoy; Timothy A. Davis; Iain S. Duff
err分享
err收藏
Julia: A Fresh Approach to Numerical Computing朱莉娅: 一种新的数值计算方法
err2017-01-01
err3.6K
errOAAI
errBezanson, Jeff; Edelman, Alan; Karpinski, Stefan; Shah, Viral B.
err分享
err收藏
err分享
err收藏
err分享
err收藏
学者 查看更多内容