快科技 2小时前 · 2026-10-01 23:26:32 · 3 阅读
Linux 7.4新优化:AMD核显快23%!入门APU成大赢家
快科技10月1日消息,Linux在7.4内核中引入了一项AMD PerfOpt优化,让Radeon核显在本地运行大语言模型时绕过IOMMU直接访问系统内存,Llama.cpp吞吐量最高提升23%。
该补丁由IOMMU维护者Joerg Roedel于9月24日合入,AMDGPU驱动会在检测到APU核显工作在Identity Domain时自动启用,独立显卡不受影响。
Netflix开发者Boqun Feng在邮件列表中公布的测试数据显示,核显访问动态分配的系统内存(GTT区域)的速度只有固定预留显存的二分之一到三分之一,PerfOpt开启后,GTT访问延迟降至预留显存的10%以内。
大语言模型无法完全装入入门笔记本的小容量预留显存时,大部分数据落在GTT区域,这正是PerfOpt在AI场景下效果明显的原因。
Phoronix基于Linux 7.3补丁构建测试内核,对三款APU进行了实测,锐龙AI 9 365的AI性能提升最高23%,同时提升了吞吐量和首Token响应速度。
此外预留显存越少,PerfOpt收益越大,锐龙AI 5 340搭载Radeon 840M,各项测试均有提升,增幅从18%起。
旗舰APU方面,锐龙AI Max+ 395在Framework Desktop上配备64GB LPDDR5-8000,典型提升仅2%至4%,个别测试中未开启PerfOpt反而更快。
目前测试仅覆盖Zen 5架构搭配RDNA 3.5核显的APU,老芯片如锐龙7040或Steam Deck的Van Gogh定制芯片是否具备该特性位尚无定论。
PerfOpt补丁共新增341行代码,涉及8个文件,最终以何种形式进入正式内核仍有待确认。
原始来源: 快科技

