正文内容 评论(0)

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家
2026-10-01 23:07:19  出处:快科技 作者:黑白 编辑:黑白     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

快科技10月1日消息,Linux在7.4内核中引入了一项AMD PerfOpt优化,让Radeon核显在本地运行大语言模型时绕过IOMMU直接访问系统内存,Llama.cpp吞吐量最高提升23%。

该补丁由IOMMU维护者Joerg Roedel于9月24日合入,AMDGPU驱动会在检测到APU核显工作在Identity Domain时自动启用,独立显卡不受影响。

Netflix开发者Boqun Feng在邮件列表中公布的测试数据显示,核显访问动态分配的系统内存(GTT区域)的速度只有固定预留显存的二分之一到三分之一,PerfOpt开启后,GTT访问延迟降至预留显存的10%以内。

大语言模型无法完全装入入门笔记本的小容量预留显存时,大部分数据落在GTT区域,这正是PerfOpt在AI场景下效果明显的原因。

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

Phoronix基于Linux 7.3补丁构建测试内核,对三款APU进行了实测,锐龙AI 9 365的AI性能提升最高23%,同时提升了吞吐量和首Token响应速度。

此外预留显存越少,PerfOpt收益越大,锐龙AI 5 340搭载Radeon 840M,各项测试均有提升,增幅从18%起。

旗舰APU方面,锐龙AI Max+ 395在Framework Desktop上配备64GB LPDDR5-8000,典型提升仅2%至4%,个别测试中未开启PerfOpt反而更快。

目前测试仅覆盖Zen 5架构搭配RDNA 3.5核显的APU,老芯片如锐龙7040或Steam Deck的Van Gogh定制芯片是否具备该特性位尚无定论。

PerfOpt补丁共新增341行代码,涉及8个文件,最终以何种形式进入正式内核仍有待确认。

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

【本文结束】如需转载请务必注明出处:快科技

责任编辑:黑白

文章内容举报

  • 支持打赏
  • 支持0人

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |
本文收录在
#Linux#AMD#AI

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...