JVM中Shenandoah收集器在多核处理器架构下对NUMA(Non-Uniform Memory Access)的适配
Shenandoah在JDK21及主流OpenJDK中缺乏原生NUMA感知,未实现线程绑定或本地内存优先分配,GC基于统一堆视图。多核NUMA系统需依赖numactl手动干预,与G1的显式NUMA优化形成对比。

mbind()、numactl相关API来控制页放置位置
- 读屏障触发的转发指针访问,其延迟受实际物理内存位置影响,但收集器自身不优化该路径
### NUMA对Shenandoah的实际影响
虽然Shenandoah不主动适配NUMA,但在真实的多节点服务器上,NUMA特性仍会间接影响其行为:
- 停顿时间可能轻微波动:初始标记、最终标记等STW阶段,如果恰好涉及跨节点引用扫描,远程内存访问延迟可能会略微抬高停顿峰值
- 并发阶段吞吐受带宽限制:在并发回收阶段进行大量对象复制时,如果目标Region位于远程节点内存,QPI/Infinity Fabric总线争用可能降低复制速率
- 内存局部性未被利用:用户线程集中在Node 0分配对象,而Shenandoah线程却在Node 1执行回收,容易引发缓存行伪共享与跨节点同步开销
### 手动提升NUMA友好性的可行做法
如果一定要在NUMA系统上跑Shenandoah并追求极致性能,那也不是完全没办法,主要得靠外部手段来“曲线救国”:
- 启动JVM前使用numactl --cpunodebind=0 --membind=0 ja va ...将整个JVM进程限定在单个NUMA节点,直接消除跨节点访问
- 配合-XX:+UseLargePages减少TLB miss,缓解远程内存访问的地址翻译开销
- 调整-XX:ParallelGCThreads和-XX:ConcGCThreads,使其不超过单节点CPU核心数,避免线程跨节点迁移
- 监控/sys/devices/system/node/下各节点内存使用与跨节点访问计数(如numastat输出),验证是否出现显著的remote node page allocation
### 对比G1的NUMA支持更显差异
相比之下,G1就显得“贴心”多了。自JDK 14起,G1通过-XX:+UseNUMA参数即可启用显式NUMA优化:自动为每个节点维护独立的Remembered Set、按节点划分年轻代Eden区,并尝试将Region分配与创建线程所在节点对齐。而Shenandoah目前没有对应开关,也没有内部模块来处理这件事。它的设计重心始终放在“停顿时间与堆大小解耦”这一核心目标上,NUMA适配尚未被纳入官方路线图。
Shapr3D是一款面向工业设计、机械工程、建筑概念和三维打印工作流的CAD软件。Mac版采用Parasolid建模内核,支持草图约束、实体建模、工程图、可视化渲染及常见CAD格式交换,并可通过账户在多台设备之间同步项目。
REAPER是Cockos开发的数字音频工作站,提供多轨音频与MIDI录制、剪辑、处理、混音和母带制作工具。Mac版兼容Intel与Apple芯片,支持AU、VST、VST3、CLAP等插件格式,并提供高度可定制的工作流程。
Ableton Live 是面向音乐制作人与现场表演者的数字音频工作站,提供编曲视图、独具特色的现场视图、音频录制、MIDI创作、实时变速、乐器及效果器。Mac版原生支持Apple芯片,并可连接音频接口、MIDI控制器和第三方插件。
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。














