本期检索说明

先读取 content/collections/deep-radar 的历史原文链接并按标题复查转载,再检索 2026-08-24 至 25 日;不足 2 篇后回溯到 8 月 18 日。最终保留 3 篇:两篇 OpenJDK 原作者 RFR 与一篇 Rust 编译器团队文章。两篇 RFR 截稿时仍在评审中,下面讨论其证据与实现,不把它们写成已经合入主线的事实。

本周期没有收录 Kotlin、Zig、Linux:最近七日找到的候选多为 release note、功能新闻或缺少 benchmark/源码链路,达不到“实测 + 源码/汇编 + 原理”三项同时满足的红线。

主题 原始发布日期 一手来源 状态 推荐强度
Zen3+ 的 C2 spill 策略 2026-08-24 OpenJDK RFR / JBS 评审中 必读
G1 FromCardCache 重构 2026-08-21 OpenJDK RFR / JBS 评审中 推荐
Rust 新一代 trait solver 2026-08-21 Rust 官方 / rustc initiative Nightly 默认启用 必读

被排除的候选

  • Kotlin 2.4.0 发布说明:信息新,但属于版本清单,缺少单一问题的实验与源码闭环。
  • 8 月的 Zig 工具链更新:以 changelog 为主,没有足够的 benchmark 与反汇编证据。
  • OpenJDK Valhalla 大型重构候选:提交规模很大,但截稿时 AArch64 构建仍有失败记录,不适合在证据未稳定时推荐。
  • Inside Java JFR 视频:方向符合,但发布时间超出七日窗口,且正文技术材料不足以独立复核。

01 · Zen3+ 为什么不该默认用 FPU 保存整数 spill

原文与日期: Jatin Bhateja,2026-08-24;OpenJDK RFR 8390818,对应 JBS 8390818

为什么值得读: 这是“微架构差异如何反推 JVM 默认参数”的完整案例。作者把热点缩到相同的 45 条指令,再定位唯一语义差异,最后在五代 Zen 上横向验证。

核心技术结论: UseFPUForSpilling 在 Zen1 有益、Zen2 中性,但在 Zen3/4/5 上会拖慢这组 Valhalla array-fill benchmark。loop-carried 整数通过 XMM 往返会把 FPU round-trip latency 暴露成循环延迟;栈槽形式则可利用 store-to-load forwarding。RFR 因此只在 AMD family 0x17 与 Hygon 0x18 默认开启,0x19+ 保持产品默认关闭。

最有价值的实验、源码与汇编: Zen5 Turin 上,ValueOopNullFree.arrayfill_static 关闭该选项后,在 s=100/1024/4096 分别为 1.81x/2.40x/2.45x;instance 版本约 2.02x–2.10x。两边热点循环都为 45 条指令,关键差异只有:

ASM
; UseFPUForSpilling=on
vmovd xmm0, r13d
vmovd ebx, xmm0
vmovd r13d, xmm0

; off
mov DWORD PTR [rsp], r13d
mov r10d, DWORD PTR [rsp]
mov r13d, DWORD PTR [rsp]

最终产品补丁只改 src/hotspot/cpu/x86/vm_version_x86.cpp 的 family 判定:7 行新增、1 行删除。RFR 正文、diff 与 JBS 互相印证,性能数据来自作者的 Valhalla JMH microbenchmark;目前仍需完成 OpenJDK 评审。

适合的工程师背景: 熟悉 C2 汇编、JMH、AMD EPYC/Zen 部署,或研究 Valhalla value class array 的 JVM 工程师。

预计阅读收益: 约 15–25 分钟;能学会用依赖链、微架构代际和最小 diff 区分“指令数相同”与“关键路径相同”。

02 · G1 用线程本地 per-card cache 替换全局 FromCardCache

原文与日期: Ivan Walulya,2026-08-21;OpenJDK RFR 8371327,对应 JBS 8371327

为什么值得读: 它展示了 remembered-set 数据结构如何随着 JEP 522 之后的访问路径改变。旧结构的 O(1) 索引并非免费;当主要入口变成线性 heap scan,全局表的内存规模不再合理。

核心技术结论:G1FromCardCache 空间近似 O(region 数 × worker 数);新设计在每个活跃 worker 只缓存当前 from-card 对应的少量 card-set group,目标复杂度为 O(单卡最大引用数 × 活跃 worker 数)。代价是极短线性查找,作者测得平均每次查询约 1.3 次比较。

最有价值的实验与源码: cache 被放入 concurrent refinement sweep 和 concurrent remembered-set rebuild 的 worker/closure 生命周期,并在 concurrent rebuild yield 后重置,防止跨阶段伪命中。作者报告 Tier 1–3 通过、未观察到性能回归;评审者 Thomas Schatzl 仍要求补充 refinement time 与迭代次数。这条 review 反而是重要证据:复杂度推导与 1.3 次比较还不能替代端到端 GC 指标,因此当前只能把它视为值得跟踪的 RFR。

适合的工程师背景: 熟悉 G1 card table、remembered set、concurrent refinement,或负责大堆 GC 辅助内存的 JVM 团队工程师。

预计阅读收益: 约 20–35 分钟;能理解为何访问模式变化会让“小型线程本地线性表”胜过“大型全局 O(1) 表”,并学会识别评审阶段尚缺的证据。

03 · Rust 新一代 trait solver 的生态级性能收敛

原文与日期: lcnr 代表 Rustc Trait System Refactor Initiative,2026-08-21;Rust 官方文章,实现与问题清单见 trait-system-refactor-initiative

为什么值得读: 这是 Rust 编译器近四年最大内部替换的阶段报告:where-clause 证明、associated type 归一化、opaque type 与 higher-ranked type 同时迁移,而且公开了生态级性能长尾。

核心技术结论: 新 solver 已在 Nightly 默认启用,已知修复超过 200 个问题,并为 TAIT、RTN 和剩余 soundness 修复清路。统一求解模型取代长期累积的特殊分支,但诊断与兼容性仍可能回归,因此官方保留 -Znext-solver=coherence 回退。

最有价值的实验、源码与 benchmark: 团队比较 crates.io 前 20,000 个 crate,并从中展示约 1,000 个更有信息量的样本;绝大多数完整样本的新旧实现性能相近,负向离群点持续收敛。trait-heavy 的 datafusion 编译超过 8 倍加速,“在类型系统里下棋”的极端用例从旧 solver 近乎挂起变成约 1 分钟。正文还提供 RPIT 递归与 for<'a> associated type 两个最小复现;initiative 仓库可继续追到设计目标与实现工作项。

适合的工程师背景: Rust 库作者、编译器/类型系统工程师,以及关注 Kotlin/Java 泛型推理与编译性能治理的人。

预计阅读收益: 约 25–40 分钟;获得 compiler core replacement 的真实方法:兼容开关灰度、全生态样本找长尾,并分别收敛 correctness、diagnostics 与 compile time。

中国大陆 ToC 硬件价格观察

数据口径

观察窗口为 2026-07 下旬至 2026-08-25,单位人民币。来源优先采用什么值得买商品百科与慢慢买的历史价摘要,再用中关村在线的有日期行情交叉检查。国内聚合页没有开放完整逐日原始序列,因此图只连接实际可复核的价格快照,不补齐缺失日期,也不把稀疏促销价称为市场成交均价。券后价会受账号、地区、包装形式影响;GPU 与主板面板分别使用同档零售样本,不能当作单一 SKU 的严密时间序列。

中国大陆六类 PC 硬件近 30 天价格快照

类别 代表样本与当前可见价 窗口内可核验变化 建议
CPU Ryzen 7 9800X3D,约 ¥3,179 8/10 盒装促销 ¥2,283;8/21 促销 ¥2,597 观望,当前回弹明显;非刚需等接近 ¥2,600
GPU 万丽 RTX 5070 OC 12GB,约 ¥6,899 窗口边界附近低价 ¥5,249 观望,溢价过大;优先比较非 OC 与 AMD 同档
主板 B850M 同档样本,约 ¥1,298 7/21 TUF 样本 ¥1,332 可按需入手,波动远小于核心与存储
DRAM Kingston Fury DDR5-6000 32GB,约 ¥3,900 8/7 低价 ¥3,870 非刚需继续等;价格处于异常高位
HDD IronWolf Pro 8TB,约 ¥1,540.7 最近公开快照基本持平 刚需可小量买;NAS 扩容尽量分批
SSD ZHITAI Ti600 2TB,约 ¥749 7/26 低价 ¥749,随后公开摘要未显示更低点 国产 TLC/无缓型号可按需入手,不囤货

价格来源: 9800X3D 慢慢买历史摘要9800X3D 商品百科万丽 RTX 5070 商品百科华硕 B850M 商品百科Kingston Fury 32GB 商品百科IronWolf Pro 8TB 商品百科ZHITAI Ti600 2TB 商品百科

判断依据

CPU 与 GPU 不建议追涨:国内装机渠道已出现“一日一价”,同配置中端主机两个月上涨约 ¥1,500;内存、SSD、CPU 与显卡依次传导涨价。证券时报的线下渠道走访给出了经销商报价变化。DRAM/SSD 的异常价主要来自 AI 需求挤占存储产能及供应重配,短期不具备“正常换代必降”的前提;深圳新闻网对华强北的调查也记录了存储与整机成本上浮。主板相对平稳,可按接口、供电与扩展需求购买;HDD/SSD 则建议按容量告警分批采购,降低单一促销节点和渠道波动风险。

本期结论

技术侧的共同主题是“默认策略必须服从真实访问路径”:C2 spill 要服从微架构依赖链,G1 cache 要服从 JEP 522 后的线性扫描,trait solver 要在整个 crates.io 生态上证明长尾可以收敛。价格侧同样要尊重数据边界:稀疏促销快照只能支持方向性购买判断,不能伪装成完整市场指数。