硬件嵌入式
RISC-V 指令集架构深度实战:从 RV64I 基础指令到自定义指令扩展与处理器微架构全链路
深度解析 RISC-V 指令集架构:从 RV64I 基础指令编码、寄存器模型、内存访问(RVWMO),到特权架构(M/S/U-mode)、中断陷阱处理、Sv39 虚拟内存、标准扩展(M/A/F/D/V)、自定义指令编码空间、处理器微架构(流水线/分支预测/乱序执行/TLB/Cache)、Chisel/Rocket SoC 构建实战。涵盖 AI 推理加速器、汽车电子、数据中心等前沿落地案例。
RISC-V Hypervisor Extension H:从架构规范到云原生生产部署
深入解析 RISC-V Hypervisor Extension H 的核心机制:两阶段地址翻译、虚拟中断架构、HLV/HSV 指令集,以及 KVM RISC-V 生产级部署方案,涵盖性能调优、常见陷阱与前沿发展方向。
ARM CCA 机密计算架构(Confidential Compute Architecture)深度工程实战
ARMv9-A CCA 机密计算架构深度工程实战:从 RME 硬件扩展、Granule Protection Table 粒级隔离、RMM 状态机与 Realm 生命周期、Linux 内核 6.x 主线支持、远程证认协议到性能开销评估与 TDX/SEV-SNP 对比。
ARM SME2 可扩展矩阵扩展:AI推理的下一代硬件加速引擎
ARM SME2(Scalable Matrix Extension 2)是ARMv9.4-A架构的核心扩展,首次引入二维ZTile矩阵寄存器和FMOPA外积累加指令,使通用CPU具备与入门级GPU竞争的INT8/BF16矩阵运算能力。本文深入解析SME2硬件架构、编程模型、LLM推理工程实践以及性能实测数据。
ARM SVE2 可扩展向量扩展:AI 推理加速的深度工程实战
深入解析ARM SVE2可扩展向量扩展在AI推理加速中的核心机制与工程实战:从VLA模型的谓词寄存器到SDOT指令的INT8矩阵乘手写kernel,覆盖RoPE/Softmax并行化、编译器自动向量化、Graviton4实测数据、以及与RISC-V V扩展的AI推理性价比对比。
RISC-V 特权架构与系统编程深度工程实战:从 M-Mode 到 S-Mode 的全栈透视
深入分析 RISC-V 特权架构的设计哲学、各特权级核心机制,结合 OpenSBI、共形内存管理、中断委托等关键系统编程话题,提供从裸机固件到 Linux 内核启动的全栈工程视角。
