零拷贝

Linux io_uring 深度实战:从内核态 escapes 到零拷贝高性能 I/O 全链路

从架构原理到生产落地,深入解析 io_uring 的三大共享环形队列设计、三种操作模式(Interrupt-Driven/SQPOLL/IOPOLL)、固定缓冲区零拷贝机制、Fixed Files文件描述符注册、链式请求、内核轮询模式下的零系统调用实现,并提供完整的 C 语言 HTTP 服务器实战代码与性能调优指南。

Linux内核DMA-BUF显式同步与跨驱动缓冲区共享:从零构建零拷贝GPU计算管线

在现代AI推理管线中,数据搬运的耗时往往超过计算本身。CPU与GPU、GPU与GPU、存储与加速器之间的零拷贝数据共享,是突破性能瓶颈的关键。Linux内核的DMA-BUF子系统正是解决这一问题的核心基础设施,而显式同步机制(explicit fencing)则是保证多设备并发访问正确性的基石。本文将深入DMA-BUF的内部机制,从零实现一个跨驱动的零拷贝GPU计算管线。