【Openmvs源码分析】【requestscope源码】【delphierp源码】jdk源码mmap-皮皮网

【Openmvs源码分析】【requestscope源码】【delphierp源码】jdk源码mmap

来源：马马源码时间：2024-12-24 10:28:32

1.MappedByteBuffer VS FileChannel å°å¼ºå°å¼±ï¼
2.12 张图带你彻底理解 ZGC
3.Spring Boot引起的“堆外内存泄漏”排查及经验总结
4.一文搞定 mmap 内存映射原理

jdk源码mmap

MappedByteBuffer VS FileChannel å°å¼ºå°å¼±ï¼

Java å¨ JDK 1.4 å¼å¥äº ByteBuffer ç NIO ç¸å³çç±»ï¼ä½¿å¾ Java ç¨åºåå¯ä»¥æå¼åºäº Stream ï¼ä»èä½¿ç¨åºäº Block çæ¹å¼è¯»åæä»¶ï¼å¦å¤ï¼JDK è¿å¼å¥äº IO æ§è½ä¼åä¹çââ é¶æ·è´ sendFile å mmapãä½ä»ä»¬çæ§è½ç©¶ç«æä¹æ ·ï¼ å RandomAccessFile æ¯èµ·æ¥ï¼å¿«å¤å°ï¼ ä»ä¹æåµä¸å¿«ï¼å°åºæ¯ FileChannel å¿«è¿æ¯ MappedByteBuffer å¿«......

(é¶æ·è´åè Zero Copy I: User-Mode Perspective )

å¤©åï¼é®é¢å¤ªå¤äºï¼ï¼ï¼ï¼ï¼ï¼

è®©æä»¬æ¢æ¢åæã

æä»¬ç¥éï¼Java ä¸çæå¾å¤ MQï¼ActiveMQï¼kafkaï¼RocketMQï¼å»åªå¿ MQï¼èä»ä»¬åæ¯ Java ä¸çä½¿ç¨ NIO é¶æ·è´çå¤§æ·ã

é£ä¹ï¼å°åºæ¯ MMAP å¼ºï¼è¿æ¯ FileChannel å¼ºï¼

MMAP ä¼æå¨ç¥ï¼åºäº OS ç mmap çååæ å°ææ¯ï¼éè¿ MMU æ å°æä»¶ï¼ä½¿éæºè¯»åæä»¶åè¯»åååç¸ä¼¼çéåº¦ã

æ¥ä¸æ¥ï¼benchmark everything ââ å¾å¦.

å¦ä½ Benchmarkï¼ Benchmark åªäºï¼

ï¼tipsï¼è¯å¿ç RocketMQ æä¾äº Linux IO è°ä¼çèæ¬ï¼è¿ç¹åçä¸é ï¼ï¼

è·é¢äºã

æ¥¼ä¸»åäºä¸ä¸ªå°é¡¹ç®ï¼ç¨äºæµè¯ Java MappedByteBuffer & FileChannel & RandomAccessFile & FileXXXputStream çè¯»åæ§è½ãå¤§å®¶ä¹å¯ä»¥å¨èªå·±çæºå¨ä¸è·è·çã

CPUï¼intel i7 4æ ¸8çº¿ç¨ 4.2GHz

ååï¼GB DDR4

ç£çï¼SSD è¯»å 2GB/s å·¦å³

JDK1.8

OSï¼Mac OS ..6

èæååï¼ æªå³éï¼å¤§å° 9GB

æµè¯æ³¨æç¹ï¼

1GB æä»¶ï¼

æµè¯ MappedByteBuffer & FileChannel & RandomAccessFile & FileInputStream.

åæ¾å¤§çç mmap å FileChannel çæ¯è¾ï¼

å æ¤ï¼å¦æä½ çæ°æ®åå¤§äº 4kbï¼è¯·ä½¿ç¨ FileChannelã

1GB æä»¶ï¼

æµè¯ MappedByteBuffer & FileChannel & RandomAccessFile & FileInputStream.

åçç¼©ç¥å¾ï¼

æä»¬çå°ï¼åè æ¯ FileChannel å mmap æ§è½çåæ°´å²ï¼ä» åèå¼å§ï¼FileChannel ä¸è·¯åæï¼ç´å° BT 1GB æä»¶ç¨ç¨è¾äºä¸ä¸¢ä¸¢ã

åºäºä»¥ä¸æµè¯ï¼æä»¬å¾åºä¸å¼ å¾è¡¨ï¼

çï¼è¯»ä½¿ç¨ mmapï¼ä»ä»åä½¿ç¨ FileChannelã

ååè¿å¤´çç MQ çå®ç°èä»¬ï¼ä¼¼ä¹åªæ QMQ æ¯ è¿ä¹åçãå½ç¶ï¼RocketMQ ä¹æä¾äº FileChannel çåéé¡¹ãä½é»è®¤ mmap åå å¼æ¥å·çï¼åºè¯¥æ¯ broker busy çåå¶å§ã

è¿æ ·ä¸æ£æµï¼è¿äº MQ çè®¾è®¡ä¼¼ä¹é½éå¸¸åçã

æåï¼è½ä¸ç¨ force å°±å«ç¨ forceãå¦æè¦ç¨ force ï¼å°±è¯·ä½¿ç¨ FileChannelã

张图带你彻底理解 ZGC

ZGC（Z Garbage Collector）是一款性能优于G1的垃圾收集器。ZGC自JDK 作为实验特性引入，至JDK 正式投入使用。启用方式为使用–XX:+UseZGC。ZGC有三大特色：

1. 内存多重映射：ZGC使用mmap技术将不同的虚拟内存地址映射到同一物理内存地址，从而在Marked0、Openmvs源码分析Marked1和Remapped三个虚拟内存中灵活高效地管理内存。应用程序在创建对象时，为对象在上述三个视图空间分别申请一个虚拟地址，这三个虚拟地址映射到同一物理地址。Marked0、Marked1和Remapped作为ZGC的三个视图空间，同一时间点内只能有一个有效，通过切换视图空间完成并发的垃圾回收。

2. 染色指针：ZGC使用染色指针技术将GC信息保存在指针上，提升GC效率。在位JVM中，对象指针为位，高位用于寻址，剩下位可管理内存达到TB。ZGC仅用高4位存储4个标志位，最大内存管理可达TB。通过这4个标志位，JVM可以直接从指针上获取对象的三色标记状态、是否进入重分配集和是否需要通过finalizer访问的信息，无需进行对象访问即可获得GC信息。

3. 内存布局：ZGC基于Region进行内存分布，requestscope源码不区分新生代和老年代，支持动态创建和销毁，包括三种类型的Region。与G1类似，ZGC的内存布局同样基于Region，但其设计更注重并发和效率。

4. 读屏障：读屏障技术是ZGC在解释执行时向应用代码中插入的小段代码，当线程从堆中读取对象引用时执行。它判断对象引用是否满足条件，执行相应动作，以实现高效的并发收集。读屏障会略微影响应用性能，但提高了GC并发能力，降低了停顿时间。

5. GC过程：ZGC的垃圾收集过程包括标记、转移和重定位三个阶段。标记阶段从GC Roots出发，找出直接引用的对象，放入活跃对象集合。并发标记阶段GC线程和应用线程并行运行，标记过程中可能有引用关系变化导致的漏标记问题，再标记阶段重新标记并发标记阶段变化的对象。初始转移和并发转移阶段将活跃对象复制到新内存，转移过程对象地址发生改变，在重定位阶段调整所有指向对象旧地址的指针。

6. 垃圾收集算法：ZGC采用标记-整理算法，delphierp源码将存活对象移动到堆的一侧，移动完成后回收边界以外的对象。在JDK 之前，ZGC预留了一块堆内存，以支持简单的并行收集算法，但存在预留内存的问题。JDK 改进后支持就地搬移对象，无需预留空闲内存。尽管就地搬移带来了挑战，如考虑搬移对象顺序，但总体提高了GC表现。

ZGC的引入使并发性能大幅度提升，STW时间几乎只与GC Roots数量相关，不随堆大小和对象数量变化。ZGC的并发性能和内存管理技术显著改善了Java应用的垃圾回收效率，但其浮动垃圾问题仍然存在。

Spring Boot引起的“堆外内存泄漏”排查及经验总结

为了更好地实现对项目的管理，我们将组内一个项目迁移到MDP框架（基于Spring Boot），随后我们就发现系统会频繁报出Swap区域使用量过高的异常。笔者被叫去帮忙查看原因，发现配置了4G堆内内存，但是实际使用的物理内存竟然高达7G，确实不正常。JVM参数配置是“-XX:MetaspaceSize=M -XX:MaxMetaspaceSize=M -XX:+AlwaysPreTouch -XX:ReservedCodeCacheSize=m -XX:InitialCodeCacheSize=m, -Xssk -Xmx4g -Xms4g,-XX:+UseG1GC -XX:G1HeapRegionSize=4M”，实际使用的物理内存如下图所示：

使用Java层面的工具定位内存区域（堆内内存、Code区域或者使用unsafe.allocateMemory和DirectByteBuffer申请的源码风暴堆外内存）。

笔者在项目中添加-XX:NativeMemoryTracking=detailJVM参数重启项目，使用命令jcmd pid VM.native_memory detail查看到的内存分布如下：

发现命令显示的committed的内存小于物理内存，因为jcmd命令显示的内存包含堆内内存、Code区域、通过unsafe.allocateMemory和DirectByteBuffer申请的内存，但是不包含其他Native Code（C代码）申请的堆外内存。所以猜测是使用Native Code申请内存所导致的问题。

为了防止误判，笔者使用了pmap查看内存分布，发现大量的M的地址；而这些地址空间不在jcmd命令所给出的地址空间里面，基本上就断定就是这些M的内存所导致。

使用系统层面的工具定位堆外内存。

因为已经基本上确定是Native Code所引起，而Java层面的工具不便于排查此类问题，只能使用系统层面的工具去定位问题。

首先，使用了gperftools去定位问题。

从上图可以看出：使用malloc申请的的内存最高到3G之后就释放了，之后始终维持在M-M。笔者第一反应是：难道Native Code中没有使用malloc申请，直接使用mmap/brk申请的？（gperftools原理就使用动态链接的方式替换了操作系统默认的内存分配器（glibc）。）

然后，使用strace去追踪系统调用。

因为使用gperftools没有追踪到这些内存，于是直接使用命令“strace -f -e"brk,mmap,munmap" -p pid”追踪向OS申请内存请求，但是wbc源码并没有发现有可疑内存申请。

接着，使用GDB去dump可疑内存。

因为使用strace没有追踪到可疑内存申请；于是想着看看内存中的情况。就是直接使用命令gdp -pid pid进入GDB之后，然后使用命令dump memory mem.bin startAddress endAddressdump内存，其中startAddress和endAddress可以从/proc/pid/smaps中查找。然后使用strings mem.bin查看dump的内容，如下：

从内容上来看，像是解压后的JAR包信息。读取JAR包信息应该是在项目启动的时候，那么在项目启动之后使用strace作用就不是很大了。所以应该在项目启动的时候使用strace，而不是启动完成之后。

再次，项目启动时使用strace去追踪系统调用。

项目启动使用strace追踪系统调用，发现确实申请了很多M的内存空间，截图如下：

使用该mmap申请的地址空间在pmap对应如下：

最后，使用jstack去查看对应的线程。

因为strace命令中已经显示申请内存的线程ID。直接使用命令jstack pid去查看线程栈，找到对应的线程栈（注意进制和进制转换）如下：

这里基本上就可以看出问题来了：MCC（美团统一配置中心）使用了Reflections进行扫包，底层使用了Spring Boot去加载JAR。因为解压JAR使用Inflater类，需要用到堆外内存，然后使用Btrace去追踪这个类，栈如下：

然后查看使用MCC的地方，发现没有配置扫包路径，默认是扫描所有的包。于是修改代码，配置扫包路径，发布上线后内存问题解决。

为什么堆外内存没有释放掉呢？

虽然问题已经解决了，但是有几个疑问。带着疑问，直接看了一下 Spring Boot Loader那一块的源码。发现Spring Boot对Java JDK的InflaterInputStream进行了包装并且使用了Inflater，而Inflater本身用于解压JAR包的需要用到堆外内存。而包装之后的类ZipInflaterInputStream没有释放Inflater持有的堆外内存。于是以为找到了原因，立马向Spring Boot社区反馈了这个bug。但是反馈之后，就发现Inflater这个对象本身实现了finalize方法，在这个方法中有调用释放堆外内存的逻辑。也就是说Spring Boot依赖于GC释放堆外内存。

使用jmap查看堆内对象时，发现已经基本上没有Inflater这个对象了。于是就怀疑GC的时候，没有调用finalize。带着这样的怀疑，把Inflater进行包装在Spring Boot Loader里面替换成自己包装的Inflater，在finalize进行打点监控，结果finalize方法确实被调用了。于是又去看了Inflater对应的C代码，发现初始化的使用了malloc申请内存，end的时候也调用了free去释放内存。

此时，怀疑free的时候没有真正释放内存，便把Spring Boot包装的InflaterInputStream替换成Java JDK自带的，发现替换之后，内存问题也得以解决了。

再次看gperftools的内存分布情况，发现使用Spring Boot时，内存使用一直在增加，突然某个点内存使用下降了好多（使用量直接由3G降为M左右）。这个点应该就是GC引起的，内存应该释放了，但是在操作系统层面并没有看到内存变化，那是不是没有释放到操作系统，被内存分配器持有了呢？

继续探究，发现系统默认的内存分配器（glibc 2.版本）和使用gperftools内存地址分布差别很明显，2.5G地址使用smaps发现它是属于Native Stack。内存地址分布如下：

到此，基本上可以确定是内存分配器在捣鬼；搜索了一下glibc M，发现glibc从2.开始对每个线程引入内存池（位机器大小就是M内存），原文如下：

按照文中所说去修改MALLOC_ARENA_MAX环境变量，发现没什么效果。查看tcmalloc（gperftools使用的内存分配器）也使用了内存池方式。

为了验证是内存池搞的鬼，就简单写个不带内存池的内存分配器。使用命令gcc zjbmalloc.c -fPIC -shared -o zjbmalloc.so生成动态库，然后使用export LD_PRELOAD=zjbmalloc.so替换掉glibc的内存分配器。其中代码Demo如下：

通过在自定义分配器当中埋点可以发现实际申请的堆外内存始终在M-M之间，gperftools监控显示内存使用量也是在M-M左右。但是从操作系统角度来看进程占用的内存差别很大（这里只是监控堆外内存）。

使用不同分配器进行不同程度的扫包，占用的内存如下：

为什么自定义的malloc申请M，最终占用的物理内存在1.7G呢？因为自定义内存分配器采用的是mmap分配内存，mmap分配内存按需向上取整到整数个页，所以存在着巨大的空间浪费。通过监控发现最终申请的页面数目在k个左右，那实际上向系统申请的内存等于k * 4k（pagesize） = 2G。

为什么这个数据大于1.7G呢？因为操作系统采取的是延迟分配的方式，通过mmap向系统申请内存的时候，系统仅仅返回内存地址并没有分配真实的物理内存。只有在真正使用的时候，系统产生一个缺页中断，然后再分配实际的物理Page。

整个内存分配的流程如上图所示。MCC扫包的默认配置是扫描所有的JAR包。在扫描包的时候，Spring Boot不会主动去释放堆外内存，导致在扫描阶段，堆外内存占用量一直持续飙升。当发生GC的时候，Spring Boot依赖于finalize机制去释放了堆外内存；但是glibc为了性能考虑，并没有真正把内存归返到操作系统，而是留下来放入内存池了，导致应用层以为发生了“内存泄漏”。所以修改MCC的配置路径为特定的JAR包，问题解决。在发表这篇文章时，发现Spring Boot的最新版本（2.0.5.RELEASE）已经做了修改，在ZipInflaterInputStream主动释放了堆外内存不再依赖GC；所以Spring Boot升级到最新版本，这个问题也可以得到解决。

一文搞定 mmap 内存映射原理

本文将深入解析内存映射文件技术mmap，它通过将文件或对象映射到进程地址空间，实现地址空间与文件磁盘地址的一一对应，使得进程能够通过指针操作内存，而系统会自动管理数据同步，无需频繁的系统调用。

在Linux内核中，内存管理采用页式结构，进程通过task_struct和mm_struct描述其内存空间，其中vm_area_struct用于描述虚拟内存区域。当内存空间需求变化，会使用链表或红黑树进行动态管理。

mmap的核心功能包括：建立内存和文件的映射关系、仅初始化映射而不进行数据拷贝、解除映射关系、对内存区域设置保护和同步操作。例如，mprotect允许调整内存保护级别，msync则确保映射区域的修改被写回文件。

在JDK的DirectByteBuffer示例中，我们看到了mmap在内存管理中的实际应用，通过strace跟踪，可以看到一系列mmap、mprotect、brk和munmap等系统调用的交互过程，显示了mmap如何高效地进行内存操作，避免了常规IO中的两次数据拷贝。

与常规IO相比，mmap的优势在于减少了数据复制的步骤，直接在用户空间和内核空间间交互，显著提高了数据访问速度。它广泛应用于需要高性能IO操作的场景，如NIO编程和直接内存访问。

【Openmvs源码分析】【requestscope源码】【delphierp源码】jdk源码mmap

热点新闻

重点推荐