跳到正文
原文
Mistral AI·· 2026-01-22精选AI 评分67

Mistral 排查 vLLM 拆分推理中的内存泄漏

Heaps do lie: debugging a memory leak in vLLM.

AI 导读

Mistral AI 团队在预发布中发现了使用 Mistral Medium 3.1 和图编译的 vLLM 拆分推理场景下出现每小时约 24GB 的内存泄漏。经过 Heaptrack、pmap、BPFtrace 和 GDB 自动化排查,最终定位为 UCX 的 mmap hook 机制导致内存累积。

推荐理由

原文披露了使用Heaptrack、pmap、BPFtrace和GDB自动化定位vLLM内存泄漏的全过程,可迁移至同类系统。

来源:Mistral AI · mistral.ai