
2026 年 7 月 16 日,密瓜智能(Dynamia)联合创始人兼 CTO、HAMi 作者 李孟轩 在 vLLM Meetup 上做了一场关于 vLLM 部署与算 力优化 的技术分享。围绕一个直击痛点的问题:「你的算力用的好么?」,他系统梳理了 vLLM 推理集群从"能跑起来"到"把算力榨干"的演进路径,把整个优化过程拆解为清晰的三个阶段。
本文结合分享 PPT 与现场纪要,带大家完整回顾这场干货满满的分享。
我们很高兴地宣布:2026 年 7 月 2 日,HAMi 正式晋升为 CNCF Incubating(孵化)项目,CNCF 技术监督委员会以全票赞成通过了本次孵化投票。
这是 HAMi 继 2024 年 8 月作为 Sandbox 项目加入 CNCF 后的又一个重要里程碑,意味着 CNCF 技术监督委员会(TOC)认可 HAMi 已具备成熟的技术与安全实践、活跃的社区、真实的生产采用与开放的生态集成。
2026 年 6 月 18-19 日,KubeCon + CloudNativeCon India 2026 在印度孟买举行,来自云原生生态的实践者、平台工程师、AI 基础设施团队和开源贡献者齐聚一堂。随着 AI 成为本届大会最重要的主题之一,HAMi 展示了 Kubernetes 原生 GPU 共享如何帮助组织提升加速器利用率,同时保持工作负载隔离和运维灵活性。
从开场 Keynote 到展台现场演示,再到与工程团队的技术讨论,本次活动凸显了一个越来越明确的行业关注点:让昂贵的 GPU 基础设施真正适用于多租户 AI 工作负载。
本文中的集成对象严格来说是 HAMi-core,而非完整 HAMi 平台。KAI Scheduler 保留自身调度能力,引入 HAMi-core 提供 GPU Memory Isolation 能力。
2026 年 6 月,两项核心 PR 正式合并进入 NVIDIA KAI Scheduler 主干。这意味着,HAMi 的 GPU 显存硬隔离能力将作为 KAI Scheduler 下个版本的内置特性发布,云原生 GPU 资源调度正式从「软共享」迈入「硬隔离」时代。
HAMi 社区正式发布 HAMi v2.9.0。这是一个在异构设备虚拟化深度、调度器生态扩展与 Kubernetes 原生标准落地层面具有里程碑意义的版本。
v2.9.0 引入了昇腾 910C HAMi-core 模式、HAMi-DRA 正式可用、项目发布以及 Volcano vGPU 升级至 v0.19 等重磅特性,同时在可观测性、安全性、稳定性等方面进行了系统性增强,共有 19 位新贡献者首次参与。
本文将对 v2.9.0 的主要更新进行详细说明。