ChengRang
EN

ML Drift 新增

AI 开发平台 开源

Google AI Edge 团队于 2026 年 10 月 8 日以 Apache 2.0 许可开源的跨平台端侧 GPU 计算引擎,专为设备上的 AI 推理打造,也是 LiteRT 的核心 GPU 加速层。统一抽象 OpenGL ES、OpenCL、Metal 与 WebGPU 四种底层 API,用张量虚拟化把逻辑张量与物理显存分配解耦,一次维护统一着色器;新增 5D 张量支持、可扩展自定义算子框架,并对端侧大模型按 prefill 与 decode 两个阶段切换内核与布局,在 Chrome、YouTube Shorts、Google 相册等产品上已日服务数百万设备

端侧推理 GPU 加速 Apache 2.0 LiteRT 跨平台
访问 ML Drift 官网

免责声明:测评内容仅代表编辑个人观点和使用体验,不构成任何商业推荐或投资建议。产品信息和价格可能随时变动,请以官方最新信息为准。

产品简介

ML Drift 是 Google AI Edge 团队在 2026 年 10 月 8 日以 Apache 2.0 许可放出来的端侧 GPU 计算引擎,专门为设备上的 AI 推理打造。它的正式定位是 LiteRT 内部的 GPU 加速层,接替此前的 TFLite GPU delegate,同时也可以作为一个独立库,给自研的图形或推理运行时当底座。

要理解它为什么存在,得先看端侧 GPU 推理的麻烦在哪。数据中心里模型跑在同构、可预测的加速卡集群上,端侧却是一片硬件多样性:GPU 架构、驱动版本、底层 API 各不相同,开发者事先并不知道应用最终会落在哪块芯片上。TFLite GPU delegate 打下了 GPU 加速的地基,但它硬编码 4D 张量、着色器按后端各写一套,面对今天从实时视觉、音频、深度处理一直到大参数生成式模型的 workloads,算力和显存都成了瓶颈。ML Drift 想给的是一套通用工程底座,让经典模型和下一代模型在同一套框架里既有可移植性又有峰值性能。

核心功能

适合谁用

以下类型的用户会特别受益于 ML Drift:

优点亮点

价格与方案

以 Apache 2.0 许可开源,可免费商用、修改与自托管。官方文档与 LiteRT 一并维护,作为 LiteRT 的 GPU 加速层时也随 LiteRT 的开源许可提供,不单独收费。

总结与建议

ML Drift 的价值不在提出什么新算法,而在把端侧 GPU 推理这件事的工程底座重新做了一遍。张量虚拟化解决的是跨后端着色器的维护成本,5D 张量解决的是模型形态被框架结构卡住的问题,阶段感知优化解决的是端侧大模型真正的显存带宽瓶颈。它已经在 Google 自家一批日活千万级的产品上跑着,YouTube Shorts 降 40% 帧延迟、Google Photos 快 2 秒这类数字是生产环境里量出来的,不是基准表里的。

对开发者的实际意义是:如果你在做端侧视觉、端侧生成式模型或者本地编码智能体,现在有一套统一的、开源可改的 GPU 底座可用,不必再为每个后端分别调一套着色器。作为独立库使用时,它也可以嵌进自研的图形或推理运行时。需要注意的是桌面端目前仍是预览状态,官方的主要精力还是放在资源最紧的移动端与边缘设备上。

版本演进

分类
AI 开发平台
价格
开源
标签
端侧推理 · GPU 加速 · Apache 2.0