产品简介
Hailo-10H 是 Hailo 第二代神经核心架构的加速器,定位是把生成式 AI 放到边缘设备上。它在同类里较早把 LLM 推理纳进边缘加速器的能力范围,同时把功耗压在很低的水平。
最广为人知的落地形态是树莓派 AI HAT+ 2,那块扩展板就基于这颗芯片,并额外焊了 8GB LPDDR4X 专供模型加载。
核心功能
- 算力与功耗的组合:INT4 算力 40 TOPS、INT8 算力 20 TOPS,典型功耗 2.5W。这个比值是它的主要卖点,适合电池供电或封闭无风扇的设备。
- 直连 DDR 接口:带直接 DDR 接口,模型规模不局限于片上缓存,可以承载 LLM、VLM 这类参数量较大的模型。
- 宽温与车规选项:工业级支持 -40℃ 到 85℃,车规级支持 -40℃ 到 105℃,能进产线和车载场景。
- 软件栈与框架支持:支持 TensorFlow、TensorFlow Lite、Keras、PyTorch、ONNX,宿主机架构覆盖 x86 与 ARM,操作系统覆盖 Linux、Windows、Android。Dataflow Compiler 负责模型移植与量化。
- 树莓派 AI HAT+ 2:官方扩展板定价 $130,板载 8GB LPDDR4X 独立内存池,模型加载不占用树莓派系统内存。首发支持 Llama 3.2 1B、DeepSeek-R1-Distill 1.5B 与若干 Qwen 1.5B 变体。启动阶段以 1B 到 1.5B 量级为主。
- 单租户限制:一颗芯片同一时刻只跑一个模型。视觉检测与大模型摘要无法并发,切换模型约有 600ms 停顿。需要同时跑视觉与语言的场景,通常要用两张卡或另选平台。
适合谁用
以下类型的用户会特别受益于 Hailo-10H:
- 树莓派爱好者给已有设备加本地 LLM 推理能力
- 语音助手、命令解析、摘要这类 1B 到 3B 量级模型的边缘部署
- 功耗预算在 15W 以内的电池或太阳能供电设备
- 需要把 LLM 推理与 GPIO、摄像头、I²C 等外设逻辑放在一起的嵌入式项目
优点亮点
- 40 TOPS INT4 与 2.5W 典型功耗的组合,能效比突出
- 树莓派 AI HAT+ 2 把模型内存独立出来,不挤占系统内存
- 工业级与车规级宽温覆盖,场景适应面广
- 可走 PCIe 或 USB,M.2 2242 与 2280 形态都提供
价格与方案
AI 加速器按模组销售,形态含 Chip On Board、M.2 2242 与 M.2 2280。树莓派 AI HAT+ 2 定价 $130。
总结与建议
Hailo-10H 把边缘生成式 AI 的门槛压到了一个具体的价位:树莓派加扩展板总共不到 300 美元,就能跑 1B 到 3B 量级的模型。代价是模型规模有天花板,7B 级需要另找平台;LLM 工具链进入时间比视觉栈短,生产环境建议锁定一个已知可用的 hailort 版本。对已经持有树莓派、又想在本地跑小模型的人来说,这是目前成本较低的可行路径。
版本演进
- Hailo-10H 量产供货 (2026):M.2 2242 与 2280 模组供货,工业级与车规级宽温版本可用
- 树莓派 AI HAT+ 2 (2026):基于 Hailo-10H,板载 8GB 独立内存,定价 $130