Skip to content

模型目录

选择合适的 FastVLM 模型

三个官方规模共享 FastViTHD 视觉编码策略,但分别面向不同的延迟、占用和质量优先级。

速度最快

FastVLM-0.5B

最小的官方 FastVLM 版本,也是浏览器 Playground 使用的模型。重视延迟、占用和可移植性时优先选择。

适合场景
浏览器、WebGPU 与资源受限端侧设备
运行方式
Browser · Transformers.js · Python · Apple Silicon
模型详情
均衡之选

FastVLM-1.5B

官方中等规模版本,在 Apple 公布的每项评测中都高于 0.5B,同时明显小于 7B。

适合场景
均衡的本地推理与 Apple Silicon 开发
运行方式
Python · Apple Silicon · Workstation
模型详情
质量最佳

FastVLM-7B

最大的官方 FastVLM 版本,在 Apple 公开评测表的每一行都得分最高,优先考虑桌面级原生部署。

适合场景
最高的 FastVLM 公开基准质量
运行方式
Python · Desktop · Native deployment
模型详情

实用选择规则

  • 需要 WebGPU 或最低资源占用时,从 0.5B 开始。
  • 能够增加内存以换取稳定基准提升时,选择 1.5B。
  • 公开准确率比延迟更重要,且可以原生部署时,选择 7B。

模型名称描述的是 LLM 规模级别,并不等同于每个分发版本显示的总参数量。配置硬件前应检查具体模型卡与文件大小。