ブログへ戻る
FastVLMSeptember 24, 2026

FastVLM 0.5B、1.5B、7B:模型、下载与基准结果

阅读指南 ↓
FastVLM 0.5B、1.5B、7B:模型、下载与基准结果
目次3 セクション

FastVLM 有 0.5B、1.5B 和 7B 三种模型大小。选择时先确定运行环境,再挑选对应的权重和精度。模型参数量、训练阶段(Stage2/Stage3)、权重格式是不同的概念,不能只看文件名中的一个数字。

在线体验 0.5B · 返回 FastVLM 中心

如何选择

模型适合的起点需要确认的事项
0.5B浏览器体验、轻量实验浏览器演示使用社区 ONNX 转换版,而不是 Apple 原始 PyTorch 权重。
1.5B本地应用与 Stage3 实验根据 PyTorch、Transformers 或 Apple 原生应用选择对应文件。
7B需要比较更高公布分数的研究在目标设备上验证显存、延迟与实际回答质量。

Apple 的官方代码库与模型目录列出原始权重及运行方式 。0.5B1.5B7B模型卡提供各自的下载说明 。此站的浏览器演示运行 onnx-community/FastVLM-0.5B-ONNX,属于社区转换版;它不能直接替代 Apple 的原始权重。完整 Python 示例使用另一个经过验证的 Transformers 转换版本,详见Python 指南

下载前的检查

  1. 确认你要使用浏览器、Transformers、原始 PyTorch 实现还是 Apple 原生应用。
  2. 阅读该权重自己的模型卡与许可说明。不要把 Apple Silicon 导出文件当作通用 PyTorch 检查点。
  3. 预留模型加载时的临时内存;仅凭参数量无法确定峰值内存。
  4. 用自己的图片、提示词和设备测试质量、首次加载和后续推理的耗时。

1.5B 的 Stage3 文件与设置见专项指南;浏览器开发可下载WebGPU 示例

Published benchmarks · 公布的基准结果

以下为 Apple 模型卡公布的分数 ,并非本站重新测得的结果。同一行可比较三个模型;不同数据集采用不同的评分方法,不能混成一个综合排名。

基准测试0.5B1.5B7B
AI2D68.077.483.6
ScienceQA85.294.496.7
MMMU33.937.845.4
VQAv276.379.180.8
ChartQA76.080.185.0
TextVQA64.570.474.9
InfoVQA46.459.775.8
DocVQA82.588.393.2
OCRBench63.970.273.1
RealWorldQA56.161.267.2
SeedBench-Img71.074.275.4

原论文讨论了视觉编码、首 token 延迟和图像分辨率对结果的影响:FastVLM 论文 。这些公布分数不能保证浏览器转换版或你的设备会达到相同质量与速度。旧站的24 张图片评测采用另一套方法 ,不应与上表混算。

比较模型时建议同时记录模型版本、权重格式、图像大小、设备、推理库和生成长度。先在在线演示用几张真实图片验证任务是否适合,再决定是否下载更大的权重。本站是独立开发者资源,并非 Apple 官方网站。

この記事を共有

関連ツール

この記事のテーマに近いディレクトリ項目を確認できます。

ディレクトリを見る