公開評価
FastVLM ベンチマーク
3つの公式モデルを11種類の視覚言語評価で比較します。モデルを選択するとスコア分布を確認できます。
モデルを選択
ベンチマークスコア分布
FastVLM-0.5B高いほど良い
AI2D
68.0
ScienceQA
85.2
MMMU
33.9
VQAv2
76.3
ChartQA
76.0
TextVQA
64.5
InfoVQA
46.4
DocVQA
82.5
OCRBench
63.9
RealWorldQA
56.1
SeedBench-Img
71.0
全比較表
| ベンチマーク | 0.5B | 1.5B | 7B |
|---|---|---|---|
| AI2D | 68.0 | 77.4 | 83.6 |
| ScienceQA | 85.2 | 94.4 | 96.7 |
| MMMU | 33.9 | 37.8 | 45.4 |
| VQAv2 | 76.3 | 79.1 | 80.8 |
| ChartQA | 76.0 | 80.1 | 85.0 |
| TextVQA | 64.5 | 70.4 | 74.9 |
| InfoVQA | 46.4 | 59.7 | 75.8 |
| DocVQA | 82.5 | 88.3 | 93.2 |
| OCRBench | 63.9 | 70.2 | 73.1 |
| RealWorldQA | 56.1 | 61.2 | 67.2 |
| SeedBench-Img | 71.0 | 74.2 | 75.4 |
数値の読み方
Apple FastVLM Hugging Face モデルカードで公開された評価値です。遅延は解像度、精度、ハードウェア、実装に依存するため、単一の共通値は掲載していません。同じベンチマーク行でモデルを比較し、異なる評価の数値尺度を同一視しないでください。