On This Page1 sections
ブラウザで試す
画像は端末内で処理されます。実行時にモデルをダウンロードします。WebGPU の対応はブラウザと端末によって異なります。
上のツールを操作し、以下の使い方と注意点をご確認ください。
ブラウザ AI ベンチマーク · FASTVLM-0.5B
実際の視覚言語モデルがあなたのハードウェアでどれだけ速く動くかを確認します。テストは FastVLM-0.5B を一度ダウンロードし、固定の画像と質問を2回実行して、ウォーム実行の読み込み時間、最初のトークン、デコード速度を報告します。共有する数値以外は端末から出ません。
あなたのデバイス
ブラウザ
—
OS
—
GPU アダプター
確認中…
WebGPU
確認中…
shader-f16
確認中…
ブラウザ報告メモリ
—
方法:Transformers.js と WebGPU による FastVLM-0.5B ONNX(q4、fp16 埋め込み)。固定の 1024 px レシート例とプロンプト。ウォームアップ1回、計測1回。トークン/秒 = 生成トークン数 ÷(画像→回答 − 最初のトークン)。数値は GPU、ドライバ、ブラウザ、他のタブに依存します。
画像と回答は端末内に残ります。利用統計はステップ名と所要時間を記録し、GPU 名と共有テキストはコピーしたリンクにのみ含まれます。
この数値の使い方
- 10 tokens/s 未満:ブラウザではなく Python、MLX、Core ML で FastVLM を使うか、SmolVLM-256M などより小さいモデルを選択。
- 10〜60 tokens/s:単一画像の質問には十分。回答ごとに数秒かかります。
- 60 tokens/s 超:対話的な利用が快適。精度向上にはネイティブで 1.5B を試してください。最近の Apple Silicon Mac は 100 を大きく超えます。 オンデバイス VLM を比較 · 画像 Playground を開く
Share this article
Continue Reading
More articles connected to the same themes, protocols, and tools.
Referenced Tools
Browse entries that are adjacent to the topics covered in this article.









