本页目录8 个章节
工具 · 在你的设备上运行
每个工具首次使用时下载一次开放模型,然后通过 WebGPU(或标注的 WebAssembly)在你的 GPU 上运行。图片、标签与结果都留在本机。
[浏览器内运行
图片问答
对照片或截图提问、提取文字、解释图表。
驱动模型
FastVLM-0.5B
下载量
≈1.1 GB
打开工具](/zh/fastvlm/demo#image-playground) · [浏览器内运行
深度图生成器
把一张图片转换成深度图并下载 PNG。
驱动模型
Depth Pro · Depth Anything V2
下载量
50 MB – 600 MB
打开工具](/zh/blog/depth-map-generator-zh) · [浏览器内运行
零样本图片分类
输入自定义标签,对图片打分排序,无需训练。
驱动模型
MobileCLIP-S0
下载量
≈55 MB – 110 MB
打开工具](/zh/blog/image-classifier-zh) · [浏览器内运行
图文相似度
用 CLIP 向量计算句子与图片的匹配程度。
驱动模型
MobileCLIP-S0
下载量
≈55 MB – 110 MB
打开工具](/zh/blog/image-text-similarity-zh) · [本地教程
图片转 3D
把一张照片变成可看邻近视角的 3D Gaussian,或可重打光的 3D 资产。
驱动模型
SHARP · Luce
下载量
Local install
打开工具](/zh/blog/apple-sharp-image-to-3d-zh) · [浏览器内运行
测试你的设备
测量模型加载、首 Token 和每秒 Token 数,并分享结果。
驱动模型
FastVLM-0.5B
下载量
≈1.1 GB
打开工具](/zh/blog/benchmark-fastvlm-device-zh)
这些工具如何工作
- 模型首次使用时从 Hugging Face 获取,并由浏览器缓存。
- 推理在 Web Worker 中调用你的 GPU;FastVLM.net 不会收到你的图片。
- 使用统计只记录固定的步骤名、模型和耗时,不包含任何内容。
想了解模型本身?
每个工具都链接到背后的 Apple 模型页面,包含 Python、MLX 与浏览器运行说明。
继续阅读
更多围绕相同主题、协议或工具的文章。
引用的工具
浏览与本文主题相关的目录条目。









