# 在浏览器里运行的 AI 图片工具

基于 Apple 视觉模型的浏览器工具：深度图生成器、零样本图片分类、图文相似度、图片问答和设备基准测试。图片不离开你的设备。

Canonical URL: https://aiidelist.com/zh/blog/apple-ai-browser-tools-zh

Language: zh

Published: 2026-09-24

Updated: 2026-09-24

工具 · 在你的设备上运行

每个工具首次使用时下载一次开放模型，然后通过 WebGPU（或标注的 WebAssembly）在你的 GPU 上运行。图片、标签与结果都留在本机。

 [浏览器内运行

## 图片问答

对照片或截图提问、提取文字、解释图表。

**驱动模型**

FastVLM-0.5B

**下载量**

≈1.1 GB

打开工具](/zh/fastvlm/demo#image-playground) ·  [浏览器内运行

## 深度图生成器

把一张图片转换成深度图并下载 PNG。

**驱动模型**

Depth Pro · Depth Anything V2

**下载量**

50 MB – 600 MB

打开工具](/zh/blog/depth-map-generator-zh) ·  [浏览器内运行

## 零样本图片分类

输入自定义标签，对图片打分排序，无需训练。

**驱动模型**

MobileCLIP-S0

**下载量**

≈55 MB – 110 MB

打开工具](/zh/blog/image-classifier-zh) ·  [浏览器内运行

## 图文相似度

用 CLIP 向量计算句子与图片的匹配程度。

**驱动模型**

MobileCLIP-S0

**下载量**

≈55 MB – 110 MB

打开工具](/zh/blog/image-text-similarity-zh) ·  [本地教程

## 图片转 3D

把一张照片变成可看邻近视角的 3D Gaussian，或可重打光的 3D 资产。

**驱动模型**

SHARP · Luce

**下载量**

Local install

打开工具](/zh/blog/apple-sharp-image-to-3d-zh) ·  [浏览器内运行

## 测试你的设备

测量模型加载、首 Token 和每秒 Token 数，并分享结果。

**驱动模型**

FastVLM-0.5B

**下载量**

≈1.1 GB

打开工具](/zh/blog/benchmark-fastvlm-device-zh)

## 这些工具如何工作

- 模型首次使用时从 Hugging Face 获取，并由浏览器缓存。
- 推理在 Web Worker 中调用你的 GPU；FastVLM.net 不会收到你的图片。
- 使用统计只记录固定的步骤名、模型和耗时，不包含任何内容。

## 想了解模型本身？

每个工具都链接到背后的 Apple 模型页面，包含 Python、MLX 与浏览器运行说明。

[浏览 Apple 模型](/zh/blog/apple-ai-models-zh)
