本页目录8 个章节
APPLE 模型 · 体验 · 教程
Apple 研究团队发布的远不止 FastVLM。本页按任务整理模型,标注哪些在本站有浏览器工具或经过验证的本地教程,并把每一项链接到官方来源。
视觉
可在端侧运行的视觉语言模型、图文编码器与深度估计。
[### FastVLM
浏览器工具
使用 FastViTHD 编码器的视觉语言模型;0.5B 可在浏览器运行。
发布 2025打开](/zh/blog/fastvlm-models-zh)[### Depth Pro
浏览器工具
从单张图片估计绝对深度与焦距;驱动深度图生成器。
发布 2024打开](/zh/blog/depth-pro-zh)[### MobileCLIP2
浏览器工具
低延迟图文编码器;零样本分类与相似度工具。
发布 2025打开](/zh/blog/mobileclip2-zh)[### AIMv2
运行教程
开放视觉编码器(0.3B–2.7B),支持 PyTorch、JAX 与 MLX。
发布 2024打开](/zh/blog/aimv2-zh)
3D
单图 3D:邻近视角合成与可重打光资产生成。
[### SHARP
运行教程
一张照片生成 3D Gaussian,并在一秒内实时渲染邻近视角。
发布 2025打开](/zh/blog/apple-sharp-image-to-3d-zh)[### Luce
资料
从单张物体图片生成可重打光的 PBR Gaussian 与带纹理网格。
发布 Aug 2026打开](/zh/blog/luce-zh)
图像与视频生成
基于 normalizing flow 的图像、视频与统一多模态生成。
[### STARFlow · STARFlow-V · STARFlow2
资料
面向图像、视频与统一多模态生成的可扩展 normalizing flow。
发布 2025–2026打开](/zh/blog/starflow-zh)
语言与代码
面向代码生成与检索增强推理的研究模型。
[### DiffuCoder
资料
面向代码生成的 7B 掩码扩散语言模型。
发布 2025打开](/zh/blog/apple-diffucoder-zh)[### CLaRa
资料
通过连续潜在推理连接检索与生成。
发布 2025打开](/zh/blog/apple-clara-zh)[### SimpleSD
资料
极简自蒸馏方法提升代码生成能力(Apple Research)。
发布 2026官方页面](https://machinelearning.apple.com/research/simple-self-distillation)
Apple Intelligence
驱动 Apple Intelligence 的 Apple Foundation Models 及其开发者框架。
[### Apple Foundation Models (AFM 3)
运行教程
Apple Intelligence 背后的 AFM 3 Core、Core Advanced 与 Private Cloud Compute 模型。
发布 Jun 2026打开](/zh/blog/apple-foundation-models-zh)[### Foundation Models framework
运行教程
用于端侧 LLM 会话、结构化生成、工具调用与多模态提示的 Swift 与 Python API。
发布 WWDC25 · WWDC26打开](/zh/blog/apple-foundation-models-framework-zh)
标签含义
- 浏览器工具:在本站浏览器中直接运行,无需安装。
- 运行教程:按官方仓库核对过的本地安装步骤。
- 资料:研究摘要与官方链接;尚无可运行的发布版本,或超出端侧使用范围。
或者从任务开始
深度图、分类、相似度与图片问答——每个工具都标明背后的 Apple 模型。
不止 Apple
把 FastVLM 与 SmolVLM2、LFM2.5-VL、Gemma 等可端侧运行的小型 VLM 对比。
继续阅读
更多围绕相同主题、协议或工具的文章。
引用的工具
浏览与本文主题相关的目录条目。









