返回文章列表
本页目录8 个章节

APPLE 模型 · 体验 · 教程

Apple 研究团队发布的远不止 FastVLM。本页按任务整理模型,标注哪些在本站有浏览器工具或经过验证的本地教程,并把每一项链接到官方来源。

视觉

可在端侧运行的视觉语言模型、图文编码器与深度估计。

[### FastVLM

浏览器工具

使用 FastViTHD 编码器的视觉语言模型;0.5B 可在浏览器运行。

发布 2025打开](/zh/blog/fastvlm-models-zh)[### Depth Pro

浏览器工具

从单张图片估计绝对深度与焦距;驱动深度图生成器。

发布 2024打开](/zh/blog/depth-pro-zh)[### MobileCLIP2

浏览器工具

低延迟图文编码器;零样本分类与相似度工具。

发布 2025打开](/zh/blog/mobileclip2-zh)[### AIMv2

运行教程

开放视觉编码器(0.3B–2.7B),支持 PyTorch、JAX 与 MLX。

发布 2024打开](/zh/blog/aimv2-zh)

3D

单图 3D:邻近视角合成与可重打光资产生成。

[### SHARP

运行教程

一张照片生成 3D Gaussian,并在一秒内实时渲染邻近视角。

发布 2025打开](/zh/blog/apple-sharp-image-to-3d-zh)[### Luce

资料

从单张物体图片生成可重打光的 PBR Gaussian 与带纹理网格。

发布 Aug 2026打开](/zh/blog/luce-zh)

图像与视频生成

基于 normalizing flow 的图像、视频与统一多模态生成。

[### STARFlow · STARFlow-V · STARFlow2

资料

面向图像、视频与统一多模态生成的可扩展 normalizing flow。

发布 2025–2026打开](/zh/blog/starflow-zh)

语言与代码

面向代码生成与检索增强推理的研究模型。

[### DiffuCoder

资料

面向代码生成的 7B 掩码扩散语言模型。

发布 2025打开](/zh/blog/apple-diffucoder-zh)[### CLaRa

资料

通过连续潜在推理连接检索与生成。

发布 2025打开](/zh/blog/apple-clara-zh)[### SimpleSD

资料

极简自蒸馏方法提升代码生成能力(Apple Research)。

发布 2026官方页面](https://machinelearning.apple.com/research/simple-self-distillation)

Apple Intelligence

驱动 Apple Intelligence 的 Apple Foundation Models 及其开发者框架。

[### Apple Foundation Models (AFM 3)

运行教程

Apple Intelligence 背后的 AFM 3 Core、Core Advanced 与 Private Cloud Compute 模型。

发布 Jun 2026打开](/zh/blog/apple-foundation-models-zh)[### Foundation Models framework

运行教程

用于端侧 LLM 会话、结构化生成、工具调用与多模态提示的 Swift 与 Python API。

发布 WWDC25 · WWDC26打开](/zh/blog/apple-foundation-models-framework-zh)

标签含义

  • 浏览器工具:在本站浏览器中直接运行,无需安装。
  • 运行教程:按官方仓库核对过的本地安装步骤。
  • 资料:研究摘要与官方链接;尚无可运行的发布版本,或超出端侧使用范围。

或者从任务开始

深度图、分类、相似度与图片问答——每个工具都标明背后的 Apple 模型。

浏览工具

不止 Apple

把 FastVLM 与 SmolVLM2、LFM2.5-VL、Gemma 等可端侧运行的小型 VLM 对比。

端侧 VLM 中心

分享这篇文章

引用的工具

浏览与本文主题相关的目录条目。

探索目录