在苹果设备上运行Stable Diffusion模型

2024-08-22 17:52

本文主要是介绍在苹果设备上运行Stable Diffusion模型,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

在苹果设备上运行Stable Diffusion模型

本文介绍了在苹果设备(MAC、iPad、iPhone)上运行Stable Diffusion模型的方法,包括模型的下载、格式转换以及如何在Swift中调用模型进行推理。

模型类别

首先要下载模型,Stable Diffusion模型可以在huggingface或者Civitai下载到。但是在这两个网站上下载的模型可能会有三种格式。

CoreML格式

这种类别的模型较少,文件主要以.mlmodelc.mlmodel为主,其文件结构大致为:

├── TextEncoder.mlmodelc
├── TextEncoder2.mlmodelc
├── Unet.mlmodelc
├── VAEDecoder.mlmodelc
├── merges.txt
└── vocab.json

Diffusers格式

huggingface上下载的模型大多是这种类型,其文件结构大致为:

├── model_index.json
├── scheduler
│   └── scheduler_config.json
├── text_encoder
│   ├── config.json
│   └── pytorch_model.bin
├── tokenizer
│   ├── merges.txt
│   ├── special_tokens_map.json
│   ├── tokenizer_config.json
│   └── vocab.json
├── unet
│   ├── config.json
│   └── diffusion_pytorch_model.bin
└── vae├── config.json└── diffusion_pytorch_model.bin

safetensors格式

Civitai网站下载的大多是这种格式,就一个文件,非常方便。

模型转换

接下来,需要把下载下来的模型都转成CoreML格式,如果你在第一步下载的模型已经是CoreML格式,那么这一步就可以跳过。

Diffusers格式转CoreML格式

首先下载该仓库代码:ml-stable-diffusion。查看System Requirements检查自己的设备是否支持。然后安装依赖:

pip install -r requirements.txt

找到torch2coreml.py文件,执行以下命令:

python torch2coreml.py \
--bundle-resources-for-swift-cli \
--xl-version \
--convert-unet \
--convert-text-encoder \
--convert-vae-decoder \
--attention-implementation ORIGINAL \
--model-version /your/model/path \
-o /your/model/output/path

注意有个参数--xl-version,如果模型是sdxl类型的,就加上,否则把这行删除。另外如果你的模型支持图生图,你可以加上--convert-vae-encoder参数。

运行完该命令,应该在你指定的目录生成了文件,在Resources目录下的文件就是转换好的CoreML格式。

safetensors格式转Diffusers格式

首先下载该仓库代码:Diffusers。然后安装依赖:

pip install --upgrade diffusers

找到convert_original_stable_diffusion_to_diffusers.py文件并执行以下命令:

python convert_original_stable_diffusion_to_diffusers.py \
--checkpoint_path /your/model/path \
--dump_path /your/model/output/path \
--from_safetensors \
--half \
--device mps

这里--half表示转换时精度为fp16--device mps表示模型使用mps(GPU)进行推理。

运行完该命令,会生成Diffusers格式的模型,再利用Diffusers格式转CoreML格式的步骤,将模型转换为CoreML格式。

Swift调用Stable Diffusion模型

使用Huggingface提供的swift-coreml-diffusers库。

import StableDiffusion
import CoreML// 初始化CoreML配置
let config = MLModelConfiguration()
// 运行在GPU上(MAC限定)
config.computeUnits = MLComputeUnits.cpuAndGPU
// 初始化pipeline
var pipeline = try StableDiffusionPipeline(resourcesAt: modelDirectory,controlNet: [],configuration: config,reduceMemory: diffusersConfig.reduceMemory)
let pipeline.loadResources()
// 初始化图片推理配置
var pipelineConfig = StableDiffusionPipeline.Configuration(prompt: prompt)
pipelineConfig.stepCount = stepCount
pipelineConfig.guidanceScale = cfgScale
pipelineConfig.schedulerType = scheduler
// 开始图片推理
let images = try pipeline.generateImages(configuration: pipelineConfig,progressHandler: { progress in
})

我的AquariusAI项目提供了示例代码。

最后

那到底什么是CoreML呢?

Core ML 是Apple Silicon芯片产品(包括macOS、iOS、watchOS 和 tvOS)中使用的机器学习框架,用于执行快速预测或推理,在边缘轻松集成预训练的机器学习模型,从而可以对设备上的实时图像或视频进行实时预测。

Core ML 通过利用 CPU、GPU 和 神经网络引擎 ,同时最大程度地减小内存占用空间和功耗,来优化设备端性能。 由于模型严格地在用户设备上,因此无需任何网络连接,这有助于保护用户数据的私密性和 App 的响应速度。

简而言之,如果你的模型运行在Silicon芯片的苹果设备上,利用Core ML可以获得更快的性能和更低的内存及能耗。


本文首发于:https://babyno.top/posts/2024/06/run-the-stable-diffusion-model-on-apple-devices/

欢迎关注我的公众号“机器人小不”,原创技术文章第一时间推送。

这篇关于在苹果设备上运行Stable Diffusion模型的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1096981

相关文章

Python运行中频繁出现Restart提示的解决办法

《Python运行中频繁出现Restart提示的解决办法》在编程的世界里,遇到各种奇怪的问题是家常便饭,但是,当你的Python程序在运行过程中频繁出现“Restart”提示时,这可能不仅仅是令人头疼... 目录问题描述代码示例无限循环递归调用内存泄漏解决方案1. 检查代码逻辑无限循环递归调用内存泄漏2.

Spring Security基于数据库的ABAC属性权限模型实战开发教程

《SpringSecurity基于数据库的ABAC属性权限模型实战开发教程》:本文主要介绍SpringSecurity基于数据库的ABAC属性权限模型实战开发教程,本文给大家介绍的非常详细,对大... 目录1. 前言2. 权限决策依据RBACABAC综合对比3. 数据库表结构说明4. 实战开始5. MyBA

Java的IO模型、Netty原理解析

《Java的IO模型、Netty原理解析》Java的I/O是以流的方式进行数据输入输出的,Java的类库涉及很多领域的IO内容:标准的输入输出,文件的操作、网络上的数据传输流、字符串流、对象流等,这篇... 目录1.什么是IO2.同步与异步、阻塞与非阻塞3.三种IO模型BIO(blocking I/O)NI

基于Flask框架添加多个AI模型的API并进行交互

《基于Flask框架添加多个AI模型的API并进行交互》:本文主要介绍如何基于Flask框架开发AI模型API管理系统,允许用户添加、删除不同AI模型的API密钥,感兴趣的可以了解下... 目录1. 概述2. 后端代码说明2.1 依赖库导入2.2 应用初始化2.3 API 存储字典2.4 路由函数2.5 应

Java终止正在运行的线程的三种方法

《Java终止正在运行的线程的三种方法》停止一个线程意味着在任务处理完任务之前停掉正在做的操作,也就是放弃当前的操作,停止一个线程可以用Thread.stop()方法,但最好不要用它,本文给大家介绍了... 目录前言1. 停止不了的线程2. 判断线程是否停止状态3. 能停止的线程–异常法4. 在沉睡中停止5

在VSCode中本地运行DeepSeek的流程步骤

《在VSCode中本地运行DeepSeek的流程步骤》本文详细介绍了如何在本地VSCode中安装和配置Ollama和CodeGPT,以使用DeepSeek进行AI编码辅助,无需依赖云服务,需要的朋友可... 目录步骤 1:在 VSCode 中安装 Ollama 和 CodeGPT安装Ollama下载Olla

解读docker运行时-itd参数是什么意思

《解读docker运行时-itd参数是什么意思》在Docker中,-itd参数组合用于在后台运行一个交互式容器,同时保持标准输入和分配伪终端,这种方式适合需要在后台运行容器并保持交互能力的场景... 目录docker运行时-itd参数是什么意思1. -i(或 --interactive)2. -t(或 --

C#集成DeepSeek模型实现AI私有化的流程步骤(本地部署与API调用教程)

《C#集成DeepSeek模型实现AI私有化的流程步骤(本地部署与API调用教程)》本文主要介绍了C#集成DeepSeek模型实现AI私有化的方法,包括搭建基础环境,如安装Ollama和下载DeepS... 目录前言搭建基础环境1、安装 Ollama2、下载 DeepSeek R1 模型客户端 ChatBo

pycharm远程连接服务器运行pytorch的过程详解

《pycharm远程连接服务器运行pytorch的过程详解》:本文主要介绍在Linux环境下使用Anaconda管理不同版本的Python环境,并通过PyCharm远程连接服务器来运行PyTorc... 目录linux部署pytorch背景介绍Anaconda安装Linux安装pytorch虚拟环境安装cu

SpringBoot快速接入OpenAI大模型的方法(JDK8)

《SpringBoot快速接入OpenAI大模型的方法(JDK8)》本文介绍了如何使用AI4J快速接入OpenAI大模型,并展示了如何实现流式与非流式的输出,以及对函数调用的使用,AI4J支持JDK8... 目录使用AI4J快速接入OpenAI大模型介绍AI4J-github快速使用创建SpringBoot