mflux

mflux

Mac专用的FLUX模型AI图像生成工具

mflux是基于Apple MLX框架的FLUX模型开源实现,为Mac设备优化的AI图像生成工具。它支持本地运行FLUX.1-Schnell模型,可生成1024x1024分辨率图像,无需云服务。项目代码简洁,专注于模型表达,适合学习和开发。未来计划支持更多FLUX模型和功能。

FLUXMLXAI绘图MacFLUXHuggingface DiffusersGithub开源项目

图片 基于Hugging Face Diffusers实现的FLUX的MLX移植版本。

关于

在您的Mac上本地运行来自Black Forest Labs的强大FLUX模型!

理念

MFLUX(MacFLUX)是将Hugging Face Diffusers库中的FLUX实现逐行移植到Apple MLX的版本。MFLUX刻意保持简洁明了 - 网络架构是硬编码的,除了分词器外不使用配置文件。目标是拥有一个专注于表达这些模型的精简代码库(从而避免过多抽象)。MFLUX优先考虑可读性,而非通用性和性能。

所有模型都是在MLX中从头实现的,只有分词器是通过Hugging Face Transformers库使用的。除此之外,只有最少的依赖,如用于简单图像后处理的NumpyPillow

模型

  • FLUX.1-Scnhell
  • FLUX.1-Dev

安装

  1. 克隆仓库:
    git clone git@github.com:filipstrand/mflux.git
    
  2. 进入项目目录并设置虚拟环境:
    cd mflux && python3 -m venv .venv && source .venv/bin/activate
    
  3. 安装所需依赖:
    pip install -r requirements.txt
    

生成图像

运行提供的main.py

python main.py

或创建一个新的独立脚本,如下所示

import sys sys.path.append("/path/to/mflux/src") from flux_1_schnell.config.config import Config from flux_1_schnell.flux import Flux1Schnell from flux_1_schnell.post_processing.image_util import ImageUtil flux = Flux1Schnell("black-forest-labs/FLUX.1-schnell") image = flux.generate_image( seed=3, prompt="奢华的生日蛋糕美食照。中间有三根蜡烛,形状像字母拼写出'MLX'一词。完美的灯光和舒适的背景,有大型散景和浅景深。场景氛围是托斯卡纳的日落阳台。照片从蛋糕侧面拍摄。温暖诱人的光线凸显了食材的质地和色彩,营造出令人食欲大开且优雅的效果。", config=Config( num_inference_steps=2, ) ) ImageUtil.save_image(image, "image.png")

如果您的机器上尚未下载模型,它将开始下载过程并获取模型权重(Schnell模型约34GB大小)。

生成单张图像(使用2步推理,Schnell模型)需要2到3分钟。此实现已在两台MacBook Pro机器上测试:

  • 2021 M1 Pro (32 GB)
  • 2023 M2 Max (32 GB)

更新: 在更快的机器上,@karpathy@awni报告时间约20秒甚至更短!

等同于Diffusers实现

生成图像时只有一个随机源:初始潜在数组。在此实现中,这个初始潜在完全由输入的seed参数确定性控制。然而,如果我们导入从Diffusers实现中保存的固定潜在数组实例,那么MFLUX将生成与Diffusers实现相同的图像(假设使用固定的提示词并使用Diffusers设置中的默认参数设置)。

下面的图像说明了这种等同性。 在所有情况下,Schnell模型运行了2个时间步。 Diffusers实现在CPU模式下运行。 MFLUX的精度可以在Config类中设置。 在16位和32位精度之间切换时,最终图像通常会有明显但非常小的差异。


奢华的食物照片

图片


昏暗房间里木桌上老旧多尘的CRT显示器的细节电影感景深渲染,周围杂乱脏乱。屏幕上柔和发光的字母"FLUX"。高细节硬表面渲染

图片


写实风格,魔戒,一只蜷缩在巢穴中睡觉的小红龙,(柔焦),(光圈2.8),(焦距50mm)微距镜头f/2.8,中世纪巫师桌,(柔和)色彩,(舒适的)晨光透过附近窗户,(奇幻的)蒸汽形状,用(佳能EOS R5)拍摄,突出(宁静的)舒适感,中世纪,龙与地下城,角色扮演游戏,3D,16K,8K

图片


一位60多岁的饱经风霜的渔夫站在他的船甲板上,凝视着暴风雨中的大海。他有浓密的花白胡须,深陷的蓝眼睛,皮肤因多年阳光照射而晒黑并布满皱纹。他穿着黄色雨衣和帽子,布料上挂着水滴。他身后,乌云密布,波浪拍打着船舷。整体氛围充满紧张感,表现出对大自然力量的敬畏。

图片


意大利蛤蜊意大利面(Linguine alle vongole)的奢华美食照片,配有大量蛤蜊。完美的灯光和舒适的背景,有大型散景和浅景深。氛围是托斯卡纳日落阳台。照片从盘子侧面拍摄。意大利面闪闪发光,上面撒有帕尔马干酪和罗勒叶。温暖诱人的光线突出了食材的质地和色彩,营造出令人食欲大开且优雅的效果。

图片


当前限制

  • 图像逐一生成。
  • 不支持负面提示词。

待办事项

  • FLUX Dev实现
  • LoRA适配器
  • 命令行参数

编辑推荐精选

博思AIPPT

博思AIPPT

AI一键生成PPT,就用博思AIPPT!

博思AIPPT,新一代的AI生成PPT平台,支持智能生成PPT、AI美化PPT、文本&链接生成PPT、导入Word/PDF/Markdown文档生成PPT等,内置海量精美PPT模板,涵盖商务、教育、科技等不同风格,同时针对每个页面提供多种版式,一键自适应切换,完美适配各种办公场景。

AI办公办公工具AI工具博思AIPPTAI生成PPT智能排版海量精品模板AI创作热门
潮际好麦

潮际好麦

AI赋能电商视觉革命,一站式智能商拍平台

潮际好麦深耕服装行业,是国内AI试衣效果最好的软件。使用先进AIGC能力为电商卖家批量提供优质的、低成本的商拍图。合作品牌有Shein、Lazada、安踏、百丽等65个国内外头部品牌,以及国内10万+淘宝、天猫、京东等主流平台的品牌商家,为卖家节省将近85%的出图成本,提升约3倍出图效率,让品牌能够快速上架。

iTerms

iTerms

企业专属的AI法律顾问

iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。

SimilarWeb流量提升

SimilarWeb流量提升

稳定高效的流量提升解决方案,助力品牌曝光

稳定高效的流量提升解决方案,助力品牌曝光

Sora2视频免费生成

Sora2视频免费生成

最新版Sora2模型免费使用,一键生成无水印视频

最新版Sora2模型免费使用,一键生成无水印视频

Transly

Transly

实时语音翻译/同声传译工具

Transly是一个多场景的AI大语言模型驱动的同声传译、专业翻译助手,它拥有超精准的音频识别翻译能力,几乎零延迟的使用体验和支持多国语言可以让你带它走遍全球,无论你是留学生、商务人士、韩剧美剧爱好者,还是出国游玩、多国会议、跨国追星等等,都可以满足你所有需要同传的场景需求,线上线下通用,扫除语言障碍,让全世界的语言交流不再有国界。

讯飞绘文

讯飞绘文

选题、配图、成文,一站式创作,让内容运营更高效

讯飞绘文,一个AI集成平台,支持写作、选题、配图、排版和发布。高效生成适用于各类媒体的定制内容,加速品牌传播,提升内容营销效果。

热门AI辅助写作AI工具讯飞绘文内容运营AI创作个性化文章多平台分发AI助手
TRAE编程

TRAE编程

AI辅助编程,代码自动修复

Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。

AI工具TraeAI IDE协作生产力转型热门
商汤小浣熊

商汤小浣熊

最强AI数据分析助手

小浣熊家族Raccoon,您的AI智能助手,致力于通过先进的人工智能技术,为用户提供高效、便捷的智能服务。无论是日常咨询还是专业问题解答,小浣熊都能以快速、准确的响应满足您的需求,让您的生活更加智能便捷。

imini AI

imini AI

像人一样思考的AI智能体

imini 是一款超级AI智能体,能根据人类指令,自主思考、自主完成、并且交付结果的AI智能体。

下拉加载更多