如何零基础上手 Fooocus 文生图:从下载到出图实战指南

发布时间:2026/9/21 23:07:24
如何零基础上手 Fooocus 文生图:从下载到出图实战指南 如何零基础上手 Fooocus 文生图从下载到出图实战指南【免费下载链接】FooocusFocus on prompting and generating项目地址: https://gitcode.com/GitHub_Trending/fo/FooocusFooocus 是离线开源的文生图软件你只管写提示词它负责把图画好。它基于 Stable Diffusion XL 架构内置离线 GPT-2 扩词引擎短提示词出图也稳。适合不想调参数的人。一、认识项目1.1 和主流文生图方案比一比Fooocus 解决的是一个很具体的问题你只会说人话不想当提示词工程师。它把在线文生图服务的体验搬到了本地离线环境模型自己下、质量自己兜底你只负责输入。| 方案 | 形态 | 上手门槛 | 出图策略 | | - | - | - | - | | 在线文生图服务 | 在线订阅 | 最低输入即出 | 平台替你调不能本地部署 | | A1111 WebUI | 本地 | 高参数多要自己调 | 依赖你选的模型容易出塑料感 | | ComfyUI | 本地节点图 | 最高连线搭图 | 最灵活但要求懂原理 | |Fooocus| 本地 |只写提示词| 内置离线扩词 采样修正开箱稳定 |它的技术底座是 SDXL核心改进藏在 readme 的 Hidden Tricks 一节里GPT-2 离线提示词扩写、负向 ADM 引导、自注意力锐化这些就是短提示词也能出好图的原因。二、跑起来2.1 装前自检硬件最低要求Fooocus 只追求高质量出图不为低配机器妥协装之前先对表| 平台 | 最低配置 | 说明 | | - | - | - | | Windows / Linux N 卡20 系及以后 | 4GB 显存 8GB 内存 足够 Swap | 最快官方主力支持路径 | | Windows AMD 显卡DirectML | 8GB 显存 8GB 内存 | 约为 N 卡 30 系的 1/3 速度beta 支持 | | Linux AMD 显卡ROCm | 8GB 显存 8GB 内存 | 约为 N 卡 30 系的 1/2 速度beta 支持 | | Mac M1/M2MPS | 共享内存 | 约为 N 卡 30 系的 1/9 速度非官方指南 | | 纯 CPU | 32GB 内存 | 约为 N 卡的 1/17 速度仅作体验 |直白说一句低于 4GB N 卡显存 8GB 内存这条线就别硬试了官方明确说不会为了降低要求而牺牲画质。2.2 最短路径安装按系统分三条路Windows最省事从官方发布页下载 Windows 整合包7z 压缩包解压到一个不含中文和空格的路径双击run.bat就完事了。官方保证从点下载到出第一张图点击次数小于 3 次。想要动漫或写实画风直接双击run_anime.bat/run_realistic.bat。AMD 显卡要改run.bat换 DirectML 流程属于 beta 支持。Linux需要 Python 3.10conda 或 venv 都行核心就四步git clone https://gitcode.com/GitHub_Trending/fo/Fooocus cd Fooocus pip install -r requirements_versions.txt python entry_with_update.pyAMD 显卡的机器需要把 torch 换成 ROCm 版本再启动官方标注 AMD 支持是 beta 状态。macOSM1/M2压缩版装好 conda 和带 MPS 支持的 PyTorch 后同样克隆仓库、conda env create -f environment.yaml建环境、装依赖、python entry_with_update.py启动。M2 机器如果模型加载慢加--disable-offload-from-vram参数。官方对 Mac 的定位是非官方指南跑得慢属于正常。第一次启动你会看到什么点下载 / 克隆 → 终端滚动下载模型进度默认模型几个 GB→ 浏览器自动打开 Gradio 网页界面 → 提示词框里输入一句话点生成 → 几十秒到几分钟拿到第一张图。网络差的时候下载这一步就是纯等待别慌不是卡死。三、核心能力逐个拆3.1 文生图短提示词直接出图它解决的问题不会写长提示词也不想知道 CFG 是什么但想要一张拿得出手的图。上手动作在顶部提示词框输入短句子比如 a house in garden点生成其他一律不用动。实际效果内置的离线 GPT-2 引擎会先把短提示词扩写成完整提示词再叠加负向 ADM 引导和自注意力锐化三个单词的提示词也能出完整、不塑料、不过度平滑的图。3.2 图生图放大、变化、局部重绘它解决的问题手上已经有一张图想放大、微调或者只改其中一部分。上手动作在 Input Image 面板上传参考图选模式——Upscale1.5x / 2x 放大、VarySubtle / Strong 轻微或强烈变化、Inpaint / Outpaint局部重绘或向上、下、左、右扩图。实际效果Fooocus 用自己的 inpaint 模型首次用到会自动下载inpaint_v26.fooocus.patch约 1.28GB官方结论是重绘结果比用标准 SDXL 重绘方案的软件更自然。3.3 Image Prompt拿图当风格参考它解决的问题想用一张现成图控制生成结果的构图或风格而不是从头写。上手动作Input Image 面板选 Image Prompt 并上传图片想换脸的话在高级选项里开 FaceSwap。实际效果这套算法是 Fooocus 自己实现的官方结论是质量和对提示词的理解都优于标准 IP-Adapter 类方法。3.4 风格与预设一键切换画风它解决的问题想换画风但懒得自己写长提示词模板。上手动作Advanced 面板的 Style 下拉框选风格即可。仓库内置了几百个 SDXL 风格sdxl_styles/samples/ 目录里的样本图和风格名一一对应文件名就是风格名。2.3.0 之后还可以直接在浏览器界面里切换预设不切也行启动时加--preset anime就是动漫版。实际效果换画风零成本预设anime / realistic / lcm / lightning 等会连模型、LoRA、风格组合一起换每种画风用的是单独调过的模型。3.5 提示词技巧权重、通配符、数组它解决的问题想探索多个变体但一张张改提示词太慢。上手动作三种写法直接打在提示词里不用开任何开关——权重I am (happy:1.5)走 A1111 的加权算法从 Civitai 直接抄提示词也能正常发挥通配符__color__ flower从 wildcards/color.txt 按种子随机挑一个颜色数组[[red, green, blue]] flower按元素各生成一张图Image Number 设 3 即可全部出齐。实际效果探索阶段不用来回改词一次生成拿到全部变体种子相同结果可复现。四、把它调成你的样子4.1 改默认行为编辑 config.txt跑过一次之后程序会生成config.txt这是你自定义默认行为的入口默认模型、默认 LoRA、采样器、负向提示词、默认风格组合都能改示意如下{ default_model: realisticStockPhoto_v10.safetensors, default_cfg_scale: 3.0, default_sampler: dpmpp_2m, default_styles: [Fooocus V2, Fooocus Photograph, Fooocus Negative] }完整键值格式见首次启动时一并生成的config_modification_tutorial.txt。改崩了怎么办删掉config.txt就恢复默认官方就是这么说的。4.2 高级面板里值得动的旋钮Guidance控制风格化程度数值越高清爽代价是偏离提示词本意Sampling Sharpness / Contrast直接微调锐度和对比度比导出后做后处理省事Aspect Ratio用界面给的固定档位就好——SDXL 的位置编码对训练时没见过的任意分辨率处理不好固定档位出图更稳Negative Prompt等价于 Midjourney 的--no写 low quality 之类的反向约束。部署和排障时会用到几个启动参数| 参数 | 作用 | | - | - | |--listen/--port 8888| 开放局域网访问配auth.json可加账号密码 | |--share| 生成远程 API 端点 | |--preset anime| 以动漫预设启动预设文件在 presets/ 目录 | |--disable-preset-selection| 锁定浏览器里的预设切换 |其余冷门参数一句话带过跑python entry_with_update.py -h看完整表。五、高频问题速查问生成很慢、卡在 adm 2816、报RuntimeError: CPUAllocator或 Segmentation Fault答本质都是系统交换空间Swap不足。保证每个盘至少 40GB 空闲Win10/11 会自动建 SwapSwap 放 SSD 里改完重启。问报MetadataIncompleteBuffer或PytorchStreamReader答模型文件下载损坏。删掉损坏文件重新下载网络好的话 Fooocus 会自动重下。问安装时报subprocess-exited-with-error答Python 版本不对官方要求 3.10或照野教程装了依赖。严格按官方流程走Windows 用户直接跑run.bat最省事。问模型下载时SSL: CERTIFICATE_VERIFY_FAILED答下载链路证书校验失败国内网络环境常见。检查代理设置或手动下载模型放到models/checkpoints对应目录。问CUDA kernel errors might be asynchronously reported答少数设备的驱动或 CUDA 兼容问题。先升级 N 卡驱动到最新版仍不行就按官方流程换附带的旧版 xformers 环境包。问什么都没动突然变得非常慢答多半是后台还跑着第二个 Fooocus 实例或 N 卡驱动升到 532 以上触发了约 10 倍降速的已知问题。关掉多余实例驱动问题可回退到 531 版本试试。问Found no NVIDIA driver/Torch not compiled with CUDA enabled答驱动缺失或安装方式不对。升级驱动AMD 用户确认是否按--directmlWindows或 ROCmLinux流程装的。问加了--lowvram、--gpu-only、--bf16之类的参数后更卡答Fooocus 的显存管理是自动的手动干预反而更糟。去掉这些参数回到默认。更多条目见官方排障文档 troubleshoot.md。六、之后去哪儿项目目前处于LTS 状态只修 bug不加新功能暂无迁移到 Flux 等新架构的计划想玩新模型官方推荐同门的 WebUI Forge 或 ComfyUI 生态社区也有不少功能更丰富的 Fooocus 分支fork可以折腾。常用资源入口排障文档troubleshoot.md风格库几百个 SDXL 风格sdxl_styles/预设配置default / anime / realistic / lcm / lightning 等presets/通配符词库颜色、花卉、动物、国籍等wildcards/核心业务模块配置、风格、UI 逻辑modules/具体参数行为和版本差异以官方文档为准。【免费下载链接】FooocusFocus on prompting and generating项目地址: https://gitcode.com/GitHub_Trending/fo/Fooocus创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考