指南)
如何零基礎上手 Fooocus 文生圖從下載到出圖實戰(zhàn)指南【免費下載鏈接】FooocusFocus on prompting and generating項目地址: https://gitcode.com/GitHub_Trending/fo/FooocusFooocus 是離線開源的文生圖軟件你只管寫提示詞它負責把圖畫好。它基于 Stable Diffusion XL 架構內置離線 GPT-2 擴詞引擎短提示詞出圖也穩(wěn)。適合不想調參數(shù)的人。一、認識項目1.1 和主流文生圖方案比一比Fooocus 解決的是一個很具體的問題你只會說人話不想當提示詞工程師。它把在線文生圖服務的體驗搬到了本地離線環(huán)境模型自己下、質量自己兜底你只負責輸入。| 方案 | 形態(tài) | 上手門檻 | 出圖策略 | | - | - | - | - | | 在線文生圖服務 | 在線訂閱 | 最低輸入即出 | 平臺替你調不能本地部署 | | A1111 WebUI | 本地 | 高參數(shù)多要自己調 | 依賴你選的模型容易出塑料感 | | ComfyUI | 本地節(jié)點圖 | 最高連線搭圖 | 最靈活但要求懂原理 | |Fooocus| 本地 |只寫提示詞| 內置離線擴詞 采樣修正開箱穩(wěn)定 |它的技術底座是 SDXL核心改進藏在 readme 的 Hidden Tricks 一節(jié)里GPT-2 離線提示詞擴寫、負向 ADM 引導、自注意力銳化這些就是短提示詞也能出好圖的原因。二、跑起來2.1 裝前自檢硬件最低要求Fooocus 只追求高質量出圖不為低配機器妥協(xié)裝之前先對表| 平臺 | 最低配置 | 說明 | | - | - | - | | Windows / Linux N 卡20 系及以后 | 4GB 顯存 8GB 內存 足夠 Swap | 最快官方主力支持路徑 | | Windows AMD 顯卡DirectML | 8GB 顯存 8GB 內存 | 約為 N 卡 30 系的 1/3 速度beta 支持 | | Linux AMD 顯卡ROCm | 8GB 顯存 8GB 內存 | 約為 N 卡 30 系的 1/2 速度beta 支持 | | Mac M1/M2MPS | 共享內存 | 約為 N 卡 30 系的 1/9 速度非官方指南 | | 純 CPU | 32GB 內存 | 約為 N 卡的 1/17 速度僅作體驗 |直白說一句低于 4GB N 卡顯存 8GB 內存這條線就別硬試了官方明確說不會為了降低要求而犧牲畫質。2.2 最短路徑安裝按系統(tǒng)分三條路Windows最省事從官方發(fā)布頁下載 Windows 整合包7z 壓縮包解壓到一個不含中文和空格的路徑雙擊run.bat就完事了。官方保證從點下載到出第一張圖點擊次數(shù)小于 3 次。想要動漫或寫實畫風直接雙擊run_anime.bat/run_realistic.bat。AMD 顯卡要改run.bat換 DirectML 流程屬于 beta 支持。Linux需要 Python 3.10conda 或 venv 都行核心就四步git clone https://gitcode.com/GitHub_Trending/fo/Fooocus cd Fooocus pip install -r requirements_versions.txt python entry_with_update.pyAMD 顯卡的機器需要把 torch 換成 ROCm 版本再啟動官方標注 AMD 支持是 beta 狀態(tài)。macOSM1/M2壓縮版裝好 conda 和帶 MPS 支持的 PyTorch 后同樣克隆倉庫、conda env create -f environment.yaml建環(huán)境、裝依賴、python entry_with_update.py啟動。M2 機器如果模型加載慢加--disable-offload-from-vram參數(shù)。官方對 Mac 的定位是非官方指南跑得慢屬于正常。第一次啟動你會看到什么點下載 / 克隆 → 終端滾動下載模型進度默認模型幾個 GB→ 瀏覽器自動打開 Gradio 網(wǎng)頁界面 → 提示詞框里輸入一句話點生成 → 幾十秒到幾分鐘拿到第一張圖。網(wǎng)絡差的時候下載這一步就是純等待別慌不是卡死。三、核心能力逐個拆3.1 文生圖短提示詞直接出圖它解決的問題不會寫長提示詞也不想知道 CFG 是什么但想要一張拿得出手的圖。上手動作在頂部提示詞框輸入短句子比如 a house in garden點生成其他一律不用動。實際效果內置的離線 GPT-2 引擎會先把短提示詞擴寫成完整提示詞再疊加負向 ADM 引導和自注意力銳化三個單詞的提示詞也能出完整、不塑料、不過度平滑的圖。3.2 圖生圖放大、變化、局部重繪它解決的問題手上已經(jīng)有一張圖想放大、微調或者只改其中一部分。上手動作在 Input Image 面板上傳參考圖選模式——Upscale1.5x / 2x 放大、VarySubtle / Strong 輕微或強烈變化、Inpaint / Outpaint局部重繪或向上、下、左、右擴圖。實際效果Fooocus 用自己的 inpaint 模型首次用到會自動下載inpaint_v26.fooocus.patch約 1.28GB官方結論是重繪結果比用標準 SDXL 重繪方案的軟件更自然。3.3 Image Prompt拿圖當風格參考它解決的問題想用一張現(xiàn)成圖控制生成結果的構圖或風格而不是從頭寫。上手動作Input Image 面板選 Image Prompt 并上傳圖片想換臉的話在高級選項里開 FaceSwap。實際效果這套算法是 Fooocus 自己實現(xiàn)的官方結論是質量和對提示詞的理解都優(yōu)于標準 IP-Adapter 類方法。3.4 風格與預設一鍵切換畫風它解決的問題想換畫風但懶得自己寫長提示詞模板。上手動作Advanced 面板的 Style 下拉框選風格即可。倉庫內置了幾百個 SDXL 風格sdxl_styles/samples/ 目錄里的樣本圖和風格名一一對應文件名就是風格名。2.3.0 之后還可以直接在瀏覽器界面里切換預設不切也行啟動時加--preset anime就是動漫版。實際效果換畫風零成本預設anime / realistic / lcm / lightning 等會連模型、LoRA、風格組合一起換每種畫風用的是單獨調過的模型。3.5 提示詞技巧權重、通配符、數(shù)組它解決的問題想探索多個變體但一張張改提示詞太慢。上手動作三種寫法直接打在提示詞里不用開任何開關——權重I am (happy:1.5)走 A1111 的加權算法從 Civitai 直接抄提示詞也能正常發(fā)揮通配符__color__ flower從 wildcards/color.txt 按種子隨機挑一個顏色數(shù)組[[red, green, blue]] flower按元素各生成一張圖Image Number 設 3 即可全部出齊。實際效果探索階段不用來回改詞一次生成拿到全部變體種子相同結果可復現(xiàn)。四、把它調成你的樣子4.1 改默認行為編輯 config.txt跑過一次之后程序會生成config.txt這是你自定義默認行為的入口默認模型、默認 LoRA、采樣器、負向提示詞、默認風格組合都能改示意如下{ default_model: realisticStockPhoto_v10.safetensors, default_cfg_scale: 3.0, default_sampler: dpmpp_2m, default_styles: [Fooocus V2, Fooocus Photograph, Fooocus Negative] }完整鍵值格式見首次啟動時一并生成的config_modification_tutorial.txt。改崩了怎么辦刪掉config.txt就恢復默認官方就是這么說的。4.2 高級面板里值得動的旋鈕Guidance控制風格化程度數(shù)值越高清爽代價是偏離提示詞本意Sampling Sharpness / Contrast直接微調銳度和對比度比導出后做后處理省事Aspect Ratio用界面給的固定檔位就好——SDXL 的位置編碼對訓練時沒見過的任意分辨率處理不好固定檔位出圖更穩(wěn)Negative Prompt等價于 Midjourney 的--no寫 low quality 之類的反向約束。部署和排障時會用到幾個啟動參數(shù)| 參數(shù) | 作用 | | - | - | |--listen/--port 8888| 開放局域網(wǎng)訪問配auth.json可加賬號密碼 | |--share| 生成遠程 API 端點 | |--preset anime| 以動漫預設啟動預設文件在 presets/ 目錄 | |--disable-preset-selection| 鎖定瀏覽器里的預設切換 |其余冷門參數(shù)一句話帶過跑python entry_with_update.py -h看完整表。五、高頻問題速查問生成很慢、卡在 adm 2816、報RuntimeError: CPUAllocator或 Segmentation Fault答本質都是系統(tǒng)交換空間Swap不足。保證每個盤至少 40GB 空閑Win10/11 會自動建 SwapSwap 放 SSD 里改完重啟。問報MetadataIncompleteBuffer或PytorchStreamReader答模型文件下載損壞。刪掉損壞文件重新下載網(wǎng)絡好的話 Fooocus 會自動重下。問安裝時報subprocess-exited-with-error答Python 版本不對官方要求 3.10或照野教程裝了依賴。嚴格按官方流程走Windows 用戶直接跑run.bat最省事。問模型下載時SSL: CERTIFICATE_VERIFY_FAILED答下載鏈路證書校驗失敗國內網(wǎng)絡環(huán)境常見。檢查代理設置或手動下載模型放到models/checkpoints對應目錄。問CUDA kernel errors might be asynchronously reported答少數(shù)設備的驅動或 CUDA 兼容問題。先升級 N 卡驅動到最新版仍不行就按官方流程換附帶的舊版 xformers 環(huán)境包。問什么都沒動突然變得非常慢答多半是后臺還跑著第二個 Fooocus 實例或 N 卡驅動升到 532 以上觸發(fā)了約 10 倍降速的已知問題。關掉多余實例驅動問題可回退到 531 版本試試。問Found no NVIDIA driver/Torch not compiled with CUDA enabled答驅動缺失或安裝方式不對。升級驅動AMD 用戶確認是否按--directmlWindows或 ROCmLinux流程裝的。問加了--lowvram、--gpu-only、--bf16之類的參數(shù)后更卡答Fooocus 的顯存管理是自動的手動干預反而更糟。去掉這些參數(shù)回到默認。更多條目見官方排障文檔 troubleshoot.md。六、之后去哪兒項目目前處于LTS 狀態(tài)只修 bug不加新功能暫無遷移到 Flux 等新架構的計劃想玩新模型官方推薦同門的 WebUI Forge 或 ComfyUI 生態(tài)社區(qū)也有不少功能更豐富的 Fooocus 分支fork可以折騰。常用資源入口排障文檔troubleshoot.md風格庫幾百個 SDXL 風格sdxl_styles/預設配置default / anime / realistic / lcm / lightning 等presets/通配符詞庫顏色、花卉、動物、國籍等wildcards/核心業(yè)務模塊配置、風格、UI 邏輯modules/具體參數(shù)行為和版本差異以官方文檔為準?!久赓M下載鏈接】FooocusFocus on prompting and generating項目地址: https://gitcode.com/GitHub_Trending/fo/Fooocus創(chuàng)作聲明:本文部分內容由AI輔助生成(AIGC),僅供參考