繪圖工作流 | ComfyUI (06-24)

Krea 2 Turbo — Native ComfyUI Workflow + FP8 Weights (12GB, Drag & Drop) 🔥 讚數: 111 | 📂 討論板: r/comfyui 🔗 原文連結: 點擊這裡 這篇貼文分享了 Krea 2 Turbo 模型在 ComfyUI 中的原生工作流程,特別強調了其對 FP8 權重的支援,使得在僅需 12GB VRAM 的硬體上也能流暢運行。對於許多受限於顯存資源的 AI 繪圖愛好者來說,這個版本不僅效能顯著提升,還支援直覺的拖放操作,大幅降低了使用門檻,讓高品質的圖像生成變得更加親民且高效。 TESTING LTX 2.3 INGREDIENT LOHA WITH 6GB OF VRAM 🔥 讚數: 99 | 📂 討論板: r/comfyui 🔗 原文連結: 點擊這裡 作者針對 LTX 2.3 模型進行了極限測試,成功在僅有 6GB VRAM 的顯卡上運行 LTX 2.3 Ingredient LoRA。這段影片展示了在極低硬體規格下,AI 影片生成的可能性,證明了透過適當的優化與 LoRA 技術,即使是入門級的顯卡也能體驗到最新的 LTX 2.3 模型帶來的視覺效果,引發了社群對於低配硬體運行高階模型的熱烈討論。 ...

繪圖工作流 | ComfyUI (06-23)

Castle on The Hill 🔥 讚數: 70 | 📂 討論板: comfyui 🔗 原文連結: 點擊這裡 這則貼文展示了在 ComfyUI 中生成的城堡場景,標題靈感來自於 Ed Sheeran 的知名歌曲《Castle on The Hill》。雖然沒有詳細的技術參數,但這個視覺呈現捕捉了歌曲中那種懷舊與宏大的氛圍,展現了 AI 影像生成在構圖與光影處理上的潛力。 LTX-2.3 Water Sim LoRA flooding the Joker stairs (v2v test) 🔥 讚數: 41 | 📂 討論板: comfyui 🔗 原文連結: 點擊這裡 作者利用 LTX-2.3 的 LoRA 模型進行了水體模擬測試,將經典電影《小丑》中標誌性的階梯場景淹沒在洪水中。這則影片展示了 Video-to-Video (v2v) 技術在處理動態物理效果(如水流)時的細節與流暢度,讓熟悉的場景呈現出截然不同的災難美感,是 ComfyUI 使用者測試新模型效能的精彩案例。 How are people replicating Nano Banana’s reference-image workflow locally in ComfyUI? 🔥 讚數: 28 | 📂 討論板: comfyui 🔗 原文連結: 點擊這裡 這是一則熱門的技術討論貼文,許多 ComfyUI 使用者正在努力複製社群紅人「Nano Banana」的參考圖像工作流程。由於該流程可能涉及特定的節點組合或權重設定,大家紛紛在留言區分享各自的解法與設定檔,旨在讓本地端用戶也能達到同樣高質量的影像生成效果,展現了社群共享與解決技術難題的熱忱。 ...

繪圖工作流 | ComfyUI (06-22)

Shared the opening last week, here is how the mid-section transitions hold up. 🔥 讚數: 40 | 📂 討論板: r/comfyui 🔗 原文連結: 點擊這裡 這位使用者在上一週分享了他們的 ComfyUI 工作流開頭部分,並在這次更新中展示了中段轉場效果的持久性與穩定度。透過影片演示,觀眾可以清楚看到畫面在動態轉換過程中的流暢度,這對於追求高品質視頻生成的 ComfyUI 玩家來說,是驗證節點邏輯是否穩固的重要指標,引發了大家對於細節處理的熱烈討論。 VNCCS Utils 0.5.3 - UniCanvas 🔥 讚數: 33 | 📂 討論板: r/comfyui 🔗 原文連結: 點擊這裡 此貼文介紹了 ComfyUI 中極受歡迎的 VNCCS Utils 插件的最新更新版本 0.5.3,重點聚焦於其對 UniCanvas 功能的支援。UniCanvas 作為強大的畫布工具,允許使用者進行更自由的影像繪製與編輯,而這次更新進一步優化了其效能與易用性。對於依賴自訂節點來提升繪圖靈活度的使用者而言,這是一個不容錯過的實用工具更新,影片詳細展示了其操作方式與實際應用效果。

Stable Audio 3.0 在 ComfyUI 中的部署與使用:高品質音樂生成

在 AI 生成音訊的領域中,Stability AI 推出的 Stable Audio 3.0 無疑是一個里程碑。這套全新家族式的音訊生成模型,不僅支援從短促音效到長達六分多鐘的完整音樂作品,更重要的是——它採用完全授權的音樂數據集訓練,意味著你生成的作品可以直接商用。 而 ComfyUI 作為目前最靈活的 AI 創作平台,已經在 Stable Audio 3.0 發布當天就提供了首日支援(Day-0 Support)。這篇文章將帶你從零開始,了解 Stable Audio 3.0 的模型差異、ComfyUI 中的部署流程,以及實際使用技巧。 Stable Audio 3.0 模型家族概覽 Stable Audio 3.0 並非單一模型,而是一個針對不同使用場景設計的模型家族。理解這些差異,能幫助你選擇最適合的方案。 模型變體 主要用途 最大長度 硬體需求 3.0 Small SFX 音效、環境音 ≤ 2 分鐘 CPU 即可運行 3.0 Small 完整音樂創作 ≤ 2 分鐘 CPU 即可運行 3.0 Medium 高音樂性、長曲目 ~6 分 20 秒 需要 GPU 3.0 Large 進階音樂性、低延遲 ~6 分 20 秒 API / 企業部署 幾個值得注意的亮點: ...

Z-Image-Turbo + IP-Adapter FaceID:最新 ComfyUI 工作流與 LoRA 訓練素材準備指南

前言 最近 Z-Image-Turbo 在社群中掀起了一波熱潮——這個由阿里通義實驗室推出的影像生成模型,以極低的推理步數(僅 8 步)就能產生媲美競爭對手的品質,而且推理速度在 H800 上可達毫秒級。但對於想訓練角色 LoRA 的玩家來說,如何從零開始準備高品質的訓練素材,一直是個痛點。 這篇文章整合了 Reddit、HuggingFace Blog 以及多個 GitHub 社群的最新實測經驗,整理出一套完整的 Z-Image-Turbo + IP-Adapter FaceID 工作流,幫你從參考圖到訓練素材一次搞定。 IP-Adapter 對 Z-Image-Turbo 的支援現況 首先,我們需要釐清一個關鍵事實:Z-Image-Turbo 目前沒有專屬的 IP-Adapter FaceID 模型。但這不代表不能用 IP-Adapter,只是需要透過幾種替代方案來達成面部一致性。 方案一:SD3 IP-Adapter 轉換法(開發中) 研究人員 DragonDiffusionbyBoyo 發現,SD3 的 IP-Adapter 經過修改後可以跟 Z-Image-Turbo 相容。這個實作已經包含在 Boyonodes 中,檔案包括 zimage_ip_adapter_nodes.py 和 zimage_attention_wrapper.py。截至 2026 年 3 月仍在持續開發,是未來最有潛力的方案。 方案二:ControlNet Union(目前最穩定) Z-Image-Turbo 官方提供了 Z-Image-Turbo-Fun-Controlnet-Union.safetensors,支援 Canny(邊緣)、Depth(空間構圖)和 DWPose(人物姿勢)三種模式。對於角色一致性來說,DWPose 特別好用——你可以用一張角色參考圖控制姿勢,再搭配 prompt 來控制表情和服裝。 方案三:傳統 IP-Adapter FaceID(SDXL/SD1.5) 直接插入 SDXL 或 SD1.5 的 IP-Adapter FaceID 模型也能跑,但面部相似度偏低。適合用來做「風格和構圖參考」,而不是精確的面部復現。 ...