← 返回博客

为什么在本地跑 ComfyUI 而不是用在线出图

SillyTavern 的角色卡头像、场景插画、表情差分,传统做法是调用在线 API。延迟、审查、按张计费,以及最要命的一点:你的角色卡设定会被上传到别人的服务器。ComfyUI 本地部署后,整条链路离线,模型、LoRA、工作流全在你自己的硬盘上,配合本地 LLM 跑对话,整套角色卡工作流可以完全不联网。…

发布于
  • comfyui
  • image-generation
  • local-llm
  • character-cards
  • sillytavern

本文以角色卡 Iris the Pixel Painter 为例,走一遍「装环境 → 出人像 → 出场景 → 接回 SillyTavern → 导出角色卡」的完整流程。

环境准备

ComfyUI 对硬件的要求取决于模型,不是取决于软件本身。

档位显存可用模型单张耗时(512–768px)
最低6GBSD 1.5 系、部分 SDXL 量化15–40s
推荐12GBSDXL、Pony、Illustrious5–15s
舒适16GB+Flux 系、SDXL + 多 LoRA3–10s

安装要点:

  • 从官方仓库拉取 ComfyUI,用便携包或 venv 隔离依赖,避免污染系统 Python。
  • 显卡驱动与 CUDA 版本对齐;NVIDIA 用户优先,AMD 走 ROCm 或 DirectML,速度会有折扣。
  • 模型分三类放:checkpoints(底模)、loras(风格/角色)、vae。下载后核对哈希,损坏的 safetensors 会导致加载报错而非明显画质问题。
  • 首次启动后访问本地端口,确认能跑通默认工作流再继续。

出角色卡头像:Iris the Pixel Painter

角色卡头像的核心诉求是一致性——同一个角色在不同表情、不同角度下要像同一个人。

工作流骨架

  1. 底模:选一个偏插画/像素风的 checkpoint,动漫向角色不要用写实底模硬掰。
  2. 正面提示词:角色外貌锚点写死——发色、瞳色、服装、配饰、画风关键词。Iris 的定位是像素画家,提示词里固定「pixel art style, painter’s apron, paint-stained gloves」这类不随场景变化的部分。
  3. 负面提示词:通用质量负面 + 该底模推荐负面,别照搬网上模板,不同底模的负面词效果差异很大。
  4. LoRA 叠加:如果有角色专属 LoRA,权重从 0.6 起调,过高会锁死姿势。
  5. 采样器与步数:DPM++ 系或 Euler 系,步数 20–30 足够;CFG 7 左右,风格化模型可降到 5。
  6. 分辨率:头像用 1:1,512×512 或 768×768。SDXL 底模不要低于 1024 边长,否则构图崩。

批量出表情差分

用 ComfyUI 的批次或队列功能,固定种子 + 只改表情/角度提示词,一次出 6–8 张。挑出可用的,剩下的当废片删掉。这比在线 API 按张付费试错成本低得多。

出场景插画

场景图和头像的差别在于:构图权重更高,角色一致性反而可以放松。

  • 宽幅比例:16:9 或 21:9,适合做聊天背景或剧情配图。
  • ControlNet:需要精确构图时上 depth 或 canny,先画草图再引导生成,比纯提示词可控。
  • IPAdapter:想让场景里的角色保持和头像同一张脸,用 IPAdapter 把头像作为参考图喂进去,效果比堆提示词稳。
  • 分层输出:背景、角色、前景分开生成再合成,后期改动成本低。

接回 SillyTavern

生成完的图要进角色卡,有两条路:

  1. 直接嵌入 PNG:SillyTavern 的角色卡本质是 PNG 内嵌 JSON(chara 数据块)。用支持写入的编辑器把头像写进卡里,导入 SillyTavern 即显示。
  2. 外链图床:角色卡只存 URL,图放本地目录或自建图床。适合图多、卡要频繁更新的情况,但换设备会断链。

表情差分和场景图建议放在角色卡外的资源目录,用扩展或前端脚本按剧情调用,不要全塞进 PNG——单张卡体积过大会拖慢加载。

配合本地 LLM 跑对话时,整条链路(对话 + 出图)都在本机,没有网络往返,也没有内容审查打断沉浸感。

常见坑

  • 出图全糊:多半是 VAE 没配或底模与 VAE 不匹配。
  • 人物每张都不一样:提示词锚点不固定,或 LoRA 权重太低。固定种子先验证一致性,再开随机。
  • 显存爆掉:降分辨率、开 --lowvram、分块解码,或换量化版模型。
  • 角色卡导入后无图:PNG 元数据块写入失败,换工具重写。

小结

本地 ComfyUI 出图的价值不在「免费」,而在于可控、可复现、不泄露角色设定。头像走固定提示词 + LoRA 保一致性,场景走 ControlNet/IPAdapter 保构图,最后按需嵌回角色卡或走外链。

如果你想跳过环境配置,直接在移动端管理角色卡和出图流程,可以看看 MiniTavern 的角色卡市场与移动端应用,iOS、Android 与 Chrome 扩展都支持,角色卡导入导出和 SillyTavern 生态互通。

你可能还会喜欢这些文章

SillyTavern 角色卡规则:如何通过定义角色扮演规则优化 AI 行为

在 SillyTavern 生态中,角色卡(Character Cards)是驱动 AI 角色扮演的核心。无论你是新手还是资深创作者,掌握角色卡规则的编写技巧,都能显著提升 AI 角色的响应质量。今天,我们将以经典角色“Elena the Enchantress”为例,深入解析如何通过定义角色扮演规则,让 A…

  • sillytavern
  • character cards
  • roleplay rules
  • ai behavior
阅读全文

2026年最佳免费SillyTavern角色卡创作工具指南

在AI角色扮演的世界里,SillyTavern早已成为爱好者们构建沉浸式对话体验的首选平台。而支撑这一切的核心,正是精心设计的charactercard(角色卡)。一张优秀的角色卡不仅包含角色的外貌、性格、背景故事,还能通过精心编写的提示词让AI理解角色独特的说话方式和行为逻辑。随着2026年的到来,越来越多…

  • sillytavern
  • character-card
  • creator
  • tools
阅读全文

什么是 World Book:解决上下文窗口的长期记忆问题

SillyTavern 的 World Book(又称 World Info、Lorebook)是一套基于关键词触发的动态注入系统。它不把全部设定塞进角色卡,而是按需将条目插入上下文。对长线角色扮演而言,这比堆砌描述更节省 token,也更可控。 核心逻辑:扫描最近对话 → 命中关键词 → 将对应条目注入提…

  • world-book
  • world-info
  • lorebook
  • sillytavern
阅读全文