术语
术语集锦
SillyTavern 与 MiniTavern 专业术语
涵盖酒馆资深概念与 MiniTavern 便捷扮演能力说明,帮助新手与进阶用户快速上手。
AI 角色扮演与角色卡博客 · MiniTavern 与 SillyTavern 对比
SillyTavern 专业术语
- SillyTavern(ST / 酒馆)
- 开源 LLM 角色扮演前端,围绕角色卡、预设、世界书与多种 API 接入构建,常用于本地或自建部署。
- 角色卡(Character Card)
- 可移植的人设包(姓名、性格、场景、头像、示例对话),用于约束模型保持角色一致性。
- 角色卡 V2(PNG 卡)
- 通用 JSON 规范(常写入 PNG),含 description、personality、scenario、first_mes、mes_example 等字段,ST 生态通用。
- first_mes(开场白)
- 新建对话时角色的第一条消息,用于定调、交代场景并引导用户进入扮演。
- mes_example(示例对话)
- 写在卡内的范例对白,帮助模型学习角色的语气、节奏与典型互动方式。
- 世界书 / Lorebook(WI)
- 按关键词触发的设定条目,命中后注入上下文,用于世界观、势力、技能或人物关系等补充信息。
- Author's Note(作者注释)
- 附在上下文后段的短指令,用于调整文风、节奏或镜头感,无需改动整张角色卡。
- 主提示词 / 系统提示(Main Prompt)
- 全局生效的指令(格式、视角、语言、安全语气等),与角色卡正文分开配置。
- 预设(Preset)
- 打包好的提示词 + 采样参数 + 输出模板组合,决定模型如何格式化角色扮演回复。
- API 连接器
- 对接 OpenAI 兼容、Claude、DeepSeek、Ollama 本地等接口,把拼装好的提示发送给模型。
- LM Studio
- 桌面端本地大模型运行工具,基于 llama.cpp,提供图形化模型加载器与 OpenAI 兼容 REST API(默认端口 1234)。
- LM Link
- LM Studio 设备互联功能,通过 Tailscale 端到端加密网状网络,让家中 GPU 为手机/笔记本提供「像本地一样」的模型服务。
- Locally(LM Studio 移动端)
- 接入 LM Link 的 iOS/iPadOS 聊天应用,外出时访问家中托管的模型,无需暴露公网 API。
- lms CLI
- LM Studio 命令行工具(`lms link enable`、`lms server start`),适合无界面 GPU 服务器与自动化部署。
- GGUF
- llama.cpp / LM Studio 使用的量化模型格式;Q4_K_M、Q5_K_M 量化在显存占用与回复质量间较均衡,适合本地角色扮演。
- OpenAI 兼容本地端点
- 位于 `http://localhost:1234/v1` 的 REST API(chat/completions),SillyTavern 与 MiniTavern 可像连 OpenAI 一样接入,数据不经过云端。
- KoboldCpp
- 基于 llama.cpp 的便携本地推理服务器(LostRuins),面向 GGUF 模型,在 5001 端口提供 Kobold API 与 OpenAI 兼容 API;SillyTavern Text Completion 原生后端。
- Kobold API
- 位于 `http://localhost:5001/api/` 的文本补全 HTTP API,SillyTavern 将 API Type 设为 KoboldCpp 时使用——沿袭 KoboldAI 协议,许多 ST 预设仍优先此路径。
- GPU Layers(n_gpu_layers)
- KoboldCpp/llama.cpp 中决定多少 Transformer 层跑在 GPU、多少溢出到 CPU;显存不足则调低,占满 VRAM 则速度最佳。
- KoboldAI Lite
- KoboldCpp 内嵌的轻量浏览器聊天页,在连接 SillyTavern 或 MiniTavern 前测试已加载的 GGUF 模型。
- Remote Tunnel(KoboldCpp 远程隧道)
- KoboldCpp 生成临时 HTTPS 公网链接(如经 Cloudflare)的功能,让手机或远端客户端访问家中推理服务,无需手动端口映射。
- .kcppt(KoboldCpp 预设)
- 打包模型路径、上下文、GPU 后端与启动参数的 KoboldCpp 模板文件,可在 Quick Launch 直接加载而无需每次重填。
- Text Completion 与 Chat Completion
- ST 两种 API 模式:Text Completion + KoboldCpp 发送原始提示串(经典 RP);Chat Completion 通过 OpenAI 兼容 `/v1` 使用消息数组格式。
- Ollama
- 本地大模型运行时与模型管理器——`ollama pull` 下载模型,守护进程在 11434 端口提供 OpenAI 兼容 API;SillyTavern 原生连接器,最适合私密入门。
- ollama pull / ollama run
- CLI 命令:从 Ollama 库下载模型标签(pull),或在终端交互测试(run),再接 SillyTavern。
- Modelfile(Ollama)
- 文本配方(`FROM`、`PARAMETER`、`SYSTEM`)构建自定义 Ollama 模型变体,可统一默认扮演语气而无需改每张卡。
- OLLAMA_HOST
- 环境变量(如 `0.0.0.0:11434`),将 Ollama 绑定到局域网供手机 MiniTavern 访问——切勿无认证暴露到公网。
- 上下文窗口 / Token 预算
- 模型单次能“看见”的文本上限;角色卡、世界书与聊天记录会抢占空间,需裁剪或摘要。
- 重Roll / 滑动切换(Regenerate / Swipe)
- 重Roll 替换上一条 AI 回复;滑动可在同一次生成的多个候选之间切换。
- 用户人设(Persona)
- 你在对话中的身份设定,让角色对稳定的“你”做出反应,而不是泛化的 User。
- 群聊(Group Chat)
- 多张角色卡同场对话,需管理发言顺序与提示结构,避免角色串台。
- 扩展(Extensions)
- 社区或官方插件,为 ST 增加导入、自动化、UI 功能;堆叠过多可能影响稳定性。
- 快捷回复(Quick Reply)
- 一键发送预设用户句(如“继续”“OOC”),减少重复输入。
- 流式输出(Streaming)
- 模型边生成边显示文字,长回复体感更快、交互更连贯。
- Instruct / 聊天模板
- 按不同模型要求包装消息格式;模板不匹配时易出现破人设或乱格式回复。
MiniTavern 术语
- MiniTavern
- 面向移动端的 SillyTavern 式生态,专注更便捷的 AI 角色扮演:iOS/Android 原生应用、网页酒馆、Chrome 管卡与角色卡市场一体化。
- 一键导入角色卡
- 手机端秒级导入 ST 兼容 PNG/JSON 卡,无需折腾文件夹,即可开聊。
- 移动端酒馆 UI
- 为单手操作优化的界面与流程,相比桌面向 ST 更适合 iPhone / Android 日常游玩。
- 多模型中枢
- 在同一应用内切换 OpenAI、Claude、DeepSeek、OpenRouter、本地端点等,角色库无需重复搭建。
- 网页酒馆(Web Tavern)
- 浏览器即可开聊(EvaX explore),不想装 App 时也能快速进入扮演。
- 角色卡管理扩展(Chrome)
- 在浏览器侧管理本地 ST 角色卡:创建、编辑、文件夹同步,并生成分享链接供 MiniTavern 导入。
- 链接导入卡片
- 粘贴扩展生成的一次性分享 URL,即可把卡片拉进 MiniTavern,方便跨设备传递。
- Card Quest 角色卡市场
- 海量 ST 兼容 PNG 卡在线浏览与下载,支持分类与搜索,更快发现热门人设。
- Explore 发现页
- 应用内推荐与更新角色卡流,持续提供可试玩的新角色与题材。
- 内置示例卡
- 新用户可直接用 bundled 示例角色开聊,先体验再去找社区卡源。
- 界面语言回复
- 可在主提示词中默认用当前 UI 语言对话,减少非英语用户收到英文回复的情况。
- 同卡多会话
- 同一张角色卡可分叉多条剧情线,不必复制文件即可并行多个故事。
- 多用户人设
- 创建并切换多套 Persona(昵称 + 人设提示),适配不同账号或剧情线。
- 默认流式回复
- 对话默认流式输出,移动网络下减少长时间空白等待。
- 离线浏览卡库
- 已导入卡片可本地浏览整理;仅 AI 生成需要联网,适合通勤与弱网环境。
- 全链路生态
- 市场发现 → Chrome 管理 → App/网页开聊,MiniTavern 优化的是整张角色卡生命周期,而不只是聊天窗口。