術語

術語集錦

SillyTavern 與 MiniTavern 專業術語

涵蓋酒館進階概念與 MiniTavern 便捷扮演說明,協助新手與進階使用者快速上手。

AI 角色扮演與角色卡部落格 · MiniTavern 與 SillyTavern 對比

SillyTavern 專業術語

SillyTavern(ST / 酒館)
開源 LLM 角色扮演前端,圍繞角色卡、預設、世界書與多種 API 接入構建,常用於本機或自建部署。
角色卡(Character Card)
可攜帶的人設包(姓名、性格、場景、頭像、範例對話),用於約束模型保持角色一致性。
角色卡 V2(PNG 卡)
通用 JSON 規範(常寫入 PNG),含 description、personality、scenario、first_mes、mes_example 等欄位。
first_mes(開場白)
新建對話時角色的第一則訊息,用於定調、交代場景並引導使用者進入扮演。
mes_example(範例對話)
寫在卡內的範例對白,幫助模型學習角色的語氣、節奏與典型互動方式。
世界書 / Lorebook(WI)
依關鍵詞觸發的設定條目,命中後注入上下文,補充世界觀、勢力或人物關係。
Author's Note(作者註釋)
附在上下文後段的短指令,用於調整文風、節奏或鏡頭感。
主提示詞 / 系統提示(Main Prompt)
全域生效的指令(格式、視角、語言等),與角色卡正文分開配置。
預設(Preset)
打包好的提示詞、採樣參數與輸出模板,決定模型如何格式化角色扮演回覆。
API 連接器
對接 OpenAI 相容、Claude、DeepSeek、Ollama 等介面,將提示送往模型。
LM Studio
桌面端本機大模型執行工具,基於 llama.cpp,提供圖形化模型載入器與 OpenAI 相容 REST API(預設埠 1234)。
LM Link
LM Studio 裝置互聯功能,透過 Tailscale 端到端加密網狀網路,讓家中 GPU 為手機/筆電提供「像本機一樣」的模型服務。
Locally(LM Studio 行動端)
接入 LM Link 的 iOS/iPadOS 聊天應用,外出時存取家中託管的模型,無需暴露公網 API。
lms CLI
LM Studio 命令列工具(`lms link enable`、`lms server start`),適合無介面 GPU 伺服器與自動化部署。
GGUF
llama.cpp / LM Studio 使用的量化模型格式;Q4_K_M、Q5_K_M 量化在顯存與回覆品質間較均衡,適合本機角色扮演。
OpenAI 相容本機端點
位於 `http://localhost:1234/v1` 的 REST API,SillyTavern 與 MiniTavern 可像連 OpenAI 一樣接入,資料不經過雲端。
KoboldCpp
基於 llama.cpp 的便攜本機推理伺服器(LostRuins),面向 GGUF 模型,在 5001 埠提供 Kobold API 與 OpenAI 相容 API;SillyTavern Text Completion 原生後端。
Kobold API
位於 `http://localhost:5001/api/` 的文字補全 HTTP API,SillyTavern 將 API Type 設為 KoboldCpp 時使用——沿襲 KoboldAI 協定。
GPU Layers(n_gpu_layers)
KoboldCpp/llama.cpp 中決定多少層跑在 GPU、多少溢出到 CPU;顯存不足則調低,占滿 VRAM 則速度最佳。
KoboldAI Lite
KoboldCpp 內嵌的輕量瀏覽器聊天頁,在連接 SillyTavern 或 MiniTavern 前測試已載入的 GGUF 模型。
Remote Tunnel(KoboldCpp 遠端隧道)
KoboldCpp 產生臨時 HTTPS 公網連結的功能,讓手機或遠端客戶端存取家中推理服務,無需手動埠轉發。
.kcppt(KoboldCpp 預設)
打包模型路徑、上下文、GPU 後端與啟動參數的 KoboldCpp 模板檔,可在 Quick Launch 直接載入。
Text Completion 與 Chat Completion
ST 兩種 API 模式:Text Completion + KoboldCpp 發送原始提示串;Chat Completion 透過 OpenAI 相容 `/v1` 使用訊息陣列。
Ollama
本機大模型執行環境與模型管理器——`ollama pull` 下載模型,守護程序在 11434 埠提供 OpenAI 相容 API;SillyTavern 原生連接器,最適合私密入門。
ollama pull / ollama run
CLI 指令:從 Ollama 庫下載模型(pull),或在終端互動測試(run)後再接 SillyTavern。
Modelfile(Ollama)
文字配方(`FROM`、`PARAMETER`、`SYSTEM`)建立自訂 Ollama 模型變體,可統一預設扮演語氣。
OLLAMA_HOST
環境變數(如 `0.0.0.0:11434`),將 Ollama 綁定到區域網路供手機 MiniTavern 存取——切勿無認證暴露到公網。
上下文視窗 / Token 預算
模型單次能看見的文字上限;角色卡、世界書與聊天記錄會搶占空間。
重 Roll / 滑動切換
重 Roll 替換上一則 AI 回覆;滑動可在同一次生成的多個候選間切換。
使用者人設(Persona)
你在對話中的身分設定,讓角色對穩定的「你」做出反應。
群聊(Group Chat)
多張角色卡同場對話,需管理發言順序與提示結構,避免角色串台。
擴充功能(Extensions)
為 ST 增加匯入、自動化、UI 的插件;堆疊過多可能影響穩定性。
快捷回覆(Quick Reply)
一鍵發送預設使用者句(如「繼續」「OOC」),減少重複輸入。
串流輸出(Streaming)
模型邊生成邊顯示文字,長回覆體感更快。
Instruct / 聊天模板
依不同模型包裝訊息格式;模板不匹配時易出現破人設或亂格式。

MiniTavern 術語

MiniTavern
面向行動端的 SillyTavern 式生態,專注更便捷的 AI 角色扮演:iOS/Android、網頁酒館、Chrome 管卡與角色卡市場一體化。
一鍵匯入角色卡
手機端秒級匯入 ST 相容 PNG/JSON 卡,無需折騰資料夾即可開聊。
行動端酒館 UI
為單手操作優化的介面與流程,比桌面 ST 更適合 iPhone / Android 日常遊玩。
多模型中樞
在同一應用內切換多種 LLM,角色庫無需重複搭建。
網頁酒館(Web Tavern)
瀏覽器即可開聊(EvaX explore),不想裝 App 時也能快速進入扮演。
角色卡管理擴充(Chrome)
在瀏覽器側管理 ST 角色卡,並生成分享連結供 MiniTavern 匯入。
連結匯入卡片
貼上擴充產生的一次性分享 URL,即可把卡片拉進 MiniTavern。
Card Quest 角色卡市場
海量 ST 相容 PNG 卡線上瀏覽與下載,支援分類與搜尋。
Explore 發現頁
應用內推薦與更新角色卡流,持續提供可試玩的新角色。
內建範例卡
新使用者可直接用內建範例角色開聊,先體驗再探索社群卡源。
介面語言回覆
可在主提示詞中預設以目前 UI 語言對話,減少英文回覆。
同卡多會話
同一張角色卡可分叉多條劇情線,無需複製檔案。
多使用者人設
建立並切換多套 Persona,適配不同劇情線或帳號。
預設串流回覆
對話預設串流輸出,行動網路下減少長時間空白等待。
離線瀏覽卡庫
已匯入卡片可本地整理;僅 AI 生成需要連線。
全鏈路生態
市場發現 → Chrome 管理 → App/網頁開聊,優化整張角色卡生命週期。