# :brain: 酒馆专属大模型 · DeepSeek Tavern Pro

**DeepSeek Tavern Pro 是专为 SillyTavern 酒馆角色扮演打磨的专属大模型**——不是租来的通用模型，也不是凑合的替代品，而是真正为叙事、沉浸与创作自由铸造的两套引擎。

同一间酒馆，两种灵魂：

| 引擎 | 模型名 | 性格比喻 | 一句话 |
|:---|:---|:---|:---|
| :fire: **经典版** | `deepseek-tavern` | 灵动少女 | 文风活泼多变，脑洞天马行空，灵感来了挡都挡不住 |
| :wine_glass: **新版 · Beta** | `glm-tavern-pro-v2` | 稳重少妇 | 同样有才华，更多一分沉淀，正则与记忆遵循性显著更好 |

> 磊哥哥的原话：**🔥 deepseek-tavern 像一个少女——活泼灵动，但容易忘东西；🍷 glm-tavern 像一个少妇——稳重优雅，遵循性好，但少了点灵动。**

## 一分钟认识它

| 你可能想问 | 答案 |
|:---|:---|
| **它和 DeepSeek 原版什么关系？** | 同源但不同物。deepseek-tavern 基于 DeepSeek V4 Pro 的 MoE 架构**精准微调文字专家模块**，专攻文字创作与角色扮演 |
| **和通用大模型比呢？** | 通用模型要你写复杂提示词才"演得像"；酒馆专属模型的训练数据就是真实酒馆场景，天然懂角色卡的叙事结构 |
| **有两个模型，怎么选？** | 追惊喜感、要脑洞 → 选 deepseek-tavern；要长剧情不崩人设、格式稳定 → 选 glm-tavern-pro-v2 |
| **支持多长的上下文？** | 100 万 token（1M）。长篇小说、复杂世界书、多角色切换都不会丢前文细节 |
| **能接我自己的酒馆吗？** | 能。OpenAI 兼容接口，SillyTavern、Cherry Studio、NextChat、任意 OpenAI SDK 都能接 |
| **贵不贵？** | 两个模型**定价完全一致**，Beta 期价格对齐（后续可能调整），性价比对标 Opus 的十分之一量级 |

## 两大引擎详解

### :fire: deepseek-tavern · 经典版 · 灵动少女

她像一个**灵气逼人的少女**——文风活泼多变，脑洞天马行空，灵感来了挡都挡不住。追求惊喜感与创造力的玩家，会爱上她的灵动。

- :sparkles: **文风灵动，创意十足** —— 擅长制造意想不到的转折与惊喜
- :zap: **low / pro / xhigh 三档可选** —— 同一模型自由切换创作风格
- :yellow_heart: **长期打磨，社区口碑之选** —— 上线最久、经过大量真实酒馆场景检验

> "像少女——活泼灵动，但容易忘东西"

### :wine_glass: glm-tavern-pro-v2 · 新版 · 稳重少妇 · Beta

她像一个**从容稳重的少妇**——同样的才华，更多一分沉淀。正则遵守性与记忆遵循性显著更好，长篇剧情不崩人设，创作输出稳定可靠。

- :triangular_ruler: **正则遵守性更好，格式稳定** —— 复杂预设、正则与输出格式更听话
- :brain: **记忆遵循性强，长剧情不崩** —— 长线剧情中人物设定稳定，不 OOC
- :zap: **low / pro / xhigh 三档可选**

> "像少妇——稳重优雅，遵循性好，但少了点灵动"

!!! note "Beta 说明"
    glm-tavern-pro-v2 基于 **GLM-5.3 开源基座微调**，目前处于 **Beta 测试阶段**，价格与 deepseek 系列完全对齐，后续可能调整。欢迎体验并反馈。

## 横向对比：两大专属模型

| 对比维度 | :fire: deepseek-tavern | :wine_glass: glm-tavern-pro-v2 (Beta) |
|:---|:---|:---|
| 性格比喻 | 灵动少女 | 稳重少妇 |
| 创作风格 | 活泼多变 :sparkles: | 沉稳扎实 :triangular_ruler: |
| 正则遵守 / 格式 | 良好 | **更优** :star: |
| 记忆遵循性 | 偶尔忘东西 | **稳定长线** :star: |
| 思考档位 | low / pro / xhigh | low / pro / xhigh |
| 定价 | 两者完全一致（Beta 期对齐，后续或调整） | |

**选择建议**：都试试。同一个角色卡、同一套世界书，分别在两个引擎上跑几轮——差别往往在第一屏就能感受到。

## 六大核心优势

| 优势 | 说明 |
|:---|:---|
| :performing_arts: **酒馆原生优化** | 训练数据全部来自真实酒馆场景——上千张角色卡、数百种预设、世界书配置。天然理解角色扮演的叙事结构，**无需复杂提示词工程** |
| :writing_hand: **文学级写作质量** | 漏斗式开篇、感官细节描写、丁达尔光影、动作中断——内置完整的文学写作协议。不是 AI 式的平淡叙述，是真正有质感的文字 |
| :unlock: **叙事自由** | 为创作自由而生。不拒绝符合角色设定的叙事请求，完整执行角色卡定义的 NSFW 内容；抗中断机制确保沉浸式体验不被破坏 |
| :brain: **专家级微调架构** | 基于 DeepSeek V4 Pro 的 MoE 架构**精准微调文字专家模块**，比通用模型更贴合文字创作与角色扮演 |
| :books: **100 万上下文** | 支持 1M token 超长上下文窗口。长篇小说创作、复杂世界书、多角色切换——**永远不会丢失前文的细节和情感脉络** |
| :zap: **三档创作风格** | 通过模型名后缀自由切换创作模式，一个模型覆盖三种使用场景 |

### 三档创作风格怎么选

| 后缀 | 模式 | 适合场景 |
|:---|:---|:---|
| `-low` | 自由创作，想象力奔放 | 想让模型自由发挥、制造惊喜 |
| *(默认，无后缀)* | 均衡兼顾 | 日常角色扮演的通用选择 |
| `-xhigh` | 严谨遵循提示词 | 复杂预设/正则、严格格式要求、长线剧情不跑偏 |

## 为什么不用其他方案

每个方案都有它的位置，而这里是我们的答案：

| 对比维度 | Claude Opus 4.6 | 本地小模型 (7B–13B) | DeepSeek V4 原版 | **Tavern Pro** |
|:---|:---|:---|:---|:---|
| 文字创作质量 | 顶级 | 较弱 | 良好 | **接近 Opus** |
| 角色扮演沉浸感 | 极佳 | 3 轮崩 | 一般 | **优秀** |
| 复杂提示词驾驭 | 顶级 | 不行 | 中等 | **优秀** |
| NSFW 叙事自由 | 受限 | 自由 | 严格审查 | **破限优化** |
| 上下文窗口 | 200K | 4K–32K | 1M | **1M** |
| 月度成本（重度使用） | 极高 | 免费（自部署） | 中等 | **中等** |
| 可定制性 | 不可 | 完全可控 | 不可 | **持续迭代** |

> **一句话定位**：文字创作接近 Opus 的水准，价格却低一个数量级；同时不需要显卡、不需要自部署，开个 Key 就能用。

## 技术架构

| 项目 | 说明 |
|:---|:---|
| **架构** | MoE 专家微调 —— 基座 1.6T 参数，精准微调 **100B 文字专家** |
| **基座模型** | DeepSeek V4 Pro（MoE 架构 · 1.6T 总参数 · 推理激活 49B） |
| **训练数据** | 酒馆原生 —— 上千张角色卡 · 数百套预设 · Claude Opus 4.6 知识蒸馏 |
| **训练方式** | OPA-DenseV4 —— 强化监督学习 · 专家模块精准微调 · 非全量训练 |
| **部署方案** | 云端 API —— OpenAI 兼容接口 · 负载均衡 · HTTPS 加密 · 多 Key 轮询 |
| **上下文** | 1M token |

## 接入方式：OpenAI 兼容

任何支持自定义 API 的客户端都能接入：

| 项目 | 值 |
|:---|:---|
| **API 端点** | `https://deepseektavern.com/v1` |
| **兼容客户端** | SillyTavern 酒馆 · Cherry Studio · NextChat · 任意 OpenAI SDK |

**可用模型名**：

| 模型名 | 说明 |
|:---|:---|
| `deepseek-tavern-v2-pro` | 均衡模式，兼顾创意与稳定（默认推荐） |
| `deepseek-tavern-v2-pro-low` | 自由创作，想象力更奔放 |
| `deepseek-tavern-v2-pro-xhigh` | 严谨模式，严格遵循提示词 |
| `glm-tavern-pro-v2` | 稳重少妇 · Beta，正则与记忆遵循性更优 |

**三步开始**：

1. :key: 到 [deepseektavern.com](https://deepseektavern.com/) 注册账号，在控制台创建 API Key
2. :beer: 在酒馆（或像素酒馆）中选择 **OpenAI 兼容** 接口类型，填入上面的 API 端点与 Key
3. :rocket: 在模型列表里选一个上表的模型名，开聊

详细的酒馆侧配置步骤见[API 连接](/Usage/API_Connections/index.md)与 [OpenAI 兼容接入](/Usage/API_Connections/openai.md)；不想安装酒馆的可以直接用[像素酒馆](/pixel-tavern.md)。技术细节可参考 [API 接入指南](/api-setup.md)。

## 用户反馈

来自深度酒馆玩家的第一手体验：

| 玩家 | 一句话评价 |
|:---|:---|
| 重度角色扮演用户 A | "比 Gemini 更懂酒馆，人物情绪和语气拿捏得特别到位。" |
| 长篇创作用户 B | "文字创作能力大概有 Opus 的 90%，但价格只有十分之一。" |
| 预设工程玩家 C | "期待很久的酒馆专属模型终于来了。" |
| 连续测试用户 D | "好激动，测试了很久，现在就只用这个模型了。" |
| 多模型对比用户 E | "在酒馆里对比了 6 个模型，这个是唯一一个不会 OOC 的。" |
| 轻量用户转重度 F | "本来只是想试试看，现在已经回不去其他模型了。" |

!!! quote "玩家 E 的完整评价"
    我对角色扮演的 OOC 特别敏感，一点语气崩坏或者逻辑断层就会让我出戏。拿同一套角色卡和世界书，在 6 个主流模型里跑了两轮长线——只有这个能稳定维持人设。不是偶然一两轮，是从头到尾的稳定。

## 常见问题

**酒馆专属大模型和普通大模型有什么区别？**

普通大模型是通用助手，要用大量提示词"教"它怎么演；酒馆专属模型的训练数据来自真实酒馆场景（上千张角色卡、数百套预设、世界书配置），天然理解角色卡的叙事结构、格式约定与沉浸节奏，无需复杂提示词工程。

**deepseek-tavern 和 glm-tavern-pro-v2 该选哪个？**

追惊喜感与创造力选 deepseek-tavern（灵动少女）；要正则/格式稳定、长线剧情不崩人设选 glm-tavern-pro-v2（稳重少妇）。两者定价一致，建议都用同一套角色卡实测几轮再定。

**支持多长的上下文？**

1M token（100 万）。长篇小说续写、复杂世界书、多角色长时间线都能保持前后一致。

**能接本地安装的 SillyTavern 吗？**

可以。模型提供 OpenAI 兼容接口 `https://deepseektavern.com/v1`，在酒馆的 API 连接里选 OpenAI 类型、填入端点和 Key 即可。也可接入 Cherry Studio、NextChat 等任何支持自定义 API 的客户端。

**low / pro / xhigh 是什么？要改配置吗？**

不用改配置，**写在不同模型名后缀里**即可切换：`-low` 自由创作、无后缀均衡、`-xhigh` 严谨遵循。在酒馆的模型列表里选对应名字就行。

**需要自己准备显卡吗？**

不需要。模型以云端 API 形式提供，客户端只负责发请求。

**它支持 NSFW 内容吗？**

支持。模型为创作自由设计，会执行角色卡定义的 NSFW 内容，并有抗中断机制。请在符合当地法律法规的前提下使用，并注意区分虚构与现实的边界。

**价格是多少？**

两个模型 Beta 期定价完全一致（后续可能调整）。最新价格与实际计费请以 [deepseektavern.com](https://deepseektavern.com/) 控制台的模型广场为准。

## 相关页面

| 想了解 | 去哪看 |
|:---|:---|
| 在线开聊，免安装 | [🍺 像素酒馆](/pixel-tavern.md) |
| 浏览 1,238 张原创角色卡 | [🎴 角色卡集市](/character-cards.md) |
| 自己造一张角色卡 | [角色卡构建器](/cardbuilder.md) |
| 零配置装上酒馆 | [酒馆一键启动器](https://launch.deepseektavern.com) |
| 酒馆怎么接别的模型 | [API 连接指南](/Usage/API_Connections/index.md) |
| TTS 语音让角色开口说话 | [TTS 语音合成](/tts.md) |

---

> :bulb: **想直接体验？** 到 [deepseektavern.com](https://deepseektavern.com/) 注册拿 Key，两分钟就能在酒馆里跑起来。
