DeepSeek 接入 SillyTavern 指南:本地 Ollama 与 API 怎么选
对比 SillyTavern 接入 DeepSeek 的本地 Ollama 与官方 API 两条路线,并提供对应教程、配置入口和常见问题。
把 DeepSeek 接入 SillyTavern,真正需要先决定的不是某个配置项,而是模型跑在哪里。
一条路线是在自己的电脑上用 Ollama 运行开源模型。它能离线使用,对话不经过云端模型服务,但速度和效果受显卡、内存与模型大小限制。另一条路线是保留本机的 SillyTavern 界面,把推理交给 DeepSeek API。它不需要下载大模型,普通电脑也能用,但需要联网并按用量付费。

先看结论
| 需求 | 更适合的方案 |
|---|---|
| 没有独立显卡,希望尽快用起来 | DeepSeek API |
| 想离线使用,不希望对话发往云端 | 本地 Ollama |
| 希望效果更接近官方在线模型 | DeepSeek API |
| 有足够显存,想比较不同开源模型 | 本地 Ollama |
| 不想下载和维护几十 GB 的模型文件 | DeepSeek API |
| 能接受本地小模型的能力边界 | 本地 Ollama |
两种方案都能连接 SillyTavern,但解决的是不同问题。本地部署强调控制权和可折腾空间,API 强调低门槛和日常可用性。
本地 Ollama 路线
本地路线需要先安装 SillyTavern 和 Ollama,再选择适合硬件的 DeepSeek R1 模型。模型越大,对显存和内存的要求越高。普通电脑可以从 8B 或 14B 开始,24 GB 左右显存再考虑 32B。
完整步骤见 DeepSeek R1 接入 SillyTavern 小酒馆:Ollama 本地部署教程。
这条路线适合愿意维护本地环境、需要离线使用,或者想比较不同开源模型的人。需要注意的是,本地蒸馏模型不能直接等同于 DeepSeek 官方在线模型。
DeepSeek API 路线
API 路线只在本机运行 SillyTavern,模型推理由 DeepSeek 的服务器完成。配置的关键是 API Key、连接模式、Base URL 和模型名,不需要本地显卡。
完整步骤见 DeepSeek API 接入 SillyTavern:不用本地显卡的小酒馆方案。
这条路线更适合普通笔记本和日常使用。代价是必须联网,对话会发送给模型服务商,并且需要关注 API 费用和服务可用性。
两种方案可以同时保留
没有必要在本地和 API 之间永久二选一。
日常聊天可以使用 API,减少模型下载和硬件负担;需要离线、测试角色卡或比较模型时,再切回 Ollama。SillyTavern 只是交互界面,连接目标可以按场景切换。
常见问题
没有显卡还能使用 SillyTavern 吗?
可以。SillyTavern 本身不负责大模型推理,使用 DeepSeek API 时,普通电脑只需要运行界面并发送请求。
本地方案一定更隐私吗?
只有模型、角色卡和对话都留在本机时,本地方案的隐私边界才更清楚。安装插件、使用远程向量库或连接其他在线服务后,还需要分别判断这些组件的数据流向。
API 和 Ollama 哪个效果更好?
如果比较的是普通个人电脑能运行的蒸馏模型,官方 API 通常更接近 DeepSeek 的完整在线能力。本地模型的优势主要是离线、可控和方便实验。
应该先看哪篇教程?
没有强显卡,先看 API 教程;已经安装 Ollama,或者明确需要离线使用,直接看本地部署教程。