DeepSeek 接入 SillyTavern 指南:本地 Ollama 与 API 怎么选

对比 SillyTavern 接入 DeepSeek 的本地 Ollama 与官方 API 两条路线,并提供对应教程、配置入口和常见问题。

把 DeepSeek 接入 SillyTavern,真正需要先决定的不是某个配置项,而是模型跑在哪里。

一条路线是在自己的电脑上用 Ollama 运行开源模型。它能离线使用,对话不经过云端模型服务,但速度和效果受显卡、内存与模型大小限制。另一条路线是保留本机的 SillyTavern 界面,把推理交给 DeepSeek API。它不需要下载大模型,普通电脑也能用,但需要联网并按用量付费。

English version

本地 SillyTavern 在本地模型与云端 API 之间选择连接方式

先看结论

需求 更适合的方案
没有独立显卡,希望尽快用起来 DeepSeek API
想离线使用,不希望对话发往云端 本地 Ollama
希望效果更接近官方在线模型 DeepSeek API
有足够显存,想比较不同开源模型 本地 Ollama
不想下载和维护几十 GB 的模型文件 DeepSeek API
能接受本地小模型的能力边界 本地 Ollama

两种方案都能连接 SillyTavern,但解决的是不同问题。本地部署强调控制权和可折腾空间,API 强调低门槛和日常可用性。

本地 Ollama 路线

本地路线需要先安装 SillyTavern 和 Ollama,再选择适合硬件的 DeepSeek R1 模型。模型越大,对显存和内存的要求越高。普通电脑可以从 8B 或 14B 开始,24 GB 左右显存再考虑 32B。

完整步骤见 DeepSeek R1 接入 SillyTavern 小酒馆:Ollama 本地部署教程

这条路线适合愿意维护本地环境、需要离线使用,或者想比较不同开源模型的人。需要注意的是,本地蒸馏模型不能直接等同于 DeepSeek 官方在线模型。

DeepSeek API 路线

API 路线只在本机运行 SillyTavern,模型推理由 DeepSeek 的服务器完成。配置的关键是 API Key、连接模式、Base URL 和模型名,不需要本地显卡。

完整步骤见 DeepSeek API 接入 SillyTavern:不用本地显卡的小酒馆方案

这条路线更适合普通笔记本和日常使用。代价是必须联网,对话会发送给模型服务商,并且需要关注 API 费用和服务可用性。

两种方案可以同时保留

没有必要在本地和 API 之间永久二选一。

日常聊天可以使用 API,减少模型下载和硬件负担;需要离线、测试角色卡或比较模型时,再切回 Ollama。SillyTavern 只是交互界面,连接目标可以按场景切换。

常见问题

没有显卡还能使用 SillyTavern 吗?

可以。SillyTavern 本身不负责大模型推理,使用 DeepSeek API 时,普通电脑只需要运行界面并发送请求。

本地方案一定更隐私吗?

只有模型、角色卡和对话都留在本机时,本地方案的隐私边界才更清楚。安装插件、使用远程向量库或连接其他在线服务后,还需要分别判断这些组件的数据流向。

API 和 Ollama 哪个效果更好?

如果比较的是普通个人电脑能运行的蒸馏模型,官方 API 通常更接近 DeepSeek 的完整在线能力。本地模型的优势主要是离线、可控和方便实验。

应该先看哪篇教程?

没有强显卡,先看 API 教程;已经安装 Ollama,或者明确需要离线使用,直接看本地部署教程。