DeepSeek Harness 模型连不上?API 密钥、网络代理与 DSH plugin 本地模型接入排查
DeepSeek Harness 模型连不上,九成是 API 密钥或 endpoint 配错了:先查设置里的密钥与接口地址,再看网络代理,最后查本地模型服务是否在跑。
概览
模型链路分三段:配置、网络、模型服务。 配置指 API 密钥与 endpoint(接口地址),网络指代理与超时,模型服务指云端 API 或本地跑的模型进程。按这个顺序排查,多数问题在第一步就能解决;排查时先看报错:401/403 与密钥、额度有关,超时类与网络、代理有关,404 多半是模型名写错——报错已经帮你划好了范围。DSH 还在开发者预览阶段,配置项可能变化,以官方文档为准(来源)。
DeepSeek Harness 模型 API 密钥与 endpoint 配置排查
模型不通,九成是 API Key 没配好。 打开 Web UI 的设置 → 模型,输入 DeepSeek API 密钥保存,模型路由立即生效、不用重启(来源)。Key 填错、额度用尽都会表现为连不上:401 Unauthorized 或 403 提示密钥无效或没权限,402/429 多半是余额或限流——对照报错能快速定位是密钥问题还是额度问题。复制密钥时注意别带进空格、别串行多复制,新申请的密钥通常要等几秒到几分钟才生效。如果 Web UI 本身都打不开,先解决界面问题再查模型,看《DeepSeek Harness Web UI 打不开、白屏排查》。
自定义 endpoint(比如第三方 OpenAI 兼容接口)在同一个配置页填 Base URL 与模型名,两者必须匹配,参考官方 providers 文档。怀疑配置没写进去时,执行:
dsh --dump-config
看组合后的配置树里模型相关行是否已写入(来源)。
DeepSeek Harness 模型网络代理与超时排查
密钥没问题还是连不上,下一步查网络。 常见三类:超时(模型响应慢、代理不稳)、代理没生效(终端代理对 DSH 服务进程不生效)、防火墙拦截出站连接。先用 curl 确认模型 API 域名可达:
curl -I -m 10 https://api.deepseek.com
-m 10 让请求最多等 10 秒,避免命令挂起。返回 200 或 30x 跳转即说明网络通;一直转圈或超时,则问题在网络或代理。查当前终端代理变量用 env | grep -i proxy(Windows 可查 $env:HTTP_PROXY),并确认 DSH 服务进程启动时继承了同一套代理——终端代理环境变量对已启动的服务进程不生效,改完代理要重启 DSH 进程。超时频繁时,在模型配置里调大超时与重试参数再试;代理的详细配置方法见《DSH plugin 下载慢?镜像源与代理加速》。
DSH plugin 本地模型接入排查(LM-Kit / llama.cpp / Ollama)
本地模型连不上,多半是服务没起或 endpoint 填错。 三类常见的本地模型服务都提供 OpenAI 兼容接口,DSH 走通用配置即可接入:
- LM-Kit:本地 OpenAI 兼容服务,endpoint 填它的
/v1本地地址(端口以你启动时的配置为准)。 - llama.cpp(llama-server):默认
http://127.0.0.1:8080/v1。 - Ollama:默认
http://127.0.0.1:11434/v1。
接不上的排查顺序:先用 curl 请求对应 /v1 地址确认服务在跑 → 核对端口与模型名填的是不是已加载的模型 → 确认模型加载完成再重试。模型名要填服务端真实存在的模型,写错会直接 404。三个具体检查点:
- 服务在不在:curl 对应
/v1地址,连不上先确认进程没被退出,本地服务端口没监听或监听异常都会表现为请求失败。 - 端口对不对:llama-server 与 Ollama 的默认端口可以在启动时改,改了之后 DSH 里的 endpoint 必须同步改,两边端口不一致必然连不上。
- 模型加载完没有:本地大模型首次加载要几十秒,加载完成前发起请求会超时或报错,等日志显示加载完成再重试。
完整的本地模型接入配置步骤看《DeepSeek Harness 怎么接入本地大模型》。
本地模型接入后,token 用量、成本统计一类的模型类 DSH plugin,可以在 DSH Plugin Hub 的模型分类下挑选——这类插件能辅助观察每次调用是否真正走通,帮你在云端与本地模型之间对比排查。
注意事项
- API 密钥保存后立即生效,不用重启 DSH。
- 换模型时 endpoint 与模型名要一起改,两者不匹配会连不上。
- headless 模式使用同一套模型配置,
dsh --dump-config可确认。 - 报错信息会提示方向:
401/403查密钥与额度,404查模型名与 endpoint,超时类查网络与代理。
常见问题
按「配置 → 网络 → 模型服务」三步:先确认 API 密钥与 endpoint 填对,再看代理与超时,最后查本地模型服务是否在跑、endpoint 是否填对。
看网络:用 curl 确认模型 API 域名可访问,确认终端代理对 DSH 服务进程生效,再看额度是否用尽;也可以在模型配置里调大超时与重试。
本地服务基本都提供 OpenAI 兼容接口:LM-Kit 填它的 /v1 本地地址,llama.cpp 的 llama-server 默认 http://127.0.0.1:8080/v1,Ollama 默认 http://127.0.0.1:11434/v1,模型名填已加载的模型。
可以。在设置 → 模型里按 OpenAI 兼容配置添加不同 endpoint 与模型名,切换即时生效;模型类 DSH plugin 可在 DSH Plugin Hub 的模型分类下挑选,辅助观察调用是否走通。
来源
- DeepSeek Harness 官方文档 - Quickstart· deepseek-harness
- dsh CLI README· deepseek-ai