结论:本地接入的核心是让 WorkBuddy 能通过兼容 OpenAI 协议的接口访问你的本地推理服务。

① 先用 Ollama、vLLM 或 LM Studio 把模型跑起来,确认暴露的端口和接口路径,比如 Ollama 默认是 11434。

② 在 WorkBuddy 的模型配置里选「自定义」或「OpenAI 兼容」,Base URL 填本地地址加 /v1,模型名填你拉取的模型标识。

③ 如果 WorkBuddy 部署在容器或另一台机器,注意网络互通和防火墙,别用 localhost,要写实际 IP 或服务名。

④ 本地模型对显存和并发有要求,建议先小流量测试,确认响应速度和上下文长度够用再切生产。