← 全部指南

怎么在编程 agent 里用别的模型(GLM、DeepSeek、本地)

如果你想让编程 agent 跑在 GLM、DeepSeek、OpenAI 兼容接口或本地模型上——图便宜、图快、或图有得用——这里讲清模型路由到底怎么回事,以及切换前要确认什么。

先说结论:编程 agent 就是一个模型加一个工具执行循环。只要客户端说的是 OpenAI 兼容那套 API,你就能把它指向 GLM、DeepSeek、自建的 vLLM 接口,或任何暴露这套 API 的东西——设好 base URL、key、模型名就行。绑死单一供应商的 agent 做不到这点;生来就支持自带模型的可以。

为什么要换模型

成本

日常编码活儿,GLM 和 DeepSeek 每 token 可能便宜一大截。

可用性

一家被限流、封顶或挂了,第二个模型能让你继续往前走。

隐私 / 掌控

本地或自建模型,能把代码留在自己机器或内网里。

模型路由是怎么回事

本质上,编程 agent 就是把 chat-completion 请求发给一个模型接口,再执行它返回的工具调用。如果两家供应商说的是同一套 API 形状——大多数都说 OpenAI 兼容那套——在它们之间切换只是改三样东西:base URL、API key、模型名。agent 的循环不在乎接口后面是哪个模型。

一般要设的东西

字段示例说明
Base URLhttps://…/v1供应商的 OpenAI 兼容接口
API key你自己的 key按用量计费在你头上
模型名glm-4.7 / deepseek-chat / 你的本地模型那个接口暴露的名字

关键是:不是每个客户端都让你换

拦路的通常是客户端,不是模型。绑死一家供应商的 agent 不让你改接口,你就被锁在那家的定价和限额上。想自由路由,你需要一个生来就支持自带模型的客户端——供应商、base URL、key 都是设置项,而不是写死的。

一个经验法则:如果客户端把「base URL + key + 模型名」做成设置项,你基本就能把它指向任何 OpenAI 兼容供应商(GLM、DeepSeek、Together、本地 vLLM 等等)。

跑本地模型

想完全本地,就用一个暴露 OpenAI 兼容接口的东西把模型服务起来(比如 vLLM),再把 agent 的 base URL 指向你的本地服务。这样代码从不离开你的机器,也完全没有按 token 计费——代价是你得有跑得动模型的硬件。

常见问题

我能用 GLM 或 DeepSeek 代替默认模型吗?

能,只要你的客户端允许设 base URL、key、模型名。GLM 和 DeepSeek 都暴露 OpenAI 兼容接口,支持自定义供应商的客户端可以直接路由过去。

编程 agent 能跑本地模型吗?

能——用一个 OpenAI 兼容的服务(比如 vLLM)把模型起起来,再把 agent 的 base URL 指向本地接口。代码留在你机器上,也没有按 token 的费用。

为什么我现在的 agent 换不了模型?

因为它写死绑了一家供应商。想自由切换,你需要一个把供应商、base URL、key 做成可配置设置项的客户端,而不是固定值。

想让编程 agent 跑在 GLM、DeepSeek、OpenAI 兼容接口或本地模型上,还想随时切换?无为是一个免费、开源的 AI agent,生来就支持自带模型:设好供应商、base URL、key,想路由到哪就到哪。

Windows · macOS · Linux — 免费,无需登录

一个免费、开源、跑在本地的 AI Agent。你说一句话,它就帮你读写文件、改代码、跑命令,想接哪个大模型都行,代码和数据始终留在你自己电脑上。

一念既出,万事自成 · One intention. Everything done. · © 2026 无为 Wuwei