编辑器里的 AI 助手已经是写代码的标配,但官方订阅按月付费、额度还卡得紧。其实 Cursor 和 VSCode 的主流 AI 插件都支持自定义 API——把地址、密钥换成你自己的,模型随便挑,成本按用量走,多开几个编辑器也不用重复订阅。这篇以 Cursor 和 VSCode 里的 Cline / Continue 两类插件为例,十分钟把自建 API 接进编辑器。
为什么值得接自建 API
编辑器 AI 的消耗比聊天场景大得多:每次补全、每次对话都会把整个文件的上下文发给模型,token 走得飞快。用自建 API 有三个好处——模型可以随时换(今天的问答用便宜模型,重要的重构换强模型);用量透明可查(控制台里每一笔消耗都有明细);多端共用一份密钥(公司电脑、家里电脑、服务器上的终端工具全都能接)。AIGC微风网关的接口与 OpenAI 格式完全兼容,凡是支持自定义 OpenAI 兼容端点的编辑器和插件都能直接用。
三步接入:Cursor 和插件是同一套逻辑
不同编辑器的界面不一样,但要填的东西永远是同样的三样:
- Base URL:填 https://api.aigcbreeze.cn/v1。注意结尾带 /v1,少了它请求会 404
- API Key:填你在控制台创建的令牌(sk- 开头)。建议给编码场景单独开一个令牌,方便单独统计和随时停用
- 模型名:手动填站点在售的模型 ID(如 glm-5.3-flash、deepseek-v4.1-flash)。有些插件默认列表里没有这些模型,选「自定义模型 ID」手动输入即可
Cursor 在 Settings → Models 里关掉默认模型后点 Add model 手动添加,再在 Override Base URL 处填上面的地址;Cline / Continue 这类插件则在设置页选 OpenAI Compatible 提供商,把三项填进去保存。配置完先用聊天窗口问一句话验证连通,再开补全和内联改写。
模型怎么分配:对话用便宜的,改动用强的
编辑器场景最好配两个模型档位:日常问答、解释代码、写注释这类高频操作用快而便宜的模型(响应快才不打断思路);跨文件重构、排查疑难 bug、生成完整模块时再切到更强的模型。多数插件支持分别设置「对话模型」和「内联编辑 / 补全模型」,把档位分开后成本能差出一个数量级。另外补全类的延迟极其敏感,优先挑响应速度快的模型,别只看参数榜单。
容易踩的坑:编辑器插件默认会带上很大的上下文(整个文件甚至整个工作区),长会话记得开新对话,否则每轮都在为重复的旧上下文付费。发现消耗异常时,先看插件是否在把超大文件整篇塞进请求。
常见问题
填完配置连不上,报 401 或 404 怎么排查?
401 是密钥问题:检查是否复制完整、令牌是否被删除或额度用尽;404 多半是 Base URL 少了 /v1 或者插件在地址后面又拼了一层路径。先用命令行 curl 请求一次 https://api.aigcbreeze.cn/v1/models 验证密钥和地址,编辑器里的配置再照着填,能少走大半弯路。
补全功能不生效或特别慢?
先确认插件厂商是否要求专用补全端点——部分插件的「自动补全」只支持官方模型,对话和内联改写才走自定义 API,这种限制在插件文档里都有说明。速度慢则优先换响应更快的模型档位,并检查是否在网络代理环境下走了绕路。实在不行就只把对话接自建 API,补全留在本地方案。
一个令牌多人多设备共用安全吗?
个人多设备共用没问题,但建议按设备或按场景分令牌:每个令牌单独记账、单独限额度,哪个泄露了停哪个就行,不影响其他设备。控制台里可以随时查看每个令牌的用量明细和充值额度。