模型渠道
渠道(provider)可以是模型端点或本地模型进程。hipmmcode 内置大型预置目录(Top + Extended),也可接任意自定义 URL。原生支持四种 HTTP wire 协议 —— OpenAI 兼容、Anthropic、Gemini、OpenAI Responses(Codex / xAI 搜索等)—— 以及本地 Claude Code 进程桥。
核心渠道(Top)
| id | 协议 | base URL | 环境变量 | 说明 |
|---|---|---|---|---|
anthropic | anthropic | https://api.anthropic.com | ANTHROPIC_API_KEY | 服务端原生 web_search |
anthropic-claude | 本地进程 | 已安装的 claude CLI | 无 | Claude Pro/Max 订阅桥 |
openai | openai-compat | https://api.openai.com/v1 | OPENAI_API_KEY | |
openai-codex | Responses | ChatGPT Codex 后端 | OAuth | 设备码订阅登录 |
gemini | gemini | https://generativelanguage.googleapis.com | GEMINI_API_KEY | 原生 googleSearch 接地 |
deepseek-anthropic | anthropic | https://api.deepseek.com/anthropic | DEEPSEEK_API_KEY | 推荐 DeepSeek 路径 · 原生联网 · V4 Pro/Flash |
deepseek | openai-compat | https://api.deepseek.com/v1 | DEEPSEEK_API_KEY | 无原生 web_search(用 AnySearch 或换 deepseek-anthropic) |
qwen-token-plan-anthropic | anthropic | https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic | QWENCLOUD_TOKEN_PLAN_API_KEY | 推荐 Token Plan 路径 · 个人版/团队版 · sk-sp- |
qwen-token-plan | openai-compat | https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1 | QWENCLOUD_TOKEN_PLAN_API_KEY | Token Plan 个人版/团队版 · sk-sp- |
kimi | openai-compat | Moonshot 国际 .ai | KIMI_API_KEY | |
kimi-cn | openai-compat | Moonshot 国内 | KIMI_API_KEY |
DeepSeek 建议模型 id(API 真名,非营销名):deepseek-v4-flash、deepseek-v4-pro,可选 deepseek-v4-pro[1m]。不要把日期后缀(如 0731)当成 API model id —— 接口会拒绝。
anthropic 还支持 ANTHROPIC_BASE_URL(中转)与 ANTHROPIC_AUTH_TOKEN(bearer 别名,排在 API key 之后)。详见设置 → 环境变量。
阿里云百炼:Token Plan 与按量付费
阿里云百炼的 Token Plan 和按量付费是两套独立计费产品。HiPMMCode 为每套产品分别提供 OpenAI 兼容与 Anthropic Messages 两种协议入口:
qwen-token-plan 就是 Token Plan 的 OpenAI 兼容渠道;更直观的别名 qwen-token-plan-openai 会解析到同一渠道。
| 渠道 id | 计费方式 | 协议 | Base URL | 密钥 |
|---|---|---|---|---|
qwen-token-plan-anthropic | Token Plan 个人版/团队版 | Anthropic Messages | https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic | 推荐 QWENCLOUD_TOKEN_PLAN_API_KEY;兼容 Qwen Code 的 BAILIAN_TOKEN_PLAN_API_KEY 与旧名 QWEN_TOKEN_PLAN_API_KEY;必须是 sk-sp-... |
qwen-token-plan | Token Plan 个人版/团队版 | OpenAI 兼容 | https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1 | 推荐 QWENCLOUD_TOKEN_PLAN_API_KEY;兼容 Qwen Code 的 BAILIAN_TOKEN_PLAN_API_KEY 与旧名 QWEN_TOKEN_PLAN_API_KEY;必须是 sk-sp-... |
qwen-anthropic | 按量付费 | Anthropic Messages | https://dashscope.aliyuncs.com/apps/anthropic | DASHSCOPE_API_KEY,也兼容旧名 QWEN_API_KEY;使用 sk-... 或 sk-ws-... |
qwen | 按量付费 | OpenAI 兼容 | https://dashscope.aliyuncs.com/compatible-mode/v1 | DASHSCOPE_API_KEY,也兼容旧名 QWEN_API_KEY;使用 sk-... 或 sk-ws-... |
密钥不能跨计费产品混用:sk-sp-... 只用于 Token Plan,sk-... / sk-ws-... 只用于按量付费。HiPMMCode 也不会让这两组渠道互相回退凭证。内置预设使用北京端点;国际区可把 QWEN_TOKEN_PLAN_BASE_URL 指向 https://token-plan.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1。Token Plan 面向交互式编程与 Agent 工具,不应作为无人值守的批量后端。
# Token Plan:Agent 场景优先选择 Anthropic 协议
export QWENCLOUD_TOKEN_PLAN_API_KEY='sk-sp-...'
hipmmcode model qwen-token-plan-anthropic
hipmmcode chat -p qwen-token-plan-anthropic -m qwen3.8-max
# 按量付费:同一 DashScope key 可用于这两种协议
export DASHSCOPE_API_KEY='sk-ws-...'
hipmmcode model qwen-anthropic
hipmmcode chat -p qwen-anthropic -m qwen3.7-plus推荐模型:qwen3.8-max 用于主 Agent 和高难度任务,qwen3.7-max 可作强力子 Agent,qwen3.7-plus 适合日常编码与性价比场景,qwen3.6-flash 适合轻量、低延迟任务。实际可用模型以阿里云控制台中的套餐或地域为准。Anthropic 兼容端点不提供 /v1/models,因此向导会使用 HiPMMCode 内置的精选列表,而不是把发现失败误报为配置失败。
qwen3.8-max 与 qwen3.8-max-preview 在未显式选择 effort 时默认使用 xhigh;前者可用 /effort off 关闭思考,后者始终开启。OpenAI 兼容端点会发送 reasoning_effort: xhigh、enable_thinking 与 preserve_thinking,并把思考模式温度提升到最低 0.6。Anthropic 渠道使用对应的 Anthropic 自适应思考格式,严格网关若拒绝该字段会安全降级重试。
Token 用量与套餐 Credits
HiPMMCode 会读取响应中的 usage,保留输入、输出、缓存创建、缓存读取与推理 Token 明细。/usage 显示规范化后的会话输入/输出总量,无头 JSON 输出还会包含这些明细字段。OpenAI 兼容流式请求会启用 stream_options.include_usage;Anthropic 流式请求则使用最终 message_delta.usage。这些值是 Token 计数,不等于 Token Plan 的 Credits:Credits 还会随模型、思考和工具调用动态折算。套餐剩余 Credits、重置时间与 5 小时/7 天窗口请到阿里云百炼控制台的套餐用量详情查看,不能从普通模型响应准确推算。
图像、视频和音频生成使用各自独立的多模态生成 API,不要把生成模型放进普通聊天模型选择器。直连 qwen-token-plan 或 qwen-token-plan-anthropic 时,HiPMMCode 的原生 GenerateImage 会自动改走 Token Plan 专用端点,和 Grok Imagine 一样无需 Skill。个人版可用 wan2.7-image / wan2.7-image-pro;团队版还可逐次选择 qwen-image-2.0 / qwen-image-2.0-pro。默认使用两种套餐共有的 wan2.7-image,也可设置 HIPMMCODE_IMAGE_MODEL。
原生 GenerateVideo 也会在 qwen-token-plan 与 qwen-token-plan-anthropic 上复用同一个已配置的 sk-sp-...;聊天协议不同不会改变北京专用视频端点。当前个人版和团队版都列出 happyhorse-1.1-t2v、happyhorse-1.1-i2v 与 happyhorse-1.1-r2v,可生成 720P/1080P、3–15 秒 MP4。新付费任务提交前会经过权限门禁;HiPMMCode 私密记录返回的 task_id、持续轮询并立即下载仅保留 24 小时的结果,恢复模式只查询同一任务而不会再次 POST。官方 Skills 仍可作为独立按量付费工作流使用。参见Token Plan 多模态生成、个人版支持模型与异步任务管理。
原生 GenerateSpeech 同样复用直连渠道的 sk-sp-...,通过北京专用 WebSocket 调用个人版和团队版均列出的 qwen-audio-3.0-tts-plus。默认使用 Plus 兼容音色 longanlingxin、输出 MP3 22.05 kHz,也可设置兼容音色、格式、采样率、音量、语速、音高、语言提示与指令。HiPMMCode 在联网前按官方规则校验文本/指令的加权长度,在消耗 Credits 前请求确认,完整接收并校验二进制音频流,再通过固定本地输出 capability 原子落盘。参见Qwen-Audio-TTS WebSocket API与当前的Qwen-Audio-TTS 音色列表。
扩展目录(节选)
在 hipmmcode model 的 More providers… 中可见(也是 -p / /provider 的合法 id)。各自带好 base URL、协议与惯用环境变量:
| id | 说明 |
|---|---|
xai | xAI Grok API Key(XAI_API_KEY)—— 对话、Imagine 出图、Responses 联网搜索 |
xai-oauth | SuperGrok / Premium+:设备码 OAuth(或复用 ~/.grok/auth.json) |
qwen / qwen-anthropic | 阿里云百炼按量付费 · OpenAI 兼容 / Anthropic Messages |
qwen-oauth | 复用外部 Qwen CLI OAuth 凭证文件;不同于百炼 API Key 渠道 |
dashscope / dashscope-cn | 阿里云百炼国际 / 国内 |
alibaba-coding / alibaba-coding-cn | 阿里 coding-plan 端点 |
zai / zai-cn | Z.AI / GLM |
minimax / minimax-cn / minimax-cn-anthropic | MiniMax(含国内 Anthropic 协议) |
mimo | 小米 MiMo |
tokenhub | 腾讯 TokenHub |
nvidia | NVIDIA API 目录 |
stepfun / stepfun-cn | 阶跃星辰国际 / 国内 |
openrouter、ai-gateway、huggingface、copilot、copilot-acp | 聚合器与 GitHub Copilot |
ollama、lmstudio | 本机 OpenAI 兼容服务 |
arcee、gmi、kilocode、opencode、opencode-go、nous | 其他目录项 |
bedrock | AWS Bedrock bearer(AWS_BEARER_TOKEN_BEDROCK) |
渠道向导
hipmmcode model # 完整向导:渠道 → 认证 → 实时模型列表 → 默认模型
hipmmcode model deepseek-anthropic
hipmmcode model qwen-token-plan-anthropic # Token Plan(sk-sp-)
hipmmcode model openai-codex # ChatGPT Codex 订阅(或复用 ~/.codex/auth.json)
hipmmcode model xai-oauth # 设备码登录(或复用 Grok CLI)向导拉取渠道真实的 /v1/models 列表(失败时回退精选预设),并持久化 key 或 OAuth 凭证、渠道定义与 defaultProvider / defaultModel。
OAuth 与订阅渠道
以下渠道不用静态 API key 认证:
| 渠道 | 工作方式 |
|---|---|
Claude Code 订阅(anthropic-claude) | 调用本机已登录的官方 claude 进程。先运行 claude auth login --claudeai,再在 hipmmcode model 里选择 Anthropic → Claude Pro/Max subscription。非交互式可用 hipmmcode -p anthropic-claude -m 'sonnet[1m]' exec "..." 或把模型换成 opus[1m]。默认模型列表只包含这两个已验证的 1M 选项;后缀会原样传给 Claude Code,HiPMMCode 的上下文预算也按 1M 计算,最终可用性仍由官方 CLI 按账号权益判断。HiPMMCode 不读取、不复制、不保存 Claude OAuth token,该渠道也不会读取 Anthropic API/代理环境变量。这是实验性的本机兼容桥:每个模型回合都以 safe mode 启动 Claude Code、禁用其内置工具,再把工具意图交回 HiPMMCode 自己的权限/工具循环;不能作为会员网关或托管订阅中转。 |
OpenAI Codex(openai-codex) | 用 ChatGPT/Codex 订阅走设备码:向导展示 URL + 验证码,浏览器授权后 token 写入 ~/.hipmmcode/config.json 的 oauthCredentials。每轮前自动刷新。再次进入向导可选 Use existing / Reauthenticate / Cancel。原生 OpenAI Responses(含联网与出图)。若本机已有 Codex CLI 的 ~/.codex/auth.json 也可被动复用。 |
xAI Grok OAuth(xai-oauth) | 对 https://auth.x.ai 做 设备码登录(与 Grok CLI / Hermes 同款公开客户端)。token 存入 oauthCredentials["xai-oauth"] 并自动刷新(约 1 小时提前量)。若已用 Grok CLI 登录,可直接复用 ~/.grok/auth.json。覆盖对话(grok-4.5 等)、Imagine 出图、Responses 联网搜索。API Key 替代方案:渠道 xai + XAI_API_KEY。 |
Qwen OAuth(qwen-oauth) | 复用外部 qwen CLI 凭证(~/.qwen/oauth_creds.json)—— 先 qwen auth qwen-oauth;hipmmcode 只读并自动刷新该文件。 |
AWS Bedrock(bedrock) | AWS_BEARER_TOKEN_BEDROCK 的 bearer 模式。完整 IAM/SigV4 不支持。 |
Claude 订阅桥和原生 anthropic API 渠道是两回事:它只启动用户安装的官方 CLI, 不会把 Claude.ai 登录变成可复用的 HTTP 凭据。生产、远程或高吞吐场景请继续使用 Anthropic Console API key 配置 anthropic;可用模型和额度以本机 Claude 套餐及 CLI 为准。
OpenAI Codex 快速配置
# 方案 A —— 设备码登录(ChatGPT / Codex 订阅)
hipmmcode model openai-codex
# 打开打印的 URL,输入验证码,等待凭证写入
# 方案 B —— 本机已有 Codex CLI 登录(~/.codex/auth.json)
hipmmcode model openai-codex # 无自管 token 时被动复用本机登录
# 或临时指定、不改默认:
hipmmcode -p openai-codex -m gpt-5.1-codex "hello"xAI Grok 快速配置
# 方案 A —— 设备码(无需安装 Grok CLI)
hipmmcode model xai-oauth
# 打开打印的 URL,确认验证码,等待 ✓ Logged in to xAI Grok
# 方案 B —— API Key
export XAI_API_KEY=xai-...
hipmmcode model xai
# 方案 C —— 本机已有 Grok CLI 登录(~/.grok/auth.json)
hipmmcode model xai-oauth # 选择 Use existing credentials运行时切换
hipmmcode chat -p deepseek-anthropic -m deepseek-v4-flash
hipmmcode chat -p qwen-token-plan-anthropic -m qwen3.8-max
hipmmcode chat -p openai-codex -m gpt-5.1-codex
hipmmcode chat -p xai-oauth -m grok-4.5
hipmmcode models --all # 无头列出所有渠道的模型
hipmmcode models -p kimi --json # 单渠道,机器可读REPL 里:
/model—— 两段式选择器:先渠道后模型(实时发现,带上下文窗口信息)。/model prov/model也有 ghost 补全。OAuth 渠道在凭证就绪时出现(自管 store 或外部 CLI 文件)。/provider <id>—— 切换渠道(持久化为默认)。/refresh-models—— 清发现缓存。
裸 /model 走渠道 → 模型两步,当前组合有标记:
› /model Channel — 选一个渠道,Enter 查看其模型 anthropic key: config ❯ deepseek-anthropic key: config (active) xai-oauth oauth kimi key: env deepseek-anthropic — models 实时发现 / 精选回退 ❯ deepseek-v4-flash ctx (active) deepseek-v4-pro ctx ↑/↓ 移动 · Enter 确认 · Esc 返回
自定义渠道
任何 OpenAI 兼容、Anthropic 协议或 Gemini 协议端点都能接。交互式添加(hipmmcode model → custom),或直接写 ~/.hipmmcode/config.json:
{
"custom": {
"my-proxy": {
"baseUrl": "http://10.0.0.5:8080",
"protocol": "Anthropic",
"envVar": "MY_PROXY_API_KEY",
"models": ["claude-opus-4-8", "claude-sonnet-4-6"],
"headers": { "X-Team": "platform" },
"modelOverrides": {
"claude-opus-4-8": { "contextWindow": 200000, "maxOutputTokens": 16000 }
}
}
},
"apiKeys": { "my-proxy": "sk-..." }
}hipmmcode chat -p my-proxy -m claude-opus-4-8字段说明:
protocol——OpenaiCompat(默认)/Anthropic/Gemini/OpenaiResponses。models—— 省略则实时发现;设置则钉死列表。headers/headersHelper—— 静态附加头,或输出 JSON 头的 shell 命令(短期 token)。envVar—— 无存储 key 时去哪个环境变量找。envVars—— 在envVar之后按序尝试的额外环境变量名(如 Gemini 也认GOOGLE_API_KEY,Copilot 认GH_TOKEN/GITHUB_TOKEN)。预置目录渠道自带正确的回退列表。modelOverrides—— 纠正代理误报的上下文窗口 / 输出上限。oauth—— 需要浏览器登录的端点的 OAuth 配置。
自定义渠道从其协议家族继承合理默认 —— openai-compat 自定义借用 openai 的模型建议,gemini 自定义借用 gemini 的,以此类推。
模型名解析
模型名在所有入口解析一致 —— REPL、exec、serve、ACP:
- 简写 → 规范名:
opus、sonnet、haiku这类家族别名展开为渠道的规范 id。 - 长上下文标记:
[1m]后缀在内部选中长上下文变体,调 API 前剥除。 provider/model形式在任何接受模型名的地方都可用(如/model kimi/kimi-k2)。
回退与韧性
--fallback-model(可重复,最多 3 个)或配置里的fallbackModels—— 主模型过载时按序尝试。- 瞬时故障指数退避重试;重试横幅显示原因。
- 上下文溢出走压缩恢复而不是让回合失败。
模型元数据
上下文窗口、输出上限、模态支持(视觉 / 视频)来自内置的 models.dev 元数据层,随发现缓存刷新。可用 modelOverrides(自定义渠道)或 <provider>.modelOverride.<model>.… 配置键逐模型覆盖。
推理力度
hipmmcode config set effort=high # off / low / medium / high / max或运行中执行 /effort high。按各协议的原生方式生效(reasoning token、adaptive thinking)。deepseek-anthropic 的主 Agent 与子 Agent 默认均为 max;Codex 类渠道默认 high,其他渠道保持原有默认行为。显式执行 /effort off 始终会关闭 DeepSeek 的思考。