公司外部大模型中转平台使用指南
本平台为公司研发人员提供统一的大模型 API 代理服务,方便接入 Claude Code、Codex 等 AI 编程工具,并通过智能路由降低上游限流和单点拥堵对工作流的影响。
Why
平台优势
这里把原文的长段说明拆成可扫描的能力卡片,普通用户进入页面后能先判断平台解决什么问题。
网络直连
平台部署在云端环境,可在公司网络下直接访问,无需额外代理或 VPN。
模型全面
统一接入 Claude、GPT、GLM、DeepSeek、KIMI 等模型,凭一个内部 Key 切换使用。
工具自由
优先保持官方客户端体验,可按官网教程安装最新版工具,不强制安装额外依赖。
高可用路由
后端自动处理限流、熔断和路由切换,尽量减少单一供应商拥堵带来的中断。
统一额度
公司统一分配额度,个人无需处理海外账号、信用卡和充值流程。
Updates
最近更新
更新日志改成时间线,避免混在优势列表里导致阅读节奏断开。
- 调整页面布局,新增每次请求价格计算悬浮窗。
- 新增 coding.fullhan.cc 域名。
- 新增模型广场页面,上线实时成本测算。
- 新增 claude-opus-4-8 模型。
- 禁止在 CC-switch 中测试 Anthropic 模型连通性。
- Claude Code 需要登录时,可在 .claude.json 添加 "hasCompletedOnboarding": true。
Step 1
准备工作:获取 API 凭证
用户最关心的是 Key 从哪来、到哪里验证、哪些页面能看到个人消耗。
联系管理员获取凭证
凭证通常以 sk- 开头。内部大模型平台和外部中转平台凭证不通用。

Step 2
工具接入流程
这一部分采用“工具卡片 + 端点规则 + 截图”的布局,比原始长文更适合按工具快速定位。
接入 Claude Code
在 CC-switch 中新建 Claude Code 供应商,Provider Name、Notes 和 Website URL 可自由填写。
API Key: sk-...
API EndPoint: https://coding.fullhan.cc

接入 Codex
在 CC-switch 中新建 Codex 供应商,不要直接修改 default 配置。
API Key: sk-...
API Request URL: https://coding.fullhan.cc/v1

VS Code 插件
在 VS Code 插件市场安装 Claude Code for VS Code 或 Codex。原则上 CC-switch 参数配置完成后,插件会自动读取配置,无需额外设置。
Models
模型选择建议
模型列表保留,但收敛成分组和选择表,减少用户第一次阅读时的负担。
如何切换和选择不同模型
如果使用 Claude Code 搭配 Anthropic 模型,或 Codex 搭配 OpenAI 模型,通常无需额外设置。需要第三方模型时,可在 CC-switch 高级选项中填写模型字段。
Claude Code CLI 也可以通过命令行参数临时指定模型,例如:
claude --model deepseek-v4-pro
Anthropic
claude-opus-4-8claude-opus-4-7claude-sonnet-4-6claude-haiku-4-5OpenAI
gpt-5.5gpt-5.4gpt-5.4-minigpt-5.3-codex国产模型
glm-5.1deepseek-v4-prokimi-k2.6qwen3.6-plusmimo-v2.5-pro| 场景 | 建议模型 | 成本感知 |
|---|---|---|
| 简单问题、配置环境、一般代码 | 国产模型 | 很低 |
| 常规复杂代码任务 | Codex + GPT | 中等 |
| 困难规划和复杂重构 | Claude Code + Opus | 较高 |
| 超长文档解析 | DeepSeek 1M | 较低 |
Billing
计费与缓存
把计费解释从 FAQ 中抽出来,避免用户只有出账后才看到规则。
实际扣费
实际扣费金额 = 官方 API 基础价格 x 平台倍率。
倍率用于覆盖智能路由、账号池、网络资源和高可用能力成本。
Prompt Caching
Anthropic 相关模型可能产生缓存创建费用。后续命中缓存时,读取缓存通常更便宜且响应更快。
FAQ
常见问题
我们目前支持哪些可用模型?v
平台会持续接入 Claude、GPT、GLM、DeepSeek、KIMI、Qwen、MIMO 等模型。实际可用模型以模型广场展示为准。
如何切换和选择不同模型?v
Claude Code 搭配 Anthropic 模型、Codex 搭配 OpenAI 模型时通常不需要额外设置。Claude Code CLI 可通过 --model 指定模型,CC-switch 也可在高级选项中配置模型映射。

DeepSeek 1M 上下文如何开启?v
将模型名修改为 deepseek-v4-pro[1m]。请确保当前供应商和分组支持该模型名。
平台计费规则是什么?v
实际扣费金额按官方 API 基础价格乘以平台倍率计算。倍率用于覆盖路由、账号池、网络和稳定性成本。
Cache Creation 是什么?v
部分 Anthropic 模型会对提示词缓存写入收费。缓存建立后,后续命中缓存的读取成本通常更低,响应速度也会更好。
请求出现 503 怎么排查?v
先检查 API Endpoint 是否正确,尤其是 Claude Code 不加 /v1,Codex 必须加 /v1。排除配置后,可切换模型或联系管理员。
如何设置 Claude Code 缓存为 1 小时?v
在 CC-switch 中添加配置 "ENABLE_PROMPT_CACHING_1H": "1"。后台监控出现 1h 字样代表生效。注意 1h 缓存创建费用通常高于 5m 缓存,请谨慎开启。

为什么不建议使用 MiniMax 系列模型?v
MiniMax 建议直接使用公司内部大模型平台,目前内部平台提供满血 MiniMax M2.7,且不占外部中转额度。
为什么 Claude Code 不支持外接 GPT 系列模型?为什么 Codex 不支持外接其他模型?v
当前强烈推荐在 Codex 中使用 GPT 模型。如果确实有跨工具模型组合需求,请联系管理员评估供应商和客户端兼容性。
Opus 模型最强,是不是只用这个就行?v
原则上可以,但 Opus 成本较高,很容易触发额度上限。建议根据任务难度切换模型,不要把简单环境配置和轻量代码修改都放在高价模型上。
我应该如何选择模型?v
论文理解、复杂规划、深入分析依赖工程等任务适合高阶模型;环境配置、简单 bug 定位、了解工程大致框架通常可先用低成本模型。若模型陷入反复 debug,再切换高级别模型。
使用 GPT-5.5 出现 Selected model is at capacity 是什么原因?v
这是上游 OpenAI 侧容量不足或高负载信号,个人用量页面通常表现为 409。可切换到 GPT-5.4 等模型,或稍后重试。
个人用量页面请求出现 499 是什么原因?v
499 通常表示客户端和服务器之间的连接提前断开。一般情况下请求已经正常发出,可结合个人用量页面和本地客户端日志判断是否需要重试。
想要更多模型怎么办?v
实际供应商可用模型通常多于文档列出的模型。如果你看到新的模型发布,或有特殊模型需求,可以联系管理员评估是否接入。
遇到其他问题
如果在使用过程中遇到网络不通、前端网页报错、模型缺失或计费异常,请联系平台管理员协助排查。