
ThinkWatch Lite 是一个开源的本机 AI 网关,用于集中管理中转、国产模型、Claude Code、Codex,并可查看每个请求的花费。 主要功能与描述: - 本机网关集中管理:客户端只接一次并指向本机网关,切换上游、调整路由都在网关内完成,客户端配置不再改动。 - 上游与策略切换:换上游、调路由不重启客户端;手动选择的策略组可在菜单栏或托盘切换。 - 配置接管与还原:接管时只修改指向网关的配置项,写入前提供完整 diff 和原文件备份,可随时还原;客户端只获得网关专用 key,原 key 和登录信息不会被导入或使用。 - Codex 会话连续性:Codex 只认一个 provider,换上游不影响会话列表,接管前旧会话仍在原处。 - 路由能力:按模型、token 数、工具、图片、思考等条件分给不同上游,可改写模型名;支持故障转移、轮询、延迟最低、费用最低;轮询时同一会话固定在同一个上游,缓存照常命中。 - 多格式兼容:Anthropic、OpenAI Chat、Responses、Gemini 四种格式互相转换;Claude Code 可用 GPT、Gemini,Codex 可接只有 Chat 接口的中转。 - 请求可观测与计费:查看费用、token、缓存命中、首 token 时间、生成速度、走了哪条规则、依次试了哪些上游,以及完整请求和响应;中转可按倍率计价,请求可重放到另一个上游对照;菜单栏显示当天花费,可查看 GLM Coding Plan、ChatGPT 额度。 - 节省套餐额度:Claude Code 的标题生成、预热等辅助请求可由网关本地应答,不发给上游。 - 密钥与敏感信息保护:发出前将 API key、token、私钥等替换为占位符,响应回显时再换回;模型让客户端执行“下载后执行”“外发环境变量”等命令时,可在流式输出中途切断;默认只记录、不拦截,确认无误报后可开启。 - 客户端接入:一键接管 Claude Code、Codex(包括 ChatGPT 桌面版里的 Codex)、opencode、Claude Desktop、Zed、Aider、DeepSeek Harness;Cursor、Continue、Antigravity CLI 提供手动配置说明;Windows 上 WSL 里的 Claude Code、Codex 也可接入(WSL 1 或 mirrored 网络);网关可装在 Linux 服务器上,由桌面端远程管理。 - 开源与数据本机:开源,数据都在本机,不收集使用数据。
















