providerService.ts 10 KB

123456789101112131415161718192021222324252627282930313233343536373839404142434445464748495051525354555657585960616263646566676869707172737475767778798081828384858687888990919293949596979899100101102103104105106107108109110111112113114115116117118119120121122123124125126127128129130131132133134135136137138139140141142143144145146147148149150151152153154155156157158159160161162163164165166167168169170171172173174175176177178179180181182183184185186187188189190191192193194195196197198199200201202203204205206207208209210211212213214215216217218219220221222223224225226227228229230231232233234235236237238239240241242243244245246247248249250251252253254255256257258259260261262263264265266267268269270271272273274275276277278279280
  1. import { mkdir, readFile, writeFile } from 'node:fs/promises';
  2. import { join } from 'node:path';
  3. import { chatBridge } from './chatBridgeService';
  4. import { getCodexDataDir } from './codexHome';
  5. import { DEFAULT_API_KEY_ENV, type CodexProviderSpec, type CodexRuntime, type JsonValue } from './codexRuntime';
  6. import type { AppliedProviderInfo, ApplyProviderInput } from './types';
  7. /**
  8. * 把后端「模型管理」里的一条记录翻译成 Codex 的 model provider。
  9. * 全程不做任何 Codex/OpenAI 账号登录:靠 wire_api="responses" + requires_openai_auth=false + env_key。
  10. * apiKey 只存在于内存与子进程环境变量,落盘的 AppliedProvider 不含任何密钥。
  11. */
  12. export const PROVIDER_ID = 'zsjz';
  13. export type AppliedProvider = AppliedProviderInfo;
  14. /**
  15. * 端点判定。后端「模型管理」里的记录一律是 Chat 协议(没有 /responses),
  16. * 所以这里只关心「能不能用 Chat」:chat → 走内置桥接;其余两种拒绝。
  17. */
  18. export type EndpointProtocol = 'chat' | 'unsupported' | 'unreachable';
  19. export interface EndpointProbeResult {
  20. protocol: EndpointProtocol;
  21. /** /chat/completions 的 HTTP 状态;未探或网络失败为 null */
  22. chatStatus: number | null;
  23. detail: string;
  24. }
  25. const EXTRA_ALLOWLIST: readonly string[] = [
  26. 'request_max_retries',
  27. 'stream_max_retries',
  28. 'stream_idle_timeout_ms',
  29. 'query_params',
  30. ];
  31. function providerFile(): string {
  32. return join(getCodexDataDir(), 'provider.json');
  33. }
  34. /** Codex 要求 base_url 是 API 根(形如 https://api.openai.com/v1),它自己再拼路由 */
  35. export function normalizeBaseUrl(raw: string | null | undefined): string | null {
  36. const value = (raw ?? '').trim().replace(/\/+$/u, '');
  37. return value || null;
  38. }
  39. /** 给页面的非阻断提示;返回 null 表示没问题 */
  40. export function baseUrlHint(baseUrl: string | null): string | null {
  41. if (!baseUrl) return '未配置 base_url';
  42. if (!/^https?:\/\//u.test(baseUrl)) return 'base_url 必须以 http:// 或 https:// 开头';
  43. if (!/\/v\d+$/u.test(baseUrl)) {
  44. return 'base_url 通常应写到版本段(如 .../v1),否则拼出的 /chat/completions 可能 404';
  45. }
  46. return null;
  47. }
  48. function parseJsonRecord(raw: unknown): Record<string, unknown> | null {
  49. if (!raw) return null;
  50. if (typeof raw === 'object' && !Array.isArray(raw)) return raw as Record<string, unknown>;
  51. if (typeof raw !== 'string') return null;
  52. try {
  53. const parsed = JSON.parse(raw) as unknown;
  54. return parsed && typeof parsed === 'object' && !Array.isArray(parsed)
  55. ? (parsed as Record<string, unknown>)
  56. : null;
  57. } catch {
  58. return null;
  59. }
  60. }
  61. function readStringMap(raw: unknown): Record<string, string> | null {
  62. const record = parseJsonRecord(raw);
  63. if (!record) return null;
  64. const result: Record<string, string> = {};
  65. for (const [key, value] of Object.entries(record)) {
  66. if (typeof value === 'string' && value) result[key] = value;
  67. }
  68. return Object.keys(result).length ? result : null;
  69. }
  70. /**
  71. * 后端「模型管理」的一条记录一律翻译成自定义 provider:Codex 0.155.1 把 ollama / lmstudio
  72. * 等内置 id 列为保留字,覆盖 model_providers.<内置 id> 会让 app-server 启动即退出。
  73. * 地址缺失就是配置缺失,直接报错让页面提示,不做 localhost 兜底。
  74. */
  75. export function toProviderSpec(input: ApplyProviderInput): CodexProviderSpec {
  76. const model = `${input.modelId ?? ''}`.trim();
  77. if (!model) throw new Error('缺少 modelId');
  78. const baseUrl = normalizeBaseUrl(input.baseUrl);
  79. if (!baseUrl) {
  80. throw new Error(`模型「${input.name || model}」没有配置 base_url,请到「模型管理」补全(形如 https://host:port/v1)`);
  81. }
  82. const config = parseJsonRecord(input.config);
  83. const extra: Record<string, JsonValue> = {};
  84. for (const [key, value] of Object.entries(config ?? {})) {
  85. if (EXTRA_ALLOWLIST.includes(key)) extra[key] = value as JsonValue;
  86. }
  87. return {
  88. id: PROVIDER_ID,
  89. name: input.name ?? model,
  90. baseUrl,
  91. model,
  92. apiKey: input.apiKey ?? null,
  93. envKey: DEFAULT_API_KEY_ENV,
  94. httpHeaders: readStringMap(input.headersJson),
  95. extra: Object.keys(extra).length ? extra : null,
  96. };
  97. }
  98. /** config 里被丢弃的非白名单键,用于页面提示 */
  99. export function describeDroppedKeys(input: ApplyProviderInput): string[] {
  100. const config = parseJsonRecord(input.config);
  101. return Object.keys(config ?? {}).filter((key) => !EXTRA_ALLOWLIST.includes(key));
  102. }
  103. /**
  104. * 探测只问「路由在不在」,绝不让端点真去生成:本地服务多是单槽推理,
  105. * 一次生成能占住整个 HTTP 服务几十秒(实测 max_tokens:1 也要 14 秒,期间连 /models 都不应答)。
  106. * 15 秒是留给排队的余量。
  107. */
  108. const PROBE_TIMEOUT_MS = 15_000;
  109. interface ProbeAttempt {
  110. status: number | null;
  111. error: string | null;
  112. ms: number;
  113. timedOut: boolean;
  114. }
  115. function describeFetchError(error: unknown): { message: string; timedOut: boolean } {
  116. const err = error instanceof Error ? error : new Error(String(error));
  117. return {
  118. message: err.message,
  119. timedOut: err.name === 'TimeoutError' || err.name === 'AbortError' || /timeout/iu.test(err.message),
  120. };
  121. }
  122. async function probeFetch(url: string, init: RequestInit, timeoutMs: number): Promise<ProbeAttempt> {
  123. const startedAt = Date.now();
  124. try {
  125. const response = await fetch(url, { ...init, signal: AbortSignal.timeout(timeoutMs) });
  126. return { status: response.status, error: null, ms: Date.now() - startedAt, timedOut: false };
  127. } catch (error) {
  128. const { message, timedOut } = describeFetchError(error);
  129. return { status: null, error: message, ms: Date.now() - startedAt, timedOut };
  130. }
  131. }
  132. async function postProbe(url: string, body: Record<string, unknown>, apiKey?: string | null): Promise<ProbeAttempt> {
  133. return probeFetch(
  134. url,
  135. {
  136. method: 'POST',
  137. headers: {
  138. 'content-type': 'application/json',
  139. ...(apiKey ? { authorization: `Bearer ${apiKey}` } : {}),
  140. },
  141. body: JSON.stringify(body),
  142. },
  143. PROBE_TIMEOUT_MS,
  144. );
  145. }
  146. /**
  147. * 不可达的提示必须带上是哪个地址、等了多久——只说「端点不可达」时,
  148. * 用户既不知道配错在哪,也无从判断是没起服务还是被防火墙慢慢吞掉。
  149. */
  150. function unreachableDetail(url: string, attempt: ProbeAttempt): string {
  151. if (attempt.timedOut) {
  152. return `端点不可达:${url} 在 ${(attempt.ms / 1000).toFixed(1)} 秒内没有响应,请确认服务已启动、地址与端口正确`;
  153. }
  154. return `端点不可达:${url} —— ${attempt.error ?? '网络错误'}`;
  155. }
  156. function probeResult(partial: Partial<EndpointProbeResult> & { protocol: EndpointProtocol; detail: string }): EndpointProbeResult {
  157. return { chatStatus: null, ...partial };
  158. }
  159. /**
  160. * 判定端点能不能用 Chat 协议——后端「模型管理」里的记录都是 Chat 端点,
  161. * 有的就交给内置桥接。
  162. *
  163. * 只看 /chat/completions 这条路由在不在:请求体故意不带 messages,
  164. * 端点会在校验阶段就回 400(实测 15ms),不会真的开始生成。
  165. * 代价是模型名写错要到真正提问时才暴露。
  166. */
  167. export async function probeEndpoint(params: {
  168. baseUrl: string;
  169. modelId?: string | null;
  170. apiKey?: string | null;
  171. }): Promise<EndpointProbeResult> {
  172. const baseUrl = params.baseUrl.replace(/\/+$/u, '');
  173. const chatUrl = `${baseUrl}/chat/completions`;
  174. const model = params.modelId?.trim() || 'probe';
  175. const chat = await postProbe(chatUrl, { model }, params.apiKey);
  176. if (chat.status === null) {
  177. return probeResult({ protocol: 'unreachable', detail: unreachableDetail(chatUrl, chat) });
  178. }
  179. if (chat.status !== 404 && chat.status !== 405) {
  180. return probeResult({
  181. protocol: 'chat',
  182. chatStatus: chat.status,
  183. detail: `端点支持 Chat 协议(HTTP ${chat.status}),应用时经内置桥接转换为 Responses`,
  184. });
  185. }
  186. return probeResult({
  187. protocol: 'unsupported',
  188. chatStatus: chat.status,
  189. detail: `端点没有 /chat/completions 路由(HTTP ${chat.status}),本客户端只对接 Chat 协议端点`,
  190. });
  191. }
  192. export async function readAppliedProvider(): Promise<AppliedProvider | null> {
  193. try {
  194. const raw = JSON.parse(await readFile(providerFile(), 'utf8')) as Partial<AppliedProvider>;
  195. return raw.model ? (raw as AppliedProvider) : null;
  196. } catch {
  197. return null;
  198. }
  199. }
  200. async function writeAppliedProvider(value: AppliedProvider | null): Promise<void> {
  201. await mkdir(getCodexDataDir(), { recursive: true });
  202. await writeFile(providerFile(), JSON.stringify(value ?? {}, null, 2), 'utf8');
  203. }
  204. /** 应用一条模型配置:先探端点,再重启子进程(api_key 走 env,换 key 必须重启) */
  205. export async function applyProvider(
  206. runtime: CodexRuntime,
  207. input: ApplyProviderInput & { modelRecordId?: string | number | null },
  208. ): Promise<AppliedProvider> {
  209. const spec = toProviderSpec(input);
  210. /** 落盘存上游真实地址(展示用);桥接 URL 每次应用临时分配,不落盘 */
  211. const displayBaseUrl = spec.baseUrl;
  212. // 一定要先探端点:应用成功后才发现连不上,比这里直接报错更难排查
  213. const probe = await probeEndpoint({
  214. baseUrl: spec.baseUrl,
  215. modelId: spec.model,
  216. apiKey: spec.apiKey,
  217. });
  218. if (probe.protocol !== 'chat') throw new Error(probe.detail);
  219. // Codex 只会发 Responses,所以 Chat 端点一律经内置桥接:Codex 改连本地代理的 /v1/responses
  220. const bridge = await chatBridge.start({ upstreamBaseUrl: spec.baseUrl, headers: spec.httpHeaders ?? null });
  221. spec.baseUrl = bridge.url;
  222. try {
  223. await runtime.applyProvider(spec);
  224. } catch (error) {
  225. // 应用失败回滚桥接,避免留下一个指着旧上游的孤儿代理
  226. await chatBridge.stop();
  227. throw error;
  228. }
  229. const applied: AppliedProvider = {
  230. model: spec.model,
  231. modelRecordId: input.modelRecordId === undefined || input.modelRecordId === null
  232. ? null
  233. : String(input.modelRecordId),
  234. baseUrl: displayBaseUrl,
  235. providerId: spec.id,
  236. name: spec.name ?? null,
  237. appliedAt: new Date().toISOString(),
  238. bridged: true,
  239. };
  240. await writeAppliedProvider(applied);
  241. return applied;
  242. }
  243. export async function clearProvider(runtime: CodexRuntime): Promise<void> {
  244. await chatBridge.stop();
  245. await runtime.applyProvider(null);
  246. await writeAppliedProvider(null);
  247. }