• 简体中文
  • 模型与协议

    接入 Geekit 时需要同时选对模型和协议。协议决定请求与事件结构,模型决定能力、上下文、速度和计费;只改 Base URL 不能自动消除两者差异。

    快速选择

    客户端或场景首选协议说明
    Codex CLIOpenAI Responses需要 Responses 流式事件和工具调用
    Claude Code CLIAnthropic Messages推荐 Claude 系模型
    通用桌面 Agent、编辑器插件Chat Completions兼容范围最广
    Gemini 原生 SDKGemini使用 generateContent 等原生动作
    普通对话应用Chat Completions最容易验证和迁移
    向量检索Embeddings选择专用向量模型
    候选文档精排Rerank选择专用重排序模型

    如果客户端同时支持多种协议,优先使用它原生设计的协议。例如 Codex CLI 优先 Responses,不要仅因为 Chat Completions 更常见就强制转换。

    获取真实模型 ID

    curl "$GEEKIT_BASE_URL/v1/models" \
      -H "Authorization: Bearer $GEEKIT_API_KEY"

    复制 data[].id。模型展示名、家族名和真实请求 ID 可能不同;版本日期、推理等级或渠道别名也可能是 ID 的一部分。

    协议兼容不等于能力兼容

    同一个请求能被网关接受,不代表目标模型具备客户端需要的全部行为:

    • 工具调用:Agent 需要稳定生成工具名与参数,并能接收工具结果。
    • 上下文长度:代码仓库、长文档和多轮任务需要足够的上下文窗口。
    • 流式事件:Responses、Messages 和 Chat 的事件结构不同。
    • 推理内容:不同模型使用不同字段和展示规则。
    • 多模态:图像、音频和文件输入需要模型与协议同时支持。
    • 结构化输出:JSON Schema 等能力可能只在特定模型上可用。

    模型别名与后缀

    Geekit 可能向用户展示稳定别名,也可能直接展示上游快照 ID。使用时遵循以下原则:

    1. /v1/models 和控制台当前显示为准。
    2. 不自行删除日期、能力或版本后缀。
    3. 切换模型后重新验证流式输出、工具调用和上下文。
    4. 自动发现失败时手动填写 ID,不要用相似名称替代。

    Base URL 规则

    协议常见 Base URL
    OpenAI Chat / Responseshttps://geekit.yryq.top/v1
    Anthropic Messageshttps://geekit.yryq.top
    Gemini 原生https://geekit.yryq.top,由 SDK 拼接 /v1beta
    完整 URL 模式直接填写具体端点

    客户端可能自动拼接路径。出现 /v1/v1/... 或缺少 /v1 时,先确认它要求的是根地址、/v1 Base URL,还是完整请求 URL。

    Agent 模型检查清单

    在投入真实任务前,用一个最小任务依次确认:

    • 模型能完成普通文本响应。
    • 流式输出不会停在中途。
    • 能正确发起并继续工具调用。
    • 长输入不会立即超过上下文。
    • Geekit 日志记录了正确模型和协议。
    • Token 与额度消耗符合预期。

    首选客户端的完整步骤见 Codex CLIClaude Code CLI