AICOMBO
CN
  • CN
  • EN
CN
  • CN
  • EN
CN
  • CN
  • EN
    • 使用手册
    • 音频
      • 文本转语音
        POST
      • Gemini原生
        POST
    • 聊天
      • 原生OpenAI格式
        • ChatCompletions格式
        • Responses格式
        • Responses 异步任务查询
        • Responses 异步任务删除
        • Responses 流式异步任务查询
      • 原生Gemini格式
        • Gemini对话
      • 原生Vertex AI格式
        • Gemini对话
      • 原生Anthropic格式
        • 原生Claude格式
        • 原生Claude格式 - Token计数
    • 补全
      • 原生OpenAI格式
        POST
    • 图像(Images)
      • Gemini格式
        • Gemini原生
        • OpenAI兼容
    • 模型
      • 列出模型
        • 原生OpenAI格式
        • 原生Gemini格式
    • 运营后台
      • 获取模型价格
        GET

    使用手册

    AICombo 用户指南#

    从注册、令牌管理到 API 接入。
    把平台地址替换为你的 API Base URL,使用平台颁发的令牌,即可开始调用模型。
    本指南以用户实际操作路径组织内容,适合第一次接入、迁移现有应用以及上线前自查。

    目录#

    1.
    注册与登录
    2.
    令牌管理
    3.
    使用 API
    4.
    个人设置
    5.
    使用记录

    API 接入的最短路径#

    创建令牌 → 操练场验证 → 复制 API 地址 → 选择协议 → 发起第一次调用 → 配置生产环境

    1. 注册与登录#

    首次使用请先完成账号注册。注册成功后,系统会自动跳转至首页。

    登录#

    打开平台首页,点击右上角「登录」。
    输入用户名和密码,点击「登录」。
    忘记密码时,点击「忘记密码」,输入注册邮箱并通过重置链接设置新密码。

    注册#

    在登录页点击「注册」。
    填写用户名和密码。
    填写邮箱,点击「发送验证码」,输入收到的验证码。
    点击「注册」完成账号创建。

    2. 令牌管理#

    令牌是调用 API 的凭证。每个令牌可以独立配置权限范围、配额和使用限制。打开左侧「令牌管理」即可查看。

    创建令牌#

    点击「添加令牌」。
    填写令牌名称,建议按用途命名,例如「生产环境」或「测试用」。
    按需配置过期时间、无限配额、模型限制、IP 白名单和分组。
    点击「提交」后立即复制完整 Key;关闭弹窗后无法再次查看。
    令牌列表会展示名称、状态、总配额、剩余配额和过期时间。编辑令牌不会改变 Key;删除令牌后会立即失效且无法恢复。
    安全建议:将 Key 保存在服务端密钥管理系统,不要提交到代码仓库。

    3. 使用 API#

    本章从用户视角介绍如何拿到调用凭证、验证配置,并将平台接入到常见开发环境。完成前两步即可开始第一次调用。

    开始前准备#

    网关 API Base URL,例如 https://api.example.com。
    已创建且仍然有效的令牌 Key。
    目标模型 ID,建议先从模型列表中确认可用模型。

    3.1 在线验证令牌#

    操练场适合在不写代码的情况下快速确认令牌、模型和网关是否可用。
    左侧导航点击「操练场」。
    在左侧选择要测试的模型。
    在底部输入消息并点击发送。
    在对话区域查看模型回复。
    如果调用失败,请检查令牌状态、模型限制、剩余配额和模型 ID。

    3.2 获取 API 地址#

    访问平台首页,在 API Base URL 区域点击复制。接口路径已经包含版本前缀,拼接时不要重复添加 /v1 或 /v1beta。
    示例地址:
    https://<YOUR_API_HOST>
    https://<YOUR_API_HOST>/v1/responses
    https://<YOUR_API_HOST>/v1/models

    3.3 选择调用方式#

    新项目优先使用 Responses;迁移已有 OpenAI、Anthropic 或 Gemini 应用时,可以继续使用原协议。
    你的场景推荐入口认证方式
    OpenAI 兼容 SDK、文本对话POST /v1/responses 或 POST /v1/chat/completionsAuthorization: Bearer <API_KEY>
    Anthropic / Claude 原生调用POST /v1/messagesBearer Token + anthropic-version
    Vertex / Gemini 原生调用POST /v1/publishers/google/models/{model_name}:{action}x-goog-api-key 或 ?key=
    查询可用模型GET /v1/models 或 GET /v1beta/models按目标协议认证

    3.4 第一次 API 调用#

    使用 Responses 接口发送一次非流式请求:
    请求成功后会返回模型响应对象。生产环境请按对应接口的返回数据结构解析。

    3.5 在代码中接入#

    Python(OpenAI 兼容 SDK)#

    JavaScript(OpenAI 兼容 SDK)#

    环境变量#

    3.6 常用能力#

    多轮对话:使用 previous_response_id 串联 Responses 上下文,或自行传递历史消息。
    流式输出:接口和模型都支持时,将 stream 设为 true,并按 SSE 事件边界解析。
    工具调用:将工具结果与对应的 call_id 关联,避免串错不同轮次的结果。
    多模态输入:小文件可使用 Base64,大文件优先使用受控 URL 或文件 URI,并设置正确 MIME 类型。
    图像生成与编辑:明确指定模型、尺寸、质量和返回格式;Base64 不要直接写入日志。
    文本转语音:OpenAI 和 Gemini 的参数与音频格式不同,不能直接复用同一套后处理逻辑。

    支持的主要接口#

    能力方法与路径说明
    文本转语音POST /v1/audio/speech将文本转换为音频
    模型响应POST /v1/responses支持多轮对话、工具调用和推理配置
    Gemini 对话POST /v1/publishers/google/models/{model_name}:{action}Vertex AI 原生格式
    Claude 对话POST /v1/messagesAnthropic Messages 原生格式
    文本补全POST /v1/completions传统补全接口
    向量嵌入POST /v1/embeddings创建文本向量嵌入
    图像生成 / 编辑POST /v1/images/generations/ 或 /edits/生成或编辑图像
    模型列表GET /v1/models 或 GET /v1beta/models查询可用模型
    批处理POST /v1/vertex/batch/jobs创建和查询 Vertex 批任务

    3.7 遇到错误怎么办#

    现象优先检查
    401 / 认证失败API Key 是否完整,以及是否使用正确的认证头
    模型不可用模型 ID、令牌模型限制和模型列表结果
    429 / 请求过多并发、速率限制、账户余额和令牌配额
    400 / 参数错误路径、版本前缀、必填参数和模型支持范围
    流式内容异常是否按 SSE 事件边界解析
    可安全重试的失败通常包括 408、429、500、502、503 和 504。重试时使用指数退避与随机抖动,并限制最大次数。生成类 POST 请求只有在业务能接受重复结果或已提供幂等机制时才应自动重试。

    4. 个人设置#

    登录后点击右上角头像,进入「个人设置」。你可以在这里管理账号、安全认证和通知方式。

    常用设置#

    绑定邮箱或更改密码。
    开启 2FA,使用验证器 App 增强登录安全。
    注册 Passkey,使用指纹、面容或安全密钥登录。
    配置邮件、Webhook、Bark 或 Gotify 通知。
    按需设置价格策略、IP 记录和侧边栏显示项。

    5. 使用记录#

    打开左侧「使用日志」查看每次 API 调用的时间、模型、Token 消耗、配额和调用状态。

    筛选与统计#

    按时间范围、模型和令牌名筛选记录。
    点击「查询」刷新过滤结果。
    打开「数据看板」查看每日 API 调用量和配额消耗趋势。

    上线前检查#

    API Key 通过环境变量或服务端密钥管理系统注入。
    目标模型已验证可用。
    已设置连接、读取和整体请求超时。
    已限制并发、速率和预算,并配置有限重试。
    日志未记录 API Key、完整 Base64 或敏感提示词。
    已处理超时、断线、取消和流式请求的结束状态。
    下一页
    文本转语音
    Built with