把平台地址替换为你的 API Base URL,使用平台颁发的令牌,即可开始调用模型。 本指南以用户实际操作路径组织内容,适合第一次接入、迁移现有应用以及上线前自查。
安全建议:将 Key 保存在服务端密钥管理系统,不要提交到代码仓库。
https://api.example.com。/v1 或 /v1beta。https://<YOUR_API_HOST>
https://<YOUR_API_HOST>/v1/responses
https://<YOUR_API_HOST>/v1/models| 你的场景 | 推荐入口 | 认证方式 |
|---|---|---|
| OpenAI 兼容 SDK、文本对话 | POST /v1/responses 或 POST /v1/chat/completions | Authorization: Bearer <API_KEY> |
| Anthropic / Claude 原生调用 | POST /v1/messages | Bearer Token + anthropic-version |
| Vertex / Gemini 原生调用 | POST /v1/publishers/google/models/{model_name}:{action} | x-goog-api-key 或 ?key= |
| 查询可用模型 | GET /v1/models 或 GET /v1beta/models | 按目标协议认证 |
previous_response_id 串联 Responses 上下文,或自行传递历史消息。stream 设为 true,并按 SSE 事件边界解析。call_id 关联,避免串错不同轮次的结果。| 能力 | 方法与路径 | 说明 |
|---|---|---|
| 文本转语音 | POST /v1/audio/speech | 将文本转换为音频 |
| 模型响应 | POST /v1/responses | 支持多轮对话、工具调用和推理配置 |
| Gemini 对话 | POST /v1/publishers/google/models/{model_name}:{action} | Vertex AI 原生格式 |
| Claude 对话 | POST /v1/messages | Anthropic Messages 原生格式 |
| 文本补全 | POST /v1/completions | 传统补全接口 |
| 向量嵌入 | POST /v1/embeddings | 创建文本向量嵌入 |
| 图像生成 / 编辑 | POST /v1/images/generations/ 或 /edits/ | 生成或编辑图像 |
| 模型列表 | GET /v1/models 或 GET /v1beta/models | 查询可用模型 |
| 批处理 | POST /v1/vertex/batch/jobs | 创建和查询 Vertex 批任务 |
| 现象 | 优先检查 |
|---|---|
| 401 / 认证失败 | API Key 是否完整,以及是否使用正确的认证头 |
| 模型不可用 | 模型 ID、令牌模型限制和模型列表结果 |
| 429 / 请求过多 | 并发、速率限制、账户余额和令牌配额 |
| 400 / 参数错误 | 路径、版本前缀、必填参数和模型支持范围 |
| 流式内容异常 | 是否按 SSE 事件边界解析 |
408、429、500、502、503 和 504。重试时使用指数退避与随机抖动,并限制最大次数。生成类 POST 请求只有在业务能接受重复结果或已提供幂等机制时才应自动重试。