接入前准备
- 在控制台创建 API Key,保存到服务端环境变量。
- 打开模型与价格,复制模型 ID。
- 确认目标模型支持 Responses 或 Chat Completions。
- 先发送最小文本请求,再增加流式输出和工具调用。
Base URL
SDK 填 https://api-models.com/v1。Responses 完整地址为 https://api-models.com/v1/responses。
Responses:curl 请求
curl https://api-models.com/v1/responses \
-H "Authorization: Bearer $API_MODELS_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<MODEL_ID>",
"input": "用一句话解释向量数据库。"
}'
返回文本可从响应对象的 output 中读取。使用官方 SDK 时可以直接读取 response.output_text。
Responses:Python SDK
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["API_MODELS_KEY"],
base_url="https://api-models.com/v1",
)
response = client.responses.create(
model="<MODEL_ID>",
input="用一句话解释向量数据库。",
)
print(response.output_text)
生产环境应设置超时、重试和请求日志。日志不要记录 API Key 或完整敏感输入。
Chat Completions 兼容请求
现有项目可以继续使用 messages 请求体。该路径兼容范围通常更广,具体以模型页面的接口标记为准。
curl https://api-models.com/v1/chat/completions \
-H "Authorization: Bearer $API_MODELS_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<MODEL_ID>",
"messages": [
{"role": "user", "content": "用一句话解释向量数据库。"}
]
}'
迁移检查
| 项目 | 需要修改 | 检查方法 |
|---|---|---|
| Base URL | https://api-models.com/v1 | 检查 SDK 初始化配置 |
| API Key | API Models 控制台令牌 | 检查服务端环境变量 |
| 模型 ID | 控制台中的完整 ID | 不要根据厂商名称猜测 |
| Responses 输入 | input | 输出读取 response.output_text |
| Chat 输入 | messages | 输出读取 choices[0].message.content |
错误排查
| 状态码 | 先检查 | 处理 |
|---|---|---|
| 401 | API Key、Bearer 前缀、环境变量 | 重新创建令牌并发送最小请求 |
| 403 | 令牌分组与模型权限 | 检查控制台权限 |
| 404 | Base URL、路径、模型 ID、接口支持 | 与本页示例和模型接口标记逐项比对 |
| 429 | 余额、额度、并发限制 | 降低并发或等待后重试 |
| 5xx | 请求 ID、时间、是否可复现 | 保存脱敏请求并联系支持 |