外观
文本 API
本站文本模型分为 Responses、Messages、Chat Completions 和 Gemini 原生入口。模型名称相似不代表协议相同;具体模型和分组见模型目录。
接口选择
| 接口 | 方法 | 当前目录中的模型 |
|---|---|---|
/v1/responses | POST | GPT 系列 |
/v1/messages | POST | Claude 系列、glm-5.3 |
/v1/chat/completions | POST | Claude 系列、GLM 系列、DeepSeek、Gemini |
/v1beta/models/{model}:generateContent | POST | gemini-3.5-flash |
以上来自网关配置和公开目录;未表示本轮已完成带令牌的生成测试。不要把视频模型的目录协议标签解释为文本聊天能力。
基础参数
| 协议 | 文本输入 | 模型字段 | 流式控制 |
|---|---|---|---|
| Responses | input | model | stream: true 返回 SSE |
| Messages | messages,并提供 max_tokens | model | stream: true 返回 SSE |
| Chat Completions | messages | model | stream: true 返回 SSE |
| Gemini | contents[].parts | 路径中的模型 ID | 独立 :streamGenerateContent?alt=sse 入口 |
本站具体请求例子见快速开始。可先发起“只回复 OK”的最小请求,再加入需要的参数。
DeepSeek:Chat Completions
确认令牌可见后,可复用快速开始的 Chat 请求,将 model 替换为 deepseek-v4-flash、deepseek-v4-pro 或 deepseek-v4.1-flash。不把 GPT Responses 参数直接复制到此请求。
Gemini:原生协议
bash
curl --fail-with-body -sS "https://newapi.fq-hx.com/v1beta/models/gemini-3.5-flash:generateContent" \
-H "Authorization: Bearer $NEWAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents":[{"role":"user","parts":[{"text":"只回复 OK"}]}]}'文本通常位于 candidates[].content.parts[].text。本站网关使用 Bearer 令牌;目录也标注此模型可走 Chat Completions。两种入口的请求与响应结构不同,本轮均未进行计费生成测试。
响应处理
- Responses 的流式请求包含文本增量、错误及完成事件;SSE 的每条
data单独解析,不能对整段响应调用JSON.parse。 - Messages 的非流式文本通常位于
content中的text内容块。 - Chat 的非流式文本通常位于
choices[0].message.content。 - HTTP 成功后仍需检查流中的错误事件或终态;连接中断不能当作完整响应。
能力边界
上下文长度、推理档位、图片输入、结构化输出和工具调用取决于所选渠道及上游版本。本站没有实测依据的能力不列为固定保证,也不根据模型名自动套用官方产品参数。
目录还标注部分 GPT 模型支持 /v1/responses/compact 和 /v1/alpha/search。这些是独立接口能力,不能把其参数直接用于 Chat Completions;需要时先向管理员确认该令牌的使用方式。
费用和错误
请求可能产生费用。以控制台价格与使用日志为准;遇到失败,记录 HTTP 状态、脱敏错误、时间和模型,按照错误处理排查。