OpenAI Chat Completions
与 OpenAI /v1/chat/completions 逐字段兼容,支持流式、工具调用、推理参数与结构化输出。
端点
POST/v1/chat/completions
| 字段 | 类型 | 说明 | |
|---|---|---|---|
| model | string | 必填 | 模型名称或别名,见模型广场。 |
| messages | array | 必填 | 对话消息,role ∈ system / user / assistant / tool;content 支持文本与图片(image_url)。 |
| stream | boolean | 可选 | true 时以 SSE 返回 data: {...} 分片,最后一帧带 usage,随后 data: [DONE]。 |
| stream_options.include_usage | boolean | 可选 | 流式时在最后一帧附带用量。 |
| max_completion_tokens | integer | 可选 | 输出 token 上限(兼容 max_tokens)。 |
| temperature / top_p | number | 可选 | 采样参数,透传上游。 |
| tools / tool_choice | array / string | 可选 | 函数调用定义与策略,透传上游。 |
| response_format | object | 可选 | json_object 或 json_schema 结构化输出(模型支持时)。 |
| reasoning_effort | string | 可选 | 推理强度 low / medium / high(推理模型)。 |
curl https://www.link42.ai/v1/chat/completions \
-H "Authorization: Bearer $LINK42_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"stream": true,
"stream_options": {"include_usage": true},
"messages": [
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "列出三个使用 API 网关的好处"}
]
}'{
"id": "chatcmpl-8f1c…",
"object": "chat.completion",
"created": 1788300000,
"model": "glm-5.2",
"choices": [{"index": 0, "message": {"role": "assistant", "content": "…"}, "finish_reason": "stop"}],
"usage": {"prompt_tokens": 38, "completion_tokens": 120, "total_tokens": 158}
}- usage 中的 token 数即计费依据;缓存命中的输入按 cache_read 价格计费。
- 流式响应期间连接被客户端中断时,已生成部分仍会按实际用量结算。
模型列表
GET/v1/models
返回当前密钥所属分组可用的模型(OpenAI 形态 {object:"list", data:[{id, object:"model", owned_by}]})。
按模型对照
第一列是调用时填进 model 的目录名。部署方另外配置的别名(例如 seed-2.0-pro)以模型广场显示的为准,两者都能用。
下表包含迁移参考与暂未开通的模型,不代表全部可调用。/anthropic/v1/messages、/v1/responses 的适配还要看所选模型和当前密钥分组的实时能力;请先查 GET /v1/models,再按该端点测试。未列出的字段按各端点说明处理。
| 模型 ID | 名称 | 上游 | 计费 | 差异字段 | 限制与注意 |
|---|---|---|---|---|---|
| seed-2-0-pro-260328 | Dola-Seed-2.0-pro | BytePlus Ark | 按 token | messages[].content 支持 text、image_url 与 input_audio;响应的 message 带 reasoning_content;usage 带 prompt_tokens_details.cached_tokens / audio_tokens 与 completion_tokens_details.reasoning_tokens | 单次输入超过 128,000 token 后整次调用单价 ×2;图片输入计入 prompt_tokens 并按文本输入价结算;音频输入 token 在 legacy_v1 档案下会被计两次 |
| seed-2-0-lite-260428 | Dola-Seed-2.0-lite | BytePlus Ark | 按 token | 同 2.0-pro,但不接受图片输入;usage 明细相同 | 长上下文阈值与音频 token 的 legacy_v1 双计规则同 2.0-pro |
| seed-2-0-mini-260428 | Dola-Seed-2.0-mini | BytePlus Ark | 按 token | 同 2.0-lite,接受 input_audio 音频输入 | 长上下文阈值与音频 token 的 legacy_v1 双计规则同 2.0-pro |
| dola-seed-2-1-turbo-260628 | Dola-Seed-2.1-turbo | BytePlus Ark | 按 token | 标准 chat 字段,无扩展;usage 只有 prompt / completion 与 cached_tokens、reasoning_tokens 明细 | 没有长上下文加价档 |
| deepseek-v4-pro-260425 | DeepSeek-V4-Pro | BytePlus Ark | 按 token | 标准 chat 字段,无扩展 | 没有长上下文加价档 |
| deepseek-v4-flash-260425 | DeepSeek-V4-Flash | BytePlus Ark | 按 token | 标准 chat 字段,无扩展 | 没有长上下文加价档 |
| glm-5-2-260617 | GLM-5.2 | BytePlus Ark | 按 token | 标准 chat 字段,无扩展 | 没有长上下文加价档 |
| deepseek-v4-1-flash | DeepSeek-V4.1-Flash | 国内火山方舟(北京) | 人民币原价按当日 SAFE 汇率折美元,再应用有效折扣(账号模型专属、账号默认、模型默认依次生效) | 标准 chat / Responses;支持文本、视觉理解和工具调用,usage 的缓存命中单独计价 | 上游 deepseek-v4-1-flash-260910;实际开通与可用性读取实时目录和路由状态,不以文档代替。工作日北京时间 09:00–12:00、14:00–18:00 使用高峰价。 |
| deepseek-v4-pro | DeepSeek-V4-Pro 正式版 | 国内火山方舟(北京) | 人民币原价按当日 SAFE 汇率折美元,再应用有效折扣(账号模型专属、账号默认、模型默认依次生效) | 标准 chat / Responses;缓存命中按单独价格计费 | 上游 deepseek-v4-pro-ga-260813;实际开通与可用性读取实时目录和路由状态,不以文档代替。 |
| deepseek-v4-flash | DeepSeek-V4-Flash 正式版 | 国内火山方舟(北京) | 人民币原价按当日 SAFE 汇率折美元,再应用有效折扣(账号模型专属、账号默认、模型默认依次生效) | 标准 chat / Responses;缓存命中按单独价格计费 | 当前对应上游 deepseek-v4-flash-ga-260731;以模型广场当前 USD 报价为准 |
| glm-5-3-flash | GLM-5.3-Flash | 国内火山方舟(北京) | 人民币原价按当日 SAFE 汇率折美元,再应用有效折扣(账号模型专属、账号默认、模型默认依次生效) | 标准 chat / Responses;缓存命中按单独价格计费 | 上游 glm-5-3-flash-260828;实际开通与可用性读取实时目录和路由状态,不以文档代替。 |
| glm-5.2 | Alibaba GLM-5.2 | 阿里云百炼(OpenAI 兼容端点) | 按 token | 私有协议下的单轮 prompt 形状同 Alibaba DeepSeek-V4-Pro | cached_tokens 按缓存读单价结算;没有长上下文加价档 |
- 长上下文加价对整次调用生效:单次请求的输入 token 超过阈值后,这次调用的输入与输出都按加价后的单价结算,不是只对超出部分加价。
- 音频输入 token 的重复计数是旧系统的历史行为,只保留在 legacy_v1 档案(迁移过来的 ak- 密钥)里;新建的 sk- 密钥是 standard_v1,不重复计。
- 不带日期后缀的 deepseek-v4-pro、deepseek-v4-flash 当前绑定国内火山方舟;带 -260425 后缀的是另一条 BytePlus 历史目录记录。表中的参数资料不代表当前已开通,以实时模型广场和 API Key 分组目录为准。