按 Token 调用的大模型 API
一个按 OpenAI 兼容格式设计的接口,接入多类大模型;价格、上下文与默认限流逐项公开。
curl YOUR_API_BASE_URL/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $MATR_API_KEY" \
-d '{
"model": "matr-1",
"messages": [
{"role": "user", "content": "用三句话解释什么是向量检索。"}
]
}'示例使用 代码生成 · 标准版(示例);接口地址以控制台为准。
- 可调用模型示例
- 8个
- 模型类别示例
- 6类
- 使用方式示例
- 4种
- 服务可用性目标示例
- 99.9%
标注“示例”的数据为演示数据,以控制台与合同为准。
三步完成首次调用
已有基于 OpenAI SDK 的代码时,通常只需替换接口地址、API Key 与模型 ID
- 01
获取 API Key
申请试用额度,或在控制台创建 API Key。
- 02
配置接口地址
把 base URL 指向 matr 模型 API。
- 03
发送请求
使用模型广场中的模型 ID 发起调用。
按类别挑选模型
每个模型都公开上下文长度、价格与默认限流
按用量付费,价格逐项可查
- [ 01 ]
输入 Tokens
您发送给模型的内容,包括系统提示词、历史消息与文档,按输入价列示。
- [ 02 ]
输出 Tokens
模型生成的内容,按输出价列示。
- [ 03 ]
缓存命中
支持上下文缓存的模型另列缓存命中价;是否命中与计量口径以控制台为准。
价格单位:元 / 百万 Tokens。价格为人民币刊例价,是否含税以合同为准。
四种使用方式
从按量调用开始,用量与数据要求变化时再升级
公共资源池:按量调用 · 资源包 → 专属资源:专属吞吐 → 企业机房:私有化部署
- 按量调用
按量调用
按实际 Token 用量付费,随用随停
按实际 Token 用量计费,输入、输出与缓存命中分别列价;计量口径与扣费方式以控制台为准。
查看详情 - 资源包
资源包
预付 Token 额度,在有效期内抵扣用量
按资源包档位预付,调用时按适用范围抵扣;超出部分的计费方式以控制台规则为准。
查看详情 - 专属吞吐
专属吞吐
为高并发业务预留推理资源
按预留规格与时长计费,计费周期与服务等级以合同约定为准。
查看详情 - 私有化部署
私有化部署
模型部署在您的机房或专有云内
项目制,按部署规模、模型与运维范围报价。
查看详情
对比四种使用方式
为什么选 matr 模型 API
协议兼容
请求与响应按 OpenAI 兼容格式设计,可使用 OpenAI 官方 SDK 调用;兼容范围以 API 文档为准。
参数透明
每个模型公开上下文长度、输出上限、价格与默认限流,价格更新时间可查。
成本可估算
输入、输出与缓存命中分别列价,可按月用量或请求量估算费用;账单以控制台为准。
升级路径清晰
按量调用、资源包、专属吞吐与私有化部署可按阶段切换,由同一团队支持。
需要的不只是 API?
如果您的场景涉及知识库建设、业务智能体或系统集成,matr 数字化转型团队可以在同一套模型 API 之上完成方案设计与交付;数据须留在企业内部时,可选择私有化大模型部署。
常见问题
接口按 OpenAI Chat Completions 与 Embeddings 的请求与响应格式设计,可使用 OpenAI 官方 SDK,通常替换接口地址、API Key 与模型 ID 即可。兼容范围与个别参数的支持情况以 API 文档和模型详情页为准。