核心概念
InOneAPI 将“调用接口”和“提供推理的渠道”解耦。你面向稳定的公共模型 ID 编程,网关负责协议转换、路由、计量和安全策略。
四层资源模型
| 层级 | 作用 | 典型配置 |
|---|---|---|
| 工作区 | 团队和资源的最外层边界 | 成员、角色、审计 |
| 项目 | 一个应用或环境的隔离单元 | 模型白名单、预算、隐私模式 |
| 子密钥 | 具体调用方的凭证 | 更严格的预算、速率、模型范围 |
| 模型/供应商 | 逻辑能力与物理渠道 | 能力、价格、上游 ID、健康度 |
请求到达网关后,依次完成密钥认证、项目策略检查、模型能力校验、路由选择、协议转换、上游调用和用量记录。任一策略拒绝都会在上游调用前返回错误。
公共模型 ID
公共模型 ID(例如 openai/gpt-4.1-mini)是应用契约,不等于某个供应商的原始名称。管理员可以增加或下线渠道,应用仍使用同一个 ID。模型不可用时,网关返回 INVALID_MODEL 或 ROUTE_UNAVAILABLE,不会静默改用能力不兼容的模型。
请求级 Trace
X-Gateway-Trace-ID 串联认证、排队、重试、上游响应和计量事件。将它与业务请求 ID 一起记录,可在不保存提示词正文的前提下排查 TTFT、超时和重试。
零数据隐私模式
启用后,提示词和完成内容仅在网关内存中流式处理并计算 Token,不写入数据库。Trace 仍保留时间、状态、路由和用量等诊断元数据。需要内容审计的项目应明确关闭该模式并遵循数据保留策略。