核心概念

InOneAPI 将“调用接口”和“提供推理的渠道”解耦。你面向稳定的公共模型 ID 编程,网关负责协议转换、路由、计量和安全策略。

四层资源模型

层级作用典型配置
工作区团队和资源的最外层边界成员、角色、审计
项目一个应用或环境的隔离单元模型白名单、预算、隐私模式
子密钥具体调用方的凭证更严格的预算、速率、模型范围
模型/供应商逻辑能力与物理渠道能力、价格、上游 ID、健康度

请求到达网关后,依次完成密钥认证、项目策略检查、模型能力校验、路由选择、协议转换、上游调用和用量记录。任一策略拒绝都会在上游调用前返回错误。

公共模型 ID

公共模型 ID(例如 openai/gpt-4.1-mini)是应用契约,不等于某个供应商的原始名称。管理员可以增加或下线渠道,应用仍使用同一个 ID。模型不可用时,网关返回 INVALID_MODELROUTE_UNAVAILABLE,不会静默改用能力不兼容的模型。

请求级 Trace

X-Gateway-Trace-ID 串联认证、排队、重试、上游响应和计量事件。将它与业务请求 ID 一起记录,可在不保存提示词正文的前提下排查 TTFT、超时和重试。

零数据隐私模式

启用后,提示词和完成内容仅在网关内存中流式处理并计算 Token,不写入数据库。Trace 仍保留时间、状态、路由和用量等诊断元数据。需要内容审计的项目应明确关闭该模式并遵循数据保留策略。