Turing TokenHub
Turing TokenHub 是 Turing AgentCore 的模型 Gateway。它把模型供应商、协议和调用治理统一到 Project、Environment 与 API Key 边界中。
TokenHub 也可以独立服务普通应用;当它被 Agent 使用时,它是 AgentCore 的模型出口,而不是另一个平行的 Agent 运行平台。
它负责什么
| 能力 | 说明 | 文档入口 |
|---|---|---|
| 模型访问 | 通过统一入口访问不同供应商和模型 | 模型列表 |
| 协议适配 | Chat Completions、OpenAI Responses、Anthropic Messages | 核心接口 |
| 模型能力 | Embeddings、Rerank、图像、视频、语音和实时接口 | 生成端点 |
| 调用治理 | API Key、速率限制、超时、重试、Fallback 和请求追踪 | 可靠性 |
| Token 计量 | Token 计数、用量和费用查询 | 计费与用量 |
它与 AgentCore 的关系
| 场景 | TokenHub 的位置 |
|---|---|
| 普通应用 | 独立的模型访问 Gateway |
| 后端 Agent | Agent loop 的模型调用出口 |
| Managed Chat | 平台托管对话使用的模型调用层 |
| Agent Runtime(未来) | Runtime 内部访问模型的受治理出口 |
不应混淆的边界
- TokenHub 不保存 Agent 的长期状态;长期状态属于 AgentCore LTM。
- TokenHub 不执行工具;工具由应用、Tool Gateway 或 Runtime 执行。
- 协议兼容不代表不同供应商的参数、上下文限制和输出语义完全相同。
- Token 计量用于平台用量和治理,不替代业务侧成本核算。
当前与后续
当前文档以已有模型接口、模型目录和治理能力为准。后续可以在保持调用边界稳定的前提下增加更明确的路由、策略、配额和成本控制;接口确定前不把这些方向写成现状承诺。