核心优势
多模型聚合
接入 12 家主流模型厂商,共 62 个模型,覆盖文本对话、图像生成等多种能力:
| 厂商 | 代表模型 |
|---|---|
| OpenAI | GPT 系列 |
| Anthropic | Claude 系列 |
| Gemini 系列 | |
| DeepSeek | DeepSeek 系列 |
| 阿里巴巴 | Qwen 系列 |
| 百度 | ERNIE 系列 |
| 智谱 | GLM 系列 |
| 字节跳动 | Doubao 系列 |
| MiniMax | MiniMax 系列 |
| Moonshot | Kimi 系列 |
低延迟
AMAX Token Router 采用轻量级网关架构,对请求的处理延迟仅增加 10~50ms,对用户体验几乎无影响。
原始延迟 = 模型计算时间 + 网络延迟
AMAX 延迟 = 模型计算时间 + 网络延迟 + 10~50ms(网关开销)高并发
- 无 QPS/TPS 限制 — 不对你的请求频率做任何硬性限制
- 内置负载均衡 — 自动在多个上游实例间分发流量
- 自动故障转移 — 某个模型厂商不可用时,自动切换到备用模型
极致降本
相比直接对接各模型厂商的官方 API,通过 AMAX Token Router 调用可获得更优的价格。具体折扣因模型而异,建议登录控制台查看最新计费明细。
降本逻辑:
- 智能路由策略帮你自动选择性价比最优的模型
- 聚合采购带来的议价优势转化为用户价格
- 统一的用量管理,避免在各厂商留有零散余额
零代码改动接入
完全兼容 OpenAI 协议,你只需要:
# 改前
base_url = "https://api.openai.com/v1"
api_key = "sk-xxxx"
# 改后
base_url = "https://ai.amaxsmp.com"
api_key = "sk-xxxx" # 控制台获取其余代码原封不动。系统会自动处理协议转换,包括 OpenAI ↔ Anthropic 协议互转。