跳转到内容

API 概览

AMD Radeon Cloud API 分成两半,在脑子里分开看会清楚很多。

Model API 负责跑推理。它有两种形态,控制台里叫 Public Free Model APIsDedicated Model APIs。两者共用一把密钥和一套 HTTP 形状,此外几乎没有共同点——主机不同、关卡不同、错误体也不同——所以本参考把它们分开写,每一页都会写明讲的是哪一种。

Platform API 管理模板、实例和账户。控制台调的就是它,你也可以自己驱动它,把启动和销毁写成脚本。

接口基础 URL
Public Free Model APIshttps://developer.amd.com.cn/radeon/api/v1
Dedicated Model APIshttps://<host>/spaces/<instance-id>/<port>/v1
Platform APIhttps://radeon-global.anruicloud.com

独占的基础 URL 在实例启动时生成,会显示在启动对话框和 Active Instance 里。别自己拼——端口取决于服务栈(vLLM 是 8000,SGLang 是 30000)。

请求和响应都是 JSON,Content-Type: application/json。时间戳是 ISO 8601。出错时返回非 2xx 状态和一个 JSON 体——见错误

常开,不用起实例,不花额度。上哪些模型由 AMD 决定。四个操作:

每条路径同样可以用 /api/v1/... 访问,两种写法是同一个端点。

旧版 completions、embeddings、图像、音频、rerank 以及 /v1/responses 这里不提供,会返回 404

这些请求要过一层网关。请求体先按一组固定字段校验、再重建,然后才送往服务后端——所以这组字段之外的参数是被丢掉而不是被转发的,接受的字段清单见聊天补全。按密钥的限流、并发额度和花费上限都生效,见限流

跑在你自己启动、自己花额度的实例上的 vLLM 或 SGLang。模型和服务参数都由你定。

请求会剥掉路由前缀后原样转发给你的服务器,所以那台服务器实现了什么就有什么——通常包括 /v1/completions/v1/embeddings,也没有共享端点那套参数过滤。这条路上没有网关,所以共享端点的限流、共享目录和共享错误体统统不适用。

独占端点

范围参考
启动、查看、销毁实例实例
创建和管理模板模板
资料、API 密钥、SSH 密钥、额度账户
Model API 用量和配额用量

接着读认证——两半的认证方式不同,这一点比这套 API 里的任何其他东西都更容易把人绊倒。