网易首页 > 网易号 > 正文 申请入驻

先薅为敬,AMD 免费大模型 API 使用教程

0
分享至

AMD 想抢英伟达的开发者,已经不是一两天的事了。这次的路子更直接,把 Radeon Cloud 平台打开一个口子,直接送大模型 API,免费用,不消耗 GPU 算力。

9 月初,Public Free Model APIs 板块挂着四个模型

  • DeepSeek-V4-Flash-Vision-Exp(DeepSeek 看图说话旗舰)
  • DeepSeek-V4-Flash-0731(DeepSeek 纯文本 0731 快照)
  • Qwen3.8-Flash-Next(阿里千问 Qwen4 架构先导版)
  • MiniCPM5-1B(OpenBMB 出品,1B 小钢炮)

四个都走 OpenAI 兼容协议,curl、Python SDK,或者任何支持 OpenAI 接口的编程工具,接上就能用。这篇教程把注册、拿 Key、写代码三步讲完,顺手告诉你四个模型各自适合什么场景。



一、平台定位与入口

Radeon Cloud 是 AMD 官方的云端 AI 算力平台,类似 Colab 但跑的是 AMD 显卡。海外站是 AMD Developer Cloud。

这块 Public Free Model APIs 是平台专门为开发者开的免费窗口,模型跑在 AMD 自己的服务器上,不需要你自己开实例,也不消耗 GPU 算力额度。底层是 OpenAI 兼容协议,所以任何支持 OpenAI 接口的工具都能接。

官方文档地址在 Token Factory 页面,调用方式、Base URL、API Key、现成的 curl 示例,都能从那里拿到。

二、注册与拿 Key

整个流程十分钟左右,手机号(支持国内号码)或邮箱都能注册,也能用 GitHub、CSDN、魔搭社区账号快捷登录。

步骤 1 访问 Token Factory

打开 https://developer.amd.com.cn/radeon/modelapis,右上角点 Login。

登录方式按需选

  • 手机号注册登录,支持国内手机号码
  • 邮箱注册登录
  • GitHub、CSDN、魔搭社区账号快捷登录,点一下授权就行

避坑提醒,用 GitHub 登录时,AMD 会请求「读基础公开信息」的权限,只用来确认身份,不是偷你的代码,按提示点同意即可。

步骤 2 完成账号验证

首次登录后要完成账号验证,具体走哪步看你注册时选的方式。邮箱注册会收到验证邮件,打开点链接就激活了。用快捷登录的话,只要第三方账号的邮箱已验证,这一步通常会自动跳过。

步骤 3 进入 Token Factory

激活后页面会跳到模型列表。Public Free Model APIs 区域下面就是四个免费模型卡片,每个卡片点进去会弹出一个详情对话框,对话框里展示

  • Base URL,https://developer.amd.com.cn/radeon/api/v1
  • Model 名,如 DeepSeek-V4-Flash、Qwen3.8-Flash-Next、MiniCPM5-1B
  • 你的 API Key(每位用户独立生成)
  • 现成的 curl 测试代码(OpenAI 格式和 Anthropic 格式两套)

把 API Key 复制下来,存到自己的密码管理器里。这个 Key 就是后续调用的「通行证」,所有免费模型共用同一个 Key。

步骤 4 了解积分规则

点开任意一个模型卡片,会看到输入 0.14 pts 每 1M tokens、输出 0.28 pts 每 1M tokens、缓存读取 0.0028 pts 每 1M tokens。

这是积分制的「积分」,不是人民币。页面写得很清楚,「Free to use. Points show relative usage, not a charge」。

意思是平台用积分统计用量,方便你看自己大概跑了几次请求,实际不收费。不用担心用着用着突然扣钱。

三、四个模型怎么选

四个模型定位完全不同,按场景对号入座就行。

DeepSeek-V4-Flash-Vision-Exp

  • 出品方 DeepSeek
  • 类型 多模态(VLM),能看图能读文字
  • 能力 1M 上下文、支持图片理解
  • 亮点 305B 总参数,MoE 激活 13B,8 月 31 日官方仓库刚开源(MIT License)
  • 标签 LIMITED FREE(限时开放窗口)
  • 适合 图片问答、OCR、视觉理解、截图分析

选它的理由,看图说话能力顶级,而且限时免费,遇到就先用。

DeepSeek-V4-Flash-0731

  • 出品方 DeepSeek
  • 类型 纯文本(LLM)
  • 能力 写代码、写文章、问答、翻译、Agent 任务
  • 亮点 DeepSeek V4 Flash 系列的 0731(7 月 31 日)快照版本
  • 标签 FREE
  • 适合 日常文字工作、AI 编程辅助、长文档处理

选它的理由,免费的「全能型选手」,不知道用哪个模型时就用它。

Qwen3.8-Flash-Next

  • 出品方 阿里通义千问
  • 类型 多模态 MoE(AMD 平台标注 LLM 文本)
  • 能力 原生 262144 token 上下文(26 万),可扩展至 1M
  • 亮点 125B 总参数、每 token 激活 6B,训练成本约 Qwen3.7-Plus 的九分之一,是 Qwen4 架构的先导预览
  • 标签 FREE
  • 适合 智能体编程、长文档处理、代码任务

选它的理由,8 月 26 日刚开源的新架构模型,免费跑在 AMD 显卡上,等于提前体验 Qwen4 的底子。官方测试里编程和 Agent 任务都超过 Qwen3.7-Plus,模型权重走 Qwen Community License(开放权重,允许商用)。

MiniCPM5-1B

  • 出品方 清华 OpenBMB(面壁智能)
  • 类型 纯文本(LLM)
  • 能力 1B 参数、AA 榜单小模型组第一(17.9 分)
  • 亮点 INT4 量化后只有 0.5 GB,手机、浏览器都能本地跑
  • 标签 FREE
  • 适合 本地部署、端侧应用、轻量 Agent、IoT 设备

选它的理由,模型极小但性能逆天,AA 榜单上超过 Qwen3.5-2B 这种翻倍参数的对手。如果你准备把模型塞进自己产品里跑,这个最香。

四、三种调用方式

三种方式覆盖从临时测试到日常使用的全部场景。

方式 1 curl 命令行(最轻)

不用装任何东西,终端里一行命令就能测。把 YOUR_API_KEY 换成你的 Key 直接发请求

curl https://developer.amd.com.cn/radeon/api/v1/chat/completions \-H "Authorization: Bearer YOUR_API_KEY" \-H "Content-Type: application/json" \"model": "DeepSeek-V4-Flash","messages": [{"role": "user", "content": "用一句话介绍 AMD Radeon Cloud"}}'

换成 MiniCPM5-1B 或 Qwen3.8-Flash-Next,只改 model 字段就行。想看图的请求格式见方式 2,官方文档里也有现成示例。

方式 2 Python openAI SDK

写代码前先装包

pip install openai

基础对话

from openai import OpenAIclient = OpenAI(api_key="YOUR_API_KEY",base_url="https://developer.amd.com.cn/radeon/api/v1"response = client.chat.completions.create(model="DeepSeek-V4-Flash",messages=[{"role": "user", "content": "写一首关于秋天的五言绝句"}print(response.choices[0].message.content)

想看图的,换成 Vision 模型,content 里文字和图片各放一段,图片传公网 URL 或 base64 都行

response = client.chat.completions.create(model="DeepSeek-V4-Flash-Vision-Exp",messages=["role": "user","content": [{"type": "text", "text": "识别图中的文字"},{"type": "image_url", "image_url": {"url": "https://example.com/doc.png"}})

换其他模型同理,只改 model 字段。

方式 3 接入 AI 编程助手(以 opencode 为例)

编程助手这类工具都支持接自定义服务商,这里拿 opencode 当例子,不是说只有它能用。opencode 是跑在终端里的开源编程助手,能直接读项目代码、动手改文件,接上 AMD 这套免费 API,等于白得一个能写代码的助手。

接法有两种,个人用界面点几下最快,团队共用建议写配置文件。

界面配置,不用写文件

打开 opencode 的设置,进「提供商」,点「查看更多提供商」,输入 AMD 搜索,选中列表里的 AMD,把 API Key 粘进去保存。API Key 在 Token Factory 页面点开任意免费模型卡片,弹窗里就有,直接复制(见上文步骤 3)。

配置文件,适合团队共用

在项目根目录新建 opencode.json,内容如下

{"$schema": "https://opencode.ai/config.json","provider": {"amd": {"npm": "@ai-sdk/openai-compatible","name": "AMD Radeon Cloud","options": {"baseURL": "https://developer.amd.com.cn/radeon/api/v1","apiKey": "{env:AMD_API_KEY}"},"models": {"DeepSeek-V4-Flash": {"name": "DeepSeek V4 Flash"},"Qwen3.8-Flash-Next": {"name": "Qwen3.8 Flash Next"},"MiniCPM5-1B": {"name": "MiniCPM5 1B"}

Key 不要直接写进文件,先放进环境变量,避免哪天手滑把配置文件传到公开仓库

export AMD_API_KEY="YOUR_API_KEY"

两种方式配好后,启动 opencode,输入 /models 切到 AMD 的模型,就能开始对话。让它读代码、改 bug、补测试,它会一步步执行给你看。

其他 OpenAI 兼容工具(Cherry Studio、Cursor 这类)接法也一样,Base URL 和 Key 填同一个,模型名填平台给的 ID 就行。

五、注意事项

平台免费,但有几条规则要知道。

限速是真的有限

平台用积分做软限流,并发高了会自动降速。实测单请求响应很快,并发超过 5 个就开始排队。不要拿它当生产级高并发 API 用,定位是开发调试。

LIMITED FREE 随时可能撤

Vision 版明确标 LIMITED FREE,AMD 没说会开放多久。遇到就先用,等撤了再换纯文本版。

Key 不要公开

API Key 等同于密码,不要发到公开仓库或公共论坛。万一泄露,去 Token Factory 页面重新生成一个即可。

数据是否保留

平台走的是云端推理,请求内容会上传到 AMD 服务器。涉及敏感数据(比如未公开的产品信息、个人隐私)建议走本地 MiniCPM5-1B 部署。

缓存读取收费极低

DeepSeek 系列支持 prompt cache,缓存读取只要 0.0028 pts 每 1M tokens,比输出便宜两个数量级。多轮对话时把上下文作为消息历史传过去,会自动命中缓存,省一大笔。

免费 API 用得好,能省下的不只是 API 调用的钱,更是把 AMD 生态从头到尾摸一遍的机会。Radeon Cloud 的 GPU 用完不用清理、Key 丢了随时重生成、用量大了再上付费版,这套流程打通了,以后做 AI 应用就有了一个稳的兜底方案。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
倒计时开始,特朗普准备动手,想断中方后路?中国多个目标被锁定

倒计时开始,特朗普准备动手,想断中方后路?中国多个目标被锁定

董董历史烩
2026-09-03 11:58:40
乱了!日本领土危机浮现!不光是琉球,原来连北海道也不是日本的

乱了!日本领土危机浮现!不光是琉球,原来连北海道也不是日本的

晓楖科普
2026-09-04 13:16:55
9月3日,2026年养老金调整未公布,但却传来了一个好消息,了解下

9月3日,2026年养老金调整未公布,但却传来了一个好消息,了解下

社保小达人
2026-09-03 10:38:20
美媒急了:中国重型战斗机数量超北约总和,美军连一半都不到

美媒急了:中国重型战斗机数量超北约总和,美军连一半都不到

瞩望云霄
2026-08-30 20:03:02
亲子心理学:当孩子不尊重你,最好的处理方式,不是接纳,不是共情,而是“情绪断供”!越不惯着,孩子越感恩自律

亲子心理学:当孩子不尊重你,最好的处理方式,不是接纳,不是共情,而是“情绪断供”!越不惯着,孩子越感恩自律

心理观察局
2026-09-04 06:43:03
比黄岩岛更狠,驻守338天挤走对手,这块“长出来”的陆地有多重要

比黄岩岛更狠,驻守338天挤走对手,这块“长出来”的陆地有多重要

萧磭记录风土人情
2026-08-26 19:59:29
一句“没本事才来送外卖”,这位女老师把自己的饭碗砸了!

一句“没本事才来送外卖”,这位女老师把自己的饭碗砸了!

皮蛋儿电影
2026-09-02 10:11:24
《早春晴朗》1-15集:她用六年才听懂那句可以是你,也可以是别人

《早春晴朗》1-15集:她用六年才听懂那句可以是你,也可以是别人

动物奇奇怪怪
2026-09-04 11:38:40
使用辅助驾驶撞车被认定全责,一理想车主索赔5万元,理想:辅助驾驶有局限,司机是第一责任人

使用辅助驾驶撞车被认定全责,一理想车主索赔5万元,理想:辅助驾驶有局限,司机是第一责任人

91.6陕西交通广播
2026-09-02 15:42:47
高市早苗和天皇彻底撕破脸!日本终战81周年的追悼仪式上,出现了极其罕见的一幕:天皇和首相,当着全世界的面,唱了反调

高市早苗和天皇彻底撕破脸!日本终战81周年的追悼仪式上,出现了极其罕见的一幕:天皇和首相,当着全世界的面,唱了反调

扶苏聊历史
2026-09-04 15:41:23
实测GPT-6:AGI真来了!OpenAI缔造者都摸不到天花板

实测GPT-6:AGI真来了!OpenAI缔造者都摸不到天花板

新智元
2026-09-04 13:40:20
曾风靡全国的“宝贝”,被捧上神坛炒到天价?如今白菜价都没人要

曾风靡全国的“宝贝”,被捧上神坛炒到天价?如今白菜价都没人要

混沌录
2026-09-03 23:23:08
用普通LED“冒充”Mini LED?全球电视一哥这次有点被动

用普通LED“冒充”Mini LED?全球电视一哥这次有点被动

钉科技
2026-09-03 09:43:57
野性美:不是驯服,是我在本能与秩序之间为自己留出的可调节张力

野性美:不是驯服,是我在本能与秩序之间为自己留出的可调节张力

疾跑的小蜗牛
2026-09-03 19:05:39
中国女排亚运会名单更新!张籽萱入选,赖亚文带队,王媛媛休战

中国女排亚运会名单更新!张籽萱入选,赖亚文带队,王媛媛休战

安若浅溪b
2026-09-04 15:33:10
玄学提醒:如果一个人还在穿着10年前的衣服,只说明几个问题

玄学提醒:如果一个人还在穿着10年前的衣服,只说明几个问题

木言观
2026-08-01 13:58:35
惊天丑闻!羽协高层集体落网,林丹早就看破,赛场猫腻仅是开胃菜

惊天丑闻!羽协高层集体落网,林丹早就看破,赛场猫腻仅是开胃菜

大鱼简科
2026-09-03 22:00:41
《四川省人民政府关于授权和委托遂宁市、内江市人民政府行使省级用地审批权的通知》政策解读

《四川省人民政府关于授权和委托遂宁市、内江市人民政府行使省级用地审批权的通知》政策解读

金台资讯
2026-09-04 16:16:31
风向变了,17国拒绝对华设壁垒,美财长振臂一呼,唯有印度响应

风向变了,17国拒绝对华设壁垒,美财长振臂一呼,唯有印度响应

花小猫的美食日常
2026-09-04 07:50:22
中央定调养老金调整方向!工龄增加设为一年3元,可行吗?

中央定调养老金调整方向!工龄增加设为一年3元,可行吗?

王五说说看
2026-03-24 07:06:10
2026-09-04 17:00:49
呼呼历史论
呼呼历史论
分享有趣的历史
697文章数 18045关注度
往期回顾 全部

科技要闻

OpenAI深夜王炸!GPT-6 Astra来了

头条要闻

暗访贷款中介公司:中介称15%服务费用来打点银行

头条要闻

暗访贷款中介公司:中介称15%服务费用来打点银行

体育要闻

小卡来去10首轮,快船7年彩礼一场空

娱乐要闻

古天乐公司欠债1.49亿

财经要闻

追觅造车始末:一场无法量产的狂欢

汽车要闻

限时权益价28.99万起 FREELANDER神行者8正式上市

态度原创

数码
本地
房产
亲子
公开课

数码要闻

海信IFA2026发布AI伴侣套系:覆盖厨房、洗护、空气等核心场景

本地新闻

扒完小作文,富豪们私藏的度假胜地有多绝

房产要闻

TOP10房企卖了350亿!海南楼市,最新榜单出炉!

亲子要闻

昌平区9所新建幼儿园启用

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版