2026 最新白嫖 AMD 官方 DeepSeek V4 和 Qwen3.8,不绑卡、国内直连、每日 10 刀额度自动重置

老路之前写 [[Codex+DeepSeek 免费看图]]、[[Google AI Studio 免费AI工具]] 的时候,就有兄弟念叨:国内直连的免费大模型 API 太少了,不但得科学上网,好多还得绑卡。今天这个,老路先说结论:AMD 官方出的 Token Factory,免费共享模型 API,不绑卡、国内直连、每日额度滚动重置。DeepSeek V4 Flash、Qwen3.8 Flash 这些开源的头部模型,AMD 拿自己家的 GPU 云托管好,端点免费放出来给你调。全程实测记录,能对话、能识图、全程丝滑。同理,不喜欢看字的兄弟直接拉到最后看视频。

一、AMD 也搞起免费 API 了?

AMD 这几年在 AI 算力上憋着一口气——GPU 云(Radeon Cloud)就是它对标 NVIDIA 的牌。但 NVIDIA 有 NIM 微服务那一套,AMD 想抢开发者,光卖卡不行,得先让人用顺手。

Token Factory 就是 AMD 的获客工具:把自家 GPU 云上跑着的开源模型,挑几个做成免费共享端点,你注册个账号拿个 key 就能调,不用启动实例、不用花额度。说人话就是,AMD 出机器出电费,把 DeepSeek V4、Qwen3.8 这些模型伺候好,免费让你试,试顺手了自然去开它的 GPU 实例。

官方文档原话如下:

注意这里:模型列表里,4 个是 纯FREE 共享端点,2个是有限制免费,其他的是 Dedicated(专属实例,花 credits 那种)。

二、免费的是哪几个?够不够用?

Token Factory 页面带 FREE 标的模型卡,一共四个,如下图红框标识的

模型类型说明
DeepSeek-V4-Flash-0731LLMDeepSeek V4 Flash 0731,AMD GPU 云托管
DeepSeek-V4-Flash-Vision-ExpVLMV4 Flash 视觉实验版,能看图
Qwen3.8-Flash-NextVLM通义千问 3.8,官方文档写 125B 总参/6B 激活 MoE,上下文 262,144(26 万 token)
MiniCPM5-1BLLMOpenBMB 家的轻量模型

这套阵容对白嫖党来说相当能打了:对话有 DeepSeek V4 Flash,看图有 V4 Vision 和 Qwen3.8(262K 超长上下文),想玩轻量的还有 MiniCPM。此外,免费的模型不是固定的,AMD会根据实际情况不定期更换。

三、怎么接入?老路实测流程

整个流程非常简单丝滑,完全不卡

第一步:注册

打开 Token Factory 页→ Login,注册 AMD AI 开发者计划账号 ,全中文,直接注册即可,没有啥要注意的。

第二步:拿API Key

注册完回到Token Factory 页面,点击任意一个免费模型,都能看到BaseURL和API Key

第三步:把BaseURL和API Key配置到你的Agent软件,老路用的CherryStudio和Hermes做的测试

CherryStudio,点击设置,在模型服务里搜索amd,最新版的已经预置了AMD云,只需要把API Key粘贴进来就行,然后点击获取模型列表,把免费模型添加进来就可以了

实测对话,老路让它写了一个小说创意

可以看到,输出的响应不快,只有13.7tokens/秒,但也算是可用。

Hermes,同样来到配置,选择提供方,然后点击右上角的“改用API密钥”

由于Hermes没有预置AMD云的配置,我们需要点击最上方的“本地/自定义端点”

把BaseURL和API Key粘贴进来,点击“连接”即可

回到对话页面,点击对话框右侧的模型,刷新,选择AMD提供的模型即可

老路这次测试了DeepSeek V4 Flash Vision多模态模型,也可以正常的识别图片,之前老路写过 Codex+DeepSeek识图教程 以及 Hermes+DeepSeek识图教程,白嫖的智普和Gemini,这次又多了一个白嫖多模态模型的选择。

四、免费额度到底怎么算?”每日 10 刀”是真的吗?

这是大家最关心的,其实在配置CherryStudio时也能看到,目前免费的额度,日常轻量使用是没问题的。

此外,由于是免费,官方还是有一些调用限制的,老路整理如下:

维度限额说明
平台准入30 RPM / 每 API 密钥共享池并发
平台准入120 RPM / 每 IP
网关计量20 RPM / 每账户更严的一档
花费上限每账户一个滚动周期从第一次产生计费起算,到期自动重置(不是固定午夜边界)

超限时报错长这样:Daily usage limit exceeded: maximum $N per period for this OneClick user——注意,$N 是要登录才看得到的具体数。

关于”每日 10 刀”

标题里这个 10 刀,老路得说实话:官方文档没直接写”$10″,只写了”每日花费上限按账户滚动周期自动重置”。$10 这个数来自实测记录,老路核稿时官方页面上的 $N 需要登录才能看到具体值。

所以准确说法是:每天有免费额度,用完等自动重置(按你账户第一次计费起算的滚动周期),具体上限登录后台看,五无论如何,轻度调接口绰绰有余。

五、跟其他免费 API 的对比

对比AMD Token FactoryNVIDIA NIMGoogle AI Studio各家国产免费
国内直连✅ 实测秒开❌ 要代理❌ 要代理
绑卡❌ 不需要按官网❌ 不需要看平台
模型DeepSeek V4 / Qwen3.8 等开源Llama 系为主Gemini 系各家自研
免费模式共享端点+每日滚动重置40 RPM 全站共享每日限量新用户送 token
限制20-30 RPM,模型不定期换全站共享慢代理+限量实名/手机号

AMD 这套的独家优势就俩字——直连。国内不用代理就能调 DeepSeek V4 和 Qwen3.8 的开源权重 API,这体验在 2026 年还是稀缺品。Google AI Studio 模型更强但要代理,国产各家要么实名要么限新用户——AMD 是”注册即用 + 每日重置”,对轻度调用党是最顺的。

短板也直说:RPM 限 20-30,并发共享池,当不了生产主力;模型池不是固定菜单,今天在明天可能换——适合做开发测试、个人工具、Cherry Studio 这类前端聊天,别拿它跑关键业务。

最后

到底值不值?那老路必须说:值!!!这是白嫖清单里少见的”官方直连”级免费——AMD 大厂服务、DeepSeek V4 和 Qwen3.8 开源权重、国内不挂代理直接调、每日额度滚动重置不绑卡。对开发测试、Cherry Studio 玩家、AI 工具折腾党来说,这就是 2026 年最顺手的免费模型源之一。

但白嫖的边界得拎清:RPM 20-30 干不了生产活,模型菜单不定期换,$10 是社区口径不是官方承诺。定位是”试吃台”不是”食堂”——试顺手了,真需要稳定算力再考虑 AMD 的付费实例或别家。

免费的 API 端点其实一直都在,AMD 这扇门开在中国站里,直连不折腾。老路已经实测能用了,你还不去领个 key?

全程实操视频在此~

2026 最新白嫖 AMD 官方 DeepSeek V4 和 Qwen3.8,不绑卡、国内直连、每日 10 刀额度自动重置,注册 + 实操 CherryStudio + Hermes 丝滑配置全程记录

相关阅读:[[Codex+DeepSeek 免费看图]] · [[Google AI Studio 免费AI工具] · [[Kimi3 实测]] · [[Hermes + DeepSeek免费图片识别教程]]

×

感谢您的支持

💳
支付宝
💬
微信支付
Bitcoin
USDT
QR Code

📌 老路分享
🔧 toolmixr.com — 老路最常用的免费工具
genaipick.com — 最新AI评测
本网站部分链接为联盟链接,通过它们购买或注册不会增加您的费用,但老路会获得小额佣金,感谢支持!
隐私政策 | 使用条款 | 关于