DraftReviewPublishedArchived

3 家号称要海外网络的 API,国内直连能用

讲到 Groq、Cerebras、NVIDIA、OpenRouter,多数攻略都会加一句「需要海外网络环境」,我自己前几篇也是这么归类的,从没验证过。这次拿一台国内机房的干净机器直连实测我网关里配的 13 个入口,带 key 发真实推理请求:Cloudflare、OpenRouter、NVIDIA 这 3 家被贴了标签的其实不需要海外网络,而 Cerebras 返回的是 Cloudflare 按地区拒绝的 1009 错误码。另有 4 个网络完全通畅,卡住的是账户。

By Joker2026/08/185 min

先说清楚这篇测了什么:我自己的模型网关里配着 13 个免费大模型入口,这次测的就是这 13 个,不是市面上所有免费 API 的普查。国内能直连的免费供应商远不止这些,硅基流动、百炼、千帆这类国内平台本来就不存在网络问题,不在这次范围内。

要测的是另一件事。讲到 Groq、Cerebras、NVIDIA、OpenRouter 这几家,多数攻略都会加一句「需要海外网络环境」。我自己前几篇也是这么归类的,因为服务器一直配着海外出口,从没验证过这句话对不对。

昨天我手上正好有一台干净的境内机器:原来的生产服务器,在国内机房,出口配置已经彻底清空。于是把这些平台挨个测了一遍,纯直连。

结果跟通行说法对不上。

这 13 个入口里,有 4 个国内直连能调通

不是能 ping 通,是带着 key 发真实推理请求、拿到 200 和完整回复:

平台耗时是否符合通行说法
智谱 GLM-4-Flash1.11s符合,本来就是国内平台
Cloudflare Workers AI1.85s不符合
OpenRouter3.22s不符合
NVIDIA NIM22.08s不符合

后面三家在多数攻略里都被归进「海外平台,需要海外网络环境」,实测是直连可用的。这是这次唯一值得说的发现:不是「国内只有这 4 个入口能用」,而是「被贴上需要海外网络标签的这几家,其中有 3 家其实不需要」。

NVIDIA 那个 22 秒要单独说一句:它通是通了,但慢得离谱。同一个模型我在走海外出口的服务器上测是 4 秒,境内直连 22 秒,差了五倍多。所以「能用」和「好用」在这里不是一回事,它更适合跑离线任务,不适合放在有人等着的地方。

这批里确实被挡住的是这 4 个

Cerebras 和 Groq 返回的都是 403,但性质不一样,得看返回体。

Cerebras 的响应里写着:

HTTP/2 403
server: cloudflare
error code: 1009

1009 是 Cloudflare 用于按地区拒绝访问的错误码。这不是没带 key 的鉴权失败,也不是限流,是服务方按 IP 归属地做了访问限制。

Groq 是 403 Forbidden,同样由 Cloudflare 返回,cf-ray 显示走的是新加坡节点。

而 Mistral 和 Gemini 更干脆,连接直接超时,TCP 层就不通。

所以这几家确实需要海外网络环境,跟通行说法一致。

还有 4 个,卡的不是网络

这一类最容易被误判。

Kimi 返回 429、ModelScope 返回 insufficient balance、火山返回 401、SambaNova 的模型列表能正常拉到但推理要求先绑支付方式。

它们的共同点是:网络层完全通畅,卡住的是账户。余额没了、欠费了、要绑卡了。

这个区分很重要,因为报错的时候人的第一反应往往是「是不是网络不通」,于是去折腾网络环境,而实际卡点在账户那头。判断方法也简单:先请求这家的 /v1/models 接口,能拿到模型列表就说明网络没问题,剩下的去账户后台看。

顺便说注册门槛

既然讲到用不用得上,把注册这道坎也一起说了。这部分是查各家公开文档和注册页得到的,不是我逐个注册验证的,我说明一下来源。

按公开资料,Groq、Cerebras、NVIDIA NIM、Google Gemini 以及 OpenRouter 的免费层,都不需要绑定信用卡,邮箱或者 Google 账号注册就能拿到 API Key。Mistral 的 Codestral 免费额度同样不要求绑卡。

具体一点:Cerebras 免费层是每天 100 万 token、30 RPM;NVIDIA 注册给 1000 个推理额度、可申请扩到 5000,速率 40 RPM;Mistral 的 Codestral 是每月 10 亿 token 但只有 2 RPM。这些数字来自各家公开的说明,我没有逐一跑穿验证。

所以对国内用户来说,门槛其实不在钱,也不在绑卡,而在两件事:注册页面能不能打开,以及注册完之后调用会不会因地区被拒。这两件事,上面那张表已经回答了。

所以怎么配最省事

把可达性和注册门槛合起来看,如果你在国内又不想折腾网络环境,除了本来就没问题的国内平台,这几个海外入口也能直接用:

智谱 GLM-4-Flash 是最稳的兜底,1.11 秒,永久免费,国内平台不存在任何网络问题。

Cloudflare Workers AI 是这次最大的惊喜,1.85 秒直连可用。它上面跑的 gpt-oss-120b 跟 Cerebras、Groq 是同一个开源模型,也就是说,那两家因地区限制用不了的模型,你可以从 Cloudflare 这个入口拿到。

OpenRouter 3.22 秒直连可用,而且它本身是个聚合网关,一个 key 能路由到很多模型。

NVIDIA 能用但要忍 22 秒,放离线任务。

反过来,如果你已经有稳定的海外网络环境,Cerebras 那个 593 毫秒的速度是这批里最快的,值得留着。

必须说清楚的边界

这次测试是从国内 IDC 机房发起的。机房出口和家庭宽带的网络路径、出口 IP 段完全不同,运营商也不一样。家宽用户的实际结果可能与此不一致,尤其是那几个「意外能通」的,很可能在不同网络环境下表现不同。

这一条我没法替你验证,只能建议你自己花两分钟测一下。方法很简单,不需要 key:

curl -s -o /dev/null -w "%{http_code}\n" --max-time 10 \
  https://openrouter.ai/api/v1/models

返回 200 就说明网络通,返回 403 去看看是不是 error code: 1009,超时就是完全不通。把域名换成你想测的那家即可。

还要再强调一次范围:这 13 个入口是我自己网关里配的,选它们是因为我在生产里真在用,不代表市面上的全部。国内那些云厂商和模型平台数量远超这个数,它们对国内用户本来就不存在可达性问题,这篇没有覆盖。

另外,注册门槛那一节是公开资料整理,不是我逐个注册验证的。各家的免费额度和地区政策改起来很快,正式用之前请以官网当时的说明为准。

时间点是 2026 年 8 月 18 日。

QUEST COMPLETEREWARD: +30 XP, +1 EPIC ITEM
Build Progress100%
无信号
PULSE
0PULSES