RL RanceLee的博客
← 返回主页
● AI

超级推荐!8.12 日之前免费使用 DeepSeek V4 Flash 1M 正式版

朋友们,看看我发现了什么?

一个可以免费使用 DeepSeek V4 Flash 的网站,而且免费到 8.12 日,还有好几天呢!

https://inferx.net/

打开主页看一下,上面写得很清楚:免费直到 8.12 日!

按照惯例注册一下,然后看一看模型列表,里面有新的 0731 版本。而且平台已经直接给你分配好了 API,复制下来就能用。

老规矩,打开 OpenCodex 配置一下,API 就用你之前获取的那个。

API Base URL:
https://model.inferx.net/endpoints/v1

完整调用地址:
https://model.inferx.net/endpoints/v1/chat/completions

模型名称:
deepseek-v4-flash-0731

配置完了以后,去模型里面把不要的关掉,不然会有好多好多。我发现还有 GLM 5.2 呢!

然后去 Codex 里打开试一试,我感觉速度还蛮快的。

有点不放心,因为 0731 版本的 discount 不是 100%,不会要收费吧?看了一下,spend 是 0,没有花费。

再去账单里面看看:不对啊,我都没充钱,怕什么扣钱啊?是不是这个道理?

好了,以上就是今天的分享了。不过写完前一句话我看了一眼,上下文是 258K,并不是 1M。奇了怪了,不应该啊,网站上写的是 1M。

让 Luna Max 调研了一下,发现:258K 是 OpenCodex 的本地有效窗口,不是 InferX 官方模型上限。

如果要让 OpenCodex 按 1M 处理,需要把 inferx/deepseek-v4-flash-0731 的客户端 contextWindow 设置为 1000000。我当时用的配置命令是:

ocx models add inferx deepseek-v4-flash-0731 --context-window 1000000 --modalities text,image

配置后,界面可能显示约 950K,因为客户端会预留一部分上下文空间。你可以直接把我的这段话发给 AI,让它自己去修改。

要知道,这两天我用的 OpenCode 提供的免费模型 deepseek-v4-flash-free,上下文只有 200K,已经让我爽玩了。而这个按 InferX 端点页标注,支持 1M 上下文!

而且从体感上来说,这个的速度比 OpenCode 的那个快好多,估计是 OpenCode 的使用人太多了。

很好,我们白嫖家族又增添了一员大将!

对了,这里我要补一句,之前总有人说有些我领得到,他们领不到。我怀疑是我的环境和我的账号不一样。我的谷歌账号是十几年的老号,并且持续在用。线路走的是单人的洛杉矶线路。所以之前Modal的额度我领到了30刀,有些人用多个账号,只有一个账号领得到30刀,但是好多都只能领得到1刀。

对了,还要说一句,大家假如要白嫖的话,一定要尽快,因为只要消息扩散,很容易遇到429之类的。就像我昨天分享的那个文章,我用的时候很快,但是之后有人说就遇到无法创建session的问题了。

以上就是今天的分享~