一文讲透英伟达免费模型的白嫖技巧,零成本蹬顶级模型之nvida 的minimax m3 - UpXuu's blog

发布于 2026-08-25 09:14:15

首先先说个题外废话吧,这可能是今年upxuu出的最后一篇白嫖模型教程了,马上要开学咯~

直接进入正题,用过英伟达模型的小伙伴们都知道,nvida nim平台的大多数模型都十分卡顿,不过今天早上我忽然发现一个特别牛逼的模型 minimax m3,首字节延迟较高可能在5s左右(图为我的网关统计,有一点问题),但是 其吞吐量看可以达到恐怖的100tok/s

image-20260825092018395

模型的nvida nim平台链接如下 minimax-m3 Model by Minimaxai | NVIDIA NIM

这个是真的特别出乎意料,作为一个已然上架2mon的模型突然如此快速,其实该模型和glm ds相比本身就已经比较可用了,但我个人认为可能是DeepSeek v4 flash 0731的上架导致大多数人去挤ds去了,minimax的资源自然就被释放了

这里我也简单讲一下https://build.nvidia.com/ 这个平台的特性,或者说是潜规则吧

首先,最稳定的模型是 gpt oss 120b 这个模型没有任何套路或者说什么稳定性问题,我作为多个产品的轻agent已经稳定运行了几个月,特别稳定 可以达到150t/s且几乎没有首字节延迟

其他的小参数模型也可以尝试,基本都很快速不过可能会出现不稳定的情况

重点是DeepSeek minimax glm这类的顶级开源模型,我摸出来的规律就是,一个新模型一旦被厂商开源,首先你不要看英伟达nim的官网model列表有没有,一般都是先上架api,随后再官网上,应该直接用英伟达的接口,直接拿着模型去调用,去尝试。很有可能可以使用,此时很少有人知道特别快 就像我前几天写的kimi k3一样,这种属于是早期的鸟儿有虫吃震撼首发!英伟达推出免费kimi k3!且速度极快,白嫖界迎来巨变|nvida nim|免费AI - UpXuu’s blog

除了抢首发以外,如果你想一直白嫖的话,我个人建议部署一个new api网关,隔一段时间测一下各个模型的延迟,虽然这种顶级模型没有一直稳的,但总有稳的‘

最后就是不要贪性能,很多工作流可能很简单 gpt oss就能胜任,那就直接接入它吧,它的稳定性会让你眼前一亮

最后还是介绍一下我的公益nvida nim中转,其实没啥卵用你自己也可以直接调官方api,不过有点麻烦需要提cdk啥的,索性就给大家方便一下

https://ai.love7.top/

本站没有任何付费 没有余额直接评论我会给你加余额,反正我也不知道咋想的就觉得开个中转很好玩吧,也别指望sla毕竟我还要上学(嘻嘻不过也有稳定的模型滴

前往 upxuu.com 阅读完整版本(含交互功能)