国内AI模型大比拼:谁实力最强?

国内AI模型大比拼:谁实力最强?

国内模型大比拼

引言

现在AI模型很多。
但国外的模型比较少,御三家还是绝对主流,加上SpaceXAI,其他的都没啥显著影响。
国内就不同了。
智谱,稀宇科技,小米,美团,深度求索,月之暗面,字节跳动,阿里云,阶跃星辰,都听过吗?
换成模型,你就熟悉了。

模型对比

话不多说,直接对应模型。

公司模型多模态
智谱GLM 5.2
稀宇科技MiniMax M3
小米MiMo V2.5 Pro
美团LongCat 2.0
深度求索DeepSeek V4 Flash 0731
月之暗面Kimi K3
阿里云Qwen 3.8 Max Preview
阶跃星辰Step 3.7 Flash

眼尖的看到了,我没列字节跳动,因为实在找不到最新模型。

每家厂商分析

一己之见,给大家参考。每个厂商都有优势和缺点。

  • 智谱:现在很尴尬。以前是国内模型第一,现在Kimi K3轻松超越,DeepSeek V4 Flash 0731也差不多齐平了。当时GLM 5.2发布正好遇到Claude Fable 5全面收回,喜剧拉满,智谱说“前沿智能属于所有人”也有深意在其中;7/31智谱Coding Plan涨价(同时全面放开),同天DeepSeek V4 Flash 0731发布跑分已经差不多了,喜剧又一次拉满,不过深度求索啥也没说而已。如果智谱不抓紧推出新模型,会一直卡在中间。同时GLM的C端我认为很敷衍,也就是智谱清言,之前说过,我认为UI明显不认真。
  • 稀宇:MiniMax M3推出小火了一阵,不过Token Plan争议太大导致现在没啥风浪,评价毁誉参半。有一说一,Token Plan相当划算的,不信算一算,49元600个M,DeepSeek按量,缓存低一点或者峰谷一上来,未必能做到,就是不太厚道。最近推出了H3模型,不过不是我们的讨论范围。M3最大的优势是多模态比较吸引人,不仅输入多模态,输出也是多模态的(可以生图生视频)。
  • 小米:之前发了一个MiMo V2.5,然后套壳了一个MiMo Code,就没有然后了。比较值得注意的是MiMo的API价格,和DeepSeek等价,但DeepSeek V4 Flash 0731一上来,就算DS搞峰谷,能力摆在这里,也没办法了,优势只剩下多模态和简单任务,有Token Plan,但耍花招,也不厚道。
  • 美团:这个模型能力我没怎么了解,多模态有没有还是我现搜的,这也从侧面证明能力实在不出彩。不多了解,就不细说了。
  • 深度求索:DeepSeek V4 Flash 0731引爆全场,智谱和月之暗面都有压力。不过有一说一,如果DeepSeek V4 Pro迟迟不出,会闹Gemini的笑话(Gemini 3.5 Flash同样引爆全场,结果该发Pro的时候发Gemini 3.6 Flash结果被Meta嘲讽);同时峰谷定价争议很大,也让MiMo赚了个便宜。
  • 月之暗面:Kimi K3发布也很热闹,这也是能和御三家掰手腕的模型,不仅仅是能力,还有价格。$15的高价说明API不是给普通开发者用的,但是算力没跟上,被DeepSeek咬的比较紧,如果V4 Pro GA真出了,Kimi也尴尬了。
  • 阿里云:阿里很像Google,不仅仅卖模型,卖的是全栈,Qwen 3.7 Max发布也火,不过3.8风浪明显就没有这么大了。Token Plan也不厚道,没啥好说的。
  • 阶跃星辰:我也没了解太多,我只知道Step 3.7 Flash多个渠道可以免费用而且多模态,然后就没有了。了解不多,不细说。

Token Plan分析

接下来分析一下Token Plan。这是各个大场耍花招的密集区。

  • OpenCode Go。这是优先级最高的之一,花$10得到$60,绝对是划算的。当然看清楚文档,某些模型使用上限是$15而不是$60。这和模型能力无关,比如GLM 5.2是$60,但DeepSeek V4 Pro是$15,看看清楚。还是按量付费,Hy3或者DeepSeek V4 Flash可能还行,高阶模型基本不够用。
  • MiniMax Token Plan。优先级最高之二,其实很划算,不信算算账,1M Token大概0.07元。DeepSeek V4 Flash 0731,如果你缓存差一点,可能1M都不只这个价格。
  • MiMo Token Plan。没仔细研究过,但是耍花招很明显,Credits是膨胀过的Token。
  • Kimi会员。很像Claude,没有具体额度,而且现在停了。
  • GLM Coding Plan。刚刚涨价了一波,119元一个月大概满打满算4亿Token,人家MiniMax的119元是18亿,差距非常明显,最高档直接到1000元,很明显是和Claude Max 20x争锋,不细说。
  • 阿里/腾讯Token Plan。两个大场,额度给的都不是很多,腾讯最高档几百块才7亿/月。

结语

大模型这东西是不好推荐的。
我不想引长篇大论,所以就此收尾。
我只想让大家不要那么注重多模态,日常没有多模态模型不还是好好的?