大模型发展到今天这个时间节点,普通用户的选择大模型的侧重点应该有一些变化
去年或者是半年多以前,基本上是不推荐国产模型,因为一次任务做出来的错误太多,它自己复查也兜不住,可用性非常差。毕竟大家都是花了真金白银的,不行就不推荐。
但是最近一个月发布的模型来看,可用性普遍达到了及格线以上。有的甚至可以和最顶尖的模型在某些方面掰一掰手腕。
尤其是你梁叔叔的 DS V4 Flash ,成本极低的同时,能力比 V4 Pro 强 😲 (在我看来, V4 Pro Preview 处理公司项目的迭代已经没什么问题了。)
这让很多限购的模型坐不住了,别人速度又快又便宜,还不限量。你说说这咋选。
大部分模型的能力卷上来之后,后面难免会卷价格,卷速度。
但是现在大部分模型,还有个「稳定性」的问题没有解决,当然也不全是模型厂商的事,很多也是各大中转站,卖套餐的厂商的问题。
模型上下文都 1M 了,你一个套餐 5 小时的额度都触发不了一次压缩就被用完了,这合理吗?
还有很多官方的包月套餐,一天最少三次 429 ,就和去网吧电脑老死机一样难受。
再个
很多人 vibe coding 至今已经有一段时间了,不知道有没有一种感觉?
大部分时候并不关心技术细节,把最终结果稳定且快速的输出出来更重要。尤其是在很多模型能力都追上来的情况下,谁做的又快又好,在体验上是秒杀其他模型的。
比如说 GPT 5.6 Sol ,虽然能力很强,但是很多人接受不了它那个思考的时间。反而是 Grok ,让人用了就回不去,因为速度太快了,能力虽然不是最强的一档,但是也完全够用。因为大部分人编码不需要很复杂的架构,只需要快速的把自己的想法变成一个产品,哪怕出现了 1-2 次错误,只要在纠正后能迅速修改,也完全能接受。
尤其是, vibe coding 一段时间后,想必都已经发现自己的玩具其实什么用户都没有。
慢慢的就对最强模型祛魅了。
在模型的能力普遍及格后,用户大概率会转向便宜且快速的模型。
毕竟谁也不想这样



