2026-09-23 20:34:00 UTC+8
我之前一直觉得模型就是大就是好。于是主力干活模型从一开始的Claude,到后面的GPT5.5/5.6,后面又用上了K3。
但是最近我们的GPT和Claude的渠道一直不稳定,K3在这个周期又被我烧光了,抱着尝鲜的态度,我开始用了deepseek v4.1 flash这个比之前用的模型都小的模型。但没想到的是,是这个模型第一次惊艳到了我。
不是因为这个模型的能力(现在的主流模型都已经完美满足我的要求),反而是它的速度:300 tokens/s,作为对比,一般模型都是30-50 tokens/s左右。
之前也听说过一些超快模型,我也用过K2.7 High Speed,差不多也能到100多。但是300 tokens/s就是另一个概念了。
原来的30t/s的模型,给个需求之后总是慢吞吞的,高强度想了需求,然后开始等待突然闲下来,这时候贼难受。
但是300 tokens/s就可以完全满足我想要啥就要啥的要求。我随便想个需求,过个不到一分钟就实现了,于是我又开始提要求,过个几十秒,又好了。
这种速度让我感觉“文思泉涌”。30tokens的情况下,本来感觉到了,有很多想法,大模型做个几分钟十几分钟,这个感觉就过去了。然而在300 tokens/s下想法几乎不用等就可以变成现实,情绪一直上头,再加上现在已经是我的刚需的1M上下文,一个工作可以一直不停地进行下去,一直做一直爽。
这就是像一开始用大模型做项目的时候的飞跃。从得自己写到不用自己写,再从需要等到几乎不用等。
于是2天时间用了20亿tokens😀
评论
正在加载评论……