Yiyi (@onegecainiao) 在 如何减少token的消耗(或者构造高质量的数据) 中发帖
对于独立开发者而言,如何减少token消耗已经成为一个令人头痛的问题。在这里,给大家分享一下我个人在用的一个方法,欢迎各位大佬交流。
对于一些复杂问题而言,
首先,我通常都会用一个模型性能表现比较好的去分析、拆解问题,比如glm5、kimi3。
紧接着,在执行具体的任务的时候,我会用一个相对来说比较便宜一点的模型,但在各方面能力表现都差不多的去执行。比如deepseek-v4。
这也算是一个小妙招吧,不知道各位大佬有没有用过这个方法呢。
以下是题外话:
其实在这个方法我们也可以迁移到模型的训练里。对于企业实际工作而言,如何去构造高质量的一个数据对也是让他们比较头疼的一个问题。众所周知,在模型的预训练的时候,是需要大量的数据。那数据的好坏往往关系着模型性能的好坏。如果有从事这方面工作的大佬,也可以借鉴这个思路去构造你想要的数据对。