Leif Yang 在 模型的上下文最优区间该是多少? 中发帖
个人工作一般不会涉及大型项目,在这个前提下,我想要让模型保持在最佳的状态进行工作。
从而,我开始询问fable/sol这类前沿模型上下文在哪个阈值起会开始性能下滑。
Grok 4.6:
[image]
Gemini 3.8(回答有过于追求全面的倾向):
[image]
GPT 5.6 sol(对一篇相关论文进行分析):
[image]
三者模型风格不同,Grok确定,Gemini肯定,Sol论定,但一致的默认区间,都认为256k之前模型会保有最佳性能,300k(30%)后会出现衰退行为。在模型讨论过程中,Grok有提到,还应当根据任务不同划分区间,在我限定为长推理任务的前提下才确认如此。
佬友们有进行过相关研究吗?感觉对于最优的讨论很有趣。
投票