@Infty降智众说纷纭,不如来看看Openrouter的api请求的6 sol和6 luna! 中发帖

鹈鹕测试: 
gpt-6-sol-low:轮子飞上去了!!
[image]
gpt-6-sol-max:小Astra!
[image]
gpt-6-luna-max:也还可以
[image]
糖果题:
gpt-6-sol-low:29忽略手感
[image]
gpt-6-sol-max:21正确
[image]
gpt-6-luna-max:也是不对的
[image]

其实鹈鹕测试这种东西,因为大家codex提示词不同,记忆不同,LLM本质还是在空间采样,从输入条件下的输出分布中生成,有一些差异是正常的,除非非常离谱,不然难以通过鹈鹕判断降智,当然这个6-sol-low也确实离谱.
当然更准确的还是去sub2api或者cpa去看实际请求模型,上面只用Openrouter的api给大家作参考.
我手上有4个降智的号,我最近也一直在找攻克方案.手上唯一还正常...