@zhongfree 在 关于AI模型越来越厉害,主观感知却越来越弱的想法。 中发帖
不知道大家现在有没有这个感觉,有时候模型发布说性能飞跃,却没有感觉到能力的飞跃,而有时候一些输出格式变化又会让你模型进步了。
我最明显的感觉的就是之前从gpt5.5切到claude opus4.8的时候,claude的能力强不强没感觉,但是它的输出逻辑让我感觉这个模型很厉害,输出很有条理,分析很清楚。
从gpt5.5切到gpt5.6 sol的时候,只感觉它的工作逻辑变了,却没有感觉到能力变化。而且它特别喜欢做一些复杂操作,我让它改一个问题,只改了两行代码,它竟然还要审查分析,这两行代码看一眼就知道正不正确,它却要搞一大堆有的没的。
有时候不做高难度的问题,这些模型的差距真的很小,但是又特别的依赖。用了gpt5.6之后,在简单问题上我都不会相信gpt5.5或者其他不如gpt5.6的模型。总会怀疑会不会做不到。