@VrianCao 在 重磅分析:目前来看Opus 5.5 *大幅* 提升了帕累托前沿,实现了智价比的飞跃 中发帖
综合了多个Cost/Intelligence数据来分析,目前看来Opus的甜点档位为Medium/High,在更多数的任务中,High会是更好的选择
在CursorBench 4.0中,Opus 5.5实现了近乎平地起高楼的效果,实现了智价比的飞跃
[image]
在PPLX的WANDR测试中,Opus 5.5在分数略微超越Fable 5.1的情况下,仅使用了其三分之一的费用,整体的点位大幅向左上角的帕累托前沿推进
[image]
在AAII中,Opus 5.5的所有Reasoning Effort均处于帕累托前沿,每个档位都领先于所对标的模型
[Intelligence Index vs- Cost per Intelligence Index Task (22 Sep '26)]
FrontierCode V1.1中领先当前的全部模型,且大幅推进帕累托前沿
...