天上火 (@109016794) 在 再次澄清关于 astra 在 aa 指数上得分低的原因 中发帖
先说结论 就是 aa 自己的问题
首先 aa 作为一家前沿人工智能分析机构,他们当前的基准测试分析做的实在是太失败了 根本就配不上大家对它的信任
aa 推出这个 人工智能分析指数的目的是为了分析各大前沿 AI 的综合能力,但现在这个排行榜已经完全无法反应现实情况,甚至显得十分谬误
为什么这么说?
抛开 muse1.3>astra 这个一眼就能看到的离谱排名不谈 在 aa 的排行榜上竟然还存在另外一个极其离谱 让我怀疑 aa 处于平行宇宙的排名
[Screenshot_20260904_041929]
什么叫做 claude 4.6sonnet>claude 4.6opus ??? 这是一家前沿人工智能分析机构能排出来的排名?
还是说我们所处的宇宙和 aa 的宇宙不一样 我实在无法理解 claude4.6sonnet 凭什么比 4.6opus 强
除了排名上的失真 aa 所...