banshan (@aixuexi) 在 DeepSeek-V4-Flash-0731:在国际象棋基准测试中超越 Fable-5、Sol 和 Kimi-K3 中发帖
来自老外的帖子,前几个模型排行榜如下
[screenshot-2026-08-03T00-20-24Z]
有一个老外的评论挺好的,人可以不断学习提高,而模型停滞在训练后。可以看到梁圣确实知行合一,朝通用AGI努力,这么小的基模,其实完全没必要去训练国际象棋,把代码水平提高就很漂亮了。在不知道的角落,梁圣还在向通用AGI发起进攻。
[screenshot-2026-08-03T00-21-35Z]