天上火 (@109016794)astra 官方基准测试成绩 中发帖

astra 的表现 
数学:强 sota(指与第二名模型存在至少一代差距
编程:弱 sota(指与第二名存在不到半代差距)
科学:强 sota
知识工作:强 sota
泛逻辑推理:sota (指与第二名的差距在半代接近一代差距之间)
长任务:sota
上下文:世界第二水准 512k-1M 上下文捞针紧落后 muse1.3 两分
[HRUGCaia0AA8k0D]
正如我之前说的,astra 必然比 fable5.1 强 这两个模型不是同一个级别的 今天来看 astra 数十项基准全都高于 fable5.1,确实如此