riverxorange对 Astra 写东西的能力感到绝望。 中发帖

最近有一个批量生产试题的活,拿Astra做,结果出完结果像在做火星语阅读理解,指导它改很多次,改到人绝望,永远都是“人看不懂的中文”,试题的可用性几乎为 0,也拿 gemini 3.8 试了,感觉出的效果疯疯癫癫的,还会拽词。刚刚又拿新的隐身模型试了下,发现效果不错。 
感觉现在太多模型已经 agent rl 入脑,不会说话了。