远坂凛的宠物 (@tohsakarat)gpt5.6luna和deepseek v4 flash的直观对比 中发帖

如题,下面两轮对话,在有规划模型引路+跑subagent能力都够用+花销都可以忽略不计的情况下,你更愿意回复哪一条呢? 
我的场景是需要边开发边写文档和日志的,然而目前的harness还很少能在开发的sub agent和写文档的sub agent各自指定不同的模型。然而gpt的文档能力和抓重点能力……
如果遇到触碰到小模型能力上限的攻坚场景,我首选肯定是直接用sol,sol依然是最有性价比的旗舰模型。
但是当在一个大任务里开子代理打杂用的时候,你真的愿意用一个黑化连篇罗里吧嗦抓不住重点的luna吗?
如果能个给文档任务和执行任务分开指派模型,我肯定很乐意他俩一起用。
[image]
[image]