littleblack LB感觉稍微调教的 pi 还是不如codex好用? 中发帖

前几天自己配了一个 Pi Agent,日常在已有项目里开发、修 bug,体验还不错,而且确实很省 token。 
但后来让它从零 vibe 一个 Python 小游戏,效果却很差。我一开始以为是模型问题,因为当时用的是 Luna Max. 第二天又用 Codex 按几乎同样的提示词复现,结果效果依然差距很大。
[image]
[image]
而且像我的 Codex 去对话时,我也要求它做一个最小的 MVP。但最终代码实现出来后,工程化程度依然很强,也没有 over-engineering, 并没有因为只是 MVP 就生成一个单文件。所以你看到第二张图展示的大概实现效果,就是因为它只用了单文件,大概几百行代码就完成了。
Pi Agent 的设计理念偏“大道至简”,默认不会堆很多 prompt engineering。理论上现在模型原生能力越来越强,确实应该减少外部提示词工程吧。
但...