coftens模型经济账:小项目用国模旗舰跟GPT/Claude 的旗舰,同样效果下谁更划算? 中发帖

想问下各位佬,大家有没有仔细算过这笔账。 
我现在做小项目,有个直观感受:像 Fable5 经常一轮对话就能直接搞定需求。
国模看着便宜很多,但我的实际体验是,想要达到 Fable5 一轮交付同等质量的效果,往往需要多轮调试、反复重试。
抛开标价,把多轮产生的额外token、调试耗时一起算进去,在同一套验收标准下,国模旗舰和 GPT、Claude Opus这一档模型,真实的性价比到底是谁更高?
想问问有没有佬在同类项目实测对比过?