致远舰队 (@velsa) 在 [转载自知乎]模型体感评测,各位感觉这个排序如何? 中发帖
原文链接: 如何评价 9 月 28 日发布的Claude Sonnet 5.5?
作者:某科学的仙人仉
TL;DR:没降多少成本的,性能下降也不多。
建议使用情况:
1、常见开发任务,使用high effort,刚好在速度、开销、质量的甜点位。
2、一般日常工作,如文字处理、搜索、信息处理,high或medium均可,几乎可以低消耗cover一般需求。
横向对比GPT,在一般通用工作、前端开发、审美与文字能力上明显强于GPT6 sol,有着优秀的品味,不仅仅是审美,科研辅助与后端开发等需要深度推理的任务上相比6 sol也不弱。但token消耗明显高于6 sol,在科研一类任务上,暂时没有明显优势。
纵向对比opus,由于价格相比Opus 5.5优势不大(甚至缓存价格一样),性价比被opus 5.5挤压严重,绝大多数任务非常不推荐使用sonnet max档位,而可以考虑用opus...