云天明 (@Yuntianming)鹈鹕测试现在还准吗 中发帖

原作者开始用鹈鹕测试的时候,有个前提条件就是那时全世界可能也不会有几个人用鹈鹕骑自行车生成svg去测试大模型,所以大模型也基本上没有可能提前针对这方面做训练。 
但现在这个测试几乎已经被用烂了,模型厂商难道不会对这个测试做针对性的优化吗