老王 (@sdfasffsdf234)关于网页版本的chatgpt pro ,似乎国内的LLM 基本都不追求这种超强的答题/科研能力,只追求coding 能力 中发帖

感觉国内模型和chatgpt pro 有着巨大的鸿沟,不是一点点。 
但是如果只看benchimark ,就是看那种LLm 的coding 能力, 感觉是差不多。
但是实际使用的时候,用qwen 或者glm 网页版本,很多问题的回答即使加了搜索,他的某些回答居然也是1年前的数据。(用老数据,老新闻问题也不大,关键是回答能力和pro 差太多了。)
大家怎么看这一点呢?