@jin2lv三体名场面还原测试:GLM-5.3-Flash vs DeepSeek-V4 对比测评 中发帖

近日,Andrej Karpathy(安德烈·卡帕西)发布了一条有趣的推文:他将《指环王》开篇第一段作为 Prompt 喂给 Claude Opus 5,模型自主运行了约 2 小时,写下约 5,500 行 3D 渲染代码,把这段文字变成了可交互的 3D 场景(原文链接)。 
受此启发,我也心血来潮,尝试用类似的方式构造几道题,题目选自科幻小说《三体》系列中四个广为人知的大场面:

水滴歼灭战
太阳系二维化
古筝行动
人列计算机

把这些名场面尽可能还原成 3D 仿真,是对模型文字理解能力、空间想象能力、审美能力与前端工程能力的综合考验,希望大家在进行大模型综合能力的时候,除了鹈鹕骑车和天气卡片之外,也能有更多的选择。
测试设置


模型:GLM-5.3-Flash(智谱周末套餐赠送的 3 亿 tokens 额度)、DeepSeek-V4-Flash-Vision-Exp(Comman...