小K (@xiao_k)DeepSeek新论文 中发帖

今天凌晨,喜欢闷声做大事的 DeepSeek 再次发布重大技术成果,在其 GitHub 官方仓库开源了新论文与模块 Engram ,论文题为 “Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models”。 
与传统的大模型架构相比,该方法提出了一种新的“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下显著提升模型在知识调用、推理、代码、数学等任务上的表现。代码与论文全文均已开源。