1月21日消息,新模型DeepSeek的曝光下一代旗舰模型疑似提前曝光。在其官方GitHub代码库的新模型更新中,一个名为“MODEL1”的曝光新模型名称在多个技术文件中频繁出现,引发了人工智能社区的新模型广泛关注。
根据对代码库的曝光深入挖掘,“MODEL1”的新模型踪迹横跨了114个文件,共计被提及28次。曝光尤为关键的新模型是,它在代码逻辑中与当前已发布的曝光“V32”(即DeepSeek-V3.2模型)并列出现,表明它并非现有模型的新模型简单迭代,而极有可能是曝光一个独立的新模型序列。

技术分析显示,新模型MODEL1与V3.2在底层架构上存在显著差异。曝光代码对比指出,新模型二者在KV(键值)缓存布局、稀疏性处理方式以及FP8精度解码等核心模块上采用了不同的实现方案。特别是在内存优化方面,MODEL1显示出多处针对性改进,这通常意味着它在处理效率或支持更长上下文方面可能有新的设计目标。

此前有消息称DeepSeek计划在2026年春节前后发布其下一代重量级模型。因为,不少行业分析人士认为,此次MODEL1在开源代码中意外现身,就如同之前DeepSeek发布的优化残差链接“mHC”和AI记忆模块“Engram”两篇论文中提到的新技术一样,很可能正是为这次发布进行的技术准备。

目前,DeepSeek官方尚未对此事发表任何公开评论。所有信息均来源于对公开代码的非官方分析,模型的具体技术细节、性能指标及正式名称仍需等待官方的最终揭晓。
锦电出府网










