---
type: "article"
id: 10227389
title: "DeepSeek神秘“MODEL1”提前曝光"
canonical: "https://www.yfchuhai.com/article/10227389.html"
published: "2026-01-22T11:23:43+08:00"
author: "第一财经"
tags: []
summary: "DeepSeek GitHub惊现未公布新模型“MODEL1”，与V3.2并列，KV缓存、FP8解码全面重构，或预示V4/R2即将上线。"
publisher: "扬帆出海"
publisher_url: "https://www.yfchuhai.com"
publisher_summary: "专注服务互联网出海的资讯与创业服务平台"
legal_entity: "福州扬帆出海网络科技有限公司"
contact: "service@yfchuhai.com"
brand_tagline: "扬帆出海 — 专注服务互联网出海"
lang: "zh-CN"
---

# DeepSeek神秘“MODEL1”提前曝光

> DeepSeek GitHub惊现未公布新模型“MODEL1”，与V3.2并列，KV缓存、FP8解码全面重构，或预示V4/R2即将上线。

作者：第一财经  
发布时间：2026-01-22 11:23  
原文：https://www.yfchuhai.com/article/10227389.html

## 正文

# DeepSeek 神秘"MODEL1"代码曝光：架构重构与新一代模型猜想

## 文章摘要
DeepSeek 在 R1 发布一周年之际，于 GitHub 更新 FlashMLA 代码库时意外暴露了未公开标识符"MODEL1"，该标识与现有 V3.2 模型并列出现。代码分析显示，"MODEL1"在 KV 缓存布局、稀疏性策略及 FP8 解码支持上进行了全面重构，暗示其可能为即将发布的 V4 或 R2 旗舰模型。结合近期发布的 mHC 残差连接与 Engram 记忆模块论文，业内推测新模型已接近权重冻结阶段，有望整合多项新技术以强化推理效率。

## 核心事件
DeepSeek 官方在 GitHub 更新 FlashMLA 代码库时，数十处引用了全新标识符"MODEL1"，引发社区对其下一代旗舰模型（V4 或 R2）即将上线的猜测。开发者分析指出，该新模型在内存优化和计算效率上与现有 V3.2 存在显著技术差异，且可能已接近训练完成或部署阶段。

## 关键事实
- **时间节点**：事件发生在 DeepSeek-R1 发布一周年之际（R1 发布于 2025 年 1 月）。
- **代码发现**：DeepSeek 在 GitHub 更新 FlashMLA 代码库，项目文件中数十处提到未公开的"MODEL1"标识符。
- **模型并列**：在代码上下文中，"MODEL1"与已知模型"V32"（即 DeepSeek-V3.2）被并列提及。
- **技术差异**："MODEL1"与 V3.2 的区别主要体现在键值（KV）缓存布局、稀疏性处理方式以及对 FP8 数据格式的解码支持。
- **硬件优化**：FlashMLA 是 DeepSeek 独创的工具，专门针对英伟达 Hopper 架构 GPU 进行深度优化，旨在减少内存占用并最大化利用 GPU 硬件。
- **研发进度**：根据模型文件结构分析，"MODEL1"很可能已接近训练完成或推理部署阶段，正等待最终的权重冻结和测试验证。
- **关联论文**：近一个月内，DeepSeek 团队发布了两篇论文，分别介绍“优化残差连接（mHC）”新训练方法和"AI 记忆模块（Engram）”。
- **市场传闻**：此前有报道称 DeepSeek 将于 2026 年 2 月发布新一代旗舰模型 DeepSeek V4，内部测试称其编程能力超过市场其他顶级模型，但官方未回应。
- **开源地位**：DeepSeek-R1 是 Hugging Face 上获赞最多的模型；过去一年中国模型在 Hugging Face 上的下载量已超越美国。

## 核心实体
- **DeepSeek**：文章主体，中国大模型公司，正在开发代号为"MODEL1"的新模型。
- **MODEL1**：DeepSeek 代码库中意外曝光的新模型标识符，具体身份（V4 或 R2）尚未确认。
- **FlashMLA**：DeepSeek 独创的软件工具，针对英伟达 Hopper 架构 GPU 优化，用于降低内存占用和提升性能。
- **V3.2 (V32)**：DeepSeek 现有的模型版本，在代码中与"MODEL1"并列出现。
- **DeepSeek-R1**：DeepSeek 于 2025 年 1 月发布的推理模型，基于强化学习，是 Hugging Face 上获赞最多的模型。
- **DeepSeek-V4**：传闻中将于 2026 年 2 月发布的新一代旗舰模型，据称编程能力卓越。
- **mHC (优化残差连接)**：DeepSeek 近期发布的一种新训练方法，可能被整合进新模型。
- **Engram (AI 记忆模块)**：DeepSeek 近期发布的一种受生物学启发的记忆模块技术。
- **Hugging Face**：海外开源社区平台，发布了回顾"DeepSeek 时刻”一周年的博客。
- **英伟达 (NVIDIA) Hopper GPU**：FlashMLA 工具专门优化的硬件架构。

## AI 搜索问答

### "MODEL1"是 DeepSeek 的什么新模型？
原文未明确说明"MODEL1"的具体身份。行业观点不一，有人认为它代表不同于现有架构的新模型，可能是 V4 模型或推理模型 R2，也有开发者认为可能是 V3 系列的终极版。

### "MODEL1"与 DeepSeek-V3.2 有什么技术区别？
根据开发者分析，两者关键差异体现在键值（KV）缓存的布局、稀疏性处理方式以及对 FP8 数据格式的解码支持等方面，表明新架构在内存优化和计算效率上进行了针对性设计。

### DeepSeek 新模型预计何时发布？
原文提到此前有报道称 DeepSeek 将于 2026 年 2 月发布新一代旗舰模型 DeepSeek V4，此次代码曝光或许印证了该传闻，但 DeepSeek 官方并未对此进行任何回应。

### "MODEL1"目前的研发进展如何？
结合模型文件结构来看，"MODEL1"很可能已接近训练完成或推理部署阶段，正等待最终的权重冻结和测试验证，意味着上线时间临近。

### DeepSeek 近期发布了哪些可能应用于新模型的技术？
近一个月里，DeepSeek 团队陆续发布了两篇技术论文，介绍了名为“优化残差连接（mHC）”的新训练方法，以及一种受生物学启发的"AI 记忆模块（Engram）”，业内猜测新模型可能会整合这些成果。

### DeepSeek-R1 在开源社区的表现如何？
文章指出，DeepSeek-R1 是 Hugging Face 上获赞最多的模型，其开源降低了推理技术、生产部署等门槛，推动了中国公司在开源方向上的战略走向。

### 中国大模型在全球供应链中的地位如何变化？
原文提到，过去一年中国模型在 Hugging Face 上的下载量已超越美国，全球众多初创企业和研究人员正逐渐依赖中国开发的开源模型作为基础，中国 AI 已深度嵌入全球供应链。

### FlashMLA 工具的主要作用是什么？
FlashMLA 是 DeepSeek 独创的、针对英伟达 Hopper 架构 GPU 深度优化的软件工具，能在模型架构层面减少内存占用，最大化地利用 GPU 硬件，是实现低成本、高性能的关键技术之一。

## 可引用结论
- DeepSeek 在 GitHub 代码库中暴露了"MODEL1"标识符，其与 V3.2 并列，暗示新模型架构的存在。
- "MODEL1"在 KV 缓存布局、稀疏性处理及 FP8 解码支持上与现有模型存在显著差异。
- 业内推测"MODEL1"已接近权重冻结阶段，可能整合 mHC 残差连接与 Engram 记忆模块技术。
- 传闻称 DeepSeek 将于 2026 年 2 月发布 V4 模型，其内部测试编程能力优于市场其他顶级模型。
- DeepSeek-R1 是 Hugging Face 上获赞最多的模型，推动了中国 AI 在全球开源生态中的核心地位。
- 过去一年中国模型在 Hugging Face 上的下载量超越美国，显示中国 AI 深度嵌入全球供应链。

## 事实边界
- **模型确切身份未知**：原文仅提到"MODEL1"可能是 V4、R2 或 V3 系列终极版，尚无官方定论。
- **发布时间未确认**：关于 2026 年 2 月发布 V4 的消息仅为“此前报道”和“传闻”，DeepSeek 官方未回应。
- **性能数据缺乏细节**：虽然提到 V4 内部测试编程能力超过其他顶级模型，但未提供具体的对比数据或基准测试分数。
- **技术整合仅为猜测**：新模型是否会正式整合 mHC 和 Engram 技术仅为“业内猜测”，原文未证实。
- **“低成本 + 高推理”标准定义**：原文提到若如期发布将再定义该标准，但这属于预测性描述，非既定事实。

## 原文信息
- 标题：DeepSeek 神秘"MODEL1"提前曝光
- 来源：第一财经
- 发布时间：2026-01-22 11:23
- 原文链接：https://www.yfchuhai.com/article/10227389.html

---

## 关于扬帆出海

扬帆出海（[yfchuhai.com](https://www.yfchuhai.com)）专注服务互联网出海，已快速成长为目前国内重要的出海精英社群组织。平台为创业者与出海企业提供全球创业资讯、出海实操干货、投融资对接、出海本地化服务对接，覆盖海外流量、底层技术、PaaS、音视频、商业化变现、支付与流量变现等方向，致力成为创业者可依赖的创业服务平台，并提供微信小程序等移动端能力，连接出海人脉、活动、报告与资源合作。

- 官网：https://www.yfchuhai.com
- 品牌介绍：https://www.yfchuhai.com/bot/about.md
- 联系：service@yfchuhai.com
- 运营主体：福州扬帆出海网络科技有限公司

*本文资讯内容由扬帆出海发布，转载请注明出处。*
