• 最新
  • 热门
  • 所有
  • 外汇
  • 24 小时
  • 期货
  • 基金
  • 贵金属
  • 股票

DeepSeek 新模型 MODEL1 曝光

2026 年 1 月 21 日

全球债市过山车!日债 「特拉斯时刻」 拖累美债 美财长贝森特忙甩锅

2026 年 1 月 21 日

睿远基金傅鹏博、朱璘增持数据中心液冷、存力和算力的相关公司

2026 年 1 月 21 日
受特朗普关税担忧影响,创纪录的黄金涨势目标直指5000美元

受特朗普关税担忧影响,创纪录的黄金涨势目标直指 5000 美元

2026 年 1 月 21 日
广告
马斯克高调「复活」特斯拉Dojo3芯片项目 再度剑指「太空AI计算」!

马斯克高调 「复活」 特斯拉 Dojo3 芯片项目 再度剑指 「太空 AI 计算」!

2026 年 1 月 21 日

2025 微短剧:「暴富」 只存在于剧里

2026 年 1 月 21 日
部分宽基ETF继续放量成交 资金流向传递重要信号!

部分宽基 ETF 继续放量成交 资金流向传递重要信号!

2026 年 1 月 21 日

午盘播报 1 月 21 日 周三

2026 年 1 月 21 日
3-0!U23国足再创历史,强势闯入亚洲杯决赛

3-0!U23 国足再创历史,强势闯入亚洲杯决赛

2026 年 1 月 21 日

华尔街将 「蟑螂论」 抛之脑后,私人信贷人气依旧火热!

2026 年 1 月 21 日

午评:沪指涨 0.16% 科创 50 指数涨 2.96% 贵金属股和 CPO 概念股涨幅靠前

2026 年 1 月 21 日

红利国企 ETF(510720) 收涨超 0.9%,高股息策略配置价值凸显

2026 年 1 月 21 日
突然宣布!丹麦养老基金AkademikerPension将退出美国国债投资

突然宣布!丹麦养老基金 AkademikerPension 将退出美国国债投资

2026 年 1 月 21 日
金桂财经
广告
2026 年 1 月 21 日 星期三
联系我们
合作建议
  • 首页
  • 24 小时
  • 全球金融
  • 股市风云
  • 基金动态
  • 金财眼
  • 期货新闻
  • 期货研报
  • 外汇市场
  • 贵金属
  • 未来科技
  • 登录& 注册
没有结果
查看所有结果
  • 首页
  • 24 小时
  • 全球金融
  • 股市风云
  • 基金动态
  • 金财眼
  • 期货新闻
  • 期货研报
  • 外汇市场
  • 贵金属
  • 未来科技
没有结果
查看所有结果
金桂财经
没有结果
查看所有结果

DeepSeek 新模型 MODEL1 曝光

来自 金桂财经
2026 年 1 月 21 日
在 科技
0

【文章来源:techweb】

【TechWeb】1 月 21 日消息,DeepSeek 的下一代旗舰模型疑似提前曝光。在其官方 GitHub 代码库的更新中,一个名为 「MODEL1」 的新模型名称在多个技术文件中频繁出现,引发了人工智能社区的广泛关注。

根据对代码库的深入挖掘,「MODEL1」 的踪迹横跨了 114 个文件,共计被提及 28 次。尤为关键的是,它在代码逻辑中与当前已发布的 「V32」(即 DeepSeek-V3.2 模型) 并列出现,表明它并非现有模型的简单迭代,而极有可能是一个独立的新模型序列。

技术分析显示,MODEL1 与 V3.2 在底层架构上存在显著差异。代码对比指出,二者在 KV(键值) 缓存布局、稀疏性处理方式以及 FP8 精度解码等核心模块上采用了不同的实现方案。特别是在内存优化方面,MODEL1 显示出多处针对性改进,这通常意味着它在处理效率或支持更长上下文方面可能有新的设计目标。

此前有消息称 DeepSeek 计划在 2026 年春节前后发布其下一代重量级模型。因为,不少行业分析人士认为,此次 MODEL1 在开源代码中意外现身,就如同之前 DeepSeek 发布的优化残差链接 「mHC」 和 AI 记忆模块 「Engram」 两篇论文中提到的新技术一样,很可能正是为这次发布进行的技术准备。

目前,DeepSeek 官方尚未对此事发表任何公开评论。所有信息均来源于对公开代码的非官方分析,模型的具体技术细节、性能指标及正式名称仍需等待官方的最终揭晓。

【文章来源:techweb】

【TechWeb】1 月 21 日消息,DeepSeek 的下一代旗舰模型疑似提前曝光。在其官方 GitHub 代码库的更新中,一个名为 「MODEL1」 的新模型名称在多个技术文件中频繁出现,引发了人工智能社区的广泛关注。

根据对代码库的深入挖掘,「MODEL1」 的踪迹横跨了 114 个文件,共计被提及 28 次。尤为关键的是,它在代码逻辑中与当前已发布的 「V32」(即 DeepSeek-V3.2 模型) 并列出现,表明它并非现有模型的简单迭代,而极有可能是一个独立的新模型序列。

技术分析显示,MODEL1 与 V3.2 在底层架构上存在显著差异。代码对比指出,二者在 KV(键值) 缓存布局、稀疏性处理方式以及 FP8 精度解码等核心模块上采用了不同的实现方案。特别是在内存优化方面,MODEL1 显示出多处针对性改进,这通常意味着它在处理效率或支持更长上下文方面可能有新的设计目标。

此前有消息称 DeepSeek 计划在 2026 年春节前后发布其下一代重量级模型。因为,不少行业分析人士认为,此次 MODEL1 在开源代码中意外现身,就如同之前 DeepSeek 发布的优化残差链接 「mHC」 和 AI 记忆模块 「Engram」 两篇论文中提到的新技术一样,很可能正是为这次发布进行的技术准备。

目前,DeepSeek 官方尚未对此事发表任何公开评论。所有信息均来源于对公开代码的非官方分析,模型的具体技术细节、性能指标及正式名称仍需等待官方的最终揭晓。

YOU MAY ALSO LIKE

京东发布 JoyInside 软硬一体化方案,为玩具行业装上 「AI 大脑」

[开源] 松鼠软件管家 - 可视化管理和更新软件

【文章来源:techweb】

【TechWeb】1 月 21 日消息,DeepSeek 的下一代旗舰模型疑似提前曝光。在其官方 GitHub 代码库的更新中,一个名为 「MODEL1」 的新模型名称在多个技术文件中频繁出现,引发了人工智能社区的广泛关注。

根据对代码库的深入挖掘,「MODEL1」 的踪迹横跨了 114 个文件,共计被提及 28 次。尤为关键的是,它在代码逻辑中与当前已发布的 「V32」(即 DeepSeek-V3.2 模型) 并列出现,表明它并非现有模型的简单迭代,而极有可能是一个独立的新模型序列。

技术分析显示,MODEL1 与 V3.2 在底层架构上存在显著差异。代码对比指出,二者在 KV(键值) 缓存布局、稀疏性处理方式以及 FP8 精度解码等核心模块上采用了不同的实现方案。特别是在内存优化方面,MODEL1 显示出多处针对性改进,这通常意味着它在处理效率或支持更长上下文方面可能有新的设计目标。

此前有消息称 DeepSeek 计划在 2026 年春节前后发布其下一代重量级模型。因为,不少行业分析人士认为,此次 MODEL1 在开源代码中意外现身,就如同之前 DeepSeek 发布的优化残差链接 「mHC」 和 AI 记忆模块 「Engram」 两篇论文中提到的新技术一样,很可能正是为这次发布进行的技术准备。

目前,DeepSeek 官方尚未对此事发表任何公开评论。所有信息均来源于对公开代码的非官方分析,模型的具体技术细节、性能指标及正式名称仍需等待官方的最终揭晓。

【文章来源:techweb】

【TechWeb】1 月 21 日消息,DeepSeek 的下一代旗舰模型疑似提前曝光。在其官方 GitHub 代码库的更新中,一个名为 「MODEL1」 的新模型名称在多个技术文件中频繁出现,引发了人工智能社区的广泛关注。

根据对代码库的深入挖掘,「MODEL1」 的踪迹横跨了 114 个文件,共计被提及 28 次。尤为关键的是,它在代码逻辑中与当前已发布的 「V32」(即 DeepSeek-V3.2 模型) 并列出现,表明它并非现有模型的简单迭代,而极有可能是一个独立的新模型序列。

技术分析显示,MODEL1 与 V3.2 在底层架构上存在显著差异。代码对比指出,二者在 KV(键值) 缓存布局、稀疏性处理方式以及 FP8 精度解码等核心模块上采用了不同的实现方案。特别是在内存优化方面,MODEL1 显示出多处针对性改进,这通常意味着它在处理效率或支持更长上下文方面可能有新的设计目标。

此前有消息称 DeepSeek 计划在 2026 年春节前后发布其下一代重量级模型。因为,不少行业分析人士认为,此次 MODEL1 在开源代码中意外现身,就如同之前 DeepSeek 发布的优化残差链接 「mHC」 和 AI 记忆模块 「Engram」 两篇论文中提到的新技术一样,很可能正是为这次发布进行的技术准备。

目前,DeepSeek 官方尚未对此事发表任何公开评论。所有信息均来源于对公开代码的非官方分析,模型的具体技术细节、性能指标及正式名称仍需等待官方的最终揭晓。

Search

没有结果
查看所有结果

一周热门

全球债市过山车!日债 「特拉斯时刻」 拖累美债 美财长贝森特忙甩锅

2026 年 1 月 21 日

睿远基金傅鹏博、朱璘增持数据中心液冷、存力和算力的相关公司

2026 年 1 月 21 日
受特朗普关税担忧影响,创纪录的黄金涨势目标直指5000美元

受特朗普关税担忧影响,创纪录的黄金涨势目标直指 5000 美元

2026 年 1 月 21 日
马斯克高调「复活」特斯拉Dojo3芯片项目 再度剑指「太空AI计算」!

马斯克高调 「复活」 特斯拉 Dojo3 芯片项目 再度剑指 「太空 AI 计算」!

2026 年 1 月 21 日

2025 微短剧:「暴富」 只存在于剧里

2026 年 1 月 21 日
部分宽基ETF继续放量成交 资金流向传递重要信号!

部分宽基 ETF 继续放量成交 资金流向传递重要信号!

2026 年 1 月 21 日

午盘播报 1 月 21 日 周三

2026 年 1 月 21 日
3-0!U23国足再创历史,强势闯入亚洲杯决赛

3-0!U23 国足再创历史,强势闯入亚洲杯决赛

2026 年 1 月 21 日

华尔街将 「蟑螂论」 抛之脑后,私人信贷人气依旧火热!

2026 年 1 月 21 日

午评:沪指涨 0.16% 科创 50 指数涨 2.96% 贵金属股和 CPO 概念股涨幅靠前

2026 年 1 月 21 日
金桂财经

2026 年 1 月
一 二 三 四 五 六 日
 1234
567891011
12131415161718
19202122232425
262728293031  
« 12 月    

近期动态

  • 全球债市过山车!日债 「特拉斯时刻」 拖累美债 美财长贝森特忙甩锅
  • 睿远基金傅鹏博、朱璘增持数据中心液冷、存力和算力的相关公司
  • 受特朗普关税担忧影响,创纪录的黄金涨势目标直指 5000 美元
  • 马斯克高调 「复活」 特斯拉 Dojo3 芯片项目 再度剑指 「太空 AI 计算」!
  • 2025 微短剧:「暴富」 只存在于剧里
  • 部分宽基 ETF 继续放量成交 资金流向传递重要信号!
广告

Copyright © 2025 广州金桂广告传媒有限公司. 粤 ICP 备 2025390655 号

  • 关于本站
  • 联系我们
  • 隐私政策
没有结果
查看所有结果
  • 登录& 注册

Copyright © 2025 广州金桂广告传媒有限公司. 粤 ICP 备 2025390655 号

  • 登录
  • 注册
忘记密码?
Lost your password? Please enter your username or email address. You will receive a link to create a new password via email.
body::-webkit-scrollbar { width: 7px; } body::-webkit-scrollbar-track { border-radius: 10px; background: #f0f0f0; } body::-webkit-scrollbar-thumb { border-radius: 50px; background: #dfdbdb }