扬帆创投微信小程序
更聚焦的出海投融资平台
精准高效领先的融资对接服务
微信扫一扫进入小程序

DeepSeek今晨无预告开源 DeepSeek-V3.1-Base,连模型卡片都未配,却迅速冲上 Hugging Face 趋势榜第 4。

摘要

Hugging Face 联合创始人发推祝贺,8 万关注者的影响力可见一斑,社区已积极开始试用与讨论。

6850 亿参数,支持 BF16/F8_E4M3/F32 三种精度,Safetensors 格式 + 扩展上下文窗口,速度与智能据称对标 GPT 级模型。

推测为 V3 与 R1 的融合体,对话模板新增“思考参数”,可显式控制模型的内部推理过程。

DeepSeek 延续“先放权重、后补说明”风格,鼓励社区先行探索,也被视为对基础模型开源的坚守。

今天凌晨,全球著名大模型开源平台DeepSeek开源了Deepseek V3.1-Base版本。

非常低调没有任何介绍,只是把模型放上去了。但在Hugging Face的趋势榜单中已经上升到第4名,还是相当受欢迎的。

图片

开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3.1-Base/tree/main

Hugging Face联合创始人Clement Delangue特意发了推文祝贺,他表示,Deepseek V3.1 已经悄无声息地发布,没有附带模型卡片,却已登上 Hugging Face 趋势榜第四位,太有意思了。

这就是在 Hugging Face 上拥有 8 万名关注者的力量。

图片

根据网友的推测,新升级版本,速度更快、智能程度更高,可与GPT级模型媲美。该模型拥有 6850 亿参数,支持 BF16F8_E4M3F32三种张量类型,以Safetensors格式发布,便于高效推理,还具备扩展的上下文窗口。

同时非常欣赏DeepSeek这种 “先放权重,后补说明的风格,能让社区能够优先开展模型探索。

图片

很高兴看到仍有公司在发布基础模型。

图片

它应该是一个结合了 v3  r1 的模型。其对话模板包含一个思考参数,用于控制思考过程。

图片

我试着在我的 4GB 显卡上加载新的 DeepSeek-V3.1-Base 685B 模型,结果它崩溃了,不知道为啥?

图片

那近期R2还会有希望吗?

图片

原文链接:点击前往 >

文章作者:AIGC开放社区

版权申明:文章来源于AIGC开放社区。该文观点仅代表作者本人,扬帆出海平台仅提供信息存储空间服务,不代表扬帆出海官方立场。因本文所引起的纠纷和损失扬帆出海均不承担侵权行为的连带责任,如若转载请联系原文作者。 更多资讯关注扬帆出海官网:https://www.yfchuhai.com/

{{likeNum}}

好文章,需要你的鼓励

请前往扬帆出海小程序完成个人认证
认证通过后即可申请入驻
扫码添加小助手
微信扫描二维码,添加小助手
微信号:yfch01
扫码添加小助手
微信扫描二维码,添加小助手
微信号:yfch01
APP
小程序
微信公众号
微信小程序
扬帆出海APP
扬帆出海APP
微信
公众号
微信公众号
关注扬帆出海
专注服务互联网出海!
出海人
社群
微信公众号
扫码进群
与16万+出海人同行!