微信扫码
添加专属顾问
我要投稿
DeepSeek低调开源V3.1-Base模型,性能媲美GPT级却无需宣传,社区已沸腾! 核心内容: 1. DeepSeek V3.1-Base低调开源,登上Hugging Face趋势榜第四 2. 6850亿参数支持多种张量类型,推理效率与上下文窗口显著提升 3. 开源社区对"先放权重后补说明"的极客风格热烈响应
今天凌晨,全球著名大模型开源平台DeepSeek开源了Deepseek V3.1-Base版本。
非常低调没有任何介绍,只是把模型放上去了。但在Hugging Face的趋势榜单中已经上升到第4名,还是相当受欢迎的。
开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3.1-Base/tree/main
Hugging Face联合创始人Clement Delangue特意发了推文祝贺,他表示,Deepseek V3.1 已经悄无声息地发布,没有附带模型卡片,却已登上 Hugging Face 趋势榜第四位,太有意思了。
这就是在 Hugging Face 上拥有 8 万名关注者的力量。
根据网友的推测,新升级版本,速度更快、智能程度更高,可与GPT级模型媲美。该模型拥有 6850 亿参数,支持 BF16、F8_E4M3、F32三种张量类型,以Safetensors格式发布,便于高效推理,还具备扩展的上下文窗口。
同时非常欣赏DeepSeek这种 “先放权重,后补说明”的风格,能让社区能够优先开展模型探索。
很高兴看到仍有公司在发布基础模型。
它应该是一个结合了 v3 和 r1 的模型。其对话模板包含一个思考参数,用于控制思考过程。
我试着在我的 4GB 显卡上加载新的 DeepSeek-V3.1-Base 685B 模型,结果它崩溃了,不知道为啥?
那近期R2还会有希望吗?
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-08-29
如何评测 AI 智能体:试试字节开源的扣子罗盘
2025-08-29
HiMarket 正式开源,为企业落地开箱即用的 AI 开放平台
2025-08-28
美团 M17 团队开源 Meeseeks 评测集:揭秘大模型的 “听话”能力
2025-08-28
我摊牌了,PDF的终结者出现了!这个开源神器,让你的RAG项目吞吐能力暴增10倍!
2025-08-28
面壁开源多模态新旗舰MiniCPM-V 4.5,8B 性能超越 72B,高刷视频理解又准又快
2025-08-28
1.9K Star 微软开源TTS王炸!90分钟超长语音合成,4人对话自然切换!
2025-08-27
初探:从0开始的AI-Agent开发踩坑实录
2025-08-27
ollama v0.11.7发布:深度集成DeepSeek-V3.1与Turbo云端推理模式解析
2025-07-23
2025-06-17
2025-08-20
2025-06-17
2025-07-23
2025-08-05
2025-07-14
2025-08-20
2025-07-29
2025-07-12