微信扫码
添加专属顾问
我要投稿
阿里云最新推理模型QwQ-32B强势来袭,性能媲美671B,资源占用极低,开源免费商用! 核心内容: 1. QwQ-32B模型参数、性能与DeepSeek-R1的对比 2. QwQ-32B的开源协议、下载方式及部署优势 3. QwQ-32B发布对行业的影响及未来AI大模型的发展趋势
huggingface:
https://huggingface.co/Qwen/QwQ-32B
hf镜像站:
http://hf-mirror.com/Qwen/QwQ-32B
ollama:
https://ollama.com/library/qwq
也可以使用ollama直接拉取该模型,命令如下:
ollama run qwq
相比较deepseek-r1 671b满血版,QwQ的资源占用极低!ollama平台q4量化版,仅占用20G显存,全量模型所需的显存也不超过80G即可实现流畅推理!另外,有小道消息说有DS相关人员提供技术支持哦!
QwQ-32B发布后,影响感觉还是很大的,尤其是对之前花了很多上671B的客户们来说,可能会肉疼一段时间吧!现在AI大模型的更新迭代太快,自从DeepSeek开源后,的的确确是促进了整个大模型的跃进式迭代更新,期待这些头部企业能够给我们带来更多更好的技术吧!
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-11-06
AI时代,我们为何重写规则引擎?—— QLExpress4 重构之路
2025-11-06
锦秋基金创始合伙人杨洁揭秘:AI投资三大方向与AI创业者机遇——现场解答最真实的三大创业焦虑
2025-11-05
LLaMA Factory 安装与配置指南:在 Ubuntu 上快速搭建大模型微调平台
2025-11-05
TinyAI :全栈式轻量级 AI 框架
2025-11-04
百灵大模型 Ling 和 Ring 系列首发支持 SGLang-JAX 推理引擎
2025-11-04
首个国产开源AI原生后端,不再写后端,AI就是全栈工程师。
2025-11-04
DeepCode: 用多智能体架构重新定义代码生成
2025-11-04
AI Infra:POINTS-Reader,腾讯开源的文档解析和OCR工具
2025-08-20
2025-09-07
2025-08-20
2025-08-26
2025-08-22
2025-09-06
2025-10-20
2025-08-22
2025-09-08
2025-08-12
2025-11-03
2025-10-29
2025-10-28
2025-10-13
2025-09-29
2025-09-17
2025-09-09
2025-09-08