国产开源大模型DeepSeek的“朋友圈”正在逐步扩大。
01
几大云平台宣布上线DeepSeek模型
2月1日,华为云在官微宣布,与硅基流动联合首发并上线基于昇腾云服务的DeepSeek R1/V3推理服务,其性能可与全球高端GPU部署模型相媲美。
2月2日,腾讯云称,将DeepSeek-R1大模型一键部署至其“HAI”平台,开发者仅需3分钟即可接入调用。
2月3日,阿里云称,其PAI Model Gallery支持云上一键部署DeepSeek-V3和DeepSeek-R1模型,用户可零代码实现从训练到部署再到推理的全过程。
2月3日晚,百度智能云也宣布,其千帆平台正式上架DeepSeek-R1和DeepSeek-V3模型,并推出超低价格方案及限时免费服务;
2月4日晚间,据京东云官微消息,京东云已正式上线DeepSeek-R1和DeepSeek-V3模型,支持公有云在线部署、专混私有化实例部署两种模式,供用户按需部署,快速调用。
公有云在线部署模式方面,开发者和企业可以在京东云官网的言犀AI开发计算平台上,通过“AI资产市场”一键部署DeepSeek模型。
专混模式方面,专混私有化算力实例部署模式,已经同步上线京东云vGPU AI算力平台,为金融、企业、政府等客户提供数据不出域的私有化模型推理服务。
2月5日,中国联通宣布,联通云已基于星罗平台实现国产及主流算力适配多规格DeepSeek-R1模型,兼顾私有化和公有化场景,提供全方位运行服务保障。联通云基于A800、H800、L40S等多款主流算力卡,预置DeepSeek-R1多尺寸模型,用户可按需灵活选择、快速扩展,快速搭建DeepSeek-R1推理和微调环境。
02
推动发展
2025年以来,DeepSeek陆续开源大语言模型V3、推理模型R1和多模态模型Janus Pro,凭借高性能、低成本的优势,引发国内外市场的关注和布局。
DeepSeek采用MIT开源协议,允许商业用途和模型二次开发,极大激发了开发者创新潜力。根据AI产品榜统计,DeepSeek应用上线20天,日活突破2000万,远超ChatGPT同期表现。
业内人士认为,DeepSeek选择开源,为全球人工智能领域提供了高性能、低成本的模型范例。
随着越来越多的厂商接入,围绕DeepSeek的产业生态正在形成,云平台提供计算资源和模型部署服务,芯片厂商提供算力支持,应用厂商拓展应用场景,实现相互协作、相互促进。
Deepseek的技术发展可能在技术、行业、就业、社会和经济等多个层面产生广泛影响。其AI和大数据技术有望推动效率提升、创新加速和行业变革,但同时也带来数据隐私、伦理和法律等方面的挑战。企业和个人需要积极适应这些变化,抓住机遇,应对挑战。