升级版DeepSeek-V3模型开源!DeepSeek上可试用体验快讯

TechWeb.com.cn 2025-03-25 08:52
分享到:
导读

DeepSeek在开源平台上线了升级后的DeepSeek-V3模型,//huggingface.co/deepseek-ai/DeepSeek-V3-0324 同时DeepSeek也将DeepSeek-V3模型的开源协议更新为与DeepSeek-R1一致的MIT协议,DeepSeek于2024年12月26日发布了DeepSeek-V3 首个版本。

【TechWeb】3月25日消息,DeepSeek在开源平台上线了升级后的DeepSeek-V3模型。新模型的版本号为DeepSeek-V3-0324,模型参数为6850亿,其早期版本参数为6710亿,相比有小幅增长。

开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324

同时DeepSeek也将DeepSeek-V3模型的开源协议更新为与DeepSeek-R1一致的MIT协议,这一协议允许模型蒸馏、商用等行为,给了开发者更多的自主权。

DeepSeek在其官方交流群中称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。

从网友初步反馈的实测效果来看,V3编码能力已经接近 Claude3.7,在网站开发能力、UI设计方面展现出巨大的进步,数学能力也有提升,能像推理模型一样解题。

DeepSeek于2024年12月26日发布了DeepSeek-V3 首个版本,当时,该版本的DeepSeek-V3 多项评测成绩超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他开源模型,并在性能上和世界顶尖的闭源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。(宜月)

模型 开源 DeepSeek DeepSeek-V 能力
分享到:

1.TMT观察网遵循行业规范,任何转载的稿件都会明确标注作者和来源;
2.TMT观察网的原创文章,请转载时务必注明文章作者和"来源:TMT观察网",不尊重原创的行为TMT观察网或将追究责任;
3.作者投稿可能会经TMT观察网编辑修改或补充。