DeepSeek V3模型的版本更新
2025-03-25 16:10
收藏
3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。
从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。
此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。
其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。
2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。
本文来自全球互联网及战略合作伙伴信息的编译与转载,仅为读者提供交流,有侵权或其它问题请及时告知,本站将予以修改或删除,未经正式授权严禁转载本文。邮箱:news@wedoany.com
相关阅读

OpenAI推出GPT-6 Astra 称其为迈向通用人工智能的重要里程碑
2026-09-04

高通携手沙特阿卜杜拉国王科技大学推进6G与AI研发
2026-09-03

孟加拉国与韩国签署1300万美元协议 在达卡建立AI培训中心
2026-09-03

黄仁勋呼吁G20加快AI基础设施建设
2026-09-03

Bull获3.878亿欧元LUMI-AI超算合同
2026-09-02

国家电投与中国联通签署战略合作协议,双方董事长刘明胜、董昕见证签约
2026-09-02

美国微软捐500万美元支持加州山火AI监测
2026-09-02

NVIDIA与联发科技扩大AI合作,投资35亿美元
2026-09-01

HUMAIN与DataVolt开建沙特100MW AI数据中心
2026-09-01

中国小鹏上周发布VLA 6.3.0,机器人部门融资9亿美元
2026-08-31











