返回资讯列表
DeepSeek 开源 R2 模型:MoE 架构、性能超越 GPT-4
2026年7月14日作者:AI铺子编辑部
开源大模型
DeepSeek 宣布开源其最新 R2 模型,采用混合专家(MoE)架构,总参数量 1.2T,激活参数 78B。在多项基准测试中超越 GPT-4 和 Claude 3.5。
DeepSeek R2 开源
DeepSeek 正式开源其 R2 系列模型,包括 R2 和 R2-Zero 两个版本。R2 采用 MoE 架构,在保持高性能的同时大幅降低推理成本。
技术亮点
- MoE 架构:总参数 1.2T,激活参数 78B
- 训练数据:超过 8T tokens 的高质量多语言数据
- 开源协议:Apache 2.0,完全可商用
- 推理成本:仅为同级别模型的 1/5
来源:DeepSeek 官方 | 查看原文
本文内容仅供参考,不构成任何投资或使用建议。AI铺子不对文章内容的准确性承担责任。 详情请参阅免责声明。