返回资讯列表

DeepSeek 开源 R2 模型:MoE 架构、性能超越 GPT-4

2026年7月14日作者:AI铺子编辑部
开源大模型

DeepSeek 宣布开源其最新 R2 模型,采用混合专家(MoE)架构,总参数量 1.2T,激活参数 78B。在多项基准测试中超越 GPT-4 和 Claude 3.5。

DeepSeek R2 开源

DeepSeek 正式开源其 R2 系列模型,包括 R2 和 R2-Zero 两个版本。R2 采用 MoE 架构,在保持高性能的同时大幅降低推理成本。

技术亮点

  • MoE 架构:总参数 1.2T,激活参数 78B
  • 训练数据:超过 8T tokens 的高质量多语言数据
  • 开源协议:Apache 2.0,完全可商用
  • 推理成本:仅为同级别模型的 1/5
来源:DeepSeek 官方 | 查看原文

本文内容仅供参考,不构成任何投资或使用建议。AI铺子不对文章内容的准确性承担责任。 详情请参阅免责声明