AI 【新芒xAI】即将登场的 Deepseek R2:低至 0.07 美元 / M 的成本,挑战 GPT 4o

【新芒xAI】即将登场的 Deepseek R2:低至 0.07 美元 / M 的成本,挑战 GPT 4o

新芒xAI 4月27日消息 据网传消息,Deepseek R2 即将推出,其自研分布式训练框架亮点十足。

该框架在华为 Ascend 910B 芯片集群上利用率达 82% ,以 FP16 精度实现 512 petaflops 运算,与同规模 A100 集群相比效率达 91%,单位成本降低 97.3% 。

模型参数达 1.2T,激活参数 78B,采用混合专家混合(MoE)架构 ,训练数据量达 5.2PB,在 C-Eval2.0 上得分 89.7% ,在 COCO 上视觉表现达 92.4% 。

文章来源信息声明: 本文信息出自权威媒体、企业官方及网络,并经新芒X编辑,转载请注明源出处、作者和链接。 图片部分来源于网络,在此表示感谢,如有侵权请联系我方处理。 文章发布日期后方火形图标后的数字,为文章热度,谨代表受欢迎程度。 新芒X平台仅对用户提供信息及决策参考,本文不构成投资建议。

作者: 新芒Group

新芒出品,专注专业。兼具内容品质和传播影响力
关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部