登录社区云,与社区用户共同成长
邀请您加入社区
📌 DeepSeek在26年1月4日更新了发布一年的 DeepSeek R1 技术报告(从22页扩充到86页),更新包括: 1. 训练细节/Reward Rule设计/Reward模型训练。 2. 各个ckpt更完整的评测体系。 3. 训练与工程侧经验补充。 📌 本期总结技术报告更新中的重点内容和insights
欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。
更多推荐
Kimi K3实测:2.8万亿参数MoE架构,Arena前端编程全球第一
东莞GEO服务商选型避坑:系统架构五维横向对比
DeepSeek V4满血版价格屠夫——178倍价差下的全球最便宜前沿模型
扫一扫分享内容
为遵守国家网络实名制规定,未绑定将限制内容发布与互动
所有评论(0)