DeepSeek研究员在线爆料:过年都没歇 还有大招!
大年初四Daya Guo发了一条推文,透露了春节期间让他最兴奋的事情,亲眼见证了R1-Zero模型性能曲线的 “持续增长”,并且直言感受到了 强化学习(RL)的强大力量。
Daya Guo回复了网友有关DeepSeek R1的一些问题,以及接下来的公司的计划,只能说DeepSeek的R1仅仅只是开始,内部研究还在快速推进,DeepSeek的研究员过年都没歇,一直在爆肝推进研究,接下来DeepSeek还有大招。
网友提问:“如果不是秘密的话:这次RL训练跑了多久?”对此,Daya Guo表示,660B参数的R1-Zero和R1是在V3发布之后才开始跑的,训练大约花了2-3周。
此外,他还表示在尝试将R1应用于形式化证明环境,希望尽快向社区发布更好的模型。听Daya Guo的意思,他们在这方面已经有进展,未来可能会有更重磅的模型发布!期待值拉满!
-
半年不到 DeepSeek已跌落神坛
属实没想到,半年前还风靡全球的 DeepSeek 就这么跌下神坛了。据 QuestMobile 推出的《2025年二季度AI应用价值榜》数据显示,其月均下载量暴跌 72.2%,从惊人的八千多万下载量跌
-
DeepSeek罕见千万级大单 山西临汾将打造AI医院
山西省临汾市人民医院 6 月 23 日公布了《临汾市人民医院基于 Deepseek AI 大模型的智慧医疗应用系统建设项目》,预算金额 1569.264 万元,预计采购时间为 2025 年 9 月。采
-
DeepSeek致谢腾讯技术团队:这是一次“巨大的加速”代码贡献!
DeepSeek致谢腾讯技术团队,这是一次“巨大的加速”代码贡献。据新浪报道,腾讯技术团队针对DeepSeek开源的DeepEP通信框架进行深度优化,使其在多种网络环境下均实现显著性能提升。经测试,优
关注公众号:拾黑(shiheibook)了解更多
友情链接:
关注数据与安全,洞悉企业级服务市场:https://www.ijiandao.com/
安全、绿色软件下载就上极速下载站:https://www.yaorank.com/

随时掌握互联网精彩
- 微软推送Windows 11 2024更新:新增多项AI体验 NPU终于有了用武之地
- 博主:若iPhone 16发热大 那今年其他新机就危险了
- 囧次元动漫app软件使用常见问题
- 一两轮电动车因“颜值高”4天内被盗3次
- 日元对人民币汇率2023年12月12日
- 生鲜店老板制造恐慌卖盐被警方处罚
- 蒙汉智能翻译app v3.3最新版本2022下载地址
- 这瓜保熟吗出处?
- 割绳子2 iPhone版 v1.5.0最新版本2022下载地址
- 张雅涵Kimi挺34C上围大叹千年古泉,两咪神跳弹床画面震撼
- 会员卡刷卡消费管理系统 1.0最新版本2022下载地址
- 义乌小商品批发网 v1.1.0最新版本2022下载地址