360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

2025年2月24日——由360与北京大学联合研发的中等量级推理模型Tiny-R1-32B-Preview正式亮相,仅以5%参数,逼近Deepseek-R1-671B的性能。

360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

核心突破:小模型,大能量

▪  数学领域:以78.1分(AIME 2024评测)逼近原版R1模型(79.8分),远超Deepseek-R1-Distill-Llama-70B(70.0分);

▪  综合性能:在编程(LiveCodeBench 61.6分)、科学(GPQA-Diamond 65.0分)领域全面领先最佳开源70B模型Deepseek-R1-Distill-Llama-70B;

▪  效率跃迁:仅需5%参数量,性能达原版R1的95%以上,推理成本大幅降低。

技术革新:领域专精+模型融合

研究团队使用「分治-融合」策略:

▪  基于DeepSeek-R1生成海量领域数据,分别训练数学、编程、科学三大垂直模型;

▪  通过Arcee团队Mergekit工具智能融合,突破单一模型性能上限,实现多任务均衡优化。

开源承诺:推动技术普惠

▪  模型仓库:https://huggingface.co/qihoo360/TinyR1-32B-Preview

▪  即将公开完整技术报告、训练代码及部分数据集;  

▪  践行开源精神,助力AI社区共筑高效推理新生态。

研发团队表示:「Tiny-R1-32B-Preview是蒸馏技术的里程碑,未来将持续探索更轻量、更强大的通用模型,推动AI技术普惠化进程。」

360 团队: Lin Sun, Guangxiang Zhao, Xiaoqi Jian, Weihong Lin, Yongfu Zhu, Change Jia, Linglin Zhang, Jinzhu Wu, Sai-er Hu, Xiangzheng Zhang

北大团队: Yuhan Wu, Zihan Jiang, Wenrui Liu, Junting Zhou, Bin Cui, Tong Yang

001.jpg

图片4.jpg

【来源:经济界】凡本网注明“来源:经济界” 的所有作品,版权均属于经济界。如转载,须注明“来源:经济界”。违反上述声明者,本网将追究其相关法律责任。
Previous 2025-02-21 上午11:53
Next 2025-02-25 下午10:26

相关推荐

  • 凝心聚力 开拓新局|山东三聚20万吨/年生物柴油异构项目成功中交

    4月23日上午,北京海新能源科技股份有限公司(以下简称海新能科)旗下山东三聚生物能源有限公司(以下简称山东三聚)举行20万吨/年生物柴油异构项目中交仪式,标志着该项目由建设阶段正式转入试生产阶段,将成为海新能科厚积产业优势,打造生物能源板块高质量发展的新引擎。 在仪式现场,山东省日照市莒县人民政府党组副书记、县经济开发区党工委副书记、管委会主任尹进华,莒县国…

    6小时前
    0
  • 竞域无界——LG电子携 IT产品邀您畅游AWE新竞界

    2025  AWE(中国家电及消费电子博览会),LG 电子带来了一场精彩纷呈的 IT 产品盛宴。此次 LG 展区围绕不同群体的家庭生活方式精心布局,通过智玩空间、智趣之家、乐宠之家和臻享之家等特色展区,全方位展示了其 IT 产品的独特魅力和创新科技。 智玩空间(Immersive Lounge):2.0 版本开启 MZ 圈层的黑科技之旅 智玩空间展区作为去年…

    2025-03-21
    0
  • 联通云盘亮相MWC 2025:融云融智,让存储充满“AI”

    DeepSeek爆火,再度掀起人工智能(AI)热浪。云存储领域,也面临AI推动的深刻变革。 当地时间3月3日至3月6日,2025年世界移动通信大会(MWC,也称“巴展”)在巴塞罗那会展中心举行。全球数百个国家和地区的知名企业、行业领袖将齐聚于此,展示全球最新的数字技术,擘画通信与智能融合发展的新蓝图。中国联通以“聚智·融合·创新”为主题,聚焦全球数字化、网络…

    2025-03-06
    0
  • 深圳回波医疗立足本土化需求 开发FibroScan® Q-PLUS型号肝病检测设备

    在全球肝病负担日益加重的背景下,中国作为肝病高发国家,乙肝、脂肪肝等慢性肝病患者数量庞大。慢性肝病通常是一种沉默的疾病,往往在早期没有明显症状,但一旦疾病进展,它可能会危及生命。在达到肝硬化阶段的患者中,75% 的患者直到经历第一次失代偿事件才被诊断出来1。目前晚期肝病市场痛点显著,诊断上,传统方法难精准评估,肝穿活检又有风险,难以满足基层医疗机构的筛查需求…

    2025-02-25
    0
  • DeepSeek本地部署+谷云科技智能体搭建平台,快速搭建企业知识问答系统

    想必最近大家的朋友圈、短视频平台都被DeepSeek技术刷屏了,教大家如何本地部署DeepSeek搭建本地知识库的经验内容也是数不胜数。但当你的企业兴冲冲想本地化部署时,却发现过程并没有那么简单。 大多数企业本地部署DeepSeek时会选择在linux环境下,借助Docker、Ollama、AnythingLLM等软件来完成部署以及和大模型对话的界面搭建,整…

    2025-02-21
    0