
32B击败DeepSeek-R1,成本暴降100倍!GRPO让小模型称霸推理
32B小模型在超硬核「时间线索」推理谜题中,一举击败了o1、o3-mini、DeepSeek-R1,核心秘密武器…

32B小模型在超硬核「时间线索」推理谜题中,一举击败了o1、o3-mini、DeepSeek-R1,核心秘密武器…

播放 00:00 / 00:00 直播 点击按住可拖动视频

离了个大谱,Manus全网邀请码一票难求?激动人心的是,开源界凌晨来了一场核爆攻击,用3小时代…

诺奖级AI极大概率会在2026年降临!Anthropic向白宫提出可行的六大建议,从政策层面呼吁美国加速…

3月6日,声网在京举办了主题为“AI开口,互动无界”的产品发布会,正式发布了全球首个对话式AI引…

智源联手多所顶尖高校发布的多模态向量模型BGE-VL,重塑了AI检索领域的游戏规则。它凭借独创的M…

仅用32B,就击败o1-mini追平671B满血版DeepSeek-R1!阿里深夜重磅发布的QwQ-32B,再次让全球开…

刚刚,OpenAI被爆三类智能体定价!价格从每月2k美元到20k美元不等,用于自动化编码和博士级别的…

强化学习之父Richard Sutton和他的导师Andrew Barto,获得了2024年图灵奖。有人说,图灵奖终于…

美国《芯片法案》突遭变故!特朗普呼吁废除这项520亿美元的法案,认为是在「浪费钱」。他主张用…