
下周一,两年一度的美国超级计算大会即将开幕。
在此次大会开幕前夕,IBM与美国能源部周五达成一项价值为3.25亿美元合作协议:未来IBM将为美政府机构制造两款名为“Sierra”和“Summit”的超级计算机。
据悉,IBM所制造的“Sierra”和“Summit”超级计算机,将采用新的超级计算方法,同时搭载Nvidia公司处理加速器,并运行于Mellanox公司提供的高速网络。
美国超级计算大会所关注的高端系统,占地十分庞大——有些系统占地跟篮球场大小一样,这些设备通常被美国政府机构用于汽车空气动力学研究,检测飞机设计机构弱点,以及预测新药物性能等等。
据悉,由IBM制造的这两台巨型计算机,一台将用于民用领域,部署在田纳西州的橡树岭国家实验室;另一台则用于国家核武器模式测试,部署在加州劳伦斯利弗莫尔国家实验室。Nvidia估测,如果这些设备的计算工作量由人工操作,需要300万人同时在笔记本电脑使展开。
好文章,需要你的鼓励
论文提出CAST框架,通过多智能体系统把任务成败的粗略反馈转化为逐步动作的详细批评理由,训练出更懂节制的批评模型,再用它优化执行策略,让8B小模型在可靠性指标上反超120B大模型,提升智能体在真实动态环境中的稳定表现。
论文提出NavMCP框架,用意图、观察、记忆三条通道把VLM推理与导航基础模型NFM结合,解决具身问答中长距离探索问题,在多个基准和真实机器狗测试中均取得最优效果。
研究发现教师模型批改学生生成内容时噪声率高达50%,但学生依然能进步。作者发现真正起作用的是压制学生自己低概率词,据此提出无需外部监督的OPSA方法,在AIME24等数学测试上带来最高307%的提升。
PaperGym提出一套把科研论文转化为AI训练环境的方法,解决科研计划生成缺乏可验证奖励的难题,通过问题答案分离降低评分标准泄露,结合自蒸馏与强化学习两阶段训练,让小模型在多个基准上超越更大规模的商业模型。