论文Agent 与开发者精选13:08一种新方法让大语言模型训练提速 37%,减少 34% 训练时间朋友A对朋友B说:刚看到个挺有意思的论文,叫MoARa,是DeepSeek团队搞的,专门针对大语言模型训练优化,能让训练速度提升37%,时间缩短34%,挺实用的。#MoARa#低秩预训练#大语言模型#训练优化aarXiv: DeepSeek@Keunyoung Kim, Nojun Kwak原文稍后读已读值得跟进有用关注 MoARa