作者认为基于现有模型投入后训练,比从头训练前沿模型更具资本效率。
推荐理由:核心策略是把有限预算从基础预训练转向后训练,用现成底座换取更快的能力定制;但帖子未给出Ember-1方法、成本和评测细节。
阅读原文