Salesforce用智能体配置训练企业模型
Koa基于Nemotron开放权重,将Agent Script扩展为多轮任务并以GRPO训练。
推荐理由:核心是把Agent Script配置自动扩展为多轮任务,再以工具调用结果作奖励进行GRPO训练;增益虽有限但稳定,说明企业流程可直接沉淀为专用智能体能力。
Koa基于Nemotron开放权重,将Agent Script扩展为多轮任务并以GRPO训练。
推荐理由:核心是把Agent Script配置自动扩展为多轮任务,再以工具调用结果作奖励进行GRPO训练;增益虽有限但稳定,说明企业流程可直接沉淀为专用智能体能力。