作者质疑大模型编排、小模型执行模式在延迟和阅读成本后的真实性价比。
推荐理由:问题抓住多模型Agent工程的核心成本:编排器仍需消化worker输出,局部推理节省可能被往返延迟和上下文汇总吞掉,适合推动实测基准。
阅读原文