研究以端到端专利撰写测试台检验LLM裁判,并发现裁判反馈可持续改善其评分。
推荐理由:裁判引导的迭代在多种发明和智能体配置下均提升评分,而无引导修改趋于饱和;但结果主要证明对裁判偏好的优化,尚不能等同于专利质量真实提高。
阅读原文