作者称在一次性前端生成上,Qwen、Kimi等中国模型体验优于西方顶尖模型。
推荐理由:这反映前端代码能力可能受训练数据分布、偏好优化和评测激励影响;但样本来自个人体验,缺少统一任务集,不能直接推出阵营级结论。
阅读原文