单卡3090上的三周自主CUDA实验
Qwen 27B经约21天代理循环写出可运行CUDA推理内核,但性能未超过llama.cpp。
推荐理由:约12次人工干预即可让本地27B模型完成复杂系统原型,说明长程编码代理已有实用自主性;但83小时耗于上下文压缩,性能优化仍是明显短板。
Qwen 27B经约21天代理循环写出可运行CUDA推理内核,但性能未超过llama.cpp。
推荐理由:约12次人工干预即可让本地27B模型完成复杂系统原型,说明长程编码代理已有实用自主性;但83小时耗于上下文压缩,性能优化仍是明显短板。