有时候经常能看到关于llm代码质量的讨论。
有时候经常能看到关于llm代码质量的讨论。
不过现在基本已经集中到有没有人类代码的品味/质量这种地方,正确性已经不是问题。
虽然品味这件事情确实能看出来不同,并且从现在正确评价的路线来看短期没什么改善希望
不过对llm说品味本来就很奇怪,因为它与人类并不是同一个“物种”,就和要求长生种理解短命种眼中的时间一样。
最明显的一点,大部分llm都喜欢失败了先加个长超时看看,并且对缓慢的执行时间熟视无睹。
毕竟ai是无时间的,它的时间流动取决于下一个请求,裁剪掉了所有无效等待时间。
并且大部分工具都允许它跳过等待,假如人拥有这种能力,也会丧失对时间的敏感性,与其他人类的“品味“不一样
再者它还是朝生暮死的,不具有人类的社会性与延续性。
这就丢弃了人类代码质量改进中重要的一环,重写。
我们人类可以通过重写/得到奖励
但是对llm角度来说,它重写并没有奖励,反倒是偏离了任务。
并没有一种和人类一样,允许放弃当前任务,回到过去重写之前代码,并从未来获取激励的能力。
而且结束后也不用考虑维护,所谓的维护性的品味对朝生暮死的物种而言没有意义。
