v2 好像还好,隔壁 linux.do 的帖子 80%都是在测试模型有没降智
我用了一年除了 sonnet3.x-4.x 突然开始我说 a ,他做 b 以外这种明显的。其他基本没有感觉到啊…忘记做漏做都是自己没说清楚的。给我的感觉就是我要没提他做了是惊喜,没做是我没说清楚。只要把我说了的都稳定快速做完就是好模型。
或许这种所为的脑子不好使就是模型幻觉在 coding 里面的表现?
然后我就想到会不会是都在许愿编程?用的人自己并不清楚正确的是什么结果,或者就是一句话帮我做个登录,帮我搞一下支付,帮我做 xx 功能这样?
我用了一年除了 sonnet3.x-4.x 突然开始我说 a ,他做 b 以外这种明显的。其他基本没有感觉到啊…忘记做漏做都是自己没说清楚的。给我的感觉就是我要没提他做了是惊喜,没做是我没说清楚。只要把我说了的都稳定快速做完就是好模型。
或许这种所为的脑子不好使就是模型幻觉在 coding 里面的表现?
然后我就想到会不会是都在许愿编程?用的人自己并不清楚正确的是什么结果,或者就是一句话帮我做个登录,帮我搞一下支付,帮我做 xx 功能这样?