ornith 1.5不行,徒有虚名。今天让它写个测试项目,就是个c socks 5,多次测试过其它ai。结果它写到后来,开始编译之后出错,它居然一个人自言自语了32767 token,达到最大长度了才停下来。其它ai从未有过失败记录。
这么简单的项目都出这种幺蛾子,还tm吹牛说比肩opus 4.8。真的就是个benchmark刷子。
所以说,看大模型的跑分没啥大用。
ornith 1.5不行,徒有虚名。今天让它写个测试项目,就是个c socks 5,多次测试过其它ai。结果它写到后来,开始编译之后出错,它居然一个人自言自语了32767 token,达到最大长度了才停下来。其它ai从未有过失败记录。
这么简单的项目都出这种幺蛾子,还tm吹牛说比肩opus 4.8。真的就是个benchmark刷子。
所以说,看大模型的跑分没啥大用。