我在用 Mimo Desktop 了,用下来之后的感受是:
模型决定一切。
现在真正的差异不在于 Harness 这一层,而是模型聪不聪明。Harness 层解决的是可靠性、一致性、安全边界这些问题,但各家的 Harness 也越来越趋同化设计了。
随便找一个,花点心思,还是可以确认产出稳定符合预期的,但是一个聪明的模型,可以从本质上抹平智力差距。
模型能力是根本性的差异因素,一个聪明很多的模型,即使用很粗糙的 prompt 也能拿到不错的结果。
别对比了,有条件的还是上 GPT 吧...
但是没条件的,国内模型挑自己喜欢的,找一个靠谱的 Desktop 应用就行,Harness 的价值在"编排",又回到本质问题了。
Mimo 新版本模型用起来进步极其明显,推理效率很高...
让我选,还是一样的,Codex>Mimo Desktop>Workbuddy>Qcoder Zcode 豆包 Trae...上限是 Codex,下限是 Workbuddy,就这样
