打个比方,要开发一个 codex 类似的 agent ,只是这样告诉大模型,哪个大模型出方案比较强,比较合理
1
Ayanokouji OP 也可以其他产品,大概意思是,从 0 到 1 开发一个产品
|
2
xidaduo 13h 35m ago
Fable 5 ,然后多模型互相攻击审计才是合理的。我自己搞了一套 solo-ship 的全流程,不过完整版的没有更新到 GitHub 上去,因为不太通用。
|
3
Ayanokouji OP @xidaduo Fable 5 还没体验过,gpt 5.6 和 claude 4.x 从 0 到 1 还是差点意思,不过执行任务已经很好了
|
4
CuteGirl 13h 15m ago
Fable 5 吧 使用过后在用其他的模型感觉就差点意思
|
5
Sundayz 13h 11m ago
我觉得现在头部几个大模型已经感觉不到区别了
|
6
fe619742721 13h 8m ago
头部模型都差不多,最终效果还是取决于人对这个产品的理解和认知,以及对架构设计的知识储备
|
7
cellsyx 9h 24m ago
个人感觉是 Fable 5 。GPT 出的方案我觉得不适合原型验证阶段,有太多项目开发初期不必要的防御性编程和过度设计了,看着很累。
你给出使用场景和具体需求以及参考项目,Fable 5 产出的方案通常会比 GPT 精简很多。Fable 5 的缺点是有时候会过度自信,要花两条甚至更多指令去纠正它的想法。Fable 5 出方案挺不错,但具体代码实现还是可以让 GPT review 一遍,一定程度上防止低级错误。 |