
近期几个Frontier Models都很给力,实测下来几个Models都能承担日常任务。我目前持有的Subscription plans如下:
- Claude Codex Max (20x)
- ChatGPT Pro 20x
- Kimi Allegretto
实际常用的Models及effort为:
- Fable 5 xHigh
- Opus 5 xHigh (or as subagent decide by Fable 5)
- Codex 5.6 Sol Max
- Kimi K3 Max
基于上述额度,我的主观体感如下:
- Fable 5 xHigh: 依然最强(即使它已经被削弱了),无论是讨论需求还是实际执行,它在xHigh的effort下既能oneshot出可用的产出,也能指导更次一级的subagent做出不错的结果。
- Opus 5 xHigh: 比Opus 4.8 xHigh要好,可以用来作为Fable的subagent做出不错的执行。但是它用来讨论需求和单独实现不太靠谱,仍然需要多次back and forth才能输出我要的结果,而Fable 5往往一次就能解决问题。所以目前我把它作为Fable 5的小弟来用,可以参考这里的做法。
- Codex 5.6 Sol Max: 比Opus 5 xHigh要好,但没有Fable 5 xHigh那么强,它介于中间。但是它好处是非常经用。尤其是最近Codex不断reset,根本用不完。我这个月已经把coding plan cost (按API单价换算)冲上$14k了,而它还在reset,完全冲不完。所以当Fable 5被我用完了之后我基本上就用Codex 5.6顶上就足够了。
- Kimi K3 Max: 这个model是有点意外的,它的智商不错,虽然没有Fable 5那么聪明,但是可以跟Codex 5.6 Sol Max一比。所以在Claude与Codex都触发limit之后我会用K3来顶上。另外它还有个好处是它少了很多莫名其妙的限制(dddd)。但是,它的Kimi Code不如前两家好用,并且最致命的是它算力不够,5hr limit很快就触发,长任务没跑多久就无了。(当然我用的不是最高档订阅,但群友用了,也表示很快就用完了)所以K3不能作为日常长任务使用。用来做一些短任务还是很不错的。
综上所述,基于我持有的Plans的来说,我目前的主观优先级是:
- Fable 5 xHigh + Opus 5 subagent
- Codex 5.6 Sol Max
- Kimi K3
这三个都不错,我一般会三个同时跑不同的项目。Fable最好用于All in最重要的项目,因为单项目的卡点其实在人,所以消耗不会特别快,目前20x的weekly limit 50%足够。Codex 5.6 Sol Max基本万能而且很耐用,基本啥都能干,虽然不如5.5耐用但也比剩下两家好多了。Kimi K3智商不错但算力不行,要等官方未来升级。
如果说Codex 5.6的追及还在预期之中,那么Kimi K3的出现确实令人意外。这样看来,在Coding领域Anthropic一家独领风骚的时代就快过去了,希望早日看到百家争鸣的时代出现。