会不会是因为现在的大模型,基模的提升还远远不如长期精致调整的后训练工程?
有种 5.6-sol 好不容易在长期的进化中变成可靠的大人了,结果被邪恶的研究员硬灌了 APTX 4869 变回小孩的感觉。
会不会是因为现在的大模型,基模的提升还远远不如长期精致调整的后训练工程?
有种 5.6-sol 好不容易在长期的进化中变成可靠的大人了,结果被邪恶的研究员硬灌了 APTX 4869 变回小孩的感觉。
1
charleswh223 15h 26m ago
是的,最开始我还半信半疑,自己用了一段时间之后,gpt 6 sol 确实在指令遵从性和思考能力上都很差。 用 gpt 6 sol high 时思考链经常跑偏,而 gpt 6 sol max 智商还行但是巨慢无比。
最重要的是:gpt 6 sol 在订阅里面的价格不比 gpt 5.6 sol 低多少,因为 gpt 6 在订阅中的缓存费用是 5.6 系列的 2x 。 |
2
HusaYn 15h 12m ago
5.6-sol 6-astra
5.6-terra 6-sol 5.6-luna 6-luna 释然了吧 |
3
beafreey 15h 8m ago
更大的可能是现在的 6sol 就是 terra 后训练出来的,要不然解释不了所谓的成本降低但是能力没提高多少甚至有些还降低了。
|
4
nsjs 13h 34m ago via iPhone
你看定价,6 sol 其实就是 terra 迭代,6 应该不会出 terra 了。 所以原先的 sol 被翻了几倍的价变成了 astra
|
5
Tianqi 12h 2m ago
我也感觉到了,sol 严重缺少常识,会犯很多没有常识的错误,非常逆天
|
6
kairosbladejiuji 12h 0m ago
现在兼顾性价比和智商的档位怎么选择?
|
7
msg7086 11h 52m ago
看看我之前贴的这张图:
https://i.see.you/2026/09/27/V0fr/bug-hunt-bench-score-vs-cost-lig.png |
8
MAVETRICK 11h 48m ago
6sol 已经拉完了,干活不如用 astra low ,相比 opus5.5 也有巨大差距
|
9
chjqpmain 11h 46m ago
我觉得 6sol 还行,智能方面也还凑活,o 家的指令遵循过强,导致 astra 在某些方面也不好,当然目前遵循过强和不过强都不是两全法,是某个角度下的问题解决方式
|
10
hachimen OP @kairosbladejiuji 我现在选择 5.6 sol max
|