我线上产品调的是 deepseek ,平时做开发用 codex ,gpt 额度用完后会拿 deepseek 来顶
所以体感比较明显,大概是从昨天开始,线上突然开始出低级问题,开发用 codex 也是如此甚至一度达到不可用的程度
我线上产品调的是 deepseek ,平时做开发用 codex ,gpt 额度用完后会拿 deepseek 来顶
所以体感比较明显,大概是从昨天开始,线上突然开始出低级问题,开发用 codex 也是如此甚至一度达到不可用的程度
1
greatghoul 9 days ago
我用 OpenCode 接入了 DeepSeek, 目前没感觉到什么问题。
|
2
jinsongzhaocn 9 days ago
长上下文堆积,涉及的问题越来越复杂吧,需要靠压缩和记忆体优化。flash 版本通常是缩小知识量的版本,所以解决有确定方案的问题,日常编码可以;但是探讨方案,解决未知问题,理解复杂逻辑,需要切换到 pro 版本,用更多的知识量更好。codex 至少 5T 的参数,dsv4flahs 不到 1T,知识量就差了一大截。
|
3
yeatmeret 9 days ago
我使用 cc-switch 上面接入官方的 dsv4flash ,感觉价格不便宜干活儿没那么好,我 ds 的话之前用 pro 多一点,ds 涨价感觉他就没什么竞争力了
|
4
airqj 9 days ago
现在花百来块钱买个 glm 丐版 code plan,glm 5.3 flash 免费蹬
白天安排好工作让 zcode 晚上再跑。 说实话这阵子找不到用 deepseek v4 flash 理由 |
6
yidinghe PRO 大模型出问题都是概率性的,不出问题不表示没有降智,出问题不表示一定降智。
|
7
chongzi OP @greatghoul 也是用的 v4-flash 吗?
|
8
chongzi OP @jinsongzhaocn 我用的 skill 和文档较多,确实上下文会长,但是之前一直都顺利,就是从前天开始的,体感很明显
|
13
greatghoul 9 days ago
@chongzi 嗯,是的,v4 flash. api 总结文章和 coding 都用的这个。
|
14
chemzqm 9 days ago
> 用的 skill 和文档较多
大概率导致模型降智 |
15
everyx 9 days ago
同一会话,混用不同模型也会有问题
|
17
yidinghe PRO @chongzi 高可用不是你这么理解的,前几天一堆的大模型出故障,这个就是高可用的问题。我的意思是,不管什么大模型,都会有一些特定的场景,触发它的表现得降智的行为,这并不是模型本身被换了。
|
19
jinsongzhaocn 9 days ago
DeepSWE v1.1 智能编程/软件工程智能体基准
Kimi K3:67.5% GLM-5.3-Flash:63.4% Qwen3.8-Flash-Next:58.7% DeepSeek-V4-Flash-0731:54.4% (分数基本等于本地部署 Qwen3.8-Flash-Next Q4 量化版本) |
20
ajaxfunction 9 days ago
光说前端代码,glm 明显强于 dp v4 flash 和 pro 。
|
24
yidinghe PRO @chongzi 闭源大模型厂商会自动在简单任务时切换到较弱模型,但这是能保证任务完成的,而且你没办法阻止。大模型表现下降,主要是两个原因,一是环境恶劣,动不动就命令报错,就乱码,模型本来就走的磕磕碰碰;二是 U 型注意力机制问题,上下文一长就会忽略中间内容。刚学会用 AI 的程序员往往注意不到这两个问题。其实只要解决这两个问题,模型就会表现得很稳定。
|