V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  blueskeay  ›  全部回复第 4 页 / 共 7 页
回复总数  132
1  2  3  4  5  6  7  
@abbycin 懂了,现在还有出现吗,看了下服务器负载没问题,用的是哪个 endpoint ,频繁出现的话可以联系客服看看咋回事
@miniers
已加
@blueskeay 已加,可以试用一下
@abbycin 啊?这个是啥… 没发现问题呀
@464084838 破案了,又一个缓存刺客,我终于知道我后台那一堆报错哪来的了.... 你看那缓存像过山车一样没觉得不对劲吗



客户端不要传 service_tier 这个参数,透传到 openai 那边会报错然后反复重试报错导致不断切号,你看一下你请求的缓存完全不对劲

"detail": "Unsupported service_tier: auto"

https://i.imgur.com/qKP7Pdz.png

https://i.imgur.com/llLgQj7.png

给你补了 5 块余额... 这个还不是 header 里的我没法在 nginx 上控制,你看一下本地什么设置导致的...
@ctro15547 晚两天加上... 现在模型少,聪明点的其实就 GPT-5.4 和 GPT-5.3-codex 这两种
@Rokaki 感觉不是很对,是 codex 客户端吗,我看了一圈还是 codex 客户端利用缓存是最好的...
@taotaodaddy 差不多符合预期,上下文再长一点缓存受益能拉到 0.8 左右/M
@noming 是 CF 的吗,我自己试了下 CF 是没问题的
@cdwyd 加了
@lifei6671 现在好了吗,我查了一下是远程压缩上下文的 ,但看起来似乎正常了?
现在是 4.5/55M ,看起来是正常的
@liuliuliuliu 暂时不行,过几天可能有
@lifei6671 已加
1.不是网页逆向不会降智
2.首字速度 P80 都在 1 秒以内,并发足够不会排队,api 有个 CN2GIA 的直连优化线路,超时的应该是 free 号池一直切号导致的
@qgswzmz 已加
@imnpc 已加
@MoozLee 累积消耗 1000+税点可以开票
语言模型兜底的情况下有对缓存做什么处理吗
比如上次请求体是 100K ,这次是 110K 只有 10K 的新 token ,这个情况能处理吗
@sosowei
@Rokaki
已加,可以体验一下
@Liaaaaa 加啦
@taotaodaddy 加了,可以体验一下看看
1  2  3  4  5  6  7  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   5439 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 12ms · UTC 08:24 · PVG 16:24 · LAX 01:24 · JFK 04:24
♥ Do have faith in what you're doing.