sentinelK's recent timeline updates
@kop1989 @kop1989smurf
三转
May 31, 2023
我本将心向明月,奈何明月照沟渠。
May 30, 2023
sentinelK

sentinelK

V2EX member #631792, joined on 2023-05-30 20:41:02 +08:00
Today's activity rank 777
kop1989的三转小号
“马鞍税”,一篇非常有意思的 harness 横比文章
程序员  •  sentinelK  •  6h 59m ago  •  Lastly replied by keakon
8
deepseek-flash 的第三方跑分趣闻
DeepSeek  •  sentinelK  •  6 days ago  •  Lastly replied by sentinelK
3
sentinelK's recent replies
不光是坟帖的问题,v 站有个权重算法,自己回帖、相同账号重复回帖基本不占权重。

看的人越多、越多不同的人回帖,越靠前。
@yh7gdiaYW 可能是跟 claude code 接入 GPT 模型需要代理有关,代理还是有信息损失和额外干扰。

不过这个结果确实有点娱乐效果。太逗了。
@longaiwp 千问系列就明确官方跑分都是 claude code 环境,反正模型结构注定放弃响应速度了,不如提高跑分上限。
@Jerry02 是,所以我认为“租金”这个成本定义不贴切。
@niubilewodev 好奇的就是这个常数,5.71$/秒,其实是可以根据商电(暂定 1 人民币/千瓦时)、卡租金( 5090 4 美金/小时)反推的。大概是等效 5000 张 5090 ,感觉少了点……
决定最终产出倾向和格式的是后训练以及微调。
所以其实理论上讲,只要是开放权重的模型,有硬件,任何人都可以做到楼主说的效果。

但是工程学要讲究性价比。作为一个闭源模型,作恶没必要搞这么复杂。
gpt6 的和 gemini 给的分辨率都不同(看围裙的色块层次就可以)。结合你上面实际截图的可视距离,有没有可能 gemini 给你的方案你根本就看不全?
轻度使用可以。但是实际工作中千万不能这么用,AI 会自作聪明,搞混。

比如两个非常相似的日程,AI 的记忆会串台。
3 days ago
Replied to a topic by Haku 程序员 自部署模型卖 Token 能赚钱吗?
@Haku 简单说就是,对于大模型,使用人数和成本的关系是指数的。

每多加一个人,成本都翻一个次方。直到到一个规模化平台。
3 days ago
Replied to a topic by Haku 程序员 自部署模型卖 Token 能赚钱吗?
@Haku 这不光是配套工具那么简单。

1 、你没有官方的运行环境,所以你的显卡利用率一定不如官方。

2 、你没有配套生态,比如 Minimax H3 是有对应的 designer 工具免费提供的。能通过摆 3D 小人精准控制走台和运镜。还能自动生成分镜和剧本。多媒体模型还要缓存素材、生成结果。minimax H3 官方是 7 天免费存储的,你算算 7 天的巨量缓存成本是多少。

3 、你没有官方的部署经验,官方有海量硬件,所以可以根据推理情况灵活调配负载,你的硬件总数是固定的,所以只有一个甜点。一旦用户负载有波动,你的体验就直线下降。

最终结果就是,你的 pp/tg 比官方慢,缓存命中率低,有时候还要整个 session 重新 prefill ,还比官方贵。

视频模型更惨,排队排到死不说,素材传不上去,传上去了调不出来,还没官方的设计工具……
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   946 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 19ms · UTC 19:23 · PVG 03:23 · LAX 12:23 · JFK 15:23
♥ Do have faith in what you're doing.