V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  zephyru  ›  全部回复第 1 页 / 共 18 页
回复总数  352
1  2  3  4  5  6  7  8  9  10 ... 18  
首先无意冒犯....我感觉 OP 的对话一股 AI 味,不知道是 AI 用太多了,还是在借助 AI 发帖。
其次,我实际上也在折腾这些东西,我的经验是不同的 LLM ,markdown 记忆的写法和用法都有些似是而非。
主要在于文字其实是有损传输,而你认为最关键的而不是噪音的部分实际上很难清晰的分离出来。
原始 session 就更不用说了,这部分完全取决于搜索的命中率。
我的方案是不纠结于记忆,只专注于技能。
比如某个项目,项目有一个自述文档库,按理说需要记录的记忆都放在文档库里。
配合一个专门的 skills 维护,skills 本身是一个路由只负责找不同的主题都放在哪里,以及全局的状态。
然后根据需要组织参考文件,脚本,诸如此类的,Agent 工具自己的记忆基本是自动的,但这个技能的自更新和文档的维护则是开发完一个阶段后手动去维护(让 Agent 去提炼)。
然后有记忆的 Agent 让没有记忆的 Agent 基于文档和技能去自述理解,核对没问题就认为没问题(基于常见的开发场景,这个过程也同时暴露给人审核)。
6 月 27 日
回复了 Seddas 创建的主题 Claude Claude vs Codex vs Gemini
mimo 个人感觉跑 agent 任务效果还行。
minimax 是真的拉完了。
两家都是量给的很足,不过写代码确实不如 deepseek 。
kimi 能力好但是订阅给的量少(不知道现在有没有改善)。
glm C 端则是又慢又买不到。
Claude 结合 Claude Code 的干活体验现在确实还是最好的。
开箱即用,整合度高,现成的 harness 或者基于 Claude Code 提供的能力去搭自己想要的 harness 体验都会好很多。 主要人精力有限,虽然知道各家都有自己的客户端同时这些客户端都对自己家的模型有优化,但确实是没有动力去装一大堆。
看了头几个层回复我还在怀疑我是和 AI 交流太多了么..
后面才发现我的感性还是没出问题的。
不过排除掉文风问题,内容也还是有意思的,感觉大家走过的路程都差不多,现在一线业务开发估计也不怎么看代码了逻辑没问题,会审查 claude 都能给你推进的七七七八八。
不过就是还是要时常的去重构,AI 代码虽然能跑,但可维护性真的很差,但只要你能指出来,它又能给你整的很好,就比较矛盾。
我自己写玩具项目就 claude ,指挥者国产模型干活,效果也说的过去,我自己确实是变懒了。
6 月 6 日
回复了 Hermitist 创建的主题 Codex 你们遇到过 codex 突然提示无法使用本地的 zsh
沙盒机制吧,因为在沙盒里很多东西都要各种折腾才能推动,所以额度下降的很快
5 月 31 日
回复了 duanshiwen 创建的主题 程序员 AI 编程时代, MVP 思维已经失效了?
我感觉首先要区分什么是业务需求,什么是技术需求,对于业务需求确实还是 MVP 思维,总结来说 OP 的意思是技术需求先一步到位设计好最终架构前期慢后期快,这很传统,对于这方面的想法我部分赞同,问题是技术架构是基于具体的业务场景去做的,很难一次性覆盖所有场景(有些业务需求变更是自相矛盾的),而业务需求往往是多变的,说到底现在为了保障生产不太可能去人肉 review 所有的 AI 代码,现在软件甚至可以做到日抛,等用 MVP 验证完业务方的想法一切都相对稳定了,再基于这种架构思维去构建 harness 工程,来搞软件的黑灯工厂可能是更理想的道路。
需要数据库和云端么?需要考虑多用户么?你自己知道这方面基本的组织方式么?你能出详尽的需求文档么?这些都能解决我感觉是够的(不考虑多用户,能查出来就算成功)你如果直接对标东方财富的完整功能我感觉玄
4 月 28 日
回复了 my2492 创建的主题 OpenAI 为啥感觉 gpt 比国产模型便宜多了,是错觉吗?
@my2492 我都买过了,glm 性能不错,但是 C 端用户高峰期非常的慢(对我来说几乎不可用,这是过年那会,不知道现在怎么样了),非最高一档的额度也是一般般,kimi 我买过 49 元档( 9.9 试用,半个小时跑完一周额度非常幽默),minimax 量确实很多( 49 元档,主要是有很多增值服务,搜索,生图,生语音,音乐,视频,功能比不上第一梯队,但确实有功能,适合做一些原型验证),但这个量是建立在它不太聪明上的,适合做执行,不适合做判断,幻觉确实是个问题,挺明显的,不过也凑合用,差不多去年 5 月份的 sonnet 3.5 水平吧,然后我又买了小米的( mimo )( 99 元档)号称 2 亿 token ,实际上用的比较快(和 mimimax 同工作流),但确实干活会更好一些,尤其是搭建流程和对幻觉的处理上明显比 minimax 好非常多( minimax 自己搭工作流比较起来可以说很难说能用,当然都比不上 gtp 5.4 ),所以我现在的方案是用 gtp5.4 和 mimo 做流程和需要判断的工作,然后用 minimax 做边界清晰的执行活(脚本调用,文章摘要总结,初步的分析,诸如此类的)
4 月 23 日
回复了 my2492 创建的主题 OpenAI 为啥感觉 gpt 比国产模型便宜多了,是错觉吗?
估计再说 kimi 吧,kimi 的订阅收费确实挺幽默的,几乎就是付费体验
1 月 26 日
回复了 swananan 创建的主题 程序员 程序员的自我修养:如何用好 GDB
虽然我没接触过这些,只能从逻辑上去理解,不过确实感觉写的不错
2025 年 12 月 29 日
回复了 asche910 创建的主题 生活 2025 年大家的 flag 是什么?
我前两天刚在 B 站投了我今年练了一年演奏的结果(虽然没人看),本来只感觉是自己突然想的就开始了,看来这个帖子确实也起到了一些作用,感觉还是挺好的
2025 年 12 月 29 日
回复了 asche910 创建的主题 生活 2025 年大家的 flag 是什么?
@asche910


天呐,我都忘掉这个了,专门回去看了眼,#139

1.作息好一天坏三天或者好三天坏三天,整体入睡时间在 12:00-12:30 之间
相对去年早 30 分钟,总睡眠时间长了 10 分钟,这个视角看有一些好的变化,但不能算成功
2.今年还没体检说不上来,只说减肥,减了 8kg ,至少还需要减 8 ~ 16kg 才能达到目标
3.这个算是完成了,花了一年去练月光一,至少是能演奏下来了
4.看了 6 本,碎片娱乐的占比体感是变得不碎片了(集合在一个特定的时间段)
5.达成了,今年拿了很久的债基,算是判断失误,但大盘涨的飞起,感觉应该追求更高的收益

总结来说,大都没有完美的达成,也有自己年初计划并不清晰的缘故,但相对去年可以感觉到明显的变化,感受上还可以,但怎么说呢,处在一种游刃有余又有些累的中间态吧
2025 年 12 月 23 日
回复了 8675bc86 创建的主题 程序员 AI 是不是基本杀死了 blog
看你的目的是什么吧,我觉得还是有些不一样的,我也是高强度 AI 问答,不管哪方面(技术/生活/情绪梳理)去问 AI 或者写博客都可以做到,问 AI 得到的反馈和交互可能还更好。
我感觉核心的区别还是在于,问 AI 是输出输入并存,但写博客(或者说写作)是相对纯粹的输出,一个是上课讨论,一个是实践输出,套用一句老话:“纸上得来终觉浅,绝知此事要躬行”,与 AI 的讨论有的时候需要用自己的语言梳出才能真正的内化。
2025 年 12 月 22 日
回复了 xujdan 创建的主题 生活 真不知道我妈在想什么
就这题干,哪怕是真的不理解,被骂的真的不冤...
控制欲是控制欲,关心是关心,关系一般是关系一般,不识好歹是不识好歹,都需要分开。
真正关系一般的人反而不会反复去问,因为关系一般,真的要回答你这个问题,纯粹是,你家人对你的爱比你对它们多罢了,哪怕这个爱在你看来不是爱。
2025 年 12 月 14 日
回复了 unt 创建的主题 Cursor 请问各位大佬 cursor 是怎么计费的
cursor 这个计费是很迷惑,20 刀指定模型的话,基本几天就用完了,但用完了其实也不会断,我按它那个表格统计的消耗差不多到 60 刀才提示我限额了。然后引导我用 composer 01 ,这个目前可以在没有额度的情况下指定(但你有额度的时候这个也会计费,估计是快速和慢速模式的区别),当前是这样的,不知道后面会怎么样。
OP 在这上网,我也就默认你多少是 IT 相关的从业者
你直接把你两个帖子以及下面的回复,丢给 AI 我想都能得到一个非常清晰明确理性的分析
你把你的人生(家庭,情感,财产)寄托于别人的“良心”和“爱”(前提是真的有),这不是不行,只需要接受这样的代价,到时候不要说大家都嘲讽你。


不要幻想“还了这次就好了”
不要幻想“老婆会醒悟”

按你目前的思路走下去无非就是:钱没了,房没买,背一身债,最后被一脚踢开,还不会有任何人同情。
这是最现实的。
想用这种方式还原,必须设计稿符合编码规范,不然就像你说的没一个一样的,还不一定有截图还原效果好。
2025 年 11 月 20 日
回复了 colincat 创建的主题 职场话题 各大互联网公司使用 AI 编程情况调查
公司报销 Cursor + Copilot 目前来看做开发的至少都开了 Cursor.
就我自己的体感来说,使用应该都在用,重度至少也有三成吧,偶尔会听到基本额度不够的说法,我自己也把基础额度用完过,公司在 Cursor Pro 的基础上额外有给了一些额度。
我是做前端的
首先排除测试,这个基本没什么发展的方向,高端岗位....自动化测试?测试开发?个人感觉不是很乐观

其次 IOS 和前端通常会并在一个部分( UED )岗位方面当前前端会多一些
但高端方向少,地图,webgl ,这一类的有一定的难度,但市场上的需求不多(不过相对测试至少我个人见过一些)

Python 语言处理和游戏,这两个方向我没有接触过
前端当前和 AI (大语言模型)有关的大部分是业务开发(基于大模型的业务)做业务的话用通常用不到这一层的知识(当然了解的话做业务会顺利很多)高端的需求也有,不过也少,大部分人可能并不知道边界在哪

嵌入式开发,在我的印象中是 C++以及和硬件打交道的代码部分,同样是业务开发,不过相对前端来说要更稳定一些?这块结合上前端有的时候就可以做一些小产品(硬件+小程序面板)可能会比较容易有积累

个人感觉,开发分两个方向
基础部分(比如大语言模型,各种基建,脚手架)以及业务部分。
业务部分的岗位压倒性的多,但相对应的不会那么有意思。
基础部分会难但由于需要业务部分来转换价值,实际上很多基础部分的活并没有真正可以转换的产出(业务部分也有这个现象,不过比例上会好一些)

个人感受,供参考吧
写的很好,我也写过这种类型的总结不过,相比 OP 写的还是没有那么深度。
CLI 工具出的时候我也关注到了,但看起来好像和 Agent 工具没有什么本质区别。
然后一直把 IDE 中的 Agent 工具,当 ClI 工具用,效果也还不错,可能是搞得东西复杂度不高吧。
看来是时候试一试 CLi 工具,体验一下区别在哪了。
1  2  3  4  5  6  7  8  9  10 ... 18  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2799 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 31ms · UTC 15:22 · PVG 23:22 · LAX 08:22 · JFK 11:22
♥ Do have faith in what you're doing.