V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  LuoDiNate  ›  全部回复第 1 页 / 共 4 页
回复总数  79
1  2  3  4  
@falsemask 我 tm 的在工位就笑出声了
@chjs 先让和 cc 聊了一个 ui 设计的思路, 然后让他生成了一版 UED 的 demo, 看这个: https://github.com/LuoDi-Nate/financial-management/blob/master/preview/v0.1/index.html

然后项目的 agents.md 里面 要求后续的设计 都参考设计规范和效果,
每次迭代也会先做 ued 的样稿
@MiHwAppleTslFan 笑死 不排除这个可能 2333
@datadump 行家
@huang86041 同意, 其实就应该有一个"个人评测集"的东西
每次切换模型, 或者上了/下了 额外的 pormpt, 都应该有个指标 快速看到好了还是坏了,

如果 llm 越来越强, 那外部的东西就是应该越来越少

https://www.anthropic.com/engineering/harness-design-long-running-apps

opus4.5 自己上下文焦虑严重的一批, agent 的 planner 都是开发者额外开发的,
从 opus4.7 后面的 cc 版本, plan 都是主模型自己做的
这就是随着模型能力越来越强, 外围做的 harness 工程就会一点点被干掉, agents.md 也是一样的逻辑
@Dream4U 哈哈 那也不是, agents.md 也不是只服务于 ui 设计啊...比如你让他做个调研, 这任务和 UI 设计 一点关系都没,
agents.md 是给 agent 定方向, 或者说只是 agent 的开发者 给最终用户能织入 system prompt 的合法 hook
@luckyzd 你倒是可以试试, 我之前的 opus4.6 4.7 阶段 总是突然切换英文给我回复 贼烦, 我把用中文回复直接强制制定了 , 从那以后 再也没出现过

回到你问题上, 从原理上猜测, 如果用英文 确实会更好
@Dream4U 哈哈 这只是 ai 做事的指导原则嘛, 如果你对 ui 设计有自己的间接 可以搞个更好的页面设计 skill
不影响 agnets.md 本身的设计, 你可以在项目级别的 agents.md 里面 增加关于 ui 设计规范 或者引入一些你觉得风格好的设计 skill
@foryou2023 和工作中的迭代完全一样的, 先提意向, 让 cc 出 PRD 和 UX 稿子(html 预览), review 后, 出 TDD, review 后开始自己 coding, 在项目级别的 agents.md 中 做了大量 harness 约束(QAcase, E2E case) , 他自己跑 最后交付 部署, 部署整了个一套 skill, 可以一键发布 beta 和 prod
@molvqingtai 是不是统计口径不一致, 个人版的 codex 那个热力图 把上下行都统计了, 会虚高很多;
我一个 5h 左右的任务 也就 300M, 6B 我干了 3 个月(500+commits, 40 个版本)
@ShaoLongFei 我从 opus4.7 就从 superpower 切换到 ECC 了, 依然很重, 现在 opus5 我已经吧 ECC 也彻底卸了, 就靠自己的 agents.md 来做约束 效果很好, 长达 10h 的任务也随便跑;
@echoZero 一点都不复杂! 真的 非常 chill, 一个月就搞个几分钟就行
@Fallever 就和工作中的迭代完全一样的, 先提意向, 让 cc 出 PRD, review 后, 出 TDD, review 后开始自己 coding, 在项目级别的 agents.md 中 做了大量 harness 约束(QAcase, E2E case) , 他自己跑 最后交付 部署, 部署整了个一套 skill, 可以一键发布 beta 和 prod
@yuefancx111 哈哈哈 有被笑到
@ihainan 这个放项目级比较好 23333, 我平时 cc 还会做一些调研, 论文解读, 乱七八糟的事情 , 所以通用的 agents.md 没有单独的开发/项目约定的事情,

你看这是我项目级别的 agents.md: https://github.com/LuoDi-Nate/financial-management/blob/master/AGENTS.md
@urlk 长期看看是对的, 你看最新版 cc 确实砍了大量 systemprompt,
随着 LLM 本身能力变强, 外围 harness 的东西一层层被拆掉是肯定的;

但是短期内, 有好的约束 就是更好, 但是会逐渐从 superpower/ecc 这种这么重的 逐渐轻量级
直到 LLM 更强
@vmv2er 感觉不同 agent 实现差距还挺大, 我给 codex 上这个 体感不明显 , 但是 cc 就有巨大改善
可能和他们不同的 system prompt 本身织入不同有关
@deplives 期待反馈 23333
@cvooc 你看之前泄漏的 cc 源码, 全局 agents.md 的加载是固定植入的, 所以
1.不用担心 token 消耗 能完美的利用到 kv cahche
2.这个待考证 越靠前的指令, 目前各大 llm 的指令跟随更好

所以我觉得也不算很长, 实践下来很好, 我把 superpower 和 ECC 都彻底干掉了, 就靠两个 agents.md 约束
1  2  3  4  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1194 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 20ms · UTC 23:45 · PVG 07:45 · LAX 16:45 · JFK 19:45
♥ Do have faith in what you're doing.