V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  jybox  ›  全部回复第 1 页 / 共 68 页
回复总数  1345
1  2  3  4  5  6  7  8  9  10 ... 68  
❮ ❯
更可能的情况下是一个资深程序员(或者你说项目负责人也行,毕竟不需要实际写代码了),控制大量的 AI Agent 来完成工作。而不是多个初级程序员或者你说的普通人 —— 人多了想法更不好统一、更不好管理、质量更不好控制,人力成本也不见得低。
我最近做了一个 AI 视频剪辑的完整 Agent
https://github.com/jysperm/Montai

采用的方式主要是先完整分析一个视频( 1 fps ),形成分时间段的文字描述(例如 1:20 - 1:35 蓝色球衣的队伍经过三次传球后进球)保存下来。后续剪辑时 Agent 在基于这个描述调用工具,把关心的视频片段加入上下文(这时 agent 可以在 1 - 5 之间选择 fps )。

估计这个就和 Agentic Process 背后的实现差不多,Gemini 效果比较好主要是它有原生的视频支持,可以基于时间戳对视频进行描述不容易出错。至于 token 爆炸我觉得不是这个方案解决的关键点,因为其实视频输入的 token 用量并不大,一帧只要 300 token 左右,除非是看监控视频这种极其冗长的,否则我觉得读视频的 token 量并不是很夸张。
16 天前
回复了 1300296933 创建的主题 › 职场话题 › 入职一个月,带教真窒息
@seeu2ex 公司安排的事情都是工作的一部分呀,而不是说没有补贴、没有 PKI 、效果不好评估、领导看不到的事情就「不是自己的责任」了。
16 天前
回复了 1300296933 创建的主题 › 职场话题 › 入职一个月,带教真窒息
@wgbx 带教肯定是公司安排的,这些是她份内工作,从楼主描述来说她确实做得比较差。
22 天前
回复了 lixintcwdsg 创建的主题 › 投资 › 老登真诚给点儿投资建议
如果你真的认为是赌博的话,那根本就不应该投。
你这样主要是不方便收费呀,如果是从你的合约中转一下(同一个交易里发给商户,不托管资金),就能直接自动收手续费了。当然对用户来说主要是多了一个预授权的步骤,稍微麻烦一点。

(我用这个思路做了一个链上订阅的收款服务 https://tokensubs.io )
8 月 14 日
回复了 fallshuang 创建的主题 › 职场话题 › 如何出 ai 时代的软件面试题目?
如果是从头用 AI 做一个题目,感觉很难评估 —— 每个人用 AI 的习惯都不一样,都觉得自己的是最好的,但其实很难比较。

我有个想法是给面试者一个「运行了一半的 Session 」,面试者可以查看之前的聊天记录和 AI 写的代码,然后继续完成这个项目或解决中间的遇到的问题,这样更能考察面试者使用 AI 的能力,包括应对自己不熟悉的情况的能力。当然这个「题目」设计可能就要花一些功夫了。
我也是那种会准备得非常充分的(尤其在出行和电子产品相关的),但我有时候就想自己准备这么多真的有必要么,很多时候比如电量这些容错空间其实非常大,没有解决不了的事情,而且也花不了几个钱。
8 月 12 日
回复了 Gomoku2024 创建的主题 › 问与答 › github 新仓库你如何定义版本?
按照 SemVer 1.0 之前( 0.x )表示可以随便改 API ,对兼容性没有承诺。

我觉得这是一个非常好的区分点,即 1.0 是对于 API 稳定性的一个承诺,如果还会频繁地做不兼容改动就不要升到 1.0 ;反过来如果已经有大量用户依赖,实际上已经需要考虑兼容性了,那么也应该升到 1.0 而不是继续 0.x 。
8 月 12 日
回复了 Yesr00 创建的主题 › MacBook Pro › 你们的 MBP 套壳么?
MacBook 金属材质,贴纸回头不要了直接用那种残胶去除剂可以处理得非常干净(我之前也换过贴纸,没什么问题的)
8 月 11 日
回复了 Rrrrrr 创建的主题 › 程序员 › AI 现在智力的上限
@sentinelK 智力即压缩。同样全世界的信息,模型体积越小说明智力越高。当然实际情况是模型并没有掌握同样的全世界的信息,但总归还是可以用压缩比来度量智力的。
@galenzhao 债务是存在于人和人之间的,对于每一笔来说就是付款人和参与者之间,所以截图上我欠每个人的金额才会不一样。
虽然网上舆论如此,但你可以自己搜一下,目前没有任何一个去泰国正常旅游的中国被绑到园区,一个都没有。
你说的两种模式好像也没冲突呀?现在各家都是介于两者之间的混合机制。

你说的「定时整合用户的对话数据利用大语言模型分析」现在有个时髦的说法叫「做梦」,就和人每天睡觉一样,定时整理记忆。
做了个对比苹果芯片的网站 https://mmac.hinas.io/#chips
我本来以为 M1 应该是很多年前的东西了,但实际上最新的 M5 的跑分也只是 M1 的 177% 而已。
5 月 4 日
回复了 CNN 创建的主题 › DJI › 大疆 Pocket 4 好难抢,是饥饿营销还是真缺货?
说饥饿营销的不看看 Pocket 3 销量有多少?

话说回来饥饿营销和真缺货其实没什么本质区别 —— 都是生产线建少了,可能是因为低估销量,也可能只是想少花点钱。
@yuewolf 实际上有两个环节:
- 视频内容分析(从视频生成内容摘要),Flash 或 Lite 都可以,价格其实也只是差了一倍而已,所以直接用 Flash 了
- 视频剪辑(编辑时间线),这个就需要模型有比较好的注意力管理和工具调用能力,至少需要 Flash ,要效果更好就需要 Pro


@dassh 很正常,因为本来就是随手拍拍,更多还是自己留个回忆,然后把几十 G 的原始视频删掉。
3 月 31 日
回复了 qwzhang01 创建的主题 › 程序员 › Agent 应该怎么设计才有价值呢?
提供符合 LLM 直觉的工具给它用,不要在流程上加太多限制,让 LLM 自己决定,精简提示词长度,这样才能直接受益于模型本身的智力提升。
3 月 31 日
回复了 jybox 创建的主题 › 分享创造 › 在 Obsidian 里实现类似 Notion 的 Database 体验
@hi909 目前是通过一种 Note 类型支持链接到其他的笔记,但更复杂的关联关系就没有了。

其实我发出来之前觉得自己这个做得还不错,但实际上大家虽然都喜欢 Notion Database ,但每个人用到的功能点还挺不一样的。
3 月 30 日
回复了 jybox 创建的主题 › 分享创造 › 在 Obsidian 里实现类似 Notion 的 Database 体验
@aero99 这两个功能目前还没有
@vopsoft 本地纯文本意味着你可以直接用各种 Coding Agent (如 Claude Code )来操作里面的数据了
1  2  3  4  5  6  7  8  9  10 ... 68  
❮ ❯
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   877 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 39ms · UTC 22:19 · PVG 06:19 · LAX 15:19 · JFK 18:19
♥ Do have faith in what you're doing.