V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  ko20  ›  全部回复第 1 页 / 共 38 页
回复总数  757
1  2  3  4  5  6  7  8  9  10 ... 38  
11 小时 27 分钟前
回复了 rafa 创建的主题 生活 干了件蠢事,拿 WD-40 喷了刹车盘
https://i.imgur.com/14cwgsI.png ,想当年我也喷过山地自行车的来令片和刹车盘,还是碟刹自行车,后来一直啸叫,刹车性能也下降了,后来碟片和盘都换掉才得以解决。
1 天前
回复了 Ayanokouji 创建的主题 程序员 mysql 26.7.0 发布了
2126 年看它叫什么版本,不会还叫 26.x 吧 (doge
@andyskaura #5 哈哈哈,精准拿捏中国人性子
@ByteCat #18 就是个语音输入工具的定位的…… 上屏了可能还需要正经输入法修改措辞。
@devcxlcn #19 和我理解的“边听边写边上屏”还是不太一样,你看我这个视频 https://seafile.940304.xyz/f/e0a4b2cc0f324689ac5d/
@devcxlcn #16 但是这个不能边听边写边上屏。
5 天前
回复了 turing518 创建的主题 硬件 兄弟们, wifi7 路由器有推荐的吗?
昨天稍微帮朋友了解了一下,我觉得这款 中兴 BE7200 Pro+ 很均衡。但是不知道是否能刷固件,是否能刷入 openwrt 。不过我建议要么主路由是 ow ,要么旁路由是 ow ,wifi 路由器就用 AP 模式工作,保证稳定到 365 天不用重启(前提散热别太差就行)
5 天前
回复了 turing518 创建的主题 硬件 兄弟们, wifi7 路由器有推荐的吗?
不要为了名头追 wifi7

```
当前"WiFi 7 不如 WiFi 6",主要是这几个原因:

1. 6GHz 频段没开全——WiFi 7 最大卖点就是 6GHz 320MHz 超大带宽,但国内 6GHz 基本没开放,所以国内卖的 WiFi 7 基本等于"阉割版",最核心的优势享受不到,本质还是双频( 2.4G+5G )。
2. MLO 多链路聚合早期不稳定——2.4G/5G 同时连一个终端,很多设备(尤其手机)支持差、甚至会掉速,不少厂商默认关掉。
3. 终端跟不上——你家里手机、电脑大多还是 WiFi 6/5 ,根本用不上 WiFi 7 的新特性,向下兼容跑的其实还是 WiFi 6 的速率。
4. 4K-QAM 收益很小——需要极近的距离和高信号质量才有提升,实用性低。
```
v1.0.1 版本已推送 https://github.com/hellodk34/voice_input_linux

还写了麦克风底噪监测脚本,比如如下输出

==================================================
麦克风底噪检测(推荐 vad_threshold 等配置)
==================================================

开始前请先完成:
1. 打开「系统设置 → 声音 → 输入」,选择你要用的麦克风,
并设为默认输入设备;
2. 对着它正常说话,观察电平条是否跳动,确认能正常收音。

本脚本只检测当前「系统默认」输入设备。
==================================================
设置好了?按回车开始检测( Ctrl+C 取消)

== 检测麦克风 ==
已检测到麦克风设备。

== 测量底噪 ==
接下来录制 3 秒,请保持安静(不要说话、不要敲键盘)。
样本数 48022 (约 3.0 秒)
底噪 RMS : 0.01163 (-38.7 dBFS )
底噪 95 分位 : 0.00589 (-44.6 dBFS )

底噪等级:低(麦克风比较安静干净,日常使用很舒服)
推荐配置(写入 ~/.config/qwen-voice-input/config.ini 的 [general] 段):
vad_threshold = 0.03
batch_silence_timeout = 2.0

说明:以上仅根据底噪自动估算,实际以说话测试为准——
说完仍不结束就把 vad_threshold 调大;小声识别不到就调小。
@zjvbqla #8 实现了,可以看看最新附言,以及那个 video

@EvineDeng #12 朋友可以看看我的最新实现,支持了流式语音识别和上屏,更好用了。
@EvineDeng #12 这个我也安装了,但是之前配置的模型识别效果不太好后来没怎么用了 -_-
@zjvbqla #8

在 linux 下的光标处实现一个字一个字的蹦出来还能退格(比如删除一个逗号)再继续逐字输出还是太困难了。微信各端能做到可能是 IME 直接持有"预编辑区/组合区"( composing region ),可以随时显示文字、增删某个字/逗号、最终一次性"提交"。这大概是它在应用里"流式、可回改、标点合理"的根本原因。

什么时候 wechat for linux 支持了再来研究……https://i.imgur.com/TYtySHv.png
@zjvbqla #8 看了一下还需要改造传输和上屏逻辑,很好的想法。我准备改造看看
@zjvbqla #8 这个更换模型就行,支持 stream 那个
@ca2oh4 #6

查了一下是这样的

> GitHub 上有第三方开源项目( doubao‑murmur 、doubao‑voice‑input‑electron ),不是字节官方产品,只是调用豆包开放接口做的全局语音听写工具,只做语音转文字,没有拼音/双拼键盘输入能力,只能语音输入,不能当完整中文输入法使用
@ktyang #4 也可以再用用这个,哈哈
@enpitsulin #2 谢谢欢迎反馈
效果还是不错的,对于冒号,顿号、文字中夹杂着 APP 、10000 这种字母和数字,识别都还 OK
1  2  3  4  5  6  7  8  9  10 ... 38  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   923 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 21ms · UTC 20:28 · PVG 04:28 · LAX 13:28 · JFK 16:28
♥ Do have faith in what you're doing.