Distributions
Ubuntu
Fedora
CentOS
中文资源站
网易开源镜像站
ko20
V2EX  ›  Linux

借助语音大模型,实现 Linux 下的语音输入,邀请 Linux 桌面用户试试

  •  
  •   ko20 · 5h 17m ago · 372 views

    起因是昨天下午看到 IT 之家这个新闻:

    识别、合成、实时交互全球第一,Qwen-Audio-3.0 系列语音模型上线阿里千问 AI 平台 https://www.ithome.com/0/990/679.htm

    于是我搞了一套适用于大部分 linux 发行版和桌面环境的流程。平台送了 36000s (有效期 3 个月),到期后的话,我看了一下价格是每秒 0.00022 元

    代码开源在 这里

    截图如下,邀请用 linux 桌面的朋友们来试试。有用的话留个⭐呀。这套 flow 个人感觉在 linux 桌面环境很轻量,以后更换模型也很简单,稍微适配一下就可以了。

    demo.webp

    5 replies    2026-08-18 19:54:21 +08:00
    ko20
        1
    ko20  
    OP
       5h 15m ago
    效果还是不错的,对于冒号,顿号、文字中夹杂着 APP 、10000 这种字母和数字,识别都还 OK
    enpitsulin
        2
    enpitsulin  
       4h 58m ago
    回去试试好不好使
    ko20
        3
    ko20  
    OP
       4h 38m ago
    @enpitsulin #2 谢谢欢迎反馈
    ktyang
        4
    ktyang  
       1h 57m ago
    唉 可惜你搞出来的有点晚了 已经用别的产品了
    ko20
        5
    ko20  
    OP
       1h 21m ago
    @ktyang #4 也可以再用用这个,哈哈
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   3205 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 43ms · UTC 13:15 · PVG 21:15 · LAX 06:15 · JFK 09:15
    ♥ Do have faith in what you're doing.