← → 翻页 · F 全屏
音联

让每一次表达,
都被温柔理解

一款把「不清的语音」,实时转成大字幕的工具
非商业化 · 开放共享 | 5 分钟路演
开场白

“我只是想说清楚一句话,
可世界总在催我:你能不能快点。

在中国,许多构音障碍人士每天都在经历这种无力。
这不该是常态。
不清的语音 实时大字幕
现场 demo:说话的同时,字幕板实时出字
对面(家属 / 同事 / 医生)更顺畅地理解你
语音识别 文字转写 沟通辅助
三大能力,灵活组合
🖥️

全屏模式一键启动

打开即进入大字幕全屏
投屏 / 会议一键启动 · 不用手动切窗口

即开即用

后端推理

faster-whisper 服务端
3 秒音频 ≈ 0.86 秒返回 · 移动端不卡顿

低时延
🔄

豆包 / 千问 随时切换

内置多模型接口
按场景 / 语种自由切换 · 越用越懂你

多模型
关键数据 · 高精准识别
96%
构音障碍语音的字准确率——不清的语音,也能被准确"听清",
对面(家属 / 同事 / 医生)更顺畅地理解你。
多模型融合纠错 构音专属优化 自训练越用越准 误识自动纠正
踩过的坑,都成了现在的底气
本地 WASM 推理太慢
→ 改用豆包大模型 分担,端侧只做轻量事
离线模型体积太大
→ 做多引擎可切换,按场景按需加载
通用识别不够准
→ 预留自训练接口,接专属模型越用越懂你
一句话总结
→ 把“做不到”,拆成“先做到一点

让每一次表达,
都被温柔理解

技术很小,但理解很大。
扫码现场体验 进群一起共建 看开源仓库

谢谢聆听

让每一次表达,都被温柔理解