全程离线的语音输入法

说话,就成了文字

按住说话,松手成文——识别结果直接落在你正在打字的地方。 整场会议也能录成带说话人的逐字稿。识别全程在本机完成。

WINDOWS · MACOS

会议逐字稿 · 14:02

这个版本就定在下周三上线。

说话人 1

收到,我今天把安装包和更新说明准备好。

好,散会后我把逐字稿发到你邮箱。

已粘贴到光标处
0 字节上传
不抢焦点
自动区分说话人
装完即用
01功能

为什么是快说

一个真正安静、离线、不抢焦点的语音工具——整天挂着,想输入的时候直接说。

01

按住即说,落在光标

按住 Ctrl+Shift+Space 说话,松手成文。识别结果走一次真实粘贴,直接落进你正在打字的窗口——微信、飞书、VS Code、浏览器地址栏都行。

02

会议逐字稿

会议模式只记逐字稿,一个字都不会打进你的文档。自动区分说话人,还额外录一路系统声音,把远程会议里对方说的话也补进来。可导出 MD / JSON。

03

全程离线

识别模型跑在本机,音频和文字一个字节都不出这台机器。你的会议内容只属于你自己。

04

声纹过滤

能量和频谱分不出人,声纹向量可以。录 3 段各 3 秒完成注册,之后只有你的声音能驱动输入——电视、视频、旁边同事的声音一律进不来。

05

不抢焦点悬浮条

任务栏正上方常驻一条悬浮条,永不抢走焦点——说话的时候,你原来的窗口始终是前台,识别完自然落回光标处。

06

Webhook 实时推送

边开会边推给你的系统:每识别出一句就在几秒内 POST 到你的接口,带所属项目 ID,不用等散会。会议结束再推一份完整逐字稿。

02工作方式

从说话到落字,五步

没有开始按钮,没有复制粘贴。整个过程发生在你按住快捷键到松手之间。

  1. 按住

    按住 Ctrl+Shift+Space。快按一下则只听一句,说完自动停。

  2. 说话

    悬浮条波形转绿、随声起伏;你原来打字的窗口一直是前台。

  3. 本机识别

    SenseVoice 在这台电脑上把语音变成文字,不经过任何服务器。

  4. 松手落字

    一次真实 Ctrl+V,文字落在光标处。Draft.js、Lexical 这类自己维护文档模型的编辑器也不会乱。

  5. 还回剪贴板

    你之前复制的内容原样放回去——输入法不该顺手吃掉你复制的东西。

03隐私

全程离线,一个字都不上传

语音一旦要过一次服务器,密码、薪资、病历就都过了一次别人的服务器。快说的识别只发生在你的电脑上。

01 说话 麦克风拾音,先过声纹校验:不是你的声音,一律进不来。
02 本机识别 SenseVoice-Small 在这台电脑上运行,音频不出这台机器。
03 文字落盘 每句话在识别出的那一瞬间写入本地文件——崩溃、断电、强杀,最多丢掉正在写的那一行。
0 字节上传 没有账号 · 没有云端 · 没有遥测
04常见问题

你可能想问

需要联网吗?

识别不需要。识别模型(228MB)和声纹模型(27MB)都内置在安装包里,装完即用,首次启动不用等下载。运行时也不把音频或文字发到任何服务器;唯一的外发是你在设置里自己填了 Webhook 地址时,会议逐字稿按句推送到你指定的接口。

支持哪些系统?

目前提供 Windows 和 macOS 安装包,下载区两个按钮都可用。Windows 端额外录系统声音需要 Windows 10 及以上。

识别准吗?

内置 SenseVoice 模型在本机运行,中文日常口述与会议对话都在可用水平;安静环境、贴近麦克风时效果最好。每一句在识别出的瞬间就已落盘,说得再长也不怕丢。

会议怎么区分说话人?

用你注册声纹时的那份向量,给每段话贴上「我 / 说话人1 / 说话人2」标签,可改名,改完同步重写整份稿子。远程会议还会额外录一路系统声音,单独断句、单独分说话人,并且永远不会被标成「我」。

我的数据存在哪?

全部在这台电脑上:逐字稿与输入历史在识别出的瞬间写入本地文件,没有账号、没有云端同步。不想要了,删掉文件(或卸载)就是真的没了。

05下载

装完即用

识别模型与声纹模型都内置在安装包里,不用首次启动等下载。装上,按住,说。

最新版本
检查中