为什么是快说
一个真正安静、离线、不抢焦点的语音工具——整天挂着,想输入的时候直接说。
按住即说,落在光标
按住 Ctrl+Shift+Space 说话,松手成文。识别结果走一次真实粘贴,直接落进你正在打字的窗口——微信、飞书、VS Code、浏览器地址栏都行。
会议逐字稿
会议模式只记逐字稿,一个字都不会打进你的文档。自动区分说话人,还额外录一路系统声音,把远程会议里对方说的话也补进来。可导出 MD / JSON。
全程离线
识别模型跑在本机,音频和文字一个字节都不出这台机器。你的会议内容只属于你自己。
声纹过滤
能量和频谱分不出人,声纹向量可以。录 3 段各 3 秒完成注册,之后只有你的声音能驱动输入——电视、视频、旁边同事的声音一律进不来。
不抢焦点悬浮条
任务栏正上方常驻一条悬浮条,永不抢走焦点——说话的时候,你原来的窗口始终是前台,识别完自然落回光标处。
Webhook 实时推送
边开会边推给你的系统:每识别出一句就在几秒内 POST 到你的接口,带所属项目 ID,不用等散会。会议结束再推一份完整逐字稿。
从说话到落字,五步
没有开始按钮,没有复制粘贴。整个过程发生在你按住快捷键到松手之间。
-
按住
按住 Ctrl+Shift+Space。快按一下则只听一句,说完自动停。
-
说话
悬浮条波形转绿、随声起伏;你原来打字的窗口一直是前台。
-
本机识别
SenseVoice 在这台电脑上把语音变成文字,不经过任何服务器。
-
松手落字
一次真实 Ctrl+V,文字落在光标处。Draft.js、Lexical 这类自己维护文档模型的编辑器也不会乱。
-
还回剪贴板
你之前复制的内容原样放回去——输入法不该顺手吃掉你复制的东西。
全程离线,一个字都不上传
语音一旦要过一次服务器,密码、薪资、病历就都过了一次别人的服务器。快说的识别只发生在你的电脑上。
你可能想问
需要联网吗?
识别不需要。识别模型(228MB)和声纹模型(27MB)都内置在安装包里,装完即用,首次启动不用等下载。运行时也不把音频或文字发到任何服务器;唯一的外发是你在设置里自己填了 Webhook 地址时,会议逐字稿按句推送到你指定的接口。
支持哪些系统?
目前提供 Windows 和 macOS 安装包,下载区两个按钮都可用。Windows 端额外录系统声音需要 Windows 10 及以上。
识别准吗?
内置 SenseVoice 模型在本机运行,中文日常口述与会议对话都在可用水平;安静环境、贴近麦克风时效果最好。每一句在识别出的瞬间就已落盘,说得再长也不怕丢。
会议怎么区分说话人?
用你注册声纹时的那份向量,给每段话贴上「我 / 说话人1 / 说话人2」标签,可改名,改完同步重写整份稿子。远程会议还会额外录一路系统声音,单独断句、单独分说话人,并且永远不会被标成「我」。
我的数据存在哪?
全部在这台电脑上:逐字稿与输入历史在识别出的瞬间写入本地文件,没有账号、没有云端同步。不想要了,删掉文件(或卸载)就是真的没了。
装完即用
识别模型与声纹模型都内置在安装包里,不用首次启动等下载。装上,按住,说。