ChineseASR · 功能说明

对电脑说话,直接把文字输入当前应用

用一个小面板控制开始、暂停和取消,让说话变成当前文档里的文字;单Qwen识别,不等待文件复核的第二套模型。

当前情况:听写已有公开音频运行与故障恢复证据;本轮只检查入口,个人麦克风、口音和文字上屏体验没有重新测试。

项目快照核对于 ;具体测试保留各自日期,页面不实时探测运行状态。

复制 AI 续作说明带着这个项目,交给 AI 接着做

写下接下来想做什么。这里会把你的目标、本页事实和来源整理在一起,复制给 Astra 或 Gemini 后,就不用重新介绍项目了。

整理续作说明

只在当前网页整理,不会发起 AI 任务。

用途与实际影响

这项功能怎样使用

为什么需要它

说话打字最怕文字落进另一个窗口、麦克风被悄悄切换,或点了收起却仍在录音。这个入口将显示、采音、识别和输入落点分开,让本人能随时暂停和取消;它不为追求顺口而自动润色或回车发送。

举个实际例子

“这段邮件我想口述,识别好先放进编辑框,不要发送。”在当前编辑位置启动听写,文字分段输入;窗口焦点变了就停止后续输入,自己检查后再决定发送。

最后我会得到什么

得到当前应用中的文字和面板状态;取消只丢弃尚未提交的片段,不能撤销已经输入的字。

正常时

录音按钮变绿表示正在采音;有效语句识别完成、原焦点仍合适时输入整句文字。本人控制下一段、暂停和最后发送。

发现问题时

焦点变化或管理员窗口拒绝输入时停止自动输入,保留托盘复制入口;Esc取消未输入内容,已输入部分继续留在应用里。

入口不可用或证据不足时

指定麦克风缺席、采音丢帧、模型或GPU资源不可用时显示具体问题,不改用另一麦克风或云端,不把空识别和坏声音送进输入框。

从哪里开始

点好要输入的文本框,用 Win+H 唤起听写小窗。

需要准备什么

  • 当前可编辑位置
  • 要口述的句子

从开始到拿到结果

  1. 1

    系统核对并处理

    小窗收这一句,停顿后由本地单模型识别;输入前再看焦点,焦点变化则停下并保留最近文本供主动复制。

  2. 2

    交付与接续

    得到编辑框文字,不自动发送;取消只丢尚未输入片段,已输入内容不会撤销。