01 / THE MODEL
不止听见,
更要听懂你在说什么
面对中文方言、中英混输、复杂口音和专有词汇,新一代语音模型带来更强的语言理解能力;Yan 提供多种本地模型,让你按使用场景进行选择
无需离开正在使用的应用,以快捷键开始语音输入,让思路保持连贯。
说话时即可看到文字逐步呈现,让表达节奏与书写过程保持同步。
适用于常见的办公、编辑和沟通场景,让语音输入自然融入日常工作。
设定一次快捷键,此后在日常应用中随时唤起澄言。
选择顺手且不与其他应用冲突的快捷键,用于随时唤起澄言。
在需要书写的位置按下快捷键,即可开始语音输入。
专注于说话,澄言会将语音转化为文字,呈现在你正在书写的位置。
VOICE INPUT, RE-ENGINEERED
以 Qwen3-ASR 为代表的新一代语音模型,负责理解表达;Yan 的自研推理引擎,负责让它们实时、稳定地运行在你的电脑上
Yan 同时支持多种本地语音模型,可按语言、质量和设备性能进行选择
01 / THE MODEL
面对中文方言、中英混输、复杂口音和专有词汇,新一代语音模型带来更强的语言理解能力;Yan 提供多种本地模型,让你按使用场景进行选择
02 / THE ENGINE
实时流式处理、硬件后端选择与资源调度,共同决定大模型能否成为日常输入工具;Yan 的自研推理引擎负责把模型能力转化为桌面实时输入体验
CURRENT ASR LIMITS · 当前 ASR 痛点
QWEN + YAN ENGINE · 模型 + 端侧引擎
通用模型容易误写人名、品牌名和领域术语
Qwen3-ASR 联合音频与语言信息解码,词典规则再校正专有词
实时部分结果会随着后续语音反复修订
首轮解码压低首字延迟,refiner 持续修正并合并稳定文本
一段内容跨越多种语言或歌曲时,传统 ASR 容易切错语言
整部电影实测连续识别英语、西班牙语、德语和英文歌曲
传统推理框架优先适配 NVIDIA,AMD 与 Intel GPU 难以充分利用
Metal 让 M3 流畅运行 1.7B F16,优化后的 Vulkan 让 Intel Xe 集显流畅运行 1.7B Q8
VOICE INTELLIGENCE, ON-DEVICE
从模型、推理引擎到桌面输入体验,Yan 把语音转文字的每一步连接起来
实际转写效果和运行速度取决于所选模型、语言、口音、录音环境及设备性能
澄言依托自研推理引擎,在本机完成语音识别。你的声音与转写内容,不必经过云端。
语音识别在设备端运行,原始语音无需上传云端。
澄言不会将你的语音或转写内容用于模型训练。
转写历史留在你的设备,不在澄言服务器中建立内容副本。
从识别模型到转写记录,重要信息清楚可见,使用过程始终由你掌握。
从写作、沟通到日常办公,澄言让口述自然转化为清晰文字
在文档或编辑器中直接口述内容,让书写跟上思考。
在聊天与邮件中快速组织回复,减少重复键盘输入。
在文档、表格和协作工具中补充内容,提高日常录入效率。
快速整理回复、说明与运营文案,把注意力留给沟通本身。
想法出现时直接说出来,及时留下可继续整理的文字。
图标用于说明常见使用场景;实际兼容性取决于应用和输入控件对系统文本输入的支持。
附加能力
除实时语音输入外,澄言还可以批量转写常见音频和视频文件,在本机生成便于整理、复制和导出的文字。
先免费体验 7 天,满意后再购买。正式授权一次付费,无需订阅。
无需付款,试用期内包含正式授权的全部功能。