类型:系统安全 更新:2026-08-04




1、启用输入法,并且切换输入法

2、开始语音输入,并点击继续

3、来到首页,可以查看总口述字数和历史记录

4、点击中间图标可以查看、添加热词

5、前往个人主页能够切换界面语言

1、支持单击和长按两种交互模式,让说话成为最自然的输入方式;
2、自动过滤口语中的自我修正,直接生成流畅成稿,不留改口痕迹;
3、一键整理成编号列表、表格或大纲,条理清晰,可直接发送;
4、支持邮件、会议、笔记等多种指令,一句话即可快速成稿;
1、自动过滤「嗯、啊、那个」
实时高质量语音转文本,CosyVoice 在转写过程中自动识别并去除口语化的填充词与重复词,让你的每一句话都干净利落。
2、散乱的口述,自动排成清单
说出一堆事情,CosyVoice 自动识别其中的项目结构,整理成编号列表、表格或大纲,条理清晰,可直接发送。
3、说错了?「不对,改成…」就行
CosyVoice 能识别口语中的自我修正——「不对不对」「改成」「我意思是」——并自动应用到最终稿件,不留改口痕迹。
4、说一句指令,得到一封完整邮件
写邮件、写会议邀请、写vlog 脚本——告诉 CosyVoice 你想要什么格式,它直接给你完成稿,称谓、问候、签名一应俱全。
5、数字、公式、单位,都帮你写对
口播中的「三点五八亿」「百分之十二点六」自动还原为「3.58 亿」「12.6%」,还能识别公式表达并补齐符号,金融、科研、媒体场景都能直接用。
6、上海话、粤语、川话,都能听懂
无缝识别上海话、粤语、四川话等多种方言,并能将其转写为标准普通话,跨地区团队、田野调研、客户访谈都不再被口音卡住。
1、短句回复时,为什么感觉打字比语音更快?
在回复“谢谢”、“好的”等极简内容时,手动键盘打字的效率确实会更高。语音输入需要先口述,再等待转写完成,整体耗时反而更长。
2、网络信号不好时,转写会失败或丢失吗?
转写过程高度依赖云端大模型和网络环境。在高铁、地铁或偏远区域等信号断续的场景中,极易出现转写卡顿、内容丢失或失败等问题。若长时间口述的内容无法留存,需要重新录制,可能会影响使用的连贯性。
3、为什么转写出来的文字太像“书面语”,缺少日常交流的感觉?
目前的润色模式偏向结构化、书面化的表达逻辑。它会自动将自然口语梳理为分点式、条目化的书面文本。在日常社交等非正式沟通场景中,这种模版化的表达可能会缺少一点“人味”。
4、录入完成时误触了屏幕,导致转写失败且找不到录音怎么办?
目前的交互容错率较低,误触成本较高。如果在语音录入完成时误触了键盘以外的区域,可能会导致转写失败,并且在App内无法找回录音重新转写,需要重新口述录制。
5、遇到小众专属名词或自创品牌,识别不准怎么办?
原生词库对小众专属名词、自媒体IP等识别准确度可能存在不足,同音高频词容易覆盖自定义词汇。针对这一痛点,产品配套上线了热词Skill功能,大家能够手动录入各类专属特殊词汇,添加保存后,模型转写时会优先匹配自定义热词,从根源减少同音误识别问题。
1、告别繁琐打字,开口即是成稿
日常沟通或记录灵感时,无需再逐字敲击键盘。只需自然开口说话,就能将你的语音实时转化为流畅的文字。无论是回复消息、记录待办还是整理思路,都能让你彻底解放双手,让表达回归最本能的状态。
2、智能过滤口语废话,告别手动精修
说话时难免会夹杂“嗯、啊、那个”等语气词,或者出现重复、改口的情况。具备强大的语义理解能力,能自动识别并剔除这些口语化的冗余内容,甚至能精准捕捉你的自我修正,直接输出干净、利落的最终稿件,省去反复修改的麻烦。
3、散乱口述秒变结构化清单,逻辑一目了然
当你脑海中有一堆杂乱的想法需要整理时,只需一股脑说出来,就能自动识别其中的逻辑关系,将其梳理成清晰的编号列表、表格或大纲。无论是会议纪要还是购物清单,都能瞬间变得条理分明,直接发送也毫无压力。
4、一句指令搞定复杂文档,效率翻倍
写邮件、拟通知、做脚本,不再需要从头构思格式。只需告诉软件你的需求,比如“帮我写一封会议邀请”,它就能自动补全称谓、问候、正文和签名,直接生成一封格式规范的完整文档,让办公效率直线飙升。
5、方言也能精准转写,沟通无界限
无论是粤语、四川话还是上海话,都能轻松听懂。它支持全国多种主流方言的无缝识别,并能将其转化为标准的普通话文本。对于跨地区团队协作或面对不同口音的客户,再也不用担心沟通障碍,让每一次交流都顺畅无阻。
6、专业术语与数字精准还原,细节满分
在金融、科研或媒体等专业场景中,口播的数字、公式和单位往往容易出错。能精准识别“三点五八亿”并自动转换为“3.58亿”,甚至能识别复杂的公式表达并补齐符号,确保专业内容的严谨性与准确性,让专业场景下的记录更加得心应手。