软件测试 发表于 2026-6-25 23:34:00

千问模型语音输入法 CosyVoice v1.1.0

千问输入法Android版上线了,目前支持Android、Mac,IOS,而windows官网显示敬请期待

千问输入法安卓版  com.qianwen.ime  v1.0.2

【之前弄混了,这个准确说不是千问输入法,而是千问通义大模型语音输入法,上面的才是准确的千问输入法】

搭载了千问大模型,能够实现以下核心能力:

- 智能净化:自动过滤“嗯、啊、那个”等口语填充词,输出干净文本。

- 结构化整理:将散乱的口述内容自动排成编号列表、表格或层级大纲。

- 意图理解成稿:说一句指令,就能自动生成包含称谓、问候、签名的完整邮件或会议邀请。

- 方言转普通话:支持上海话、粤语、四川话等多种方言实时转写为标准普通话。

- 热词 Skill:支持自定义导入专属词汇,提升专有名词的识别准确率。

PS:实际体验,纯语音,整段识别,和豆包的流式识别不一样,识别率很不错

官网:https://qwentype.com/

蓝奏:https://wwbwc.lanzouq.com/i7AIP3sziimf 密码:52pj

老猫散记 发表于 2026-6-29 08:53:04

准确率到九成之后每提升一个点都要付出成倍代价。

一叶杂谈 发表于 2026-7-1 00:33:07

最容易被忽略的是评估环节,没有好的评测集根本没法优化。

夜雨记事 发表于 2026-7-3 17:16:21

合规问题比技术问题更棘手,很多场景卡在这一步。

有点困 发表于 2026-7-5 06:19:49

效果好不好很看业务理解,纯技术视角容易跑偏。

长夏林间 发表于 2026-7-7 07:54:53

这个结论我保留意见,至少在我们行业不太成立,可能跟样本有关。

隔壁老王煮酒 发表于 2026-7-8 21:29:40

落地最大的阻力往往不是技术,是部门之间的配合。有没有踩过什么比较大的坑?

旧巷69 发表于 2026-7-11 10:33:41

推理成本算下来并不低,规模化之前得先把这块压下去。

晚风随笔 发表于 2026-7-13 07:58:13

延迟和成本这两项是硬指标,演示好看但扛不住量。

阿澈10 发表于 2026-7-15 05:22:45

小规模试点的效果通常比大规模好,是因为样本还没暴露问题。
页: [1] 2 3 4 5
查看完整版本: 千问模型语音输入法 CosyVoice v1.1.0