专业机构发布《2019年语音技术》报告称,语音将成为未来十年决定性主题之一,与人工智能一起从根本上改变人与机器的关系。近日,搜狗输入法在语音输入领域率先推出“个性化语音识别”功能,突破语音识别技术瓶颈,大幅优化个人词汇录入的直接准确性,在语音输入领域实现“更懂用户”。
搜狗“个性化语音识别”打造用户专属输入法
在日常交流中,个人口头禅、惯用语经常会干扰双方的信息传达,这一问题在人机语音交互中尤为凸显。在语音输入时,往往用户只是想录入一个名称,输入结果却显示的是音同意不同的另一项结果。比如,当用户希望输入法显示人名“凭远”时,通用的语音识别往往将大众常用的“平原、品源”列在前列的候选词汇,用户的个性化内容并不在其中。除此之外,用户习惯使用的个人词汇,以及一些多音字、读音差错也会对语音识别结果造成影响。
基于以上原因,搜狗语音率先对语音识别技术进行了革新优化,推出“个性化语音识别”服务。经过本轮更新,用户只需在搜狗输入法App选择一键登录个人账户,即可体验此项服务。成功开启后,“个性化语音识别”会通过强化学习用户习惯使用的个人词汇,为每个用户建立定制化语音输入法。此后,在用户需要进行语音输入时,输入法会根据语言环境,结合上下段落语句进行分析,快速输出符合用户心意的文本内容,有效减少用户手动进行二次更改的频率。
搜狗语音又诞生“黑科技”语音识别更精准
搜狗“个性化语音识别”不仅可有效提升用户个性化词句的识别准确率,同时全自动词库学习这一特色极大保证了系统的处理及反馈速度,实现整个学习个性化特征的过程在“毫秒级别”就可以全部自动完成。
通过DTSS(Deep Transformer-based Sequence to Sequence model)的端到端声学模型、神经网络语言模型和智能标点预测等技术,搜狗输入法引入前沿深度学习技术,对语音识别进行仿真模拟和训练,有效提高语音录入在通用场景下的识别准确性,精准度已达到领先业内。“个性化语音识别”可基于用户数据分析,对用户习惯使用的个性化词组进行扫描记录,在语音输入时,优先选择用户习惯用语进行文本输出。通过此项技术革新,在保障通用识别准确性的前提下,使用户常用语的字词错误率下降40%,攻克语音识别精准化的技术难关。
掌控AI从个性化语音识别开始
手和舌头是人类最灵活的两个部分,从移动智能设备发展以来,各种触控交互无不依赖于手的操作。而当语音技术和人工智能同时走向成熟时,或许就像《2019语音技术报告》中所描述的那样:语音交互扭转了以往人机交互的存在形态,用户与设备间基于语音交互的全新关系开始搭建,与之前互联网向移动互联网过渡一样,其对底层平台的全新需求也在酝酿当中。
新时代即将来临,为应对人工智能、虚拟现实等技术的革新以及不同维度、多场景使用的需要,用户输入法的使用习惯逐渐向语音输入转移。同时,与文本输入相比,语音输入注定成为最主要的人机互动接口。优化语音识别技术,为用户提供更自然、更便利、更高效的语音录入服务,是智慧输入法的发展趋势。
随着语音识别技术的不断成熟,以及用户个性化词库的不断丰富,搜狗将聚合用户级语音个性化资源,实现“定制化语音输入法”。使每个用户基于“定制版”、“更懂自己”的搜狗语音识别的支持,在日常生活以及医疗、法律等专业领域,有效提高线上交流和人机沟通的效率及准确度,或将成为人工智能时代输入端的全局掌控者。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
2023年7月6日,第六届世界人工智能大会(WAIC2023)在上海开幕,“人工智能大模型”是本届大会的备受瞩目的话题,据悉,在昇腾AI大模型的创新研发中,华为联手26家行业领军企业,组建了一支协同创新的“AI明星队”,云天励飞作为中国人工智能企业的杰出代表,和互联网大厂、运营商、科研院所等优秀团队
这几个月来,以ChatGPT为代表的生成式AI展现出的能力令世界惊叹。自从2016年AlphaGo战胜李世石掀起了一波AI浪潮后,AI仿佛已经沉寂了很久,ChatGPT的横空出世就如同一束耀眼的光芒,让AI这个名词重回C位。过去在AI1.0时代,主要通过训练模型来实现图像识别、声音识别、语言处理等特
文:互联网江湖作者:志刚2023年的IoT需要一个新故事。6月29日,涂鸦智能在开发者大会上,发布了企业级战略PaaS2.0,希望通过一个平台+四大开发服务,建立起IoT生态。对于这场发布会,市场的态度是积极的。美东时间6月29日收盘,涂鸦智能美股股价上涨5.6%,来到1.87美元/股。近日股价稳定
2020年底,王慧文在朋友圈写下这句话时,外界本以为这位伴随中国互联网发展而持续创业20年的人物即将告别创业舞台。但是,一个曾经多次创业,正值壮年的互联网老将心中的创业热情是难以熄灭的。
近期,“AI新云”(NeoCloud)概念在科技圈和投资圈引发热潮。今年3月,被业内称作“英伟达亲儿子”的AI基础设施企业CoreWeave上市。这家依托英伟达GPU资源冲击新云市场的初创公司,上市不到3个月市值飙升359%,达881亿美元。CoreWeave的“身价暴涨”吸引了无数视线。对此,不少
一场人工智能领域的革新风暴正从华为开发者大会现场席卷全球产业界。2025年6月20日,在东莞举行的华为开发者大会HDC2025上,华为常务董事、华为云计算CEO张平安揭开了盘古大模型5.5的神秘面纱。这一全新版本在自然语言处理、计算机视觉、多模态、预测和科学计算五大基础模型上实现全面突破,标志着中国
一行代码未写,企业已获完整客服系统——这将是AI代理普及的新起点。“今天标志着AI代理技术从实验室走向产业的转折点。”OpenAI产品负责人OlivierGodement在项目发布声明中如此评价。就在今日,这家AI巨头通过HuggingFace平台开源了一套完整的客户服务代理框架,采用宽松的MIT许
6月17日,阿里巴巴旗下智能信息平台夸克App正式推出全新学习产品“夸克老师”——一款集讲题、批作业、出题、找试卷于一体的AI家教。该功能依托通义千问大模型,通过指令微调、强化学习等前沿技术,首次实现“因材施教”的个性化辅导,标志着AI在教育领域的应用迈入新阶段。技术突破:AI模拟真人教学,推理能力
2025年6月17日,字节跳动旗下智能助手豆包正式在电脑版及网页端全量上线“AI播客”功能,用户只需上传PDF文档或网页链接,即可一键生成由两位AI主播演绎的对话式播客节目。这一创新功能凭借高度拟人化的语音效果和秒级转化效率,迅速引发内容创作者、学生群体及职场人士的关注。技术突破:真人级语音交互,秒
我不是危言耸听,现在全球的AI巨头都在做MCP,毫不夸张的说:谁能把MCP做起来,谁就拥有AI生态控制权,谁就是AI圈的老大。你们有没有发现,MCP在2025年初开始特别火爆,互联网技术大厂都在强推MCP。(1)阿里云百炼搞了个MCP平台,提供50+预置MCP服务。不过大都只面向阿里系产品。(2)腾
2025国际人工智能程序设计精英挑战赛(IAEPC)在香港中文大学成功举办。作为主办方之一,欧美同学基金会理事长李军接受了大赛主持人艾诚采访。在采访中,李军认为IAEPC不仅是一场“冠军中的冠军”对决,更是一次全球AI人才的线下交流盛会。大赛“史无前例”的吸引了全球青年科技精英汇聚香港,更加推动和普