【环球网科技 记者 林迪】4月23日消息,Google人工智能研究团队的高级产品经理Sagar
Savla向包括环球科技在内的媒体介绍了一款基于Android系统的应用程序—— Live
Transcribe,即通过将自动字幕技术融入日常会话,从而减少现实世界中的对话障碍。
据Sagar Salva介绍称,Live
Transcribe是其团队的最新工作成果,它是一款运用自动语音识别技术将现实世界中的实时对话转录为手机屏幕上可阅读的文本的安卓应用程序。Live
Transcribe能实现实时的连续转录,支持70多种语言,还可以进行快速切换的双语模式。
据世界卫生组织统计,目前全球有4.66亿人患耳聋或听力障碍,到2050年,这个数字预计将增加到9亿人。
值得一提的是,以往耳聋和听障人士多依赖于人工转录服务,这些服务的费用十分昂贵,并且需要提前很久预约,因此难以在日常对话中频繁使用。Live
Transcribe能够让人们只需使用手机的麦克风便可随时随地进行语音转录。
Sagar对记者表示:“该应用的自动语音识别系统分为三个部分。第一个部分是声学模型,主要辨别单词中的不同音节;第二个部分是发音模型,将辨别出来的不同音节组成实际的单词;第三部分是语言模型,会根据识别出来的单词增加适当的标点符号停顿。”
据了解,为了使Live
Transcribe尽可能直观,在模式上有几种可考虑的模式:计算机、平板电脑、智能手机乃至小型投影仪,最后决定专注于智能手机模式。
对此,Sagar解释道,“我们也曾考虑可穿戴设备,但这种设备造价相对较高,普及率也远不及手机。因此,我们最终还是选择了手机为主要平台,旨在帮助更多听觉有障碍的人群。”