一款手语转文本(SL2T)的新模型刚推出来,主打聋哑和重听用户的手语功能——不是实验室里摆样子的demo,是真要交到用户手里的东西。
解决真实痛点,不是技术秀
聋哑和重听群体的日常沟通难处,不用多说。之前见过不少相关工具,要么识别不准,对着空气比划半天没反应;要么操作复杂,老人小孩学不会,最后成了放在抽屉里的摆设。这次的SL2T,官方明确说给Deaf和hard of hearing用户做新功能,不是用来上科技版头条的,是奔着用去的——这一点就比很多“概念型产品”实在。
这个模型,不是通用AI改改
很多人可能会想:不就是转文字吗?用通用AI改改就行?哪有这么简单。手语和说话不一样,它有自己的语法逻辑,不同地区还有明显的手势变体——同一个“谢谢”,北京手语和上海手语的手势就不一样。如果模型没针对手语的特点优化,到用户手里就是废的。这次SL2T官方说是breakthrough(突破型),说明真的在手语识别、转写上做了针对性突破,不是换个壳的旧技术。
行业终于开始盯着“真用户”了
之前聊到服务特殊群体的AI,总觉得是科技公司刷ESG的噱头,发布会放个视频就没下文了。这次SL2T不一样,它明确要做用户手里的产品,说明手语AI的方向变了:从“追热点、秀技术”,转向“找真需求、做真落地”。对整个AI行业来说,这是个信号——垂直领域的真实用户需求,才是能落地的核心,而不是大而空的技术概念。
当然,问题也不少。比如不同国家的手语差异大,国内的手语场景怎么覆盖?用户平时用手机还是专用硬件?这些都没公开细节。但至少,有人没把手语AI停在PPT上,真的想交到用户手里。你觉得,这类AI能真的帮到聋哑朋友吗?
素材来源:Google DeepMind Blog · AI情报、AI应用落地、科研前沿、消费级AI
查看报道原文

发表第一条评论吧