2026-08-13 · AI 资讯
手语 AI 进手机:DeepMind 发布 SL2T 模型助力无障碍交互
谷歌 DeepMind 发布的全新多语言手语转文本模型 SL2T,正式随 Pixel 11 系统进入消费级产品。该功能接入 Gboard 键盘与 Live Transcribe,用户只需通过前置摄像头做出手语动作,即可实时生成文本,甚至直接与 Gemini 进行多模态对话,彻底改变了听障人士的交互方式。
SL2T 模型基于 10 万小时的手语素材训练,能够精准解析动作、面部表情与唇语信息。为保障用户隐私,模型利用手机端的 MediaPipe Holistic 技术进行动作追踪,处理过程仅在本地进行坐标计算,原始视频即时删除,无需上传至云端。
作为 AI 无障碍技术的重大突破,SL2T 此前已在 SignGemma 等开源项目中积累了算法基础。随着各大科技公司相继布局,AI 正在将深奥的视觉识别技术转化为触手可及的消费级应用,加速推动无障碍交互范式的革命。
相关模型(97AI 可直接调用)
