Google DeepMind ha lanzado SL2T (Sign Language to Text), un modelo de inteligencia artificial que traduce el lenguaje de señas directamente a texto.
La mayoría de las herramientas de dictado por voz dependen del audio, pero las lenguajes de señas tienen sus propias gramáticas y involucran movimientos 3D complejos. En lugar de usar cámaras crudas o guantes físicos, SL2T rastrea las coordenadas de los puntos de referencia corporales localmente con MediaPipe Holistic y traduce esos puntos espaciales en texto.
Los usuarios pueden hacer señas naturalmente para buscar, redactar mensajes o responder en conversaciones en vivo en lugar de escribir todo.
