we_are_coded.by CODE · Светът, декодиран
EN
Google DeepMind

DeepMind сложи превод от жестомимичен език в клавиатурата на телефона

Google DeepMindНаука

Моделът гледа точките на тялото, не видеото, и превръща американския жестов език в текст направо на устройството. Самият кадър се изхвърля веднага.

Накратко
  • На 12 август DeepMind обяви модела SL2T в Gboard и Live Transcribe на Pixel 11.
  • Обучен е върху над 100 000 часа материал от над 50 жестомимични езика.
  • Първо тръгва американският жестов език към английски; следват други.
Проверено на14 август 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Първо ме спря решението, не самата новина. Моделът не гледа видеото ти, а следи къде са ставите на ръцете и тялото.

Фактите: на 12 август 2026 Google DeepMind обяви SL2T, модел за превод от жестомимичен език към текст, който захранва нови възможности в Gboard и Live Transcribe на Pixel 11. Обработката минава през модел на самото устройство, който следи точките на тялото, а не самия кадър; видеото се изхвърля веднага. Обучението е върху над 100 000 часа материал от над 50 жестомимични езика. По данни на Google моделът постига 70 BLEURT на теста FLEURS-ASL без предварителна донастройка. Първо е американският жестов език към английски.

Дребният технически ход тук е и решението за поверителност. Щом към обработката тръгват координати вместо лице, целият спор какво става с кадъра се стопява. По думите на Google самото видео се изхвърля веднага след като точките са отчетени.

Работи на един телефон, за един език, в две приложения. Толкова е засега.

Достъпността се мери в дребните неща. Клавиатурата е точно такова.
Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→Google DeepMind - Putting sign language AI into users' hands
Оригинал: https://wearecoded.com/articles/deepmind-zhestomimichen-ezik.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини