Vad Google faktiskt har lanserat
SL2T (sign language to text) är en modell från Google DeepMind som omvandlar de samtidiga hand-, ansikts- och kroppsrörelserna i teckenspråk direkt till skriven text, utan att gå via de mellanliggande 'gloss'-annoteringarna som begränsade tidigare forskningssystem. Den lanserades den 12 augusti 2026 i två konsumentprodukter på Pixel 11: tecken-till-text-diktering i Gboard och teckenbaserade samtalssvar i Live Transcribe. Modellen tränades på över 100 000 timmars teckendata från fler än 50 teckenspråk, ungefär en fjärdedel amerikanskt teckenspråk (ASL), och når 70 BLEURT-poäng på FLEURS-ASL-benchmarken, ett resultat Google beskriver som klart bättre än alla tidigare publicerade resultat. Den byggdes med en rådgivande AI-teckenspråkskommitté med dövorganisationer och specialister, och projektet initierades av Sam Sepah, en döv Google-anställd, utifrån principen att bygga tillsammans med dövsamhället och inte bara för det.
Google är öppet med var modellen fortfarande brottas: sällsynta tecken, snabb fingerbokstavering, passiva grammatiska konstruktioner, klassificerardepiktioner och härledning av tempus utan sammanhang finns alla med på företagets egen publicerade lista över begränsningar. Den öppenheten spelar roll, för detta är varken en forskningsartikel eller en demovideo, utan den första teckenspråksöversättningsmodellen som levereras inbyggd i standardtangentbordet på en vanlig konsumenttelefon, tillgänglig från dag ett utan extra kostnad för alla som äger en Pixel 11.
Integritetsvalet som ingen rubrik fångade
Enligt europeisk dataskyddsrätt hör biometriska uppgifter som används för att entydigt identifiera en fysisk person till en särskild kategori enligt artikel 9 i GDPR, med striktare villkor för när de får behandlas. Videoinspelningar av en persons ansikte och händer, fångade specifikt för att analysera kroppsrörelser, ligger nära den gränsen. SL2T:s arkitektur är byggd för att hålla tydligt avstånd från den: telefonen kör MediaPipe Holistic, en posetracker, direkt på enheten, och bara de resulterande geometriska koordinaterna för händer, ansikte och kroppshållning skickas till Googles servrar för översättningen. Originalvideon kastas på enheten omedelbart och skickas eller sparas aldrig.
Oavsett om Googles ingenjörer formulerade det internt i GDPR-termer eller inte, är det ett läroboksexempel på dataminimering: reducera en kameraström till den minsta abstraktion som ändå gör jobbet, och kasta allt annat innan det lämnar enheten. Varje produktteam med EU-användare som bygger en kamerabaserad tillgänglighets-, gest- eller dikteringsfunktion har nu ett konkret, redan lanserat exempel att peka på i en konsekvensbedömning för dataskydd, och ett starkt argument för varför landmärkeskoordinater, inte rå video, bör vara standardarkitekturen snarare än en eftertanke.
Varför 'bara ASL' väger tyngre i Europa än det låter
Teckenspråk är nationella och regionala, inte universella, och de följer inte talspråket i landet som använder dem. Brittiskt och amerikanskt teckenspråk är separata språk med olika grammatik och till stor del olika ordförråd, trots att båda länderna talar engelska. Tyskland har DGS, Frankrike har LSF, Italien har LIS, Polen har PJM, och ingen av dem är en dialekt av ASL eller av varandra. Googles siffra om 'över 50 teckenspråk, 100 000 timmar' beskriver bredden på SL2T:s träningsdata och forskningsbas; funktionen som faktiskt lanserades översätter bara ASL till engelska. Det betyder att inget EU- eller UK-teckenspråk är användbart i denna lansering, varken dag ett eller under en ospecificerad period därefter.
Tidpunkten skärper glappet. Skyldigheterna i den europeiska tillgänglighetslagen blev verkställbara för många digitala produkter och tjänster i medlemsländerna från och med den 28 juni 2025, och nationella marknadskontrollmyndigheter kan nu agera på klagomål. Lagen kräver inte en specifik tangentbordsfunktion som denna, så dess frånvaro är i sig inget brott. Men det betyder att en döv användare i Stockholm, Göteborg eller Malmö läser Pixel 11:s tillgänglighetsreklam som beskriver en förmåga som dennes eget teckenspråk inte kan använda, precis när granskningen av digital tillgänglighet i EU och Storbritannien ökar snarare än avtar.
Vad detta betyder för utrullning i EU och Storbritannien
För produkt- och efterlevnadsteam är den rena koordinatarkitekturen mönstret värt att kopiera för varje kamerabaserad tillgänglighets-, gest- eller dikteringsfunktion riktad mot EU- eller UK-användare. Den minskar frågan om biometrisk dataexponering innan juristteamet måste svara på den under press, och är ett konkret exempel att åberopa i en konsekvensbedömning för dataskydd som dataminimering redan från designen, snarare än ett sent tillägg för efterlevnadens skull.
För tillgänglighets- eller inköpsteam som utvärderar just denna funktion är rådet rakare: budgetera inte för att brittiskt teckenspråk, DGS, LSF eller något annat nationellt EU-teckenspråk kommer snart. Googles egen lista över begränsningar utlovar bara 'fler teckenspråk' utan datum, och företagets egen ordning, ASL först med allt annat beskrivet som något som följer senare, tyder på att stöd för EU och Storbritannien är en andra utrullningsvåg mätt i kvartal snarare än veckor. Vid rådgivning till en kund om enhetsinköp för döv personal eller döva kunder bör man behandla Pixel 11:s tillgänglighetsreklam och funktionen som faktiskt lanseras på en given marknad som två olika saker.
Läs vidare: Nio av de 10 bästa AI-videomodellerna är nu kinesiska | Öppen AI ger cykloner en extra dags varsel



