I årevis har telefon-AI båret en form for maske. Du spørger, den svarer, men et sted midt i processen sendes dine data til en fjernserver, bliver behandlet og sendes tilbage til dig. Den skjulte omvej har altid været prisen man betaler. Google vil nu klippe forbindelsen, og Gemma 4 er det tydeligste signal endnu på, at lokal AI på Android bliver alvorlig.
Google DeepMind præsenterede Gemma 4 i sidste uge sammen med Arm med et klart mål: at få avanceret AI til at køre direkte på Arm-baserede Android-telefoner i stedet for at afhænge af cloudtjenester. Ifølge Google er den nye modelfamilie op til fire gange hurtigere end tidligere versioner og kan bruge op til 60% mindre strøm. De mindre varianter E2B og E4B er designet med telefoner for øje, og de kan håndtere tekst, billeder og lyd uden at sende en forespørgsel over internettet.
Hvorfor Arm er afgørende her
Den stille motor bag dette spring er Arms SME2-instruktionssæt, som er en del af nyere Armv9-chips. Kort sagt accelererer det matrixberegningerne, som moderne AI er afhængig af. Arm fortæller, at deres tidlige ingeniørtests viste en gennemsnitlig forbedring på 5,5x i behandlingen af brugerinput samt en responsgenerering, der var op til 1,6x hurtigere på Gemma 4 E2B-modellen. Det interessante? Udviklere behøver ikke omskrive deres apps for at få fordelene. Arms KleidiAI-softwarelag kobler sig til Googles eksisterende runtime-biblioteker, så forbedringen kommer med meget lidt friktion.
Den slags usynlig opgradering er præcis det, der kan flytte lokal AI fra en demo til noget, folk rent faktisk bruger hver dag. Hurtigere. Lettere. Mindre afhængig af netforbindelse. Det er de tre ting, mobil-AI har jagtet fra starten.
Det klareste eksempel kommer fra Envision, en tilgængelighedsapp designet til blinde og svagtseende brugere. Indtil nu har scene-forståelse ofte været afhængig af cloudadgang. I en prototype, der brugte Gemma 4 lokalt på Arm-CPU'er, kunne en bruger tage et foto og få en detaljeret beskrivelse af scenen med det samme, uden netværk. For en sådan app er offline-understøttelse ikke en ekstra funktion. Det er hovedfunktionen.
Google lægger også grundlaget for næste skridt. Gemma 4 bruges som basis for Gemini Nano 4, den kommende lokale model til Android. Det betyder, at udviklere, der bygger med Gemma 4 i dag, bør få kompatibilitet med Gemini Nano 4, når den kommer til topmodeller senere i år. Gemini Nano driver allerede lokale funktioner som smarte svar og lydsammendrag, og chipproducenter som MediaTek har presset kraftigt i samme retning. Gemma 4 tilfører yderligere elementer, herunder multimodal understøttelse og indbyggede agentfunktioner.
For udviklere er adgangen allerede åben. E2B- og E4B-modellerne er tilgængelige via Google AI Edge Gallery på Android og iOS under en Apache 2.0-licens. Og det er vigtigt, fordi kapløbet om nyttig, privat og lav-latens AI ikke længere kun foregår i skyen. Det bevæger sig ind i telefonen i din hånd.





Diskussion
Skriv en kommentar
Kommentarer
Ingen kommentarer endnu. Vær den første.