Artikel

DeepSeek V4 kører på Huawei Ascend: Kinas AI-økosystem

DeepSeek V4 planlægger at køre udelukkende på Huaweis Ascend 950PR-chips for at bygge en billion-parameters AI i Kina. Flytningen understreger en opdeling i hardwareøkosystemer og fokus på inferenshastighed og effektivitet.

DeepSeek V4 kører på Huawei Ascend: Kinas AI-økosystem
Læsetid: 3 Minutter
Følg på Google

Forestil dig en kunstig intelligens (AI) med omkring en billion parametre, der ikke kører på vestlige GPU'er, men på hardware fremstillet i Kina. Det lyder som en teknologisk omskrivning, og det er præcis, hvad DeepSeek forsøger med sin næste generations model.

Rapporter antyder, at DeepSeek V4 udelukkende vil køre på Huaweis nyeste Ascend-chips. Det er ikke en lille omlægning. Det afspejler et bredere initiativ til at knytte avancerede modeller til indenlandsk silicon, efterhånden som eksportkontroller gør adgangen til Nvidias H-serie sværere for kinesiske udviklere.

Hvorfor skiftet? Dels fordi skaleringsbehov i dag kræver tæt koordinering mellem modelarkitektur og den chip, der skal bære den. DeepSeek sigter efter at udrulle omkring en billion parametre, og startuppet forventes at bruge hundredetusinder af Ascend 950PR-processorer for at nå målet for inferenshastighed og kapacitet. Målet er omtrent 1,8 gange hurtigere inferens, et kontekstvindue der nærmer sig en million tokens, og effektivitetsgevinster drevet af Engram-lignende optimeringer.

Den sidste detalje er vigtig. Engram-teknikker ændrer, hvordan modeller gemmer og gendanner information, hvilket reducerer hukommelsesforbruget samtidig med at ræsonnementets dybde bevares. For en model af V4's størrelse er sådanne tricks forskellen mellem muligt og utopisk. DeepSeek har ifølge rapporter brugt måneder på at omskrive kernekoden og teste den på bænken sammen med Huaweis og Cambricons ingeniører for at presse ydeevne ud af den nye stack.

Andre kinesiske teknologigiganter placerer lignende væddemål. Alibaba, ByteDance og Tencent har lagt store ordrer på Ascend 950PR-silicium, hvilket signalerer, at det indenlandske chipøkosystem hurtigt bliver standardplatform for store AI-projekter i Kina. I den forstand er DeepSeeks træk både strategisk og praktisk.

Der er også et timemæssigt aspekt. Nvidias H20-chips har mødt øget eksportkontrol, hvilket har skubbet startups og cloududbydere til at fremskynde overflytninger til lokalt fremstillede acceleratorer. DeepSeek havde allerede brugt Ascend-varianter i tidligere modeller, så en fuld migration til Huawei-centreret infrastruktur er en videreførelse af eksisterende arbejde frem for et brat spring.

Funktionelt siges V4 at fokusere på avancerede kodningsfærdigheder og forbedret flertrinsræsonnement. Kort fortalt: bedre til at skrive komplekse programmer, bedre til at føre lange samtaler og bedre til at sammenflette logik på tværs af store tekstmængder. To yderligere V4-varianter, tilpasset andre kinesiskfremstillede chips, er ifølge rapporter under udvikling og kan komme inden årets udgang.

Der er en større konklusion her. AI-løbet fragmenteres i hardwareøkosystemer, hver tilpasset sit eget sæt af compilere, runtime-miljøer og optimeringstricks. For startups som DeepSeek kan vejen til førende ydeevne nu gå gennem indenlandsk silicon lige så meget som gennem algoritmeinnovation.

Om denne tilgang lønner sig vil afhænge af, hvor godt softwareteams kan presse rå chips ind i brugbare, pålidelige tjenester, og af hvor hurtigt det globale AI-hardwarelandskab fortsætter med at ændre sig.

Mads Hansen

"Softwareudvikler med en passion for nyheder. Jeg skriver om kodning, open source og cyber-sikkerhed."

Skriv en kommentar

Kommentarer

Ingen kommentarer endnu. Vær den første.