En kompakt chip ankom til OpenAI denne uge, og det føltes som mere end blot hardware. Det var en erklæring. Navngivet Jalapeno markerer den nye ASIC OpenAIs første interne chipindsats, udviklet i samarbejde med Broadcom for at accelerere AI-inferens for virksomheden, der bragte ChatGPT til verden.
OpenAI kalder designet en Intelligensprocessor og beskriver det som den første accelerator i en platform, som virksomheden samler for at køre avancerede modeller hurtigere, mere pålideligt og i større skala. Broadcom vil fremstille siliciumet. OpenAI siger, at de designede Jalapeno på cirka ni måneder og også udviklede store dele af de omkringliggende beregningssystemer, hvor disse chips vil køre.
Hvorfor det betyder noget for AI-beregning
GPU'er fra Nvidia har været rygraden i moderne AI. De er fleksible og kraftfulde. Men de kommer med høje prisbøjler og leveringsflaskehalse. ASIC'er bytter noget fleksibilitet for effektivitet og omkostningsbesparelser. Det gør dem attraktive, når en arbejdsbyrde kan optimeres tæt. Jalapeno er OpenAIs væddemål på, at nøje tilpasset hardware kan levere mere beregning pr. watt og hjælpe virksomheden med at skalere adgangen til avancerede modeller og forbedre AI-infrastrukturens effektivitet.
Bryder OpenAI med Nvidia? Ikke helt. Dette er diversificering, drevet af en efterspørgsel, der fortsætter med at accelerere. Tidligere i år indgik OpenAI aftaler om at bruge Amazons Trainium-chips og indgik partnerskaber med AMD og Cerebras. Nu, hvor Broadcom producerer Jalapeno, sigter OpenAI mod at tilføje en yderligere pålidelig vej til rå beregningskraft, mens virksomheden opbygger racks af specialbygget hardware, som ved fuld ambition kan kræve omkring ti gigawatt strøm.

Der er også praktiske milepæle. En fysisk prøve af Jalapeno blev leveret onsdag. Selskaberne siger, at de forventer de første implementeringer inden udgangen af 2026 og bredere udrulninger i årene derefter. Hvis tidsplanerne holder, kan vi være vidne til begyndelsen på et betydeligt skifte i, hvordan store sprogmodeller betjenes i produktion.
Broadcom mærkede nyheden. Aktien steg cirka to procent efter meddelelsen. Chipproducenten har været en af AI-markedets vindere, med aktier op omtrent ti procent i år til dato og næsten syvdoblet siden slutningen af 2022, efterhånden som store cloud- og AI-laboratorier bestiller specialsilicium.
Der er kompromiser. ASIC'er er mindre fleksible end generelle GPU'er, så de fungerer bedst, når de matches med en præcis software- og systemstack. OpenAIs pointe er, at ved at designe mere af den stack internt, kan de opnå bedre effektivitet og udvide adgangen til kraftfulde AI-værktøjer. Kort sagt: byg motoren, finjuster bilen, og du kan køre længere for færre ressourcer.
Den virkelige prøve bliver ydelsen på reelle arbejdsbelastninger og hvor hurtigt OpenAI kan skalere produktionen sammen med Broadcom. For nu er Jalapeno et dristigt skridt mod hardwareuafhængighed og en påmindelse om, at AI-forsyningskæden udvikler sig fra standardkomponenter til specialbyggede platforme designet til en ny klasse software.




Diskussion
Skriv en kommentar
Kommentarer
Ingen kommentarer endnu. Vær den første.