3 Minuten
Stel je een AI met een biljoen parameters voor die niet op westerse GPU's draait, maar op hardware die in China is gemaakt. Het klinkt als een technologische herschrijving, en precies dat probeert DeepSeek met zijn model van de volgende generatie.
Berichten suggereren dat DeepSeek V4 exclusief op Huawei's nieuwste Ascend-chips zal draaien. Dit is geen kleinschalige koerswijziging. Het weerspiegelt een bredere inzet om geavanceerde modellen aan binnenlands silicium te koppelen, nu exportcontroles toegang tot Nvidia's H-serie chips voor Chinese ontwikkelaars bemoeilijken.
Waarom die verschuiving? Gedeeltelijk omdat opschaling nu strakke afstemming vraagt tussen modelarchitectuur en de chip die het model moet dragen. DeepSeek wil ongeveer een biljoen parameters inzetten, en het bedrijf zou naar verwachting honderden duizenden Ascend 950PR-processors inzetten om de beoogde inferentiesnelheden en capaciteit te bereiken. Het doel: ongeveer 1,8x snellere inferentie, een contextvenster dat richting één miljoen tokens gaat, en efficiëntiewinst door Engram-achtige optimalisaties.

Dat laatste detail is belangrijk. Engram-technieken herschikken hoe modellen informatie opslaan en terughalen, waardoor het geheugengebruik daalt maar de diepgang van het redeneren behouden blijft. Voor een model van de omvang van V4 maken zulke trucs het verschil tussen haalbaar en fantasie. DeepSeek zou naar verluidt maanden hebben besteed aan het herschrijven van kerncode en het uitvoeren van prestatietests samen met ingenieurs van Huawei en Cambricon om maximale prestaties uit de nieuwe stack te persen.
Ook andere Chinese techreuzen zetten soortgelijke zetten. Alibaba, ByteDance en Tencent hebben grote bestellingen geplaatst voor Ascend 950PR-silicium, wat aangeeft dat binnenlandse chipecosystemen snel de standaard worden voor grote AI-projecten in China. In die zin is DeepSeek's stap zowel strategisch als praktisch.
Er speelt ook een timingaspect. Nvidia's H20-chips hebben strengere exportcontrole ervaren, waardoor startups en cloudproviders worden aangespoord migraties naar lokaal geproduceerde accelerators te versnellen. DeepSeek had in eerdere modellen al Ascend-varianten gebruikt, dus een volledige migratie naar Huawei-centrale infrastructuur is een voortzetting van bestaand werk in plaats van een abrupte sprong.
Functioneel zou V4 nadruk leggen op geavanceerde programmeervaardigheden en verbeterd meerstapsredeneren. Simpel gezegd: beter in het schrijven van complexe programma's, beter in het voeren van lange gesprekken en beter in het samenvoegen van logica over grote stukken tekst. Naar verluidt worden twee extra V4-varianten, aangepast aan andere in China gemaakte chips, ontwikkeld en kunnen ze nog voor het einde van het jaar verschijnen.
Er is een bredere les hier. De AI-race fragmentariseert in hardware-ecosystemen, elk afgestemd op hun eigen stapel compilers, runtimes en optimalisatietrucs. Voor startups zoals DeepSeek kan het pad naar toonaangevende prestaties nu evenzeer via binnenlands silicium lopen als via algoritmische innovatie.
Of deze aanpak rendeert hangt af van hoe goed softwareteams ruwe chips weten om te zetten in bruikbare, betrouwbare diensten, en van hoe snel het mondiale AI-hardwarelandschap blijft veranderen.
.webp)



Laat een reactie achter
Reacties
Nog geen reacties. Wees de eerste.