Dossier

DeepSeek, Huawei Ascend en China's AI-stack

China's push naar eigen modellen en chips onder exportdruk.

Nieuwsitems

Gekoppelde artikelen

65 artikelen

Drie open-weight AI-modellen van Chinese labs worden vergeleken: Kimi K3 van Moonshot AI, DeepSeek V4 Pro en GLM-5.2 van Zhipu AI. Kimi K3 scoort het hoogst op de Artificial Analysis Intelligence Index (57), maar is alleen via API beschikbaar tot 27 juli. DeepSeek V4 Pro is de goedkoopste met MIT-licentie. GLM-5.2 is het snelst (168 tokens/sec) en direct te downloaden.

Chinees bedrijf Moonshot AI heeft een nieuwe versie van het Kimi-model uitgebracht, wat leidde tot bezorgdheid over 'volledig AI-communisme'. Het model presteert op frontniveau, maar blijft achter bij propriëtaire modellen zoals Claude Fable 5 en GPT 5.6 Sol. De aankondiging zorgde voor een daling van de Nasdaq en hevige reacties van techfiguren zoals David Sacks en Travis Kalanick.

Moonshot heeft Kimi K3 uitgebracht, een open-weight model dat indrukwekkende prestaties levert op coding- en agent-benchmarks. Volgens Artificial Analysis scoort K3 57 op de Intelligence Index, vergelijkbaar met Claude Fable 5 en GPT-5.6. De release leidde tot discussie over de kloof tussen Chinese en westerse modellen en de rol van efficiëntie versus ruwe rekenkracht.

Het Chinese Moonshot AI heeft versie 3 van Kimi uitgebracht, een open weights-model dat volgens het bedrijf presteert op het niveau van de beste modellen van ChatGPT en Claude. De aankondiging op de World AI Conference in Shanghai leidde tot een koersdaling van 25% bij concurrent Zhipu. Kimi K3 is het eerste open 3T-klasse model, gericht op langetermijncodering en redenering. President Xi Jinping riep tijdens de conferentie op tot internationale open innovatie met VN-toezicht.

Het Chinese AI-lab Moonshot AI heeft Kimi K3 aangekondigd, een model met 2,8 biljoen parameters dat volgens eigen benchmarks beter presteert dan Claude Opus 4.8 en GPT-5.5. Het model is beschikbaar via website en API, met een open gewichtsrelease gepland voor 27 juli 2026. Kimi K3 is het duurste model van een Chinees AI-lab tot nu toe, met een prijs van $3 per miljoen inputtokens en $15 per miljoen outputtokens.

Kimi heeft K3 uitgebracht, een multimodaal opengewichtsmodel met 2,8 biljoen parameters en een contextvenster van een miljoen tokens. In eigen benchmarks benadert het de prestaties van GPT-5.6 Sol en Claude Fable 5. Het model is echter aanzienlijk duurder dan zijn voorganger, wat het einde van goedkope Chinese AI inluidt. De volledige gewichten worden eind juli verwacht.

De Chinese AI-startup DeepSeek is begonnen met de voorbereidingen voor een beursgang in China, mogelijk al dit jaar. Het bedrijf uit Hangzhou werkt samen met accountants en banken om in 2027 naar de beurs te gaan, meldt Bloomberg. De IPO-plannen volgen op een recente financieringsronde van 50 miljard yuan (ongeveer 7,4 miljard dollar) tegen een waardering van meer dan 50 miljard dollar. Oprichter Liang Wenfeng behoudt via een constructie met een limited partnership de controle over het bedrijf.

Uit een rapport van de Financial Times blijkt dat bedrijven als DoorDash, Airbnb en Siemens kiezen voor Chinese AI-tools vanwege lagere kosten en open-weight modellen. Chinese modellen van DeepSeek en Z.ai hebben Amerikaanse equivalenten zoals Anthropic's Claude en OpenAI's ChatGPT ingehaald op OpenRouter. De kostenbesparingen zijn groot: een organisatie gaf in één maand 500 miljoen dollar uit aan Claude. Chinese AI wint terrein door lagere prijzen en flexibiliteit.

De voorsprong van Amerikaanse AI-bedrijven verdwijnt snel nu Chinese concurrenten, zoals DeepSeek en GLM-5.2 van Z.ai, gelijkwaardige of betere prestaties leveren tegen lagere kosten. Anthropic beschuldigt Chinese bedrijven van het illegaal gebruiken van distillatie om modellen te imiteren, maar experts betwijfelen of een aanpak op distillatie zinvol is. Amerikaanse bedrijven roepen om overheidsingrijpen terwijl de concurrentie toeneemt.

Volgens een Reuters-rapport overweegt China de toegang tot zijn meest geavanceerde AI-modellen voor het buitenland te beperken. De besprekingen, waarbij het Ministerie van Handel en bedrijven als Alibaba, ByteDance en Z.ai betrokken waren, suggereren een gelaagd regelgevingskader. Alibaba's Qwen overschreed 700 miljoen downloads op HuggingFace en overtrof daarmee Meta's Llama.

Tencent heeft Hy3 uitgebracht, een 295B-parameter Mixture-of-Experts-model met 21B actieve parameters. Het model is gelicenseerd onder Apache 2.0 en presteert beter dan vergelijkbare modellen, terwijl het concurreert met flagship open-source modellen met 2-5x meer parameters. Hy3 is beschikbaar op Hugging Face en gratis te gebruiken op OpenRouter tot 21 juli.

Het Chinese technologiebedrijf Meituan heeft LongCat-2.0 open-source gemaakt, een groot taalmodel met 1,6 biljoen parameters dat volledig is getraind en ingezet op in eigen land ontwikkelde AI-chips. Het model is beschikbaar op GitHub en Hugging Face. Volgens Meituan presteert het model vergelijkbaar met of beter dan propriëtaire modellen zoals GPT-5.5, Gemini 3.1 Pro en Claude Opus op codering- en agentbenchmarks, hoewel deze claims niet onafhankelijk zijn geverifieerd.

Nvidia verliest zijn koppositie op de Chinese markt voor AI-chips aan Huawei. De Chinese overheid geeft voorrang aan lokale partijen, mede door Amerikaanse exportrestricties. Huawei's nieuwste Ascend 950-chips zijn qua prestaties vergelijkbaar met Nvidia's H200. Marktonderzoekers voorspellen dat Nvidia's marktaandeel in China dit jaar daalt naar zo'n acht procent, terwijl Huawei doorgroeit naar ongeveer vijftig procent. Toch blijven Nvidia-chips superieur voor het trainen van AI-modellen, en de wereldwijde vraag naar AI-rekenkracht blijft record na record breken.

DeepSeek heeft een nieuw speculatief decoderingframework uitgebracht dat de inferentiesnelheid van grote taalmodellen aanzienlijk verhoogt. Het systeem combineert semi-autoregressieve token generatie met op vertrouwen gebaseerde verificatieplanning, waardoor de tekstgeneratie per gebruiker met 60 tot 85 procent wordt versneld. De methode presteert beter dan bestaande technieken zoals Eagle3 en DFlash op benchmarks voor wiskundig redeneren, code genereren en chat. DeepSeek heeft de implementatie open-source beschikbaar gemaakt via GitHub en Hugging Face, inclusief checkpoints voor de previewmodellen van DeepSeek-V4.

Coinbase CEO Brian Armstrong heeft het bedrijf overgeschakeld op goedkope Chinese AI-modellen zoals GLM 5.2 en Kimi 2.7. Een automatisch routeringssysteem kiest het beste model per verzoek op basis van taak en prijs, en caching verhoogde de hitrate van 5 naar 60 procent. Hierdoor heeft Coinbase de AI-uitgaven gehalveerd terwijl het tokenverbruik blijft stijgen.

Zhipu AI's GLM-5.2 presteert vrijwel gelijk aan Anthropics Claude Opus 4.7 in een Snowflake-benchmark met 103 coderingstaken, tegen een vijfde van de kosten per outputtoken. Het Chinese model gebruikt echter bijna twee keer zoveel tokens per taak. Deze prijsdruk zet Anthropic en OpenAI onder druk en kan de waarderingen van Westerse AI-labs beïnvloeden.

De Chinese AI-startup Z.ai (voorheen Zhipu AI) heeft GLM 5.2 uitgebracht, een open-source taalmodel met 744 miljard parameters en een contextvenster van 1 miljoen tokens. Het model presteert concurrerend met closed-source modellen zoals Claude Opus 4.8 en GPT-5.5, maar tegen een fractie van de kosten. De release komt op een moment dat de Amerikaanse overheid de toegang tot Anthropic's krachtigste modellen zoals Claude Fable heeft beperkt, waardoor veel niet-Amerikaanse bedrijven naar China kijken. Ontwikkelaars en AI-onderzoekers noemen GLM 5.2 een van de belangrijkste open-model releases sinds DeepSeek R1.

Het Chinese AI-lab Z.ai heeft GLM-5.2 uitgebracht, een open weights LLM met 753 miljard parameters en een contextvenster van 1 miljoen tokens. Volgens onafhankelijke benchmarks van Artificial Analysis is het de krachtigste open weights model op de Intelligence Index, met een score van 51. Het model is echter token-hongerig: het gebruikt 43.000 output tokens per taak. Daarnaast staat het op de tweede plaats op de Code Arena WebDev leaderboard, alleen achter Claude Fable 5.

Onderzoekers van Tencent, Tsinghua University en HKUST hebben FlashMemory-DeepSeek-V4 ontwikkeld, een techniek die het geheugengebruik bij ultra-lange contexten drastisch vermindert. De methode, Lookahead Sparse Attention (LSA) genaamd, voorspelt welke tokens relevant zijn en slaat alleen die op. Hierdoor kan DeepSeek contextvensters van 1 miljoen tokens verwerken met een fractie van het gebruikelijke geheugen.

Zhipu AI heeft zijn GLM-5.2-model open source gemaakt onder een MIT-licentie. Het model is technisch een evenknie van de topmodellen van Anthropic en OpenAI. De aankondiging leidde tot een koersstijging van bijna 50% van het bedrijf aan de beurs van Hong Kong. GLM-5.2 is sterk in coding, agentic workflows en lange context.

DeepSeek heeft meer dan $7,4 miljard opgehaald in een nieuwe financieringsronde, waarmee de waardering boven $50 miljard uitkomt. Oprichter Liang Wenfeng droeg ongeveer $3 miljard bij. Het bedrijf werd wereldwijd bekend met het open-source redeneermodel DeepSeek-R1 en lanceerde recent DeepSeek-V4-Pro met 1,6 biljoen parameters. Microsoft overweegt een aangepaste versie van DeepSeek's AI-modellen te gebruiken als goedkoper alternatief voor OpenAI en Anthropic.

Uit een nieuwe wereldwijde peiling van Public First blijkt dat in 11 van de 15 ondervraagde landen de meerderheid denkt dat China de Verenigde Staten heeft ingehaald op het gebied van AI-mogelijkheden en -innovatie. Alleen in Japan, India, Vietnam en de VS zelf denkt men dat Amerika nog voorloopt. Binnen de VS is slechts 51 procent van de burgers ervan overtuigd dat hun land de AI-race domineert.

De Chinese AI-startup DeepSeek heeft in zijn eerste externe financieringsronde meer dan 50 miljard yuan (ongeveer 7,4 miljard dollar) opgehaald. De waardering van het bedrijf bedraagt nu meer dan 50 miljard dollar. Investeerders moeten hun geld in een commanditaire vennootschap steken, beheerd door CEO Liang Wenfeng, en hebben geen stemrecht. Alleen het staatsgesteunde AI-investeringsfonds van China belegt rechtstreeks en behoudt zijn stemrecht. Liang zelf investeerde ongeveer 20 miljard yuan.

Chinese AI-modellen zoals DeepSeek bieden API's aan tegen prijzen die 5 tot 10 keer lager liggen dan vergelijkbare Amerikaanse diensten, wat leidt tot een dreigende prijzenoorlog. Bedrijven zoals Lindy en Ramp schakelen over van modellen van Anthropic en Claude naar DeepSeek V4, met aanzienlijke kostenbesparingen tot gevolg. Technische efficiëntie, zoals DeepSeek's GRPO-methode, en strategische prijsstelling stellen Chinese aanbieders in staat om marges laag te houden. OpenAI overweegt prijsverlagingen en Google breidt zijn goedkopere Gemini-aanbod uit om concurrerend te blijven.

Vier dagen nadat Apple bevestigde dat Siri AI niet in China zou lanceren, onthulde Huawei HarmonyOS 7. Het besturingssysteem draait om het Intelligent Agent Framework 2.0 met AI-assistent Xiaoyi, die meer dan 2.100 systeemfuncties en 2.000 AI-agents beheert. Huawei's openPangu 2.0 foundation model heeft 505 miljard parameters. HarmonyOS 7 heeft 19% marktaandeel in China, tegenover 16% van iOS.

Meta is begonnen met het ontvlechten van de $2 miljard overname van Manus, nadat Beijing opdracht gaf de deal ongedaan te maken om nationale veiligheidsredenen. Het AI-startup Manus wordt afgesneden van Meta's interne systemen en de medeoprichters overwegen het bedrijf terug te kopen met een investering van $1 miljard. De stap onderstreept China's streven om controle te houden over strategisch gevoelige AI-technologie.

Diepgaand artikel over de rol van residuale verbindingen in neurale netwerken. DeepSeek-AI heeft een nieuwe methode genaamd Manifold-Constrained Hyper-Connections (mHC) voorgesteld die de beperkingen van bestaande technieken aanpakt. mHC stabiliseert de signaalvoortplanting en verbetert de prestaties, met slechts 6,7% overhead tijdens training. Het onderzoek toont aan dat zelfs fundamentele componenten van AI-architecturen nog aanzienlijk kunnen worden verbeterd.

China is van plan om ongeveer $295 miljard te investeren in een landelijk AI-datacenternetwerk, waarbij minstens 80 procent van de technologie van binnenlandse leveranciers zoals Huawei moet komen. Dit sluit Amerikaanse bedrijven zoals Nvidia en AMD uit. Daarnaast overweegt Taiwan om de smokkel van AI-chips naar China strafbaar te stellen.

Amerikaanse bedrijven testen het Chinese DeepSeek als goedkoper alternatief voor OpenAI en Anthropic, nu de AI-kosten in Silicon Valley blijven stijgen. DeepSeek stond in juni bovenaan de lijst van 'trending software vendors' van Ramp, hoewel het adoptiepercentage nog steeds laag is op 0,1%. Het artikel noemt ook de kapitaalronde van $7,4 miljard van DeepSeek en de zorgen over datalocatie en leveranciersrisico.

Huawei heeft op ISCAS 2025 in Shanghai de Tau (τ) Schaalwet onthuld als alternatief voor de Wet van Moore. De wet, gepresenteerd door He Tingbo, richt zich op tijdschaling in plaats van geometrische schaling om prestaties te verbeteren. Met technologieën zoals LogicFolding en chiplets claimt Huawei 1,4nm-equivalente transistordichtheden te kunnen bereiken tegen 2031 zonder EUV-lithografie.

Huawei's chipdivisie HiSilicon, onder leiding van president Tingbo He, heeft een nieuwe optimalisatiemethode onthuld genaamd Tau's Scaling Law, die de afnemende Moore's Law moet vervangen. De aanpak richt zich op het versnellen van berekeningen over chips, circuits en systemen heen, in plaats van alleen transistors te verdichten. He belooft dat de techniek binnen enkele maanden zal leiden tot een 'grote sprong voorwaarts' in chipprestaties, wat de Amerikaanse dominantie in de chipindustrie kan ondermijnen.

DeepSeek heeft voor het eerst externe financiering opgehaald, met een waardering van $45-50 miljard. Het staatsfonds ICF leidt de ronde, samen met Tencent en Alibaba. DeepSeek sloot bewust private VC's zoals Sequoia China en Hillhouse buiten. Dit weerspiegelt de trend dat Chinese AI-startups steeds vaker staatskapitaal aantrekken nu private VC in China opdroogt.

Het artikel legt de Manifold-Constrained Hyper-Connections (mHC) in DeepSeek V4 uit met visuele uitleg en korte animaties. mHC vervangt de residu-verbindingen in de transformerblokken door meerdere parallelle residustromen om de training te stabiliseren. Het artikel behandelt de architectuur, intuïtie en toepassing van mHC in de aandachts- en MoE-blokken.

Huawei's halfgeleiderdivisie claimt een doorbraak met het LogicFolding-platform, waarmee het binnen vijf jaar kan concurreren met Samsung en Nvidia. De technologie versnelt elektrische signalen in plaats van transistors te verkleinen. De eerste LogicFolding-chips debuteren dit najaar in Kirin-processoren.

DeepSeek heeft de prijzen van zijn vlaggenschipmodel V4 Pro permanent met 75% verlaagd. De nieuwe prijzen zijn vanaf 22 mei van kracht. Het bedrijf wijst op verbeteringen in de beschikbaarheid van Huawei's Ascend 950 AI-chips als belangrijke factor voor de prijsverlaging. De stap zet concurrentie in de AI-markt verder onder druk.

Huawei claimt binnen vijf jaar 1,4nm-chips te kunnen maken zonder de geavanceerde ASML-machines, met een nieuwe Tau-schaalwet en LogicFolding-technologie. De achterstand op TSMC zou daarmee teruglopen tot circa drie jaar. Het bedrijf zegt al 381 chips op deze basis in productie te hebben.

Chinese telecomaanbieders zoals China Mobile en China Telecom verkopen AI-bundels met tokens voor toegang tot AI-modellen zoals DeepSeek, Qwen, Doubao en GLM. De bundels kosten enkele euro's tot tientjes en worden beheerd met tokenmanagementsystemen. China Mobile biedt toegang tot driehonderd modellen via een modelmanagementsysteem dat per taak het beste model kiest.

Ondanks goedkeuring van de Amerikaanse exportlicenties voor Nvidia H200-chips aan Chinese bedrijven als Alibaba en Tencent, blokkeert Peking de levering omdat het bedrijven verplicht binnenlandse chips zoals die van Huawei te gebruiken. DeepSeek V4 is geoptimaliseerd voor Huawei Ascend-processors, wat duidt op een structurele verschuiving in de Chinese AI-hardwaremarkt. Nvidia's omzet uit China is gedaald naar circa 5% en het bedrijf rekent voor het huidige kwartaal op nul omzet uit China.

Chinese AI-bedrijven zijn beter geworden in videogeneratie dan Amerikaanse alternatieven. Partijen als ByteDance, Kuaishou en MiniMax worden door ontwikkelaars als realistischer en beter bruikbaar gezien. De voorsprong komt door de enorme hoeveelheid videodata van platforms zoals TikTok.