Volgens het exclusieve nieuws van "Moby Lab" zullen DeepSeek V4 en Hunyuan's nieuwe model onder leiding van Yao Shunyu op 12 maart naar verwachting volgende maand (april 2026) verschijnen.Op 11 maart lanceerde OpenRouter twee nieuwe mysterieuze modellen: Healer Alpha en Hunter Alpha.


Volgens de OpenRouter-pagina wordt Healer Alpha beschreven als iemand met visie,gehooreen geavanceerd, volledig modaal model van redeneer- en actiemogelijkheden;


De gemeenschap koppelde het daarom snel aan een nieuwe generatie binnenlandse modellen die nog niet zijn uitgebracht, waarmee naar verluidt "het systeempromptwoord werd vastgelegd dat strikte naleving van de Chinese wet- en regelgeving vereist".


https://x.com/chetaslua/status/2031983459057672455

En op 12 maart, volgens het exclusieve nieuws van "Moby Dick Labs" (Exclusief | Liang Wenfeng brengt DeepSeek V4 naar Yao Shunyu):

DeepSeek V4 wordt officieel gelanceerd in april.

Als een groot multimodaal model dat Liang Wenfeng al lange tijd heeft gepolijst, zal DeepSeek V4 niet alleen zijn codeermogelijkheden verbeteren, maar ook doorbraken maken in het langetermijngeheugen.

Deze richting komt in principe overeen met het openbare onderzoek van het DeepSeek-team van de afgelopen maanden.

In januari 2026 stelde Liang Wenfeng het mechanisme voor "voorwaardelijk geheugen" voor in zijn ondertekende paper "Conditional Memory via Scalable Lookup";

"mHC: Manifold-Constrained Hyper-Connections" uit december 2025 blijft wijzen op de optimalisatie van de onderliggende architectuur.

Beide artikelen proberen de knelpunten van Transformer op het gebied van geheugen, trainingsstabiliteit en lange context aan te pakken.

Volgens het exclusieve nieuws van "Moby Lab" (Exclusief|Liang Wenfeng brengt DeepSeek V4 naar Yao Shunyu):

Het belangrijkste werk van Liang Wenfeng in de afgelopen zes maanden was het goedmaken van de tekortkomingen van DeepSeek op het gebied van visuele inhoudsverwerking en AI-zoeken.

Om de AI-zoekmogelijkheden te versterken, heeft DeepSeek al vorig jaar samengewerkt met Baidu.

De belangrijkste iteratierichting die Liang Wenfeng deze keer voor DeepSeek V4 heeft bepaald, is de capaciteit voor langetermijngeheugen.

DeepSeek V4 zal ook diepgaand worden aangepast aan binnenlandse chips en zal naar verwachting het eerste grote model worden dat volledig op het binnenlandse computerecosysteem draait.

Een ander feit dat publiekelijk is geverifieerd, is dat het volume van de producten van DeepSeek de marktverwachtingen heeft doen stijgen.

Vanaf de lancering van de DeepSeek-app tot 9 februari 2025 zijn de cumulatieve downloads meer dan 110 miljoen keer gedownload en heeft het aantal wekelijks actieve gebruikers een maximum bereikt van bijna 97 miljoen.

Yao Shunyu's nieuwe Hunyuan-model

Staat ook gepland voor release in april

Naast DeepSeek bereidt Tencent ook nieuwe acties voor april voor.

Yao Shunyu was in december 2025 hoofd AI-wetenschapper van het Tencent General Office en is tevens hoofd van de AI Infra Department en de Large Language Model Department;


In februari 2026 werd CL-bench, een door Yao Shunyu ondertekend paper, uitgebracht, waarin een nieuwe evaluatiebenchmark voor "contextleren" werd voorgesteld en de onderzoeksfocus van Tencent Hunyuan bleef verleggen naar lange context en beschikbaarheid van agenten.


https://arxiv.org/abs/2602.03587

Volgens het exclusieve nieuws van "Moby Lab" (Exclusief|Liang Wenfeng brengt DeepSeek V4 naar Yao Shunyu):

Yao Shunyu zal in april ook een nieuw Hunyuan-model uitbrengen, met een schaal van ongeveer 30 miljard parameters.

Al begin 2025 had Yao Shunyu de uitnodiging aanvaard om terug te keren naar China; in feite was Yao Shunyu's voorbereiding op het nieuwe model al begonnen, niet minder dan een half jaar na de officiële aankondiging.

Eind januari van dit jaar bracht "LatePost" ook het nieuws (volledig verslag van de AI-oorlog tussen Byte, Alibaba en Tencent: een oorlog die het lot beïnvloedt):

Binnen Tencent vroeg Yao Shunyu het team om niet rankinggericht te zijn.


Afgaande op het publieke traject zal deze ronde van updates in april niet alleen maar een parameterwedstrijd zijn.

Het bekende onderzoek van DeepSeek strekt zich uit tot langetermijngeheugen, multimodaliteit en onderliggende architectuur, terwijl Tencent Hunyuan zijn aanvullende cursussen over contextueel leren en evaluatie van echte taken versnelt.

De twee routes zijn heel verschillend, maar ze proberen allebei dezelfde vraag te beantwoorden: hoe kunnen we daadwerkelijk de productieomgeving betreden voor de volgende fase van grote modellen.