2025 was the calm before the storm. 2026 is when the storm breaks. The AI game has changed forever. Let me explain.
Let’s take a moment to acknowledge what is happening right now:
Qwen-3.8-Max reportedly outperforms GPT-5.6 Sol and trails Fable 5 by only a narrow margin. I know this still needs to be verified, but let’s assume for the sake of argument that it is true. If so, it would mean that China has effectively caught up with the United States. Kimi K3 has already demonstrated that the former six to eight month gap behind the leading US frontier labs no longer exists. China continues to embrace open source and open model weights, increasing the competitive pressure on US frontier labs.
-DeepSeek V4 GA is on the verge of release. It is expected to be highly competitive on price, and there is every reason to hope that its performance will improve as well.
-Minimax M3 Pro is also expected soon and will likely perform at a level comparable to Qwen-3.8-Max. That would add yet another open model capable of competing at the very top.
-GLM 5.3 or 5.5 is also expected in the near future. Qwen, GLM, and Kimi are now clearly in a race to see who can ship the strongest models. That makes GLM another potential contender that could move ahead of the US frontier labs and close the remaining gap to Fable 5.
In the United States, the industry is currently waiting for Gemini 3.5 Pro, which has already been delayed multiple times, as well as Opus 5 and Fable 5.1. GPT-6 is also expected in the near future as a new model built on a new pretraining run. The concern, however, is that Opus 5 may underperform relative to expectations! If open source Chinese models are already ahead of Opus 5 while sitting only slightly behind Fable 5, it raises the question of how Opus 5 is supposed to remain competitive. By definition, it would rank below Fable 5, making it difficult to outperform the latest Chinese models, especially since those are already more attractive from a pricing perspective. So either Opus 5 will be released *after* a Fable 5 update (Fable 5.5) *or* it will effectively underperform compared to Chinese models. Because Opus 5 will not be better than Fable.
Taken together, the pressure on US frontier labs is increasing dramatically. They are being forced to publish faster, release faster, and accelerate research and development even further. At the same time, tighter US regulation does nothing to make that challenge easier.
I do not think many people fully appreciate how quickly the balance is shifting or how close Chinese frontier labs have come to the state of the art despite ongoing export restrictions and embargoes. On pricing, they are already at least on par with their US counterparts, if not ahead. (Yes, I am aware of the argument that GPT-5.6 is more token-efficient than Kimi K3. At the same time, Kimi K3 is less expensive, which leaves the two models broadly comparable in overall cost.) Meanwhile, the debate over open source is becoming more intense in the United States, whereas China currently has little incentive to abandon open models in favor of closed ones.
The next few weeks are going to be extraordinary. Competitive pressure is forcing an acceleration of development whether anyone wants it or not. We are about to see release after release. Keeping up will become increasingly difficult. Competition will continue to fuel even faster progress. Neither of the two major blocs can afford to fall behind. The rivalry between the United States and China is driving a pace of acceleration unlike anything we have seen before.
2025 was the calm before the storm.
2026 is when the storm breaks.
FT:月之暗面Moonshot的Kimi计划在未来几天内发布K3模型。
K3拥有2-3万亿参数,为目前中国最大的模型,有望在主流基准测试中超越Anthropic Claude Opus 4.8。同时,K3将作为开放权重模型免费提供下载。
K3的发布可能会挑战业界普遍对于“中国AI模型性能落后美国模型8-12个月”的共识。
‼️ BREAKING: Anthropic has embedded hidden spyware-like code in Claude Code that covertly targets Chinese users. It then sends information regarding every user by injecting it into their prompt message.
Claude Code is sending info like timezone, proxy and possible AI Lab connections into the system prompt in ways Chinese users can't notice.
A coding agent with repo and command permissions should not silently hide routing metadata inside prompts. This is a serious breach of user trust.
China has imposed export controls on two US rare earth producers that are part of Washington’s effort to establish alternative supply chains for minerals critical to advanced manufacturing and defense https://t.co/4dnjGfm0Nq
DeepSeek is going heavy-asset.
On June 9, the company posted an opening for IDC planning engineers, a role explicitly scoped to the design and delivery of MW-to-GW scale infrastructure. It follows April's hiring of data center O&M engineers in Ulanqab, Inner Mongolia. Taken together, this is the first time DeepSeek has fully shown its hand on owning compute infrastructure rather than just renting it.
franchement l'annonce de Huawei hier à Shanghai vient de mettre noir sur blanc ce que j'essaie de vous faire comprendre ici depuis des années
pour vulgariser Huawei vient d’annoncer au sympoisum ieee iscas une nouvelle loi physique qui remplace la loi de moore, ils l’appellent la tau scaling law et elle change littéralement le paradigme du semiconducteur mondial, en gros au lieu de continuer à rétrécir les transistors ce qui se heurte à des limites physiques quantiques infranchissables, ils optimisent dorénavant la constante de temps tau à 4 niveaux simultanément et obtiennent des gains de performance équivalents à ce que les américains atteignent avec leur lithographie euv à 200 millions de dollars la machine, sauf qu’eux n’ont pas accès à cette lithographie depuis les sanctions de 2019
la Chine dépasse donc la silicon valley sur son propre terrain et la rend périmée et ce qui se joue réellement est l'exact contraire de ce que Washington imaginait en décidant des sanctions de 2019
en ce sens je crois que très peu de gens ont pris la peine de regarder vraiment les slides de la présentation parce que le coeur de la rupture se cache ailleurs que dans le concept marketing de tau scaling law, il se trouve dans un détail technique que seuls quelques ingénieurs spécialisés ont remarqué (et que je suis parti fouiller haha), il existe visiblement un procédé de collage entre couches de silicium avec un espacement + petit que 2 micromètres, ce qui transforme les fils verticaux reliant les différentes couches d'une même puce en chemins de calcul à part entière, ils maîtrisent là l'intégration en 3 dimensions au sens fort pendant que le reste du monde raisonne encore sur un seul plan horizontal
pour moi la meilleure image c'est celle d'un architecte qui construit une tour pendant que ses concurrents continuent d'étaler des maisons individuelles à l'horizontale, intel et tsmc se battent pour graver des transistors toujours plus minuscules parce que leurs lithographies euv les enferment dans cette logique, huawei coupé de ces lithographies depuis 2019 a choisi un autre combat, raccourcir au maximum le temps qu'un signal électrique met pour traverser l'ensemble du système, cette durée qu'ils nomment tau et qu'ils minimisent simultanément au niveau du composant du circuit de la puce et de la machine complète, c'est de la physique réelle présentée dans la conférence ieee la plus sérieuse au monde sur le sujet
d’ailleurs les chiffres font réfléchir, allez jeter un coupé d’œil et vous allez voir que la densité de transistors monte de 126 à plus de 400 millions par millimètre carré entre 2024 et 2031, la fréquence des coeurs grimpe de 2,6 à 5 gigahertz, même la performance des systèmes complets fait x125 en 4 ans entre 2026 et 2030 & surtout 381 puces ont déjà été fabriquées en série selon ces principes depuis 2020, autant dire qu'ils ont commencé à changer de paradigme dès la première vague de sanctions américaines, 6 années de travail discret pendant que les analystes occidentaux les croyaient en mode survie mdr ce que tout le monde prenait pour de la résistance était en réalité un virage stratégique médité et mené avec la patience d'un peuple qui voit à 50 ans (la vision à très long terme de la Chine dont je vous parle souvent )
je vous le répète depuis des années ici, les sanctions occidentales accélèrent la politique industrielle et tech de Chine au lieu de la freiner, elles l'obligent à inventer le monde d'après pendant que l’occident reste coincé dans celui d'avant, d’ailleurs pour info même BYD a créé la batterie LFP face au blocage du nickel et il domine désormais le marché mondial de la voiture électrique, deepseek a conçu son architecture multi-head latent attention face au blocage des puces h100 et il a divisé par 10 le coût des grands modèles de langage, Huawei vient de poser logicfolding et tau scaling face au blocage de l'euv et il redessine déjà la trajectoire mondiale du semiconducteur jusqu'en 2031