Rebellions achète SqueezeBits pour boucler son offre d’inférence IA

Rébellions achète SqueezeBits pour clôturer la boucle de l'inférence IA

Rebellions a annoncé l’acquisition de SqueezeBits, une startup sud-coréenne spécialisée dans l’optimisation de l’inférence et la compression de modèles IA. Le message est clair : fabriquer des puces ne suffit plus pour convaincre dans les déploiements réels. Il faut aussi maîtriser le logiciel qui fait tourner ces modèles avec un coût maîtrisé et une latence acceptable.

Du chip NPU à la plateforme IA complète

Rebellions, basée à Séoul, veut évoluer de fabricant de NPUs vers un fournisseur d’infrastructure IA de bout en bout. Avec SqueezeBits, elle intègre une pièce sur laquelle les deux sociétés collaboraient déjà depuis 2024 : optimisation de modèles, réduction de la charge computationnelle, logiciel de serving et adaptation de frameworks comme vLLM aux environnements NPU.

La logique est industrielle. En IA générative, la performance brute du chip compte, mais ne garantit pas la qualité du résultat final. Un accélérateur peut être efficace en lab mais sous-performer en production si le modèle n’est pas bien compressé, si le serving n’exploite pas bien le hardware ou si les développeurs doivent réécrire trop de code. SqueezeBits apporte précisément cette expertise. La startup, fondée en mars 2022, a travaillé avec Intel et NVIDIA sur des technologies d’accélération de modèles dans des environnements variés.

Élément intégréCe que SqueezeBits apporte
NPU RebellionsHardware spécialisé pour l’inférence IA
Compression de modèlesRéduction mémoire et charge computationnelle
Optimisation inférenceLatence réduite, meilleure utilisation du chip
ServingExécution des modèles en production
vLLM et frameworks ouvertsMoins de barrières pour les développeurs

vLLM, PyTorch et la compatibilité avec les flux GPU existants

Rebellions et SqueezeBits avaient déjà animé des ateliers communs pour la communauté de développeurs coréens, centrés sur vLLM. Dans un résumé technique publié par SqueezeBits, les deux sociétés décrivaient des serveurs NPU ATOM-MAX de Rebellions pilotés via Kubernetes, avec des flux PyTorch, Optimum et vLLM.

L’enjeu est précis : l’adoption de nouveaux accélérateurs dépend en grande partie de la capacité des équipes à garder leurs outils habituels. Le plugin vLLM-RBLN de SqueezeBits conserve la majorité du flux de code GPU, avec seulement quelques modifications. C’est ce qui peut faire la différence entre une adoption réelle et un benchmark réservé aux labos.

Pour aller plus loin sur l’évolution du rôle de chaque composant dans l’infrastructure IA, l’article sur comment l’IA agissante redonne le rôle central au CPU dans les data centers apporte un contexte utile sur la complémentarité entre les différents types d’accélérateurs.

Un pari stratégique pour l’indépendance IA coréenne

Rebellions s’est positionné comme l’une des initiatives coréennes les plus visibles pour bâtir une filiere IA locale. En décembre 2024, la fusion avec SAPEON Korea a créé le premier unicorn coréen de chips IA. En mars 2026, la société a été sélectionnée comme premier investissement direct du Fonds de croissance national. L’ambition affichée : construire une sorte de « K-NVIDIA ».

L’analogie avec NVIDIA a ses limites. La domination de NVIDIA ne tient pas qu’à ses GPUs : elle repose sur CUDA, ses bibliothèques, ses systèmes complets, son réseau de partenaires et des années d’adoption par les développeurs. Une alternative crédible doit couvrir les mêmes couches. SqueezeBits est une pièce dans cette direction : compression de modèles, serving en production, intégration dans les frameworks existants. C’est complémentaire à d’autres approches comme celle d’OpenAI avec Jalapeño, son premier processeur dédié à l’inférence, ou les travaux sur les SoC Edge AI de SEMIFIVE et ICY Tech dans l’écosystème coréen.

L’inférence, terrain décisif de la prochaine phase IA

La prochaine étape de l’IA d’entreprise ne se mesurera pas à la taille des modèles entraînés, mais à leur capacité à fonctionner efficacement en production. Chaque chatbot, agent, moteur de recherche interne, outil d’analyse ou système automatisé requiert une inférence continue. Le coût opérationnel devient la variable clé.

Dans ce contexte, compression, quantification, gestion mémoire, batching, caching et serving déterminent la viabilité économique d’un service IA. Rebellions a identifié ce terrain et intègre les briques nécessaires. Cette acquisition ne garantit pas la compétition face à NVIDIA, AWS, Google ou Huawei, qui disposent de ressources et de bases clients bien établies. Mais elle montre que la société coréenne a compris que hardware sans logiciel rest incomplet, surtout sur l’inférence.

Questions fréquentes sur l’acquisition Rebellions/SqueezeBits

Qu’a racheté Rebellions avec SqueezeBits ?

SqueezeBits est une startup spécialisée dans la compression de modèles IA et l’optimisation de l’inférence. Rebellions l’achète pour intégrer une couche logicielle à son hardware NPU et proposer une plateforme IA de bout en bout.

Pourquoi la compression de modèles est-elle importante ?

La compression réduit la mémoire et la puissance de calcul nécessaires pour exécuter un modèle. Moins de ressources = coût par requête plus bas et possibilité de déployer sur plus de configurations matérielles.

Qu’est-ce que l’inférence en IA ?

C’est le moment où un modèle déjà entraîné reçoit une requête, la traite et renvoie une réponse. C’est la phase qui pèse le plus dans les coûts de déploiement à grande échelle.

Quel lien existait entre Rebellions et SqueezeBits avant l’acquisition ?

Depuis 2024, les deux sociétés collaboraient sur la compression de modèles et les logiciels pour NPUs. Elles avaient également animé des ateliers communs sur vLLM dans la communauté de développeurs coréenne.

Qu’est-ce que l’ambition « K-NVIDIA » de la Corée du Sud ?

C’est l’ambition de bâtir un acteur national capable de rivaliser dans les infrastructures IA, en combinant chips, logiciels et écosystème de développeurs. Rebellions est l’une des sociétés portées par cette vision, soutenue par le Fonds de croissance national coréen.

Source : rebellions.ai

le dernier