Retour aux Actualités
IndustrieBriefing AI Understanding

Rebellions et ai& s'associent pour déployer une infrastructure d'inférence d'IA au Japon

Rebellions et ai& ont annoncé un partenariat pour déployer le matériel d'inférence RebelRack de Rebellions au sein du centre de données d'ai& à Tokyo, visant à fournir des services d'inférence d'IA économes en énergie aux entreprises et institutions gouvernementales japonaises.

4 min readRead the linked source
Source-provided image accompanying Rebellions and ai& partner to deploy AI inference infrastructure in Japan
Référence sourceSource enregistrée
Éditeur
hpcwire.com
Lien source
hpcwire.comhttps://www.hpcwire.com/off-the-wire/rebellions-and-ai-partner-to-bring-energy-efficient-ai-inference-infrastructure-to-japan/
Type de source
Source liée : le statut de source principale n'a pas été établi.
ContexteComprenez cela en 60 secondes

Commencez ici

Termes clés

Inférence
Phase d'exécution au cours de laquelle un modèle entraîné génère des prédictions ou des sorties.
Calculer
Les ressources de traitement nécessaires pour entraîner et exécuter des modèles, souvent mesurées en heures FLOPS ou GPU.
Jeton
Morceau de texte traité par des modèles de langage, tel qu'un mot ou un symbole.
Testez-vousQuiz sur les modèles d'IA expliqués

Que s'est-il passé

Rebellions et ai& ont annoncé un partenariat pour déployer l'infrastructure d'inférence RebelRack AI de Rebellions au sein du centre de données d'ai& à Tokyo. La collaboration cible le marché japonais, offrant une capacité d'inférence locale aux entreprises, aux institutions gouvernementales et aux développeurs. ai& prévoit de commencer par un achat initial et d'évoluer jusqu'à 100 unités RebelRack ou plus, en intégrant le matériel dans sa plate-forme d'infrastructure hétérogène.

Rebellions, une société sud-coréenne d'infrastructure d'IA, et ai&, une société de technologie d'IA verticalement intégrée, ont annoncé un partenariat le 15 septembre 2026 pour déployer les systèmes RebelRack de Rebellions au sein du centre de données d'ai& à Tokyo. L’objectif principal est de fournir une infrastructure d’inférence d’IA économe en énergie aux entreprises, institutions gouvernementales et développeurs japonais, conformément aux priorités souveraines du Japon en matière d’IA.

ai& commencera par un achat initial de matériel Rebellions, avec des plans pour étendre rapidement le déploiement jusqu'à 100 unités RebelRack ou plus. Ce déploiement fait partie du développement plus large de l'infrastructure d'ai&, qui est soutenu par plus de 2 milliards de dollars de capital engagé et comprend cinq sites qui devraient être opérationnels d'ici fin 2026, visant une capacité de 40 MW d'ici fin 2027.

Le partenariat exploite le modèle d'infrastructure hétérogène d'ai&, qui intègre plusieurs architectures de calcul. Le matériel de Rebellions est conçu pour une efficacité énergétique élevée et des coûts d'exploitation réduits, permettant à ai& d'offrir un provisionnement plus flexible de la capacité d'inférence. Le matériel s'intègre aux cadres logiciels open source déjà utilisés par les équipes techniques d'ai&, réduisant ainsi les efforts d'intégration et permettant aux systèmes d'être opérationnels dès la livraison.

Rebellions a récemment levé 400 millions de dollars lors d'un cycle pré-IPO, portant son financement total à 850 millions de dollars, et expédie actuellement ses systèmes RebelRack et RebelPOD. La société est soutenue par des investisseurs dont Aramco, Arm, Samsung et SK Hynix. David Bennett, PDG d'ai&, a déclaré que le partenariat élargit les options d'inférence pour les clients au Japon, tandis que Sunghyun Park, PDG de Rebellions, a souligné que la réduction du coût unitaire de service des jetons permet de nouveaux niveaux de tarification et une prise en charge plus large des applications.

Détails de la source: hpcwire.com ↗

Pourquoi c'est important

Ce partenariat introduit une alternative d'inférence spécialisée et économe en énergie aux architectures GPU dominantes au Japon, soutenant les objectifs souverains de l'IA et réduisant potentiellement le coût de génération des jetons d'IA. En intégrant le matériel de Rebellions dans les flux de travail open source existants d'ai&, le déploiement vise à réduire les frictions d'intégration et à offrir des niveaux de tarification flexibles pour les services d'IA, répondant ainsi à la demande croissante d'une infrastructure d'IA de production efficace.

Le déploiement de silicium d'inférence spécialement conçu, comme le RebelRack de Rebellions, représente une évolution vers un matériel spécialisé pour l'inférence de l'IA, distinct des accélérateurs de formation à usage général. Cela peut conduire à une amélioration des performances par watt et à une réduction des coûts d’exploitation, qui sont des facteurs critiques à mesure que l’IA passe de l’expérimentation à la production.

Pour le marché japonais, ce partenariat soutient les initiatives souveraines d'IA en fournissant des options de calcul disponibles localement. Cela réduit la dépendance à l'égard des infrastructures étrangères et garantit que les données sensibles des entreprises et des gouvernements peuvent être traitées à l'intérieur des frontières nationales à l'aide d'un matériel efficace et géré localement.

L'intégration du matériel de Rebellions dans la plateforme hétérogène d'ai& permet un contrôle plus granulaire sur l'économie d'inférence. En proposant des niveaux d'inférence à moindre coût, ai& peut rendre les services d'IA accessibles à un plus large éventail d'organisations ayant des exigences budgétaires variables, accélérant potentiellement l'adoption de l'IA dans différents secteurs au Japon.

Interactive Mechanism

Mécanisme interactif : comment cela fonctionne réellement

Explorez de manière interactive la technologie sous-jacente à ce développement.

Model Parameter Size:8B Parameters
VRAM Required5.5 GBGPU memory footprint
Target HardwareMacBook / Single GPUDeployment tier
Privacy100% Air-GappedLocal device capability
Core takeaway: Small, quantized models (3B–8B) now run directly inside smartphones and laptops with complete data privacy, while mammoth 400B+ models remain the domain of datacenter clusters.
Vérification de concept interactive+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Que regarder ensuite

Surveillez l'état opérationnel du déploiement initial à Tokyo et si la mise à l'échelle prévue jusqu'à plus de 100 unités se déroule comme prévu. Surveillez les modèles de tarification ou les niveaux de service spécifiques introduits par ai& tirant parti de cette infrastructure, et observez si d'autres marchés japonais ou asiatiques suivent avec des partenariats d'infrastructure d'IA souverains similaires.

Le calendrier opérationnel réel et l'ampleur du déploiement à Tokyo, en particulier si l'objectif de plus de 100 unités RebelRack est atteint et quand ces systèmes deviendront pleinement opérationnels pour les charges de travail des clients.

L'introduction de modèles de tarification ou de niveaux de service spécifiques par ai& qui exploitent la rentabilité du matériel de Rebellions, et comment ceux-ci se comparent aux services d'inférence basés sur GPU existants dans la région.

Poursuite de l'expansion de ce partenariat à d'autres marchés ou à des sites de centres de données supplémentaires dans le cadre du projet de construction de cinq sites d'ai&, et si d'autres fournisseurs d'infrastructures d'IA annoncent des déploiements d'IA souverains similaires au Japon ou dans les régions voisines.

Guides et quiz associés

Modèles d'IA expliquésAvenir de l'IAFormation IATestez ce que vous savez : essayez un quiz gratuit sur l'IARecherchez un terme d'IA dans notre glossaireSuivez le suivi du financement de l'IA
Vous avez trouvé cela utile ?