
Nebius Group a présenté une série de nouveautés pour sa plateforme cloud orientée intelligence artificielle. Au centre de cette mise à jour figure Nebius Echo, un agent IA intégré à la console cloud et à l’interface en ligne de commande. Son objectif : aider les équipes techniques à comprendre leur environnement, trouver des réponses dans la documentation, surveiller leurs quotas et, à terme, exécuter certaines actions d’infrastructure après validation humaine.
Cette annonce dépasse le simple ajout d’un chatbot dans une interface cloud. Nebius cherche à rapprocher l’expérience utilisateur d’un architecte cloud IA assisté, capable de contextualiser ses réponses selon le tenant, les ressources disponibles et les besoins opérationnels. En parallèle, l’entreprise a dévoilé des fonctions plus classiques mais essentielles pour les grands comptes : gestion budgétaire, chiffrement avec clés gérées par le client, stockage objet intelligent et orchestration simplifiée des charges IA.
Echo : un agent IA intégré au cloud Nebius
La nouveauté la plus visible est Nebius Echo, un agent IA accessible depuis la console Nebius Cloud ou via l’interface en ligne de commande. L’outil est conçu pour répondre aux questions des utilisateurs sur la documentation, les quotas, la configuration du tenant et les ressources disponibles.
Lors de la démonstration, l’opérateur a demandé à Echo de créer une machine virtuelle équipée d’un GPU H100. L’agent a proposé une configuration, puis a attendu l’approbation de l’utilisateur avant de lancer la création de la VM. Une fois validée, la machine est apparue dans la console.
Ce fonctionnement illustre une approche importante : Echo ne se contente pas de donner des conseils. Il peut préparer des actions concrètes, tout en gardant une étape de validation humaine. Pour les équipes d’infrastructure, c’est un compromis intéressant entre automatisation et contrôle.
Un assistant qui vise le rôle d’architecte cloud
Narek Tatevosyan, Product Director chez Nebius, a présenté Echo comme davantage qu’un chatbot. Selon lui, la vision est de proposer une IA qui agit comme un support client ou un architecte bien formé, capable de connaître le contexte de l’utilisateur et de l’aider à opérer ses charges de travail sur Nebius.
Dans un cloud IA, cette promesse est particulièrement pertinente. Les équipes doivent souvent jongler entre des contraintes de capacité GPU, des quotas, des coûts élevés, des règles de sécurité et des environnements complexes. Un agent intégré peut réduire le temps passé à chercher une information ou à traduire une intention en configuration technique.

SkyPilot managé : Nebius simplifie l’orchestration des charges IA
Nebius a également ajouté une option SkyPilot managée dans la section d’orchestration IA de sa console. SkyPilot est un projet open source utilisé pour exécuter des workloads d’intelligence artificielle sur différentes infrastructures cloud.
Avant cette mise à jour, les utilisateurs de Nebius devaient déployer et maintenir eux-mêmes leur serveur API SkyPilot. Désormais, Nebius héberge le plan de contrôle. L’utilisateur peut déployer une instance en choisissant un nom, une plateforme et un preset CPU.
Ce changement vise à réduire la charge opérationnelle. Les chercheurs IA, startups et équipes data n’ont pas toujours envie de gérer une couche DevOps supplémentaire avant de lancer leurs entraînements, benchmarks ou expérimentations. En proposant SkyPilot en mode managé, Nebius cherche à rendre son infrastructure plus accessible.
Un positionnement multi-outils pour les workloads IA
Nebius ne mise pas uniquement sur SkyPilot. L’entreprise indique vouloir prendre en charge plusieurs façons d’exécuter des charges IA, notamment via SkyPilot, Slurm, Anyscale et des options serverless.
Le message est clair : les clients doivent pouvoir construire leurs pipelines IA avec les outils qu’ils maîtrisent déjà. Nebius précise par ailleurs ne pas facturer le plan de contrôle SkyPilot managé, mais uniquement les ressources de calcul utilisées sur sa plateforme.
Cette stratégie répond à une réalité du marché : les GPU restent rares, chers et souvent répartis entre plusieurs fournisseurs ou centres de données. Les outils d’orchestration capables d’agréger cette capacité deviennent donc de plus en plus importants pour les équipes IA.
Budgets, alertes et FinOps : des contrôles indispensables pour les entreprises
Autre nouveauté importante : une fonctionnalité de Budget permettant de créer des alertes de dépenses. Les utilisateurs peuvent définir une limite pour un compte, une équipe, un projet, un produit ou certaines conditions sur une période donnée, par exemple une consommation mensuelle.
Lorsque le seuil défini est dépassé, Nebius envoie une notification par e-mail. La plateforme ne coupe toutefois pas automatiquement les ressources une fois le seuil atteint. Cette précision est importante : l’outil sert d’abord à alerter, pas à interrompre une charge de travail critique.
Pour les entreprises, cette fonction s’inscrit dans une logique FinOps. Les workloads IA peuvent générer rapidement des factures élevées, notamment lorsqu’ils utilisent des GPU haut de gamme, du stockage massif ou des environnements distribués. Disposer d’alertes budgétaires permet de mieux responsabiliser les équipes et d’éviter les surprises.
Pourquoi les alertes de budget comptent dans l’IA
Dans un projet IA, une erreur de configuration peut coûter cher. Une instance GPU oubliée, un entraînement relancé plusieurs fois, un stockage mal tieré ou un environnement de test laissé actif pendant le week-end peuvent représenter une dépense significative.
Concrètement, une équipe peut utiliser ces alertes pour :
- surveiller les dépenses par projet ou par équipe ;
- identifier les workloads qui consomment plus que prévu ;
- aligner les budgets cloud avec les priorités produit ;
- exporter les données vers des outils FinOps externes ;
- éviter qu’un prototype IA ne se transforme en centre de coût incontrôlé.

Key Management Service : Nebius ajoute des clés de chiffrement gérées par le client
Nebius a également annoncé un Key Management Service, ou KMS, permettant aux utilisateurs de créer des clés de chiffrement gérées par le client pour protéger leurs workloads.
Le service permet de créer des clés symétriques pour chiffrer et déchiffrer des données, ainsi que des paires de clés asymétriques pour des usages comme l’authentification, la signature ou les communications sécurisées. Les utilisateurs peuvent aussi définir des périodes de rotation des clés.
Ce type de fonction est devenu incontournable pour les organisations qui veulent migrer des charges sensibles vers le cloud, en particulier dans les secteurs soumis à de fortes contraintes de conformité.
Une étape vers un cloud IA plus adapté aux grands comptes
Selon Nebius, les demandes autour du KMS proviennent surtout de clients enterprise, même si des acteurs IA natifs ont également réagi positivement. Le service s’appuie aujourd’hui sur des modules matériels de sécurité gérés par Nebius.
L’entreprise prévoit aussi de permettre aux clients d’apporter leurs propres clés, une évolution généralement désignée par l’expression bring your own key. Cette possibilité pourrait arriver plus tard, potentiellement d’ici la fin de l’année ou au-delà.
Pour les grandes organisations, ce point est stratégique. Elles veulent bénéficier d’infrastructures IA performantes sans renoncer à leurs règles internes de gouvernance, de rotation des clés, de séparation des responsabilités et de contrôle des accès.
Stockage objet intelligent : réduire les coûts des données peu consultées
Nebius a aussi introduit un stockage objet intelligent avec gestion automatique par niveaux. L’idée est simple : les données commencent dans un niveau de stockage dit “warm”, puis basculent automatiquement vers un niveau “cold” moins coûteux si elles ne sont pas consultées pendant 30 jours.
Lorsque les données sont à nouveau accédées, elles peuvent être récupérées selon les mécanismes prévus par la plateforme. L’intérêt principal est de réduire les coûts sans demander aux clients de configurer eux-mêmes des règles de tiering complexes.
Cette fonction prend tout son sens dans les environnements IA manipulant des volumes massifs : jeux de données d’entraînement, données synthétiques, simulations, modèles multimodaux ou projets de “physical AI”. À l’échelle de dizaines de pétaoctets, une mauvaise stratégie de stockage peut peser lourd dans le budget.

Programme Builder : crédits, certifications et accès développeurs
La présentation a également mis en avant le Nebius Builder Program, un programme d’inscription gratuit destiné aux développeurs, startups et constructeurs de projets IA. Il inclut notamment des crédits, un accès communautaire, des sessions prévues avec des ingénieurs Nebius et un accès gratuit aux certifications Nebius.
Deux certifications étaient déjà disponibles au moment de l’annonce. Nebius indique vouloir accompagner les builders avec du compute et des crédits, tout en gardant un contrôle sur les risques d’abus. L’entreprise précise donc que la disponibilité des crédits et les conditions d’accès gratuit peuvent évoluer.
Pour Nebius, ce programme sert deux objectifs : attirer les développeurs sur sa plateforme et créer un écosystème d’utilisateurs capables de tester, documenter et populariser ses services cloud IA.
Feuille de route : GB300, serverless, multi-data-center et hébergement de modèles
Nebius a aussi partagé plusieurs éléments de sa feuille de route. L’un des plus notables concerne l’accès futur aux GB300, qui s’inscrit dans la volonté de proposer une infrastructure avancée à des échelles plus accessibles que celles réservées aux très grands clients.
L’entreprise prévoit également de continuer à investir dans les modèles de paiement à l’usage, notamment avec des machines préemptibles et un modèle d’enchères. Ce type d’offre peut intéresser les workloads tolérants aux interruptions, par exemple certains entraînements, calculs batch ou expérimentations non critiques.
Parmi les autres axes évoqués figurent :
- des capacités multi-data-center ;
- un cloud interconnect pour relier les centres de données clients à Nebius ;
- des endpoints serverless prêts pour la production avec autoscaling ;
- un support élargi de l’hébergement de modèles ;
- la prise en charge de modèles LLM avec poids fournis par le client via vLLM ou SGLang, actuellement via support.
Ces évolutions montrent que Nebius veut couvrir davantage de cas d’usage IA, depuis les expérimentations de développeurs jusqu’aux déploiements en production pour grandes entreprises.
Sécurité : Nebius se prépare au chiffrement post-quantique
Lors d’une session de questions-réponses axée sur la sécurité, Narek Tatevosyan a indiqué que Nebius n’appliquait pas encore le chiffrement post-quantique partout, mais préparait une transition dans cette direction au cours de cette année ou de l’année suivante.
L’entreprise considère le risque quantique comme réel, même s’il reste encore limité pour la majorité de l’industrie à court terme. Ce positionnement est cohérent avec les attentes des grandes organisations, qui commencent à anticiper les futurs standards cryptographiques sans forcément les déployer immédiatement à grande échelle.
Ce que cette annonce dit de la stratégie de Nebius
Avec Echo et les nouvelles fonctions cloud, Nebius cherche à se positionner sur un segment très disputé : l’infrastructure cloud spécialisée pour l’intelligence artificielle. La concurrence ne se joue plus seulement sur la disponibilité de GPU puissants. Elle porte aussi sur la simplicité d’usage, la gouvernance, la sécurité, l’orchestration et la capacité à maîtriser les coûts.
L’ajout d’un agent IA intégré est particulièrement révélateur. Les fournisseurs cloud savent que leurs plateformes deviennent trop complexes pour être pilotées uniquement par des menus, des documentations et des scripts. Un assistant capable de comprendre le contexte, de proposer des actions et de guider l’utilisateur pourrait devenir une interface standard du cloud moderne.
Mais l’adoption dépendra de plusieurs facteurs : la fiabilité des recommandations, la transparence des actions proposées, la qualité des garde-fous et la capacité de l’agent à fonctionner dans des environnements d’entreprise fortement gouvernés.
À retenir
- Nebius Echo est un agent IA intégré à la console cloud et à la ligne de commande.
- L’agent peut répondre à des questions sur la documentation, les quotas et l’infrastructure, puis proposer des actions comme la création d’une VM GPU.
- Nebius ajoute une option SkyPilot managée pour simplifier l’orchestration de workloads IA.
- Les nouvelles fonctions de budget, KMS et stockage intelligent ciblent clairement les besoins des entreprises.
- La feuille de route inclut l’accès futur aux GB300, le paiement à l’usage, le multi-data-center, le serverless et un support élargi pour l’hébergement de modèles.
Pour les équipes IA, cette mise à jour confirme une tendance de fond : les clouds spécialisés ne peuvent plus se limiter à fournir du calcul. Ils doivent aussi proposer une couche d’intelligence opérationnelle, de contrôle des coûts et de sécurité capable de rendre l’infrastructure IA exploitable à grande échelle.