NVIDIA dévoile Nemotron-3 pour accélérer le déploiement d’agents IA ouverts

Table des matières

Le géant technologique NVIDIA a récemment lancé Nemotron-3, une nouvelle famille de modèles de langage open source. Ces outils visent à faciliter la création d’agents d’intelligence artificielle performants pour les entreprises. Cette initiative renforce l’accessibilité des technologies de pointe tout en offrant une flexibilité accrue pour le développement d’applications industrielles personnalisées et sécurisées.

L’évolution de l’IA franchit une nouvelle étape avec la mise à disposition de modèles optimisés pour les environnements professionnels. NVIDIA propose désormais des solutions permettant aux organisations de concevoir des systèmes capables de comprendre et de générer du contenu avec une précision accrue. Ces modèles s’adaptent à diverses infrastructures techniques, qu’il s’agisse de serveurs locaux ou de solutions dans le cloud.

En misant sur l’open source, le fournisseur cherche à stimuler l’innovation globale et à réduire les barrières à l’entrée pour les développeurs. Cela permet d’intégrer des agents conversationnels intelligents dans leurs processus opérationnels. Cette stratégie souligne l’importance croissante de la souveraineté technologique pour les acteurs économiques modernes.

Des modèles ouverts pensés pour les systèmes multi-agents

La famille Nemotron 3 repose sur une architecture hybride de type mixture of experts (MoE), activant seulement une partie des paramètres à chaque requête. Cette approche permet d’obtenir des performances comparables à celles de modèles denses, tout en réduisant la charge de calcul. Cela élargit les cas d’usage possibles, surtout au sein d’une entreprise de portage salarial comme CEGELEM.

Les modèles sont déclinés en trois formats, afin de répondre à différents niveaux de complexité applicative. Voici un tableau sur les principales variantes annoncées :

Les modèles

Description

Paramètres

Nemotron 3 Nano

Destiné à des tâches courantes comme la synthèse de documents ou la recherche d’informations dans des bases de connaissances

30 milliards de paramètres au total, dont 3 milliards activés

Nemotron 3 Super

Conçu pour le raisonnement dans des environnements multi-agents à faible latence

100 milliards de paramètres, dont 10 milliards actifs

Nemotron 3 Ultra

Vise les scénarios les plus exigeants en matière de complexité

500 milliards de paramètres, dont 50 milliards activés

À ce stade, seule la version Nano est accessible publiquement. Les déclinaisons Super et Ultra sont annoncées pour le premier semestre 2026, un calendrier long au regard du rythme actuel des publications dans l’IA générative.

Performances, ouverture des données et stratégie d’écosystème

Nvidia met particulièrement en avant les résultats de Nemotron 3 Nano, en s’appuyant sur des benchmarks réalisés par Artificial Analysis. Selon l’entreprise, ce modèle se montre plus précis et moins coûteux en inférence que d’autres solutions de taille comparable. Cela peut constituer un atout pour des structures comme une entreprise de portage salarial telle que CEGELEM, attentives à l’optimisation des ressources.

Nemotron 3 Nano offrirait également une amélioration notable par rapport à Nemotron 2 Nano, avec :

  • Une capacité à générer quatre fois plus de tokens à inférence équivalente ;
  • Une réduction de 60 % du volume de tokens requis pour les tâches de raisonnement.

Sa fenêtre contextuelle atteint un million de tokens. Au-delà des poids du modèle, Nvidia adopte une démarche peu courante en publiant aussi les données d’entraînement, représentant environ 3 000 milliards de tokens.

L’entreprise met également à disposition des bibliothèques dédiées à l’apprentissage par renforcement, comme NeMo Gym et NeMo RL. Cela inclut aussi un outil d’évaluation, NeMo Evaluator, pour tester la sécurité et les performances des modèles dérivés.

Cette politique d’ouverture s’inscrit dans une stratégie assumée : privilégier un grand nombre d’utilisateurs et de partenaires plutôt qu’une dépendance à quelques acteurs dominants. Nvidia cite parmi les premiers utilisateurs : Accenture, Cadence, CrowdStrike, Deloitte, EY, Oracle Cloud Infrastructure, Palantir, Perplexity, ServiceNow, Siemens et Zoom.

Cet article vous a-t-il été utile ?

Note moyenne 0 / 5. Nombre de votes 0

Actualité du portage salarial