taraskuzio.com

Nvidia ouvre Nemotron 3.5 Lightning pour les tâches agentiques

Publié le 12 août 2026 à 14:30 par Jérôme G.

Nvidia lance Nemotron 3.5 Lightning, un modèle d'IA open source de 30 milliards de paramètres, accompagné de NeMo Switchyard, une bibliothèque de routage intelligente.

nvidia-nemotron-modeles-ouverts

Moins de trois semaines après l'intervention remarquée de son patron Jensen Huang en faveur des modèles ouverts, Nvidia concrétise un peu plus sa vision avec le lancement de Nemotron 3.5 Lightning.

Ce modèle, qualifié de léger, est spécifiquement conçu pour fonctionner sur un unique GPU, le rendant accessible jusqu'aux PC de bureau. Il s'inscrit dans une stratégie où l'IA gratuite est perçue par Nvidia comme un puissant moteur pour la vente de matériel.

Nemotron 3.5 Lightning pour des tâches plus rapides

Nemotron 3.5 Lightning s'appuie sur une architecture de Mixture-of-Experts (MoE). S'il compte 30 milliards de paramètres au total, il n'en active que 3 milliards pour chaque token généré, ce qui lui confère la puissance d'un grand modèle tout en conservant une consommation de ressources de calcul bien plus faible.

Cette optimisation se traduit par une vitesse de génération jusqu'à quatre fois plus rapide et une exécution des tâches agentiques 30 % plus véloce que les modèles concurrents de sa catégorie.

Étant open source, il est entièrement personnalisable, permettant aux entreprises de l'affiner sur leurs propres données pour des domaines spécifiques comme la cybersécurité, les services juridiques ou la revue de code.

nvidia-nemotron-3.5-lightning

Une initiative dans le débat sur l'IA open source

Ce lancement intervient dans un contexte de débat intense sur la sécurité et la régulation des modèles open source.

En publiant une lettre ouverte, Jensen Huang a fermement défendu cette approche, arguant qu'elle renforce la sécurité et la cybersécurité, accélère l'innovation et permet aux entreprises de mieux contrôler leur avenir technologique et leur souveraineté numérique.

Cette démarche aligne Nvidia avec d'autres groupes comme Meta, qui voient dans l'open source une manière de stimuler la concurrence et de faire baisser les prix face aux modèles propriétaires très coûteux.

En fournissant des outils gratuits et performants, Nvidia s'assure que la demande pour ses GPU reste soutenue, quel que soit le modèle utilisé par les développeurs.

NeMo Switchyard pour réduire les coûts

Une autre annonce de Nvidia est NeMo Switchyard, une bibliothèque de routage open source conçue pour orchestrer un système de modèles.

Au lieu d'utiliser un unique grand modèle onéreux pour toutes les requêtes, NeMo Switchyard agit comme un aiguilleur intelligent qui analyse chaque tâche et la dirige automatiquement vers le modèle le plus adapté, qu'il soit petit et rapide ou grand et puissant.

Selon les benchmarks internes de Nvidia, NeMo Switchyard peut maintenir une précision de pointe tout en réduisant le coût d'exécution des tâches à près d'un tiers de ce qu'il en coûterait avec un modèle propriétaire de premier plan utilisé seul.

Journaliste GNT spécialisé en nouvelles technologies

Cette page peut contenir des liens affiliés. Si vous achetez un produit depuis ces liens, le site marchand nous reversera une commission sans que cela n'impacte en rien le montant de votre achat. En savoir plus.