Nvidia vient de lancer son propre modèle d'IA gratuit. Le faire maintenant est parfaitement logique.

Nvidia vient de lancer son propre modèle d’IA gratuit. Le faire maintenant est parfaitement logique.

Nvidia est entré dans la course à l’IA open source avec sa propre arme. Le géant de la technologie a récemment annoncé le lancement de Nemotron 3.5 Lightning, un modèle ouvert gratuit conçu pour les agents d’IA, ainsi qu’un outil appelé NeMo Switchyard, conçu pour réduire le coût d’exécution de ces agents à grande échelle. Nous vous disons tous les détails.

Pourquoi c’est important. Nvidia tire ses revenus principalement du matériel qui exécute les modèles d’IA, et non des modèles eux-mêmes. En proposant gratuitement un modèle ouvert et compétent, l’entreprise parie qu’une IA moins chère et plus accessible incitera davantage de développeurs et d’entreprises à créer des agents, sachant que chacun de ces agents devra toujours fonctionner sur un GPU (de préférence de Nvidia).

Il s’agit d’une stratégie que son PDG, Jensen Huang, promeut publiquement depuis des semaines, arguant que les modèles ouverts se traduisent en fin de compte par « une plus grande demande de puces ».

Les détails. Nemotron 3.5 Lightning est un modèle que Nvidia décrit comme suffisamment léger pour fonctionner sur un seul GPU à l’intérieur d’un PC conventionnel, plutôt que de nécessiter un centre de données complet. Aujourd’hui, nous pouvons trouver de nombreux modèles de langage qui peuvent être exécutés localement et sur n’importe quel PC, comme la famille de modèles Qwen ou Gemma de Google, entre autres.

En ce qui concerne Nvidia, la société affirme qu’elle génère des réponses « jusqu’à quatre fois plus rapides » et accomplit des tâches environ « 30 % plus rapidement que des modèles ouverts comparables », et qu’elle est conçue spécifiquement pour des tâches étroites et spécialisées au sein de systèmes multi-agents plus grands, plutôt que pour le chat à usage général.

Nvidia explique avoir construit Nemotron 3.5 à partir de la distillation, une technique couramment utilisée dans les modèles d’IA locaux qui consiste à entraîner un modèle plus petit avec les résultats d’un plus grand, afin de lui fournir les capacités de ses plus grands modèles Nemotron à une fraction de sa taille. Comme le dit Nvidia dans son communiqué de presse, les entreprises peuvent télécharger, utiliser et modifier le modèle sans avoir à payer ni demander d’autorisation. En fait, selon CNBC, des sociétés telles que CrowdStrike, CodeRabbit et Harvey l’ont déjà testé et personnalisé. Le modèle est disponible via Hugging Face, ModelScope, OpenRouter et le site Web de Nvidia.

D’autre part, NeMo Switchyard est un outil open source qui décide automatiquement quel modèle d’IA doit gérer chaque étape d’une tâche. Il s’agit essentiellement d’un système qui pèse la précision requise par la demande et le coût avant de tout envoyer au modèle le plus puissant et le plus cher disponible. Selon l’entreprise, grâce à ses tests internes, l’outil aurait la capacité d’égaler les performances des modèles les plus avancés, réduisant ainsi le coût de réalisation des tâches à environ « un tiers de ce qu’il faudrait pour utiliser seul l’Opus 4.8 d’Anthropic ».

Prise en charge des modèles ouverts. Ce pari de Nvidia intervient quelques semaines après que Huang a publié une lettre ouverte défendant l’IA des poids ouverts et mettant en garde contre les « restrictions prématurées » qui pourraient réorganiser la carte de l’innovation technologique, une flèche dirigée directement vers Washington, d’où ils s’inquiètent après l’arrivée du Kimi K3 de Moonshot AI, un modèle qui a réussi à réduire l’écart entre les capacités des modèles américains les plus avancés et la Chine.

Huang a fait valoir que garder l’IA ouverte et abordable profite directement à Nvidia. « L’IA gratuite devrait être idéale pour le matériel. L’IA gratuite devrait être idéale pour les puces », a-t-il déclaré à Axios le mois dernier. Kari Briski, vice-président des logiciels d’IA générative pour les entreprises chez Nvidia, a déclaré au Wall Street Journal Leadership Institute que des outils comme Lightning et Switchyard « aident également les entreprises à protéger leurs propres données », car certains secteurs sont de plus en plus réticents à envoyer des informations confidentielles à une grande technologie (pour une raison quelconque).

Et maintenant quoi. Nvidia n’a pas été le seul à prendre en charge les modèles à poids ouvert. Un jour plus tôt, Meta a également lancé son propre modèle de programmation spécialisé, Muse Spark, accompagné de la démonstration de son PDG, Mark Zuckerberg, en faveur de l’IA open source, défendant que les modèles ouverts américains devraient « aspirer à être les meilleurs au monde ».

Image de couverture | Nvidia

À Simseo | Claude va laisser une marque invisible sur tout ce qu’il écrit. Le problème, c’est que cela ne prouve même pas que Claude l’a écrit.