
À l'avant-garde d'un nouveau paradigme pour le calcul IA agentique autonome en périphérie et sur site
Alors que l’IA générative entre rapidement dans l’ère de l’IA agentique, les entreprises et les développeurs recherchent activement des architectures informatiques hybrides capables d’exécuter localement des tâches complexes en plusieurs étapes avec une latence ultra-faible. Pour répondre à la demande du marché en matière de calcul IA hautement performant sur site et garantissant une confidentialité optimale, GIGABYTE a annoncé que sa plateforme matérielle AI TOP ATOM prend entièrement en charge le modèle NVIDIA Nemotron 3.5 Lightning récemment lancé ainsi que la bibliothèque de routage open source NVIDIA NeMo Switchyard, offrant ainsi à ses clients du monde entier une solution de calcul IA aux performances exceptionnelles et garantissant une souveraineté totale sur les données.
Entrer dans l’ère de l’IA agentique : l’essor des systèmes de modèles
Dans les scénarios opérationnels impliquant des agents fonctionnant en continu, chaque étape d’un flux de travail — de la collecte du contexte et de l’observation des environnements au raisonnement et à l’action — nécessite des modèles linguistiques pour piloter l’exécution. Cependant, toutes les étapes ne requièrent pas des modèles de pointe massifs et de dernière génération. Les tâches à haut volume, répétitives et spécifiques à un domaine sont bien mieux adaptées à des modèles spécialisés qui maximisent l’efficacité de calcul et minimisent la latence. NVIDIA Nemotron 3.5 Lightning est spécialement conçu pour gérer ces couches d’exécution intensives dans les systèmes d’IA agentique. Il peut être associé à la bibliothèque open source de routage de modèles NeMo Switchyard afin de créer un système de modèles qui sélectionne le modèle le plus adapté à chaque étape de l’agent en fonction des exigences du flux de travail, permettant ainsi aux agents IA d’accomplir des tâches spécialisées avec une efficacité et une précision maximales.
Technologies clés et avantages de NVIDIA Nemotron 3.5 Lightning
Issu du modèle de pointe Nemotron 3 Ultra de NVIDIA, Nemotron 3.5 Lightning est un modèle ouvert hautement personnalisable, spécialement conçu pour alimenter des agents IA fonctionnant en continu :
- Exécution des tâches ultra-rapide avec un débit jusqu’à 4 fois supérieur
Reposant sur une architecture hybride de type « Mixture-of-Experts » (MoE) avec 30 milliards de paramètres et 3 milliards de paramètres actifs, Nemotron 3.5 Lightning atteint un débit jusqu’à 4 fois supérieur à celui des modèles de même catégorie. Sa génération et son déploiement de tokens ultra-rapides réduisent considérablement les temps de réponse dans les conversations complexes à plusieurs tours et les workflows automatisés.
- Précision hors pair dès la première utilisation (Out Of The Box - OOTB)
Entraîné sur des harnais d’agents courants, le modèle offre une précision prête à l’emploi de pointe pour le codage, l’appel d’outils et le suivi d’instructions. Prenant en charge une longueur de contexte allant jusqu’à 1 million, il gère sans effort la récupération de contextes longs et les workflows à plusieurs tours.
- Contrôle total du modèle et confidentialité optimale des données
En tant que modèle ouvert, les entreprises peuvent contrôler, personnaliser et déployer Nemotron 3.5 Lightning en local, en périphérie ou dans le cloud, avec une capacité totale de post-entraînement spécifique à leur domaine. Les données sensibles restent au sein du réseau local tant pendant l’entraînement que pendant l’inférence, garantissant une confidentialité maximale et un contrôle total de la sécurité de l’entreprise.
- Écosystème matériel étendu et flexibilité de déploiement
Nemotron 3.5 Lightning prend en charge un vaste écosystème matériel, allant des appareils NVIDIA Jetson en périphérie aux systèmes personnels locaux (NVIDIA RTX / RTX PRO) et aux stations de travail (NVIDIA DGX Spark / NVIDIA DGX Station), en passant par les serveurs de centres de données (NVIDIA HGX H100 / HGX H200 / GB200 NVL72 / GB300 NVL72) — permettant ainsi aux organisations « » d’exécuter des agents d’IA n’importe où.
Applications industrielles : optimisation de divers workflows d’agents
Grâce à NVIDIA Nemotron 3.5 Lightning et à la technologie de routage NeMo Switchyard, des flux de travail spécialisés pour les agents IA dans des secteurs clés sont pleinement exploités :
- Agents personnels : des assistants puissants fonctionnant localement sur des PC ou des postes de travail pour gérer efficacement les tâches quotidiennes telles que les e-mails, l’agenda, les projets et les réservations, tout en préservant la vie privée.
- Développement logiciel : ciblent des tâches spécialisées telles que la synthèse de communiqués de presse, la classification de code et le tri des tests.
- Opérations de cybersécurité : utilisez des agents pour l’enrichissement des alertes, la classification des incidents, l’interrogation des journaux et la génération de rapports structurés.
- Services financiers et administration des soins de santé : automatisation des flux de travail courants tels que l’extraction de données entre documents, la vérification des règles de police, la prise de rendez-vous, la facturation et les communications standardisées.
- Télécommunications et commerce de détail : triez les alarmes réseau, répondez aux questions de facturation, résolvez les anomalies liées aux commandes et aux stocks, et enrichissez les catalogues de produits.
Optimisé par le matériel GIGABYTE : la combinaison parfaite pour Nemotron 3.5 Lightning
Grâce à une conception matérielle flexible et à des performances thermiques supérieures, GIGABYTE libère tout le potentiel de NVIDIA Nemotron 3.5 Lightning dans divers scénarios sur site. Pour répondre aux besoins en supercalcul IA sur ordinateur de bureau et à usage personnel, GIGABYTE associe son supercalculateur IA de bureau « AI TOP ATOM » à la superpuce NVIDIA GB10 Grace Blackwell, permettant ainsi aux développeurs de déployer, de procéder à un post-entraînement et d’exécuter facilement Nemotron 3.5 Lightning directement depuis leur bureau — reliant ainsi de manière transparente les écosystèmes informatiques de périphérie et d’entreprise.
Déclaration de GIGABYTE :
« Nous sommes fiers de poursuivre notre étroite collaboration avec NVIDIA afin d’offrir une prise en charge immédiate du dernier modèle Nemotron 3.5 Lightning et de la bibliothèque de routage du modèle NeMo Switchyard. Que ce soit sur des serveurs de centre de données ou sur la plateforme de bureau compacte AI TOP ATOM, GIGABYTE fournit une prise en charge matérielle de haut niveau pour aider les entreprises et les développeurs du monde entier à mettre en place une infrastructure d’IA agentique sécurisée, hautement performante et autonome. »
Aperçu des principaux avantages

Pour consulter les spécifications complètes et les détails du produit, rendez-vous sur :
https://www-intra.gigabyte.com/AI-TOP-PC/GIGABYTE-AI-TOP-ATOM