Spectro Cloud lance PaletteAI Inference Launchpad pour réduire de 70% les coûts des tokens d'entreprise

21 Jul 2026
SAN JOSÉ, Californie

Spectro Cloud, l'un des principaux fournisseurs de logiciels de gestion d'infrastructure d'IA, lance aujourd'hui PaletteAI Inference Launchpad, une solution clé en main gérée localement conçue pour aider les entreprises à réduire de 70% les coûts des tokens et à exécuter l'inférence d'IA plus près de leurs données, applications et utilisateurs.

Ce communiqué de presse contient des éléments multimédias. Voir le communiqué complet ici : https://www.businesswire.com/news/home/20260721691144/fr/

La société a également annoncé une prise en charge étendue de PaletteAI pour l’infrastructure IA alimentée par AMD, y compris les GPU AMD, AMD GPU Operator, le runtime ROCm™ et la pile de référence d’IA d’entreprise AMD, y compris les modèles optimisés AMD du catalogue AMD Inference Microservices (AIM).

Ensemble, les annonces étendent PaletteAI en tant que plateforme unique pour l’infrastructure d’IA de production dans des environnements hétérogènes, offrant aux entreprises, aux néoclouds et aux fournisseurs de cloud souverains une voie plus flexible pour exécuter une infrastructure d’IA gouvernée sur les puces NVIDIA et AMD.

L'infrastructure d'IA entre dans l'économie des tokens. Goldman Sachs Research prévoit que la consommation des tokens IA sera multipliée par 24 d'ici 2030, pour atteindre 120 quadrillions de tokens par mois à mesure que l'adoption par les consommateurs et les entreprises augmentera. À mesure que l'IA entre en production, l'utilisation des tokens devient une préoccupation opérationnelle. Les entreprises doivent gérer le coût des tokens, l'utilisation des compteurs, appliquer la gouvernance et décider quand les charges de travail doivent s'exécuter localement par rapport aux services de modèles externes. En parallèle, les clients recherchent un plus grand choix entre les GPU, les modèles, les runtimes et les environnements de déploiement.

PaletteAI Inference Launchpad offre aux entreprises un moyen clé en main et géré localement pour opérationnaliser l'inférence d'IA sans devoir construire en interne ni maintenir une pile d'inférence. Les équipes peuvent rapprocher l'inférence de l'endroit où le travail se produit, acheminer intelligemment les demandes à travers les modèles locaux et frontaliers, utiliser les tokens de compteur, appliquer les politiques de gouvernance et de quotas et réduire la dépendance aux services d'inférence externes lorsque les modèles locaux conviennent mieux. En fonction de la combinaison de charges de travail et des caractéristiques de déploiement, les organisations peuvent réduire jusqu'à 70% les coûts des tokens.

Conçu pour l'inférence axée sur le local, PaletteAI Inference Launchpad combine la simplicité de l'opération locale clé en main avec la flexibilité de préserver l'accès au modèle pionnier en cas de besoin. Prenant en charge les infrastructures NVIDIA et AMD, la solution offre aux entreprises, aux néoclouds et aux fournisseurs de cloud souverains un modèle opérationnel cohérent pour le déploiement, la gouvernance et la mise à l'échelle de l'inférence de l'IA dans des environnements d'IA hétérogènes.

Grâce à la prise en charge étendue d'AMD, PaletteAI offre aux entreprises, aux néoclouds et aux fournisseurs de cloud souverains une voie validée pour opérationnaliser l'infrastructure d'IA alimentée par AMD. PaletteAI assure la gestion du cycle de vie de l'ensemble de la pile (du bare metal à Kubernetes, en passant par les GPU, les runtimes, les modèles, les services d'inférence et les contrôles au niveau des tokens), aidant les clients à déployer, gouverner, exploiter et faire évoluer leurs environnements d'IA basés sur AMD tout en préservant la flexibilité de leur pile IA.

« Les entreprises et les fournisseurs de cloud recherchent une infrastructure d’IA ouverte et évolutive qui leur donne plus de contrôle sur les coûts, les performances et les choix de déploiement », déclare Kumaran Siva, Corporate Vice President, IA d'entreprise, AMD. « La prise en charge par Spectro Cloud de l’infrastructure alimentée par AMD dans PaletteAI et PaletteAI Inference Launchpad aide les clients à accélérer les déploiements d’IA de production sur des piles d’IA flexibles et ouvertes. »

Pour étendre PaletteAI Inference Launchpad aux entreprises des secteurs réglementés, ainsi qu'aux environnements néocloud et souverains, Spectro Cloud travaille avec des partenaires d'infrastructure et de services spécialisés dans ces marchés. Basé à Austin et à Dubaï, NexusIgnite est parmi les premiers à s'associer à Spectro Cloud pour aider les clients à déployer et à exploiter une infrastructure d'inférence d'IA où la résidence des données, la gouvernance et le contrôle opérationnel sont des exigences essentielles.

« NexusIgnite se concentre sur la fourniture d'une infrastructure d'IA souveraine pour les organisations ayant des exigences strictes en matière de résidence, de gouvernance et de conformité des données », déclare Greg Forrest, CEO, NexusIgnite. « Alors que l’IA d’entreprise entre en phase de production, les clients ont besoin de services d’inférence plus faciles à déployer, à exploiter et à gérer sur l’ensemble de leur infrastructure GPU. PaletteAI Inference Launchpad de Spectro Cloud s'inscrit dans notre stratégie d'infrastructure d'IA gérée et donne à ces clients un chemin plus rapide vers la production dans des environnements souverains éprouvés. »

Disponibilité

PaletteAI Inference Launchpad et la prise en charge étendue d'AMD pour PaletteAI sont disponibles dès maintenant. Veuillez contacter votre représentant Spectro Cloud pour planifier une démonstration en direct ou visitez www.spectrocloud.com.

Les participants à l'AMD Advancing AI pourront voir des démonstrations en direct de PaletteAI Inference Launchpad du 22 au 23 juillet 2026, sur le stand 515A ou dans la suite hôtelière Spectro Cloud. Les participants pourront également suivre la session ISV Pavilion Expo Theater du CTO et cofondateur de Spectro Cloud, Saad Malik, à 14h20 PT le mercredi 22 juillet.

À propos de Spectro Cloud

Spectro Cloud aide les équipes de plateformes et les fournisseurs de cloud à moderniser et à gérer l'infrastructure pour l'ère de l'IA sans ajouter d'outils ni de complexité opérationnelle.

Avec PaletteAI, les entreprises, les organisations du secteur public, les néoclouds et les clouds souverains peuvent créer, déployer, gérer, gouverner et mettre à l'échelle des environnements complets à travers les machines virtuelles, Kubernetes, les sites périphériques, réglementés et isolés, et l'infrastructure d'IA. PaletteAI aide les équipes à démarrer rapidement avec Launchpads : des solutions clés en main gérées localement pour des résultats urgents tels que la modernisation des machines virtuelles, le contrôle des coûts des tokens et les opérations périphériques, puis à évoluer vers une gestion centralisée du cycle de vie, une gouvernance et des opérations de flotte sur la même plateforme.

AMD, le logo AMD Arrow et leurs combinaisons sont des marques commerciales d'Advanced Micro Devices, Inc.

Le texte du communiqué issu d’une traduction ne doit d’aucune manière être considéré comme officiel. La seule version du communiqué qui fasse foi est celle du communiqué dans sa langue d’origine. La traduction devra toujours être confrontée au texte source, qui fera jurisprudence.

 

© Business Wire, Inc.

Aviso legal :
Este comunicado de imprensa não é um documento produzido pela AFP. A AFP não será responsável por este conteúdo. Para mais informações, por favor entre em contato com as pessoas ou entidades mencionadas no comunicado.