Cloud Souverain

Model as a Service

Model as a Service – un accès souverain à l'IA d'entreprise. L'IA d'entreprise via une API sécurisée – sur une infrastructure suisse souveraine, sans infrastructure GPU propre et sans fuite de données sensibles. Le « Model as a Service » (MaaS) d’EveryWare permet une utilisation contrôlée et évolutive de modèles d’IA modernes pour les entreprises ayant des exigences élevées en matière de protection des données, de sécurité et de gouvernance.

L’intégration dans les applications et les flux de travail existants s’effectue via une API REST compatible avec OpenAI. Cela permet d’évaluer rapidement les modèles d’IA, de les déployer de manière productive et de les faire évoluer en fonction des besoins.

  • Inférence et gestion des données : Suisse
  • API : API REST compatible avec OpenAI
  • Modèles : catalogue sélectionné de modèles Open Weight prêts à l'emploi pour les entreprises
  • Types de modèles : LLM, modèles multimodaux, embeddings, reclassement, OCR et reconnaissance vocale
  • Facturation : basée sur les tokens et en fonction de l'utilisation
  • Gouvernance : budgets, limites de débit, séparation des équipes et contrôle défini des données
  • Exploitation : service cloud géré, disponible 24 h/24 et 7 j/7
  • Assistance : assistance de base incluse, options d’assistance étendues disponibles

Modèle souverain

Les modèles, l'infrastructure d'inférence et les passerelles API sont exploités sur des ressources cloud souveraines situées en Suisse.
L'exploitation est régie par le droit suisse et respecte les exigences suisses en matière de protection des données et les exigences réglementaires.
Les données et les charges de travail restent au sein de l'environnement souverain défini.

Confidentialité et contrôle

  • Les prompts et réponses ne sont pas sauvegardés.
  • Les données clients ne sont pas utilisées dans les modèles d'IA.
  • Convient aux données d'entreprise sensibles et aux charges de travail réglementées.

Utilisation et coûts prévisibles

  • Accès sécurisé à l'API via des clés API.
  • Limites de débit définies pour les requêtes et les jetons.
  • Budgets mensuels pour des coûts maîtrisables et traçables.
  • Facturation basée sur l'utilisation, en fonction de la consommation de jetons.
  • Aucun investissement dans des GPU propres et aucune dépendance à long terme vis-à-vis du matériel.

Une gestion des modèles IA simplifiée

Le MaaS réduit la complexité technique liée à l'utilisation de modèles d'IA. L'acquisition, la gestion et la mise à l'échelle de l'infrastructure GPU, ainsi que la gestion du cycle de vie des modèles, sont assurées par EveryWare sous forme de service géré.

Les entreprises peuvent ainsi tester rapidement des applications d’IA, les déployer de manière productive et les faire évoluer en fonction de leurs besoins, sans avoir à mettre en place ni à exploiter leur propre infrastructure d’IA.

Catalogue de modèles adaptés aux entreprises

Le catalogue comprend une sélection, constamment enrichie, de modèles open-source destinés aux charges de travail typiques de l'IA d'entreprise, notamment :

  • Chat et raisonnement : Apertus 70B, DeepSeek V3.2, GLM 4.5 Air 110B, GPT OSS 120B, Granite 3.3 8B, Mistral 7B Instruct v0.3, Qwen3 8B, QwQ 32B
  • Multimodal : Gemma 3 12B IT, Gemma 4 31B, Granite Vision 3.2 2B, Llama 4 Maverick, Llama 4 Scout 17B, Qwen3 VL 235B
  • Embeddings et reclassement : BGE M3, BGE Reranker v2 M3, Granite Embedding 278M
  • OCR et reconnaissance vocale : DeepSeek OCR, MinerU 2.5, Whisper Large v3

Des processus définis de mise à jour, de dépréciation et de remplacement s'appliquent aux modèles. Cela permet de planifier l'exploitation, la sécurité et la disponibilité des modèles.

Du MaaS à la plateforme d'IA souveraine

Le MaaS est conçu comme un élément constitutif d'une plateforme d'IA souveraine complète. En fonction des besoins, le service peut notamment être complété par les composants suivants :

  • Interfaces de chat LLM
  • Génération augmentée par la recherche (RAG)
  • Protocole de contexte de modèle (MCP)
  • Workflows et intégrations d’agents IA
  • MLOps pour le développement interne d’IA
  • Serveurs et passerelles LLM dédiés
  • Zones d'atterrissage IA
  • Services de plateforme d’IA gérée

Cela permet de passer progressivement d'un accès contrôlé aux modèles à une plateforme d'IA d'entreprise autonome, sans refonte inutile de l'architecture et avec une gouvernance de bout en bout.

Le MaaS au service d’une stratégie IA pragmatique

Les entreprises empruntent différentes voies pour exploiter l'IA : API d'IA publiques, modèles gérés en interne, plateformes d'IA d'hyperscalers ou « Sovereign Model as a Service ». Dans la pratique, ces approches sont souvent combinées. EveryWare aide les entreprises à concevoir, mettre en place et exploiter l’architecture la mieux adaptée à leurs besoins, de manière pragmatique, conforme et économiquement durable.

Comment se lancer avec le MaaS

L'accès à un modèle “MaaS” s'effectue via le processus suivant:

  1. Contactez-nous ci-dessous en indiquant « AI Services » comme motif de votre demande
  2. Nous étudions votre demande et clarifions les exigences techniques et organisationnelles
  3. Nous vous fournissons les identifiants d’accès pour l’évaluation et les premiers usages

Ce processus est sans engagement et jette les bases d’une évaluation technique et économique approfondie.

Contact

Vous souhaitez en savoir plus ?
Nous serions ravis de vous montrer comment intégrer un « Model as a Service » à votre architecture informatique et IA existante. N'hésitez pas à nous contacter : nous nous réjouissons d'échanger avec vous.

Nous contacter