Aller au contenu
PERINGER Data Solutions, retour à l’accueil

Retour

← Tous les articles

L’IA interne sans cloud américain : réaliste en 2026 ?

Publié le · mis à jour le

La question revient dans presque chaque échange avec une direction : « Nous aimerions utiliser l’IA, mais nous ne pouvons pas envoyer nos fichiers à OpenAI. » L’inquiétude est fondée : le CLOUD Act américain permet aux autorités des États-Unis d’exiger l’accès à des données qu’un fournisseur contrôle, même hébergées dans un centre de données suisse. La portée de la demande et les voies de recours dépendent du cas. En 2026, la réponse honnête n’est plus « impossible ». C’est devenu une question d’assemblage : quel modèle pour quelle tâche, et où le faire tourner.

Les changements récents

Trois évolutions ont marqué l’année. Les modèles à poids ouverts sont devenus crédibles sur des tâches délimitées : vous pouvez mesurer Kimi K2.6 et Qwen3.5, ainsi que plusieurs modèles Mistral, face aux services propriétaires, sur votre propre jeu d’évaluation.

La Suisse a de son côté publié Apertus, issu de l’EPFL, de l’ETH Zurich et du CSCS, l’un des rares grands modèles dont les poids et le code sont publics, avec de vraies informations sur les données d’entraînement.

L’hébergement suisse a mûri lui aussi : Infomaniak sert ces modèles depuis Genève par une API compatible OpenAI, avec un engagement publié de ne pas entraîner de modèles sur les requêtes ; Swisscom et Exoscale complètent l’offre. Exigez que ces propriétés figurent dans le contrat que vous signez.

Le cadre légal, lui, reste sectoriel : la LPD révisée, le secret professionnel, le droit du travail, la propriété intellectuelle et les règles de branche s’appliquent déjà, sans attendre un statut général de l’IA.

Ce cadre suisse ne dit rien de la portée européenne pour un usage transfrontalier précis. Quatre questions pour une entreprise suisse séparent le rôle de l’entreprise, le lien avec l’Union européenne, l’effet sur les personnes et les preuves à réunir avant la production.

Apertus : l’atout traçabilité, et ses limites

Je ne recommande pas Apertus pour ses performances brutes. Je le propose quand la traçabilité du modèle compte davantage que le score.

Apertus vaut moins par ses capacités brutes que par sa transparence, documentation et code publiés, et par une couverture des langues suisses qui va jusqu’à l’allemand suisse et au romanche. Cette couverture intéresse l’administration ou l’école qui veut inspecter sa chaîne technique.

Sur un déploiement précis, Liip a mesuré 82 % de réponses acceptables après huit mois, sur un assistant communal zurichois. Ce chiffre dépend des questions posées par Liip et du seuil d’acceptation retenu ; il ne constitue pas une référence générale. Le français, le raisonnement, les tâches longues : testez-les sur vos propres documents. Apertus s’adapte localement, sans être pour autant la meilleure base de départ pour un ajustement spécialisé, le fine-tuning, dans tous les usages.

Le complément pour la puissance

Pour du raisonnement exigeant, Kimi K2.6 est un candidat ; il est trop volumineux pour une petite installation, et certains catalogues hébergés le proposent. L’analyse ne s’arrête ni à l’origine des données d’entraînement ni à l’emplacement du centre de données. Un modèle téléchargé dépend encore du logiciel qui l’exécute, de bibliothèques, de journaux, des données techniques envoyées pour la surveillance et d’un canal d’administration. Un modèle chinois exécuté à Genève réduit certains risques par rapport à une API américaine ; l’opérateur, le contrat, les sous-traitants ultérieurs, les clés, les accès d’administration, la licence et la chaîne de mise à jour restent à examiner.

BesoinCandidats à tester au 14 août 2026Conditions de déploiement
Assistant documentaire avec sourcesApertus 70B ou un modèle qualifiéService ou matériel approuvé, dimensionné pour la précision, le contexte et la simultanéité
Extraction, classification et réponses standardApertus 8B, Qwen3.5 ou un modèle Mistral adaptéTest interne sur vos documents ; la mémoire nécessaire couvre le modèle, le logiciel d’exécution et le texte gardé pendant la réponse
Raisonnement complexe et agentsKimi K2.6 ou un modèle de pointe qualifiéService externe ou groupe de serveurs approuvé, actions autorisées limitées, validation humaine et historique des opérations
Code confidentielDevstral Small 2 ou un autre modèle de codeLa mémoire dépend du niveau de compression du modèle et de la longueur des documents ; dépôts, mots de passe, clés et outils restent isolés

Les usages qui marchent, et ceux qui ne marchent pas encore

Dans une entreprise de 10 à 100 personnes, trois usages se prêtent à un pilote mesuré : la recherche dans des documents internes avec les sources affichées ; la transcription et le résumé de séances, dans le respect des règles applicables ; l’extraction de champs ou la classification de formulaires. La maturité de chacun dépend de la qualité exigée, de la langue, des contrôles et du prix d’une erreur. Même bien conçu, un environnement en logiciels ouverts reste en retrait des derniers modèles propriétaires sur certaines tâches. Et aucun modèle ne rattrape des données en désordre.

Les composants d’un environnement maîtrisé

  • Hébergement : un serveur sur site pour le plus sensible ; Infomaniak, Exoscale ou Swisscom pour le reste
  • Production des réponses : vLLM pour servir le modèle à une équipe, Ollama pour un poste de travail
  • Modèles : choisissez par le test, pas par la nationalité. Le guide de sélection de Mistral décrit Small 4 comme 119 milliards de paramètres au total et 6,5 milliards actifs ; le présenter comme taillé pour un « GPU modeste » sans dire la quantification, le contexte et la simultanéité tromperait le lecteur
  • Voix : Voxtral ou Whisper, transcrits localement
  • Mémoire documentaire : PostgreSQL avec pgvector, ou Qdrant, sur la même infrastructure
  • Interface : Open WebUI ou une interface maison, sur votre domaine

La souveraineté, ici, n’est ni un slogan ni une adresse de serveur. Regardez avec qui vous contractez, quelles juridictions s’appliquent à votre cas, où le prestataire traite vos données, qui sont ses sous-traitants ultérieurs, qui dispose des accès d’assistance et des clés, quelles données de surveillance quittent votre système, ce que dit la licence, comment arrivent les mises à jour, quels formats vous gardez en main et si la sortie a été testée. Une pile modulaire facilite le remplacement, sans garantir la portabilité tant que vous n’avez pas essayé de remplacer.

La méthode qui vieillit mieux que la liste

Pour chaque cas d’usage, gardez un jeu d’évaluation représentatif, une mesure de qualité et d’erreur, une classe de confidentialité, un objectif de latence, la taille du contexte, le nombre d’utilisateurs simultanés, la licence, l’opérateur, le coût total et une procédure de repli. Refaites les tests avant de changer de modèle, et au moins chaque trimestre pour les catalogues qui bougent vite.

La date du catalogue

J’ai relevé le catalogue et les caractéristiques le 14 août 2026. Modèles, offres, licences, prix et capacités changent d’un mois à l’autre. Ce tableau désigne des candidats à tester, non un classement universel ni une garantie juridique.

Un premier entretien, sans engagement

Quelques lignes sur votre projet ou votre question suffisent : je vous réponds directement, en général sous un jour ouvrable.

Prendre contact