IA souveraine

Modèle local ou modèle infonuagique : comment choisir

Faut-il exécuter un modèle ouvert sur vos propres serveurs, ou utiliser un modèle hébergé par un fournisseur et accessible par API ? Il n'y a pas de meilleur modèle dans l'absolu, seulement une meilleure adéquation avec vos données et votre contexte.

Deux façons d'utiliser un modèle

Un modèle hébergé (par exemple Claude d'Anthropic ou les modèles d'OpenAI) s'utilise par Internet : vos requêtes sont traitées sur les serveurs du fournisseur, qui facture à l'usage. Aucune infrastructure à gérer, et un accès aux modèles les plus performants.

Un modèle ouvert (par exemple de la famille Mistral ou Llama) peut être téléchargé et exécuté sur vos serveurs ou dans un nuage que vous contrôlez. Les requêtes restent dans votre environnement. En contrepartie, vous prenez en charge l'infrastructure, les mises à jour et la surveillance.

La différence essentielle porte donc sur le lieu où vos données sont traitées, et sur qui exploite le système.

Quand un modèle local se justifie

  • Les données sont sensibles : dossiers clients, renseignements de santé, propriété intellectuelle, informations financières. Garder le traitement chez vous réduit le nombre de tiers et de lieux à encadrer.
  • Vos obligations limitent les communications à l'extérieur : contrats, engagements envers vos clients, ou communications hors Québec qui exigeraient une évaluation préalable au sens de la Loi 25. Un modèle local ne rend pas conforme à lui seul, mais il simplifie l'analyse.
  • L'usage est intensif et régulier : à fort volume, une infrastructure dédiée peut devenir plus prévisible qu'une facturation à l'usage. Il faut toutefois compter l'équipement, l'énergie et le temps d'exploitation.
  • Vous voulez maîtriser les versions : un modèle local ne change pas sans votre décision.

Quand un modèle hébergé est le bon choix

  • Vous commencez et voulez valider la valeur d'un usage sans investir dans une infrastructure.
  • Les tâches sont complexes : raisonnement, rédaction nuancée, analyse de longs documents. Les modèles hébergés les plus récents restent généralement plus performants que les modèles ouverts de petite taille.
  • L'usage est modéré ou irrégulier : la facturation à l'usage évite de payer une capacité inutilisée.
  • Les données ne sont pas sensibles, ou peuvent être filtrées avant l'envoi.

Souvent, la réponse est hybride

Beaucoup d'organisations n'ont pas à choisir une seule option. Une passerelle peut acheminer les requêtes selon la sensibilité des données : le modèle local pour ce qui contient des renseignements personnels ou confidentiels, un modèle hébergé pour le reste, si vous l'avez autorisé par écrit. Chaque décision de routage est consignée. C'est le principe que nous décrivons sur la page IA souveraine.

Les questions à se poser

  • Quels types de données le système traitera-t-il ?
  • Quel volume d'utilisation prévoyez-vous, et est-il régulier ?
  • Qui exploitera un déploiement local, et avec quelles compétences ?
  • Quelles obligations légales et contractuelles s'appliquent à ces données ?
  • Quelle qualité de réponse est nécessaire, et comment la mesurerez-vous ?

La dernière question est souvent oubliée. Comparer deux options exige des critères écrits et un jeu d'essai tiré de vos cas réels, plutôt qu'une impression générale.