SERVICES & SUPPORT

De la réflexion initiale à l'exploitation au quotidien

Milisoft propose quatre services : conseil en stratégie, développement sur mesure, ingénierie de modèles et exploitation. Prenez un seul volet pour combler un manque dans votre équipe, ou confiez-nous tout le parcours — du cadrage des cas d'usage à l'astreinte au long cours une fois le système en production.

Aperçu des services

Quatre services, choisis selon l'avancement du projet

Au démarrage, ce qui manque, c'est le discernement ; en cours de projet, c'est l'ingénierie ; après la mise en production, c'est quelqu'un pour surveiller le système. Chacun des quatre services ci-dessous s'achète séparément, ou s'enchaîne avec les autres en un seul parcours de bout en bout.

CONSEIL

Stratégie IA & cadrage

Nous commençons par des entretiens métier et un inventaire des systèmes que vous exploitez déjà, puis nous passons chaque cas d'usage candidat à la même grille d'évaluation : les données sont-elles accessibles, le périmètre des droits est-il clair, qui assume une réponse erronée, et les heures gagnées se convertissent-elles en argent. La moitié de la liste est en général écartée. Ce qui subsiste mérite un budget de développement.

  • Inventaire et notation des cas d'usage Classés selon la valeur métier, la faisabilité technique et la maturité des données
  • Tests de faisabilité Des essais courts sur vos propres échantillons — nous ne tirons pas de conclusions d'une démo
  • Modélisation du coût et du retour Charge de développement, coût d'inférence et gains quantifiables, avec une fourchette de délai de retour sur investissement
  • Évolutions des processus et des responsabilités Qui valide, qui est responsable, comment revenir en arrière après une erreur — le tout inscrit dans le processus
Livrables : liste priorisée des cas d'usage Rapport de faisabilité Recommandation de budget et de calendrier 2–3 semaines

Réserver une session de cadrage

Feuille de route en quatre étapes : Cadrage en 2–3 semaines, Pilote en 4–6 semaines, Mise en production en 6–10 semaines, puis Déploiement à l'échelle en continu, avec un retour qui augmente à chaque étape
DÉVELOPPEMENT SUR MESURE

Développement d'agents sur mesure

Cahier des charges, conception des interfaces, jeu d'évaluation d'abord, revue de code, déploiement canari — nous construisons les agents comme on construit du logiciel, et non en retouchant un prompt jusqu'à ce que la démo passe. Une équipe projet compte en général un architecte, deux à quatre ingénieurs et un ingénieur dédié à l'évaluation, ajustée à la hausse ou à la baisse selon l'étape.

  • Le jeu d'évaluation d'abord Dès les deux premières semaines, nous fixons le seuil de recette avec le responsable métier, avant de toucher à la logique métier
  • Démo hebdomadaire Une version qui tourne, à heure fixe chaque semaine, pour qu'une mauvaise direction soit corrigée dans la semaine
  • Tableau de bord partagé L'avancement, les anomalies et les scores d'évaluation vous sont ouverts, et le dépôt de code reste visible
  • Livrer, c'est transférer Code source, scripts de déploiement, documents d'architecture et manuel d'exploitation partent ensemble
Cahier des charges et conception des interfaces Jeu d'évaluation et seuil de recette Revue de code Déploiement canari et retour arrière Transfert du code source

Découvrir la plateforme MiliAgent

Un agent qui enchaîne planification, appels d'outils, observation et mémoire
INGÉNIERIE DE MODÈLES

Ingénierie de modèles & déploiement privé

Nous comparons les modèles candidats côte à côte sur vos propres échantillons métier avant même de décider s'il faut faire du fine-tuning — commencer par l'entraînement, c'est prendre le problème à l'envers. Ensuite, tout le travail consiste à faire tenir le modèle dans la mémoire GPU et le budget dont vous disposez réellement : distillation, quantification, traitement par lots et mise en cache sont réglés ensemble jusqu'à ce que la latence P95 et le coût par appel tombent tous deux dans une fourchette que vous pouvez accepter.

  • Sélection des modèles API commerciales, modèles ouverts auto-hébergés et modèles spécialisés par fine-tuning, comparés sur un même jeu d'échantillons
  • Instruction tuning et distillation Alignement sur votre terminologie à partir de peu d'échantillons ; distillation d'un grand modèle vers un modèle que vous pouvez héberger vous-même
  • Performances et coût d'inférence Quantification, traitement par lots, parallélisme et mise en cache réglés pour contenir la latence et la dépense
  • Déploiement souverain et hors ligne Puces et systèmes d'exploitation souverains (maîtrisés au niveau national), installables sans le moindre accès réseau
Rapport de sélection des modèles Fine-tuning et distillation Quantification et tests de charge Matériel et OS souverains Paquet d'installation hors ligne

Découvrir la passerelle de modèles MiliGate

Déploiement en couches dans un réseau privé : les données restent sur votre réseau, propagation des droits jusqu'à la recherche, contrôle des contenus en entrée et en sortie, et piste d'audit de bout en bout
SUPPORT & EXPLOITATION

Exploitation & support

Après la livraison, nous continuons à surveiller le système : volume d'appels, latence, taux d'échec et coût en tokens ont tous un seuil d'alerte. Lorsqu'un fournisseur de modèle publie une mise à jour, que la base de connaissance est restructurée ou qu'une définition métier change, la non-régression sur le jeu d'évaluation s'exécute avant tout passage en production — pour qu'une réponse juste hier ne devienne pas fausse aujourd'hui sans que personne ne le voie.

  • Supervision et alertes Latence, taux d'échec, coût et réponses erronées déclenchent une alerte au franchissement du seuil et notifient la bonne personne selon la gravité
  • Non-régression avant chaque livraison Le jeu d'évaluation complet s'exécute avant tout changement de modèle ou de prompt ; rien ne part tant que la comparaison n'est pas concluante
  • Revue des coûts Dépense ventilée par département et par cas d'usage, avec signalement des appels qui s'emballent et des relances inutiles
  • Réponse aux incidents et revue trimestrielle Prise en charge selon le niveau de SLA, avec une liste d'améliorations écrite à échéance régulière
Astreinte 7×24 Alertes sur seuil Non-régression avant livraison Revue des coûts Revue d'optimisation trimestrielle

Comparer les trois niveaux de service

Chronologie d'un incident : une alerte se déclenche, un ingénieur prend la main, et le service est rétabli dans la fenêtre du SLA
NIVEAUX DE SERVICE

Trois niveaux de service, adaptés à la criticité du système

Un pilote interne et un système dont dépendent vos clients n'appellent pas la même couverture. Les trois niveaux ci-dessous diffèrent surtout par les plages horaires, la rapidité de réponse et la fréquence des optimisations. Le contrat se signe système par système — inutile de placer toute l'entreprise sur le même niveau.

Standard

Pour les pilotes internes, les outils d'un département et les systèmes métier non critiques

  • Plage de service 9:00–18:00 les jours ouvrés
  • Première réponse aux alertes sous 4 heures
  • Support par e-mail et par ticket
  • Accompagnement à distance pour les correctifs de sécurité trimestriels et les montées de version
  • Non-régression sur le jeu d'évaluation deux fois par an

En savoir plus sur Standard

Flagship

Pour les systèmes exposés aux clients, ceux qui touchent au chiffre d'affaires et ceux soumis à des exigences réglementaires

  • Astreinte 7×24, jours fériés compris
  • Première réponse aux alertes sous 15 minutes
  • Un interlocuteur technique nommé et un suppléant
  • Non-régression et revue d'optimisation mensuelles
  • Intervention sur site pour les montées de version majeures

En savoir plus sur Flagship

Prestation Standard Professional Flagship
Plages de service Jours ouvrés 9:00–18:00 Jours ouvrés 9:00–21:00 7×24, jours fériés compris
Première réponse aux alertes Sous 4 heures Sous 1 heure Sous 15 minutes
Objectif de rétablissement 2 jours ouvrés 8 heures 4 heures
Interlocuteur technique nommé et un suppléant
Revue d'optimisation trimestrielle mensuelle
Fréquence des tests de non-régression Deux fois par an Trimestrielle Mensuelle, et avant chaque changement
Accompagnement des montées de version Accompagnement à distance Mise en œuvre à distance Mise en œuvre sur site
Fenêtre de changement d'urgence demandée 1 jour ouvré à l'avance demandée à tout moment

Le tableau ci-dessus décrit les niveaux de service dans leurs grandes lignes. Les indicateurs de SLA précis, leur mode de mesure, la répartition des responsabilités et les exceptions applicables sont régis par le contrat de service signé entre les deux parties.

FAQ

Questions fréquentes

Comment les prestations sont-elles tarifées ?

Le conseil est facturé au projet, le périmètre et les livrables étant détaillés ligne par ligne dans le contrat. Le développement sur mesure est chiffré en jours-homme et recetté étape par étape — si une étape n'est pas validée, la suivante ne démarre pas. L'exploitation fait l'objet d'un abonnement annuel ; le prix dépend du niveau retenu et du nombre de systèmes couverts.

Les coûts de calcul ou d'API liés à l'inférence sont en principe réglés directement par vos soins. Nous en donnons une fourchette estimée dans la proposition, puis nous les ventilons par département une fois le système en production, pour que personne ne découvre un dépassement en fin de mois.

Peut-on acheter le conseil seul ?

Oui. Le conseil est vendu comme une prestation autonome. Vous repartez avec une liste priorisée de cas d'usage, un rapport de faisabilité et une recommandation de budget et de calendrier — à vous de construire ensuite, ou de confier le dossier à une autre équipe. Aucune clause d'exclusivité.

Certains clients terminent la mission et concluent que la bonne étape suivante est la gouvernance des données, l'IA étant reportée. C'est aussi un résultat valable.

À qui appartient le code source des développements sur mesure ?

La propriété intellectuelle des développements réalisés spécifiquement pour vous vous revient. Le code source, les scripts de déploiement et les documents d'architecture sont livrés avec le projet, et nous organisons une revue de code commentée pour que vos ingénieurs sachent le lire et le modifier.

Les modules de la plateforme Milisoft, eux, sont fournis sous licence. L'étendue de cette licence, ce que vous pouvez modifier et les modalités de mise à jour sont convenues séparément dans le contrat — vous ne vous retrouverez pas avec une livraison à laquelle vous ne pouvez pas toucher.

Intervenez-vous sur site ?

Oui. Par défaut, nous travaillons à distance avec des présences sur site aux moments qui comptent : cadrage du besoin, tests d'intégration en production, bascule et transfert de compétences. Pour les projets impliquant des réseaux isolés, des données qui ne peuvent pas sortir des locaux ou des environnements souverains, les ingénieurs peuvent être sur site pendant toute la mission.

Le nombre de personnes, la durée et le coût des interventions sur site sont convenus séparément. Le niveau Flagship inclut par défaut l'intervention sur site pour les montées de version majeures.

Quels environnements de déploiement prenez-vous en charge ?

Cloud public, cloud privé, votre propre centre de données et réseaux internes entièrement hors ligne. Le système est livré sous forme de conteneurs et s'exécute sur Kubernetes ; une installation sur une seule machine reste possible pour les déploiements plus modestes.

Pour les environnements souverains, nous prenons en charge les puces et systèmes d'exploitation maîtrisés au niveau national. Les modèles précis demandent une vérification de l'environnement avant le démarrage du projet ; nous fournissons une liste de contrôle et les ressources minimales requises.

Que se passe-t-il si nous avons besoin d'aide en urgence, hors contrat ?

Nous intervenons d'abord, la question du coût se règle ensuite. Si la production est indisponible, quel que soit votre niveau de service, ouvrez un ticket ou écrivez à contact@milisoft.com pour escalader. L'ingénieur d'astreinte est alerté et commence immédiatement à circonscrire le problème.

L'intervention est ensuite facturée au temps réellement passé, avec un rapport post-incident écrit couvrant la cause racine et les correctifs. Si le même type de problème revient, nous recommanderons un changement de niveau de service ou d'architecture plutôt que de facturer incident après incident.

Vous ne savez pas par quel volet commencer ?

Décrivez la tâche que vous voudriez le plus automatiser. En 60 minutes, nous savons en général s'il s'agit d'un sujet de conseil, d'ingénierie ou d'exploitation, et nous revenons vers vous avec une première étape claire. Avant-vente et support technique passent tous deux par contact@milisoft.com.