SERVICES & SUPPORT

Vom Konzept bis zum laufenden Betrieb

Milisoft bietet vier Services: Strategieberatung, Individualentwicklung, Modell-Engineering und Betriebssupport. Buchen Sie einen einzelnen Baustein, um eine Lücke im eigenen Team zu schließen, oder legen Sie den gesamten Weg in unsere Hand — von der Use-Case-Discovery bis zur langfristigen Rufbereitschaft nach dem Go-live.

Service-Überblick

Vier Services, passend zum Stand Ihres Projekts

Am Anfang fehlt das Urteilsvermögen, in der Mitte die Entwicklungsleistung, nach dem Go-live jemand, der das System im Blick behält. Jeder der vier Services lässt sich einzeln buchen oder mit den anderen zu einem durchgehenden Projektablauf verbinden.

BERATUNG

KI-Strategie & Discovery

Wir beginnen mit Fachinterviews und einer Bestandsaufnahme Ihrer bestehenden Systeme und bewerten dann jeden Use Case nach derselben Scorecard: ob die Daten erreichbar sind, ob die Berechtigungsgrenze klar ist, wer eine falsche Antwort verantwortet und ob sich die eingesparten Stunden in Geld umrechnen lassen. Die Hälfte der Liste fällt dabei üblicherweise weg. Was übrig bleibt, ist ein Entwicklungsbudget wert.

  • Use-Case-Inventar und Bewertung Rangfolge nach Geschäftsnutzen, technischer Machbarkeit und Datenreife
  • Machbarkeitstests Kleine Durchläufe auf Ihren eigenen Beispieldaten — aus einer Demo ziehen wir keine Schlüsse
  • Kosten- und Nutzenmodell Entwicklungsaufwand, Inferenzkosten und bezifferbarer Nutzen, mit einer Amortisationsspanne
  • Änderungen an Prozessen und Verantwortlichkeiten Wer prüft, wer verantwortet, wie ein Fehler zurückgenommen wird — festgehalten im Prozess
Ergebnisse: priorisierte Use-Case-Liste Machbarkeitsbericht Budget- und Zeitplanempfehlung 2–3 Wochen

Discovery-Termin buchen

Roadmap in vier Stufen: Discovery in 2–3 Wochen, Pilot in 4–6 Wochen, Produktivbetrieb in 6–10 Wochen, danach laufender Rollout, mit in jeder Stufe steigendem Nutzen
INDIVIDUALENTWICKLUNG

Agent-Entwicklung nach Maß

Anforderungen, Schnittstellendesign, zuerst das Evaluationsset, Code-Review, Canary-Release — wir bauen Agenten so, wie Software gebaut wird, und nicht, indem wir so lange an einem Prompt feilen, bis die Demo gut aussieht. Ein Projektteam besteht typischerweise aus einem Architekten, zwei bis vier Entwicklern und einem Evaluation Engineer und wird je nach Phase vergrößert oder verkleinert.

  • Evaluationsset zuerst In den ersten zwei Wochen stimmen wir die Abnahmebasis mit dem Fachbereich ab, bevor wir Geschäftslogik anfassen
  • Wöchentliche Demo Jede Woche zur festen Zeit eine lauffähige Version, damit ein Irrweg noch in derselben Woche korrigiert wird
  • Gemeinsames Board Fortschritt, Fehler und Evaluationswerte liegen für Sie offen, das Code-Repository bleibt einsehbar
  • Lieferung heißt Übergabe Quellcode, Deployment-Skripte, Architekturdokumente und das Betriebs-Runbook gehen gemeinsam über
Anforderungen und Schnittstellendesign Evaluationsset und Abnahmebasis Code-Review Canary-Release und Rollback Quellcode-Übergabe

Mehr zur Plattform MiliAgent

Ein Agent durchläuft im Kreislauf Planung, Tool-Calls, Beobachtung und Gedächtnis
MODELL-ENGINEERING

Modell-Engineering & Private Deployment

Wir vergleichen die infrage kommenden Modelle direkt nebeneinander auf Ihren eigenen Fachdaten, bevor wir überhaupt über Fine-Tuning entscheiden — zuerst zu trainieren ist die falsche Reihenfolge. Danach geht es darum, das Modell in den GPU-Speicher und das Budget zu bringen, die Sie tatsächlich haben: Distillation, Quantisierung, Batching und Caching werden gemeinsam abgestimmt, bis P95-Latenz und Kosten pro Aufruf beide in einem für Sie akzeptablen Bereich liegen.

  • Modellauswahl Kommerzielle APIs, selbst gehostete offene Modelle und fachspezifische Fine-Tunes auf ein und demselben Beispieldatensatz verglichen
  • Instruction-Tuning und Distillation Abgleich mit Ihrer Terminologie anhand weniger Beispiele; ein großes Modell wird zu einem selbst betreibbaren destilliert
  • Inferenzleistung und Kosten Quantisierung, Batching, Nebenläufigkeit und Caching so abgestimmt, dass Latenz und Ausgaben niedrig bleiben
  • Souveränes und Offline-Deployment Souveräne (national kontrollierte) Chips und Betriebssysteme, installierbar ganz ohne Netzzugang
Bericht zur Modellauswahl Fine-Tuning und Distillation Quantisierung und Lasttests Souveräne Hardware und Betriebssysteme Offline-Installer

Mehr zum Model Gateway MiliGate

Geschichtetes Deployment im privaten Netz: Daten bleiben in Ihrem Netz, Berechtigungsdurchgriff bis ins Retrieval, Inhaltsprüfung von Ein- und Ausgaben und ein durchgehender Audit-Trail
SUPPORT & BETRIEB

Betrieb & Support

Nach der Übergabe behalten wir das System im Blick: Aufrufvolumen, Latenz, Fehlerquote und Token-Kosten haben jeweils Alarmschwellen. Wenn ein Modellanbieter ein Update ausliefert, die Wissensbasis umgebaut wird oder sich eine fachliche Definition ändert, läuft die Evaluations-Regression, bevor irgendetwas durchgelassen wird — damit eine Antwort, die gestern richtig war, heute nicht unbemerkt falsch wird.

  • Monitoring und Alerting Latenz, Fehlerquote, Kosten und schlechte Antworten lösen bei Überschreiten des Schwellenwerts aus und benachrichtigen je nach Schweregrad die richtige Person
  • Release-Regression Vor jedem Modellwechsel und jeder Prompt-Änderung läuft das vollständige Evaluationsset; ausgeliefert wird erst, wenn der Vergleich besteht
  • Kosten-Review Ausgaben nach Abteilung und Use Case abgerechnet, mit Hinweis auf ausufernde Aufrufe und sinnlose Wiederholungen
  • Incident-Response und Quartals-Review Reaktion nach SLA-Stufe, mit einer schriftlichen Liste von Verbesserungen in festem Turnus
7×24 Rufbereitschaft Schwellenwert-Alarme Release-Regression Kosten-Review Vierteljährliches Optimierungs-Review

Die drei Service-Stufen vergleichen

Zeitverlauf einer Störung: ein Alarm wird ausgelöst, ein Engineer übernimmt, und der Service ist innerhalb des SLA-Fensters wiederhergestellt
SERVICE-STUFEN

Drei Service-Stufen, passend zur Kritikalität des Systems

Ein interner Pilot und ein System, auf das sich Ihre Kunden verlassen, brauchen sehr unterschiedliche Absicherung. Die drei Stufen unterscheiden sich vor allem in Servicezeiten, Reaktionsgeschwindigkeit und Optimierungsrhythmus. Abgeschlossen wird pro System — das ganze Unternehmen muss nicht auf einer Stufe liegen.

Standard

Für interne Piloten, Abteilungswerkzeuge und nicht kritische Fachsysteme

  • Servicezeiten 9:00–18:00 Uhr an Werktagen
  • Erste Reaktion auf Alarme innerhalb von 4 Stunden
  • Support per E-Mail und Ticket
  • Remote-Begleitung bei vierteljährlichen Sicherheits-Patches und Versions-Upgrades
  • Evaluations-Regression zweimal jährlich

Standard anfragen

Flagship

Für kundenseitige Systeme, umsatzrelevante Systeme und Systeme mit regulatorischen Auflagen

  • 7×24 Rufbereitschaft, auch an Feiertagen
  • Erste Reaktion auf Alarme innerhalb von 15 Minuten
  • Benannter technischer Ansprechpartner plus Vertretung
  • Evaluations-Regression und Optimierungs-Review monatlich
  • Umsetzung vor Ort bei größeren Versions-Upgrades

Flagship anfragen

Leistung Standard Professional Flagship
Servicezeiten Werktags 9:00–18:00 Uhr Werktags 9:00–21:00 Uhr 7×24, auch an Feiertagen
Erste Reaktion auf Alarme Innerhalb von 4 Stunden Innerhalb von 1 Stunde Innerhalb von 15 Minuten
Wiederherstellungsziel 2 Werktage 8 Stunden 4 Stunden
Benannter technischer Ansprechpartner plus Vertretung
Optimierungs-Review vierteljährlich monatlich
Frequenz der Evaluations-Regression Zweimal jährlich Vierteljährlich Monatlich und vor jeder Änderung
Unterstützung bei Versions-Upgrades Remote-Begleitung Remote-Umsetzung Umsetzung vor Ort
Notfall-Änderungsfenster Anmeldung 1 Werktag vorher Anmeldung jederzeit

Die Tabelle beschreibt die Service-Stufen in allgemeiner Form. Die konkreten SLA-Kennzahlen, ihre Messung, die Verteilung der Verantwortung und die geltenden Ausnahmen richten sich nach dem beiderseits unterzeichneten Servicevertrag.

FAQ

Häufige Fragen

Wie wird abgerechnet?

Die Beratung wird pro Projekt kalkuliert; Umfang und Ergebnisse stehen Position für Position im Vertrag. Die Individualentwicklung wird in Personentagen angeboten und phasenweise abgenommen — besteht eine Phase die Abnahme nicht, startet die nächste nicht. Der Betriebssupport ist ein Jahresabonnement; der Preis richtet sich nach der gewählten Stufe und der Zahl der betreuten Systeme.

Rechen- und API-Kosten für die Modellinferenz zahlen Sie in der Regel direkt. Im Angebot nennen wir eine geschätzte Spanne und rechnen sie im laufenden Betrieb nach Abteilung ab, damit niemand am Monatsende von einer Überschreitung überrascht wird.

Können wir die Beratung einzeln buchen?

Ja. Die Beratung ist eine eigenständige Leistung. Am Ende haben Sie eine priorisierte Use-Case-Liste, einen Machbarkeitsbericht sowie eine Budget- und Zeitplanempfehlung — setzen Sie sie selbst um oder geben Sie sie an ein anderes Team weiter. Eine Bindungsklausel gibt es nicht.

Manche Kunden kommen am Ende der Beratung zu dem Schluss, dass zunächst Data Governance ansteht und KI später folgt. Auch das ist ein gültiges Ergebnis.

Wem gehört der Quellcode aus der Individualentwicklung?

Die Rechte an allem, was eigens für Sie entwickelt wird, liegen bei Ihnen. Quellcode, Deployment-Skripte und Architekturdokumente werden mit dem Projekt übergeben, und wir führen einen Code-Walkthrough durch, damit Ihre Entwickler den Code lesen und ändern können.

Die eigenen Plattformmodule von Milisoft werden lizenziert bereitgestellt. Lizenzumfang, erlaubte Änderungen und der Ablauf von Upgrades werden im Vertrag gesondert vereinbart — Sie erhalten keine Lieferung, die Sie nicht anfassen dürfen.

Arbeiten Sie auch vor Ort?

Ja. Standard ist die Remote-Arbeit mit Präsenz zu den entscheidenden Zeitpunkten: Anforderungsklärung, Integrationstests in der Produktivumgebung, Umstellung und Schulungsübergabe. Bei Projekten mit isolierten Netzen, mit Daten, die das Haus nicht verlassen dürfen, oder mit souveränen Umgebungen können unsere Engineers über die gesamte Laufzeit vor Ort sein.

Personenzahl, Dauer und Kosten des Vor-Ort-Einsatzes werden gesondert vereinbart. Die Stufe Flagship enthält die Umsetzung vor Ort bei größeren Versions-Upgrades standardmäßig.

Welche Betriebsumgebungen unterstützen Sie?

Public Cloud, Private Cloud, Ihr eigenes Rechenzentrum und vollständig offline betriebene interne Netze. Das System wird containerisiert ausgeliefert und läuft auf Kubernetes; für kleinere Installationen ist auch der Betrieb auf einem einzelnen Server möglich.

Für souveräne Umgebungen unterstützen wir national kontrollierte Chips und Betriebssysteme. Konkrete Modelle brauchen vor Projektbeginn eine Prüfung der Umgebung; dafür stellen wir eine Checkliste und die Mindestanforderungen an Ressourcen bereit.

Was passiert, wenn wir außerhalb des Vertrags dringend Hilfe brauchen?

Wir beheben zuerst, abgerechnet wird danach. Steht der Produktivbetrieb still, eskalieren Sie unabhängig von Ihrer Stufe per Ticket oder per E-Mail an contact@milisoft.com. Der Engineer in Rufbereitschaft wird alarmiert und beginnt sofort damit, das Problem einzugrenzen.

Der Aufwand wird anschließend nach tatsächlichem Einsatz abgerechnet, mit einem schriftlichen Bericht zu Ursache und Behebung. Tritt dieselbe Art von Problem wiederholt auf, empfehlen wir einen Wechsel der Stufe oder der Architektur, statt weiter pro Vorfall abzurechnen.

Unklar, welcher Teil zuerst ansteht?

Beschreiben Sie die eine Aufgabe, die Sie am dringendsten automatisieren wollen. In 60 Minuten lässt sich meist sagen, ob es eine Beratungs-, eine Entwicklungs- oder eine Betriebsfrage ist, und wir nennen Ihnen einen klaren ersten Schritt. Vertrieb und technischer Support sind gleichermaßen unter contact@milisoft.com erreichbar.