AusgangslageKONTEXT Crisis Brain
01
Warum wir hier sind

Der wertvollste Teil eurer Arbeit ist für KI gesperrt.

ArchivJahre an dokumentierten Krisen, Planspielen, Statements, Q&As, Lagebildern und Monitoring in euren Ordnern und Postfächern
Kodexeuer eigener Umgang mit KI sagt zu Recht: keine Namen, keine sensiblen Kundendaten in öffentliche KI-Dienste
Folgegenau dieses Wissen bleibt für KI unerreichbar, bis es einen geschützten Ort bekommt

Eckwerte (Fallzahl, Datenmenge, Formate) erheben wir gemeinsam im Workshop: hier steht bewusst nichts Geschätztes.

„Such raus, wie wir das in einem ähnlichen Fall gemacht haben. Und mach einen ersten Vorschlag für den neuen Fall.“

Der Auftrag an das Brain, in einem Satz
2 / 12
Was wir bauenKONTEXT Crisis Brain
02
Das Prinzip

Wir bauen euer Company Brain.

Ein zentraler Wissensspeicher plus KI, die daraus antwortet. Der Speicher gehört euch, das Modell ist austauschbar.

01

Wissensspeicher

Eure Fälle, Statements und Methoden, aufbereitet als strukturierter Text (Markdown). Jedes KI-Modell kann ihn lesen. Er wächst mit jedem Projekt und bleibt euer Eigentum, egal welches Modell gerade läuft.

02

KI-Modell

Liest nur, was der angemeldete Nutzer sehen darf, und antwortet mit Quellenbeleg. Läuft je nach Variante in der Cloud, auf einem deutschen Server oder auf einer Maschine bei euch im Büro.

03

Zugang mit Rollen

Eine Chat-Oberfläche im Browser, Login je Person. Jan plus zwei, drei Kolleginnen und Kollegen, jede Anfrage protokolliert, Kundendaten sauber voneinander getrennt.

Die einzige echte Entscheidung ist: Wo läuft die KI, und wohin dürfen die Daten? Dafür gibt es vier Stufen.

3 / 12
Die vier StufenPreisstand 10.08.2026
Datensicherheit als Leiter

Vier Stufen zwischen Komfort und Kontrolle.

Stufe 1Cloud, Standard

Claude Team & Co.: kein Training auf euren Daten, AVV. Verarbeitung auf US-Servern.

~95 € / Monat4 Nutzer, sofort startklar
Stufe 2Cloud, Zero Retention

Enterprise-Zusatz: Anfragen werden nicht gespeichert. Optional EU-Verarbeitung.

ab ~300 € / Monatje Vertrag und Nutzung
Stufe 3Deutscher Mietserver

Eigenes, offenes Modell auf gemieteter Hardware im deutschen Rechenzentrum (Hetzner).

889 € / MonatMiete, monatlich kündbar
Stufe 4Maschine im Büro

Eigene Hardware bei euch in Fürth. Kein Datenpfad nach draußen, läuft auch ohne Internet.

~4.700 € einmaligdanach nur Strom · maximale Kontrolle
← bequemer Start, beste Modellqualitätvolle Souveränität →

Größenordnungen ohne HIL-Projektaufwand (Einrichtung, Datenaufbereitung, Schulung): den beziffern wir nach dem Workshop. Details je Stufe im Backup.

4 / 12
ArchitekturKONTEXT Crisis Brain
Was auf euren Server kommt

Ein Gerät, fünf Bausteine.

Krisenakten & Fälleabgeschlossene Mandate, Statements, Q&As
Methoden & VorlagenPlaybooks, Checklisten, Tonalität
Notizen & ProtokolleWord, PDF, Mail-Exporte, Scans
1 · Import & Aufbereitungliest Dokumente ein (inkl. Texterkennung für Scans), wandelt sie in strukturierten Text, ordnet sie einem Kunden zu
2 · WissensspeicherMarkdown-Ablage plus Suchindex (Vektor-Datenbank), strikt getrennt je Kunde
3 · KI-Modell (lokal)offenes Sprachmodell (gpt-oss-120b), antwortet nur aus freigegebenen Quellen, mit Beleg
4 · Chat-Oberflächeim Browser, im internen Netz. Login je Person, Rollen und Rechte
5 · Protokoll (Audit-Log)wer hat wann was gefragt, exportiert, importiert
Jan (Admin)alle Kunden, Nutzer- und Rechteverwaltung
2-3 Teammitgliederje nach Rolle: nur die eigenen Mandate
Kein externer Zugriffkein Cloud-Anbieter, keine Telemetrie, kein Fallback nach draußen
Gleiches Bild in allen Stufen: nur Baustein 3 wandert (Cloud, Mietserver oder Box im Büro).
5 / 12
Software auf der BoxKONTEXT Crisis Brain
Baustein für Baustein

Alles offen, alles Standard, nichts Eigenbau.

BausteinSoftwareWas sie tutLizenz
1 · Import & AufbereitungDocling + TesseractPDF, Word und Scans in sauberes Markdown wandeln, Texterkennung inklusiveMIT / Apache 2.0
2 · WissensspeicherMarkdown-Dateien + PostgreSQL mit pgvectorAblage im Klartext plus semantischer Suchindex, getrennt je Kundeoffen (PostgreSQL)
3 · KI-Modellgpt-oss-120b über vLLM (oder Ollama)das Sprachmodell selbst plus die Serving-Schicht für mehrere gleichzeitige NutzerApache 2.0
4 · Chat-OberflächeOpen WebUIfertige Chat-Oberfläche: Login, Rollen, Arbeitsräume, Dokumenten-Suche (RAG)offen, kommerziell nutzbar
5 · Protokoll & BetriebAudit-Log (Open WebUI) + resticZugriffsprotokoll und verschlüsselte Backups mit WiederherstellungstestBSD / offen

Basis: Ubuntu Server LTS + Docker, Firewall auf „alles zu, außer intern“. Der Chat ist nicht selbst gebaut: Open WebUI ist der etablierte Standard für genau dieses Setup, wir konfigurieren und härten nur. Jede Komponente hat eine große Community und ist ersetzbar: kein Stück Software, das nur HIL versteht.

6 / 12
ModellwahlKONTEXT Crisis Brain
Baustein 3 im Detail

Warum gpt-oss-120b, und was die Alternativen sind.

OffenApache-2.0-Lizenz, frei kommerziell nutzbar, die Modell-Gewichte liegen bei euch auf der Box
Passend117 Mrd. Parameter, aber nur ~5 Mrd. pro Antwort aktiv und ab Werk 4-Bit-komprimiert: passt exakt in 96-128 GB Speicher und antwortet flott, auch zu mehreren
Starkaktuell das stärkste frei verfügbare Denk- und Textniveau seiner Größenklasse (OpenAI-Abstammung)
Alternativen, alle auf derselben Box lauffähig
  • Qwen3: Apache 2.0, stark mehrsprachig, ernsthafter Herausforderer
  • Llama 3.3 70B: bewährt und solide, aber dichter gebaut, dadurch spürbar langsamer
  • Mistral Small: europäischer Anbieter, leichter, für einfachere Aufgaben

Ehrlich: Die deutsche Textqualität für eure Tonalität entscheidet der Pilot. Wir testen 2-3 Modelle gegen eure echten Texte. Ein Modellwechsel ist danach ein Konfigurationseintrag, kein Umbau.

7 / 12
Zugriff & RechteKONTEXT Crisis Brain
03
Wer sieht was

Rechte werden geprüft, bevor gesucht wird.

Das Berechtigungssystem entscheidet vor jeder Anfrage, welche Dokumente überhaupt durchsucht werden. Das KI-Modell entscheidet nie über Zugriffsrechte.

JF
Jan · Adminalle Datenräume, legt Nutzer an, vergibt Rollen, sieht das Protokoll
A
Beratung KriseZugriff auf die eigenen Krisen-Mandate plus Methodenraum
B
Beratung PRZugriff auf PR-Projekte, keine Krisenakten anderer Teams
C
Gast / spätereng begrenzter Raum, z. B. nur Methoden und Vorlagen

Dazu: getrennte Datenräume je Kunde (Mandatstrennung), Vier-Augen-Prinzip bei Exporten aus sensiblen Räumen, vollständiges Audit-Log. Nutzer kommen und gehen per Klick, Rechte enden mit dem Konto.

8 / 12
FahrplanKONTEXT Crisis Brain
So kommen wir vom Vorschlag zum laufenden System

Workshop, Pilot, Entscheidung.

1
Discovery-Workshop

Bei euch in Fürth: Jan plus eure IT, HIL bringt einen Techniker mit. Wir legen fest, was der Pilot enthält (welche Fälle, welche Funktionen), klären Datenbestand, Rollen und den rechtlichen Rahmen.

Festpreis · Angebot folgt
2
Pilot: Secure Case Brain

4 Wochen: Box beschaffen, Software installieren, 2-3 freigegebene Fälle importieren, Suche mit Beleg, Rollen und Protokoll. Abnahme gegen vorher vereinbarten Testkatalog.

Festpreis nach Workshop
3
Entscheidung Ausbau

Erst nach echter Nutzung: mehr Fälle, Monitoring, Planspiel-Generator, später das Kundenportal. Ihr entscheidet auf Basis gemessener Qualität, nicht auf Basis von Folien.

Ihr entscheidet, nicht wir

Für unkritische Alltagsaufgaben kann das Team parallel Cloud-Werkzeuge behalten: das Brain ersetzt nicht alles, es schützt den Kern.

9 / 12
Verantwortung & RollenverteilungKONTEXT Crisis Brain
Das klärt der Workshop, bevor irgendjemand baut

Fünf Fragen, ein Prinzip.

FrageUnser Vorschlag
Wer besorgt die Hardware?KONTEXT kauft und ist Eigentümer, HIL spezifiziert die Bestellung
Wer spielt die Software auf?HIL installiert, härtet und dokumentiert, Übergabe mit allen Schlüsseln
Wer verbindet die Box mit euren Servern?Gemeinsam: eure IT gibt die Zugänge, HIL baut den Import
Wer vergibt die Rechte?KONTEXT (Jan als Admin), HIL richtet das Rollenmodell ein
Wer baut die Use Cases?Im Pilot gemeinsam, danach euer Team: Enablement gehört zum Auftrag

Verantwortung bleibt im Haus: KONTEXT ist Betreiber und Verantwortlicher, auch datenschutzrechtlich. HIL liefert Errichtung und Enablement als klar umrissene Werkleistung, mit sauber begrenzter Haftung und ohne Freistellungs- oder Indemnity-Klauseln.

Vertragsrahmen, den der Workshop festzurrt
10 / 12
Ausblick · Schritt 2KONTEXT Crisis Brain
Wenn Schritt 1 läuft

Später: Erste Hilfe für eure Kunden, aus eurem Wissen.

Registrierte Kunden schildern auf eurer Website ein Thema und bekommen eine erste, von KONTEXT geprüfte Einordnung: wie ernst ist es, was sind die ersten drei Schritte, wann muss der Krisenstab an den Tisch.

Getrenntläuft als eigenes System (eigene VM), niemals auf dem internen Brain
Kuratiertkennt ausschließlich Wissen, das ihr explizit dafür freigegeben habt, keine Krisenakten
Geprüftjede Empfehlung geht erst nach eurer Freigabe raus, oder als Gesprächsaufhänger an euer Team

Schritt 1 baut den Wissensspeicher auf. Schritt 2 verwandelt ihn in ein Produkt: Krisen-Ersteinschätzung als Service, rund um die Uhr.

Neues Geschäftsmodell auf vorhandenem Wissen
11 / 12
Backup · Schritt 1 im AlltagKONTEXT Crisis Brain
Was das Brain im Alltag tut

Vier Handgriffe, die sofort Zeit sparen.

Präzedenzfall-Finder Findet vergleichbare Fälle aus eurem Archiv, mit Fundstelle statt Bauchgefühl. „Welche Fälle ähneln dem Rückruf bei X? Was war unsere Linie?“
Erster Entwurf Holding Statement, Q&A oder Kernbotschaften als Startpunkt, in eurer Tonalität, aus euren Mustern. „Entwirf ein Holding Statement nach dem Muster von Fall Y.“
Chronologie & Lagebild Baut aus Mails, Notizen und Protokollen eine belastbare Timeline und ein Lagebild. „Was war am Tag 1 bekannt, was wurde wann kommuniziert?“
Antwort mit Beleg Jede Antwort nennt ihre Quelle aus euren Unterlagen, oder sie verweigert sich. Kein Erfinden. „Quelle: Abschlussbericht Fall Z, Abschnitt 4.“

Read-only und intern: das Brain schreibt keine Mails, postet nichts, veröffentlicht nichts. Menschen geben frei.

Backup
Backup · Stufe 1 + 2 · CloudPreisstand 10.08.2026
Cloud, mit und ohne Speicherung

Beste Modelle, schnellster Start. Die Daten reisen.

Stufe 1 · Claude Team
~95 € / Monat für 4 Nutzer
  • 25 $ je Nutzer und Monat, sofort buchbar
  • Kein Training auf euren Daten, AVV inklusive
  • Spitzenmodell-Qualität (Claude), null Betrieb
  • Anfragen liegen bis zu 30 Tage beim Anbieter, US-Server
Stufe 2 · Enterprise mit Zero Retention
ab ~300 € / Monat, je Vertrag & Nutzung
  • Zero Retention als Vertragszusatz: Anfragen werden nicht gespeichert
  • SSO, Audit-Log, zentrale Verwaltung
  • Alternative: Claude über AWS Frankfurt, Verarbeitung in der EU
  • Nur über den Anthropic-Vertrieb, Anbieter bleibt US-Konzern (Cloud Act)

Ehrliche Einordnung: für eure Schutzregel („keine Namen, keine sensiblen Kundendaten nach draußen“) bleibt auch Stufe 2 ein Vertrauensmodell. Gut genug für viel Alltagsarbeit, nicht für den Kern des Archivs.

Backup
Backup · Stufe 3 · Deutscher MietserverPreisstand 10.08.2026
Eigenes Modell, gemietete Hardware

Euer eigenes Modell im deutschen Rechenzentrum.

Empfohlen für Stufe 3Hetzner GEX131 · dediziert
889 € / Monat, keine Setup-Gebühr
  • Profi-GPU mit 96 GB Grafikspeicher, 256 GB RAM
  • Läuft gpt-oss-120b: offenes Modell, Apache-Lizenz, starkes Niveau
  • Rechenzentrum in Deutschland, Server exklusiv für euch
  • Verschlüsselt, Zugriff nur euer Team, monatlich kündbar
Kleiner Einstieg · geteilte oder kleinere Server
180-400 € / Monat
  • Kleinere GPU- oder CPU-Server (Hetzner AX-Serie ab 124 €)
  • Reicht für kleinere Modelle und erste Tests
  • Kleinere Modelle: spürbar schwächere Antwortqualität
  • Hostinger & Co. bieten nur geteilte GPU-Power: für vertrauliche Krisenakten ungeeignet

Trade-off: Daten bleiben in Deutschland und unter eurer Kontrolle, liegen aber physisch in einem fremden Rechenzentrum. Guter Mittelweg, wenn keine eigene Maschine im Haus stehen soll.

Backup
Backup · Stufe 4 · Maschine im BüroPreisstand 10.08.2026
Eigene Hardware in Fürth

Eine Box im Haus. Nichts verlässt das Gebäude.

Unsere EmpfehlungNVIDIA DGX Spark · KI-Box
~4.700 € einmalig
  • 128 GB Speicher, gebaut genau für lokale KI-Modelle
  • Läuft gpt-oss-120b flüssig, leise Desktop-Box
  • Kein Mietpreis, nur Strom. Läuft auch bei Internetausfall
  • Für 3-5 gleichzeitige Nutzer im Textbetrieb dimensioniert
Alternative · Mac Studio
~5.300 € einmalig
  • 96 GB gemeinsamer Speicher, vertraute Apple-Welt
  • Wartungsarm, leise, unauffällig im Büro
  • Große Speicher-Konfigurationen aktuell schwer lieferbar

Hinweis: Speicherpreise steigen 2026 branchenweit stark, deshalb gilt jedes Hardware-Angebot mit Preisstand. Beschaffung, Einrichtung und Härtung (kein Datenpfad nach außen) übernimmt HIL, euer Team bekommt die Schlüssel.

Backup
Backup · KostenüberblickPreisstand 10.08.2026
Die vier Stufen nebeneinander

Was kostet welcher Weg?

StufeEinmaligLaufend / MonatKI-NiveauWo sind die Daten?
1 · Cloud Standard0 €~95 € (4 Nutzer)SpitzenklasseUS-Server, kein Training, bis 30 Tage gespeichert
2 · Zero Retention0 €ab ~300 €, je NutzungSpitzenklasseUS-Anbieter, Anfragen ungespeichert, EU-Verarbeitung möglich
3 · Deutscher Mietserver0 €889 € (Hetzner GEX131)Sehr gut (offenes Modell)Deutsches Rechenzentrum, Server exklusiv eurer
4 · Maschine im BüroEmpfehlung~4.700 €~0 € (Strom)Sehr gut (offenes Modell)Bei euch in Fürth. Kein Datenpfad nach draußen.

Größenordnungen ohne HIL-Projektaufwand (Einrichtung, Datenaufbereitung, Schulung): den beziffern wir nach dem Discovery-Workshop, wenn Datenmenge und Use Cases feststehen. Stufe 4 amortisiert sich gegenüber Stufe 3 nach gut fünf Monaten.

Backup
1 / 18  O Übersicht · F Vollbild