Praxisartikel über lokale KI-Systeme, Self-Hosted LLMs, RAG-Architekturen und individuelle Softwareentwicklung.
Wir betreiben KI-Systeme selbst: auf eigenen Servern, mit eigener Hardware, für Kunden und für uns. Was dabei herauskommt, steht hier — Messwerte statt Herstellerversprechen, Fehlschläge eingeschlossen.
Die Artikel richten sich an Entscheider und IT-Verantwortliche in Unternehmen, die KI einsetzen wollen, ohne ihre Daten aus dem Haus zu geben. Kein Grundlagenkurs und keine nacherzählten Pressemitteilungen.
Was es praktisch bedeutet, Sprachmodelle selbst zu hosten: welche Betriebsmodelle es gibt, wie Firmenwissen über RAG durchsuchbar wird und wo die Grenzen liegen. Themen, die im Angebot auftauchen und selten erklärt werden.
Wir lassen Modelle auf unserer eigenen Hardware laufen und veröffentlichen die Zahlen: Geschwindigkeit, Speicherbedarf, Qualität im direkten Vergleich. Auch dann, wenn das Ergebnis gegen die naheliegende Wahl spricht.
Token, Kontextfenster, Modellgrößen, Reasoning: Vokabeln, die in jedem KI-Angebot vorkommen. Wir erklären sie so, dass man damit eine Entscheidung treffen kann — ohne Formeln.