Serie

Souveräne & Offline-KI

KI, die im eigenen Haus läuft. Diese Reihe behandelt On-Premise- und Offline-Betrieb als das, was er in der Praxis ist: eine Frage von Hardware, Modellgröße, Wartung und Datenschutz zugleich, mit Zahlen statt Prinzipien.

8 Beiträge

GLM-5.2, Sakana Fugu, Claude Fable 5: drei Frontier-Modelle, drei Antworten auf Kontrolle GLM-5.2, Sakana Fugu, Claude Fable 5: drei Frontier-Modelle, drei Antworten auf Kontrolle Drei Frontier-Modelle, eine echte Frage für einen B2B-Käufer: wohin gehen Ihre Daten, und wie viel des Stacks kontrollieren Sie? KI 4 min 25.06.2026 ModernVBERT: kleines Modell, on-prem-tauglichKI-GENERIERT ModernVBERT: kleines Modell, on-prem-tauglich ColModernVBERT erreicht mit 250M Parametern fast ColPali-Niveau und passt auf bescheidene Hardware. Werkzeuge 2 min 25.06.2026 Open-Weight-Modell fürs deutsche B2B: Qwen, Kimi, Nemotron oder Minimax?KI-GENERIERT Open-Weight-Modell fürs deutsche B2B: Qwen, Kimi, Nemotron oder Minimax? Bei Open-Weight-Modellen fürs Deutsche entscheidet die Lizenz vor dem Benchmark. Drei der vier sind wirklich frei. Werkzeuge 5 min 18.06.2026 Souveräne europäische KI, ehrlich betrachtet: Mistral, der Rest, und was das für ein deutsches Unternehmen bedeutetKI-GENERIERT Souveräne europäische KI, ehrlich betrachtet: Mistral, der Rest, und was das für ein deutsches Unternehmen bedeutet Europas KI-Szene ist endlich ernst zu nehmen. Die ehrliche Lesart ist für einen Käufer nützlicher als die Fahnen schwenkende. KI 6 min 17.06.2026 Lokales LLM im Unternehmen: Hardware, Kosten, RealitätKI-GENERIERT Lokales LLM im Unternehmen: Hardware, Kosten, Realität Ein lokales LLM braucht weniger Hardware als gedacht. Entscheidend ist die passende Modellgröße zur Aufgabe. KI 3 min 16.06.2026 On-Premise vs. Cloud-LLM: Wann lokale KI die richtige Wahl istKI-GENERIERT On-Premise vs. Cloud-LLM: Wann lokale KI die richtige Wahl ist On-Prem oder Cloud ist selten eine Modellfrage, sondern eine Frage von Datenhoheit, Kosten und Kontrolle. KI 3 min 16.06.2026 Als das beste KI-Modell in 72 Stunden verschwand: die Fable-5-LektionKI-GENERIERT Als das beste KI-Modell in 72 Stunden verschwand: die Fable-5-Lektion Fable 5 führte die Benchmarks an, dann verschwand es in 72 Stunden. Warum operative Kontrolle gemietete Fähigkeit schlägt. KI 4 min 15.06.2026 Nemotron 3: NVIDIAs offene, für Agenten gebaute ModelleKI-GENERIERT Nemotron 3: NVIDIAs offene, für Agenten gebaute Modelle NVIDIAs Nemotron 3 Ultra: 550B offene Gewichte, agentenfokussiert, stark im Index, ab Tag eins frei. Eine echte On-Prem-Option. KI 5 min 15.06.2026

Wayne Dyer

“Wenn du die Art und Weise änderst, wie du die Dinge betrachtest, ändern sich die Dinge, die du betrachtest.”