Reeks

RAG-architecturen

Retrieval-augmented generation van ingestie tot antwoord. De reeks behandelt chunking, embeddings, vectoropslag, reranking en evaluatie als architectuurvragen, want daarmee valt of staat of een kennisbank betrouwbare antwoorden geeft of slechts plausibele.

12 artikelen

Antwortzeit eines KI-Assistenten: woraus sie sich zusammensetzt Antwortzeit eines KI-Assistenten: woraus sie sich zusammensetzt Die Antwortzeit eines KI-Assistenten besteht aus fünf Posten. Wer sie einzeln misst, findet schnellere Korrekturen als neue Hardware oder ein neues Modell. KI 8 min 14-09-2026 Warum KI-Features in der Praxis scheitern: sieben Stufen, an denen Fehler entstehen Warum KI-Features in der Praxis scheitern: sieben Stufen, an denen Fehler entstehen Eine falsche KI-Antwort hat fast immer eine Adresse. Wer die sieben Stufen eines KI-Features kennt, findet den Fehler, bevor jemand das Modell tauscht. Methodik 9 min 14-09-2026 Was ein RAG-System im Betrieb wirklich kostet Was ein RAG-System im Betrieb wirklich kostet Nicht das Modell ist der Kostenblock. Es sind Indexpflege, Evaluation und der Betrieb, und diese drei stehen in keinem Angebot, das nur die Entwicklung beziffert. Methodik 9 min 08-08-2026 Baidu OCR in de stack: waarom klassieke tekstherkenning naast visueel zoeken blijft bestaan Baidu OCR in de stack: waarom klassieke tekstherkenning naast visueel zoeken blijft bestaan OCR is niet dood. PaddleOCR-VL levert doorzoekbare tekst waar visueel zoeken alleen niet volstaat. Tools 2 min 25-06-2026 F-RAG (RAG-fusion): hoe het verschilt van eenvoudige RAG F-RAG (RAG-fusion): hoe het verschilt van eenvoudige RAG RAG-fusion voert meerdere queryvarianten uit en versmelt de resultaten via reciprocal rank fusion. Betere recall, enig afdriftrisico. Methodologie 2 min 25-06-2026 Late interaction uitgelegd: waarom Qdrant en ColQwen de betere kennisbank bouwen Late interaction uitgelegd: waarom Qdrant en ColQwen de betere kennisbank bouwen Late interaction vergelijkt elke zoekterm met elk paginafragment. Qdrant slaat dat native op. Methodologie 2 min 25-06-2026 De OCR-vrije documentstack 2026: ColPali, ColQwen, ModernVBERT en Qdrant De OCR-vrije documentstack 2026: ColPali, ColQwen, ModernVBERT en Qdrant Visuele retrievalmodellen doorzoeken de pagina als beeld in plaats van via OCR. Een nuchter overzicht. Methodologie 3 min 25-06-2026 Query-decompositie en de advanced-RAG-gereedschapskist: pas de methode aan op het falen Query-decompositie en de advanced-RAG-gereedschapskist: pas de methode aan op het falen Query-decompositie, HyDE, RAG-fusion, GraphRAG verhelpen elk een ander soort falen. Het verfijnde RAG van 2026 weet wanneer het er geen gebruikt. Methodologie 4 min 25-06-2026 Einde van OCR? Visueel documenten zoeken en wat het verandert voor het mkb Einde van OCR? Visueel documenten zoeken en wat het verandert voor het mkb Visuele retrievalmodellen vinden tabellen en scans waar OCR-RAG op vastloopt. Wat dat praktisch betekent. AI 2 min 25-06-2026 Subkwadratische LLM's: goedkopere lange context voor on-prem RAG Subkwadratische LLM's: goedkopere lange context voor on-prem RAG Subkwadratische modellen verlagen de kosten voor lange context. Een echte hefboom voor on-prem RAG, maar nog jong. Onderzoek 5 min 18-06-2026 Wat is RAG? Retrieval-Augmented Generation voor het mkb uitgelegd Wat is RAG? Retrieval-Augmented Generation voor het mkb uitgelegd RAG koppelt een taalmodel aan uw eigen documenten, zodat antwoorden onderbouwd en actueel blijven. AI 4 min 16-06-2026 Retrieval-Augmented Generation, en waarom het soevereine AI draagt Retrieval-Augmented Generation, en waarom het soevereine AI draagt RAG verankert de antwoorden van een model in opgehaalde bronnen en vermindert hallucinatie en veroudering. Waarom het soevereine AI draagt. AI 5 min 01-04-2024

Wayne Dyer

“Als u de manier waarop u naar dingen kijkt verandert, veranderen de dingen waar u naar kijkt.”