Kodschul Wissen
Direkte Antworten auf technische Entwicklerfragen — zu KI, Cloud, Backend, Daten und mehr.
Retrieval-Augmented Generation (RAG)6 Min.Wie funktioniert Retrieval-Augmented Generation (RAG) technisch genau?
RAG verbindet eine Retrieval-Komponente mit einem LLM. Eine Nutzerfrage wird per Embedding-Modell in einen Vektor umgewandelt, geg…
RAG Grundlagen (2 Tage)
7 Min.pgvector, Pinecone oder Weaviate — welche Vector Database passt zu welchem Use Case?
pgvector eignet sich, wenn bereits PostgreSQL im Einsatz ist und ein HNSW-Index auf der Zieltabelle noch mit vertretbarem RAM- und…
Vector Databases (1 Tag)
6 Min.Wie misst man die Qualität eines RAG-Systems objektiv?
RAG-Qualität lässt sich in zwei Ebenen messen: Retrieval-Metriken wie Recall@k und Precision@k prüfen, ob die richtigen Dokumente …
RAG Fortgeschrittene (2 Tage)
Prompt Engineering (produktionsreif)5 Min.Was unterscheidet Prompt Engineering für Entwickler von einfachem Prompting?
Einfaches Prompting ist die manuelle, iterative Formulierung einer Anfrage im Chat-Fenster. Prompt Engineering für Entwickler beha…
Prompt Engineering Professional (1 Tag)
7 Min.Lohnt sich Fine-Tuning von Open-Source-LLMs wie Mistral oder Llama?
Fine-Tuning und Self-Hosting von Open-Source-Modellen lohnen sich meist erst bei hohem, planbarem Anfragevolumen, strikten Data-Re…
Open-Source LLMs in der Praxis (2 Tage)
6 Min.Wie erkennt und misst man Halluzinationen in LLM-Antworten?
Halluzinationen lassen sich systematisch erkennen, indem jede Aussage einer Antwort gegen die tatsächlich abgerufenen Quellen gepr…
AI Testing & Evaluation (1 Tag)
6 Min.LangChain nutzen oder LLM-Pipeline selbst bauen — was ist der Unterschied?
LangChain lohnt sich, wenn ein Team schnell mit mehreren LLM-Anbietern, Retrievern und Agenten-Mustern experimentieren will und di…
LangChain Einführung (2 Tage)
6 Min.Wie senkt man Token-Kosten bei produktiven LLM-Anwendungen?
Die drei wirksamsten Hebel sind Prompt-Caching für wiederkehrende Kontextteile, die bewusste Wahl kleinerer Modelle für einfache T…
Cost Engineering für LLMs (1 Tag)
7 Min.Welche Chunking-Strategien funktionieren für RAG-Systeme wirklich?
Es gibt keine universell richtige Chunk-Größe. Fixed-Size-Chunking mit Overlap ist der robuste Standardfall, semantisches Chunking…
RAG Fortgeschrittene (2 Tage)
6 Min.Warum Infrastructure as Code mit Terraform statt manueller Cloud-Konfiguration?
Manuelle Konfiguration über die Cloud-Konsole (ClickOps) skaliert nicht über eine Handvoll Ressourcen hinaus, weil Änderungen nich…
Terraform Grundlagen (2 Tage)
111 von 111 Artikeln · Seite 1 von 12