[ neueste ]2024-11-12·8 Min. Lesezeit
Production-Grade RAG aufbauen, das nicht halluziniert
Ein Deep Dive in Chunking-Strategien, Embedding-Modelle, Re-Ranking und Evaluations-Frameworks für zuverlässiges Retrieval.
ragllmwork
> ls ~/writing · 5 posts
Ein Deep Dive in Chunking-Strategien, Embedding-Modelle, Re-Ranking und Evaluations-Frameworks für zuverlässiges Retrieval.
Patterns für autonome Agenten, die wissen, wann sie Tools aufrufen, wann sie delegieren und wann sie nachfragen.
Wie ich mit Drizzle, tRPC-ähnlicher Inferenz und striktem TypeScript schneller und mit weniger Runtime-Fehler shipe.
Erkenntnisse aus der Transformation von Jupyter-Experimenten zu schnellen, überwachten und versionierten Inference-Services.
Caching, Batching, Model-Routing und Token-Optimierungstechniken, die KI-Produkte profitabel halten.