AI & LLM
Experimente, Notizen, Meinungen und praktische Erfahrungen mit KI-Systemen, großen Sprachmodellen und lokalen oder gehosteten Setups.
🛠️ Infrastructure & Deployment
Fokus: Die technische Grundlage und Hardware.
LLM Performance Hub
LLM-Performance ist ein Systemproblem, kein GPU-Einkaufsproblem. Ob man ein einzelnes Modell auf ...
LLM Hosting in 2026: Local, Self-Hosted und Cloud-Infrastruktur Vergleich
LLM Hosting — Übersicht und Entscheidungshilfe Large Language Models laufen längst nicht mehr nur...
Drei Rechner, ein Modell — llama.cpp RPC Cluster im Heimnetz
Ich habe drei Rechner zu Hause, die sonst meist im Leerlauf laufen. Die Idee: alle drei per llama...
Lokale Installation und Betrieb von LLMs mit vLLM
vLLM ist ein hochdurchsatzorientiertes Inference-Framework für Hugging-Face-Modelle. Im Vergleich...
llama.cpp — Installation, Betrieb und Konfiguration
llama.cpp ist mein primäres Inference-Backend — sowohl im Arbeitscluster als auch zu Hause. Es is...
⚙️ Optimization & Model Theory
Focus: Improving the model's raw intelligence and speed. The "Making it Better" stage. Technical ...
Agentic LLM Inference Tuning Reference for Qwen 3.6 and Gemma 4
This page is a practical reference for agentic LLM inference tuning (temperature, top_p, top_k, p...
Qwen 3.6 27B and 35B MTP vs Standard on 16GB GPU
I tested Speculative decoding (Multi-Token Prediction, MTP) performance in Qwen 3.6 27B and 35B o...
🚀 AI Projects & Workflows
Focus: Applying everything to real-world development.
📚 Research & Reference
Focus: General knowledge and external bookmarks.
🎯 Prompt Engineering
Methodiken und praktische Prompt-Vorlagen für den täglichen Einsatz mit KI-Agenten. Enthält sowoh...
Blueprint Scaffolding (Structured Prompt Planning)
Was es ist Bevor du die KI bittest, eine vollständige Antwort oder ein komplettes Dokument zu erz...
Context Extraction
## Provide thread context as CSV You must now assume the role of a memory module in this system....
Prompt Reversal (Reverse Prompt Engineering)
Reverse Prompt Engineering (RPE) Was es ist Anstatt einen Prompt über mehrere Durchläufe iterati...
Summary Generators
Consolidate Outputs In Conversation ## Consolidate Outputs In Conversation Produce a new output ...
Red Team Technique (Adversarial Self-Critique)
Was es ist Eine zweistufige Methode: Zuerst lässt du die KI Inhalte erzeugen (z. B. Lebenslauf, ...
Document Generation
Generate Tech Documentation This is a simple but effective command which I use after a successful...
Five-in-One Amplifier (Content Amplification via AI)
Was es ist Nimm ein hochwertiges „Pillar“-Inhaltselement (z. B. Foliensatz, Bericht, Präsentation...
BlogPost Reformatting Prompt
Normale Version Du bist ein erfahrener technischer Editor für Markdown. Deine Aufgabe ist es, de...
📊 Benchmarks
Vergleichende Leistungsmessungen und Evaluierung von Large Language Models. Bietet eine datengetr...
🗄️ Archiv
Historische Projekte und nicht mehr aktive Arbeitsbereiche. Diese Seiten werden zu Referenzzwecke...
Project Overview
🗺️ Curriculum Roadmap The bootcamp is structured into 10 weekly milestones, focusing on full-stac...
Comparison between OneNote and Bookstack, Confluence, Docmost and Nextcloud
I asked: I need a good comparison between Dokuwiki, Confluence, Docmost, Bookstack and Nextcloud...
🚀 Week 01: The Personal Dashboard
"Your Digital Command Center" Welcome to the first real project. In the first week, we aren't jus...
📊 Week 02: The Centralized Event Hub
Welcome to Week 02! You’ve already knocked out your personal dashboard; now we’re stepping into t...
Dell Pro Max (GB10): Edge-KI-Infrastruktur & ROI-Analyse
Übersicht Das Dell Pro Max System, ausgestattet mit dem Nvidia GB10 (Grace Blackwell) Prozessor, ...
Cavecrew Reviewer Prompt
Cavecrew Reviewer Prompt Dieser Prompt dient als Vorlage für Code-Reviews im Rahmen des Cavecrew-...