Agent Wiki Topic
LLM-native Engineering
Produktionsreife LLM-Entwicklung mit Evals, Observability, UX-Vertrauen, Kosten und Ownership.
Agentenlesbare Einstiegspunkte
Verwandte Seiten
blog
Dein Agent scheiterte drei Schritte vor dem Fehler
Bei langen Agentenläufen ist der letzte Fehler oft nur das Symptom. Der bessere Debugging-Loop sucht den frühesten kausal verantwortlichen Schritt, formuliert eine minimale Korrektur und prüft sie in einem kontrollierten Rerun.
blog
Simple Graph-RAG halbiert Halluzinationen – ohne komplexes Knowledge Graph Schema
Vector-RAG + einfacher Document-Graph halbiert Halluzinationen auf komplexen QA-Aufgaben im MoNaCo-Benchmark. Die Erkenntnis: Man braucht kein komplexes Knowledge Graph Schema – nur strukturierte Navigation über Dokumente.
blog
Von 'Prompt-Klappern' zu Prompt-Debugging
Prompt-Optimierung ist kein Suchproblem mehr — es ist ein Debugging-Problem. Contrastive Reflection liefert das Framework, um Fehler gezielt zu fangen, statt blind zu raten.
tools
Architecture Diagram MCP
Architecture Diagram MCP erzeugt browserfähige Architekturartefakte aus Agent-Briefs. Es ist für Plattformkarten, Stakeholder-Erklärungen und reproduzierbare Diagramm-Outputs gebaut.
blog
Automatisch generierte Agent Skills brauchen eine Supply Chain
Das OpenClaw-Skill-Paper ist ein starkes Signal: Agent Skills werden nicht nur manuell geschrieben, sondern aus Trajektorien, Skill-Bäumen und Transfer-Evals gelernt. Aber genau das macht eine Skill-Supply-Chain wichtiger, nicht unwichtiger.
blog
Dein Coding Agent braucht eine Verfassung und ein Logbuch
Coding Agents werden nicht nur durch bessere Modelle nützlich. Teams brauchen eine kleine Verfassung für Agent-Verhalten und ein kuratiertes Logbuch für Projektwissen, sonst wird Memory zu Kontext-Müll.
blog
RAG 2026: Vergiss GraphRAG als Default
RAG wird 2026 nicht dadurch besser, dass man GraphRAG auf alles wirft. Der robuste Default ist Contextual Hybrid RAG: saubere Ingestion, BM25 plus Embeddings, Reranking, Quellenpflicht und harte Evals.
blog
AGENTS.md ist kein Kontext. Es ist eine Steuerfläche.
Die überraschende Lektion aus AGENTS.md-Benchmarks ist nicht, dass Kontextdateien nutzlos sind. Sie verändern Agent-Verhalten, manchmal in Richtung teurerer und weniger nützlicher Arbeit. Behandle sie als Steuerfläche, nicht als Repo-Handbuch.
blog
Agenten brauchen Runtime Contracts, nicht längere Prompts
Bessere Prompts machen Agenten nicht automatisch zuverlässig. Entwickler brauchen Runtime Contracts: explizite Verträge dafür, welche Tools ein Agent nutzen darf, was er erinnern darf, wann er stoppen muss und wie seine Behauptungen geprüft werden.
blog
Bewerte KI-Code nicht am Diff
Besseres KI-Coding entsteht nicht primär durch bessere Prompts, sondern durch den Harness um das Modell: explizite Contracts, getrennte Builder- und Reviewer-Rollen, Belege und eine Schleife, die Fehler in bessere Spezifikationen zurückführt.
blog
Deine KI-generierte UI braucht einen Playtester, keinen Screenshot-Review
KI-generierte Interfaces sehen oft fertig aus, bevor sie sich korrekt verhalten. Eine GUI-Playtester-Loop schickt einen separaten Browser-Agenten in die App, protokolliert Interaktionen, speichert Screenshots und Logs, macht aus kaputten Flows reproduzierbare Bug Reports und rerunnt denselben Test nach dem Fix.
blog
Spec-Driven Context Resets für Coding-Agenten
Lange Agenten-Chats verrotten. Besser ist es, Entscheidungen in kleine Spec-Dateien zu verschieben, zwischen den Ebenen bewusst den Kontext zu resetten und jede Coding-Agent-Session nur das lesen zu lassen, was sie wirklich braucht.
blog
AGENTS.md reicht nicht: Dein Coding Agent braucht einen Harness
Ein Coding Agent wird nicht durch einen magischen Prompt zuverlässig. Er braucht einen Harness: AGENTS.md, Skills, Tool-Permissions, Hooks und Evals, die merken, wenn sich sein Verhalten verschiebt.
blog
Prompt Decomposition: So zerlegst du KI-Aufgaben richtig
Nach Context Engineering kommt Decomposition: Entwickler sollten nicht alles in einen Prompt stopfen, sondern Aufgaben in direkte Prompts, Subtasks, Pipelines, Agent-Loops oder Skills zerlegen.
blog
LLM-native Entwickler brauchen mehr als gute Prompts
Die nächste Entwicklerfähigkeit ist nicht der cleverste Prompt. Es ist das Betriebssystem um LLMs herum: Datenqualität, Model-Versioning, Evals, Guardrails, Incident Response, Review-UX und Repo-Anweisungen, denen Agents wirklich folgen können.
blog
Prompting ist tot. Context zählt.
2026 geht es nicht mehr um den einen magischen Prompt. Der bessere Ansatz: Kontext wählen, Tools und Schemas definieren, Agent-Regeln setzen und mit Evals prüfen.
blog
AI-first Architektur: schneller entscheiden, sauber bleiben
AI-first Architektur heißt nicht: Modell entscheidet. Es heißt: KI erzeugt Optionen, findet Risiken, verdichtet Kontext — das Team entscheidet und dokumentiert nachvollziehbar.