Skip to content

Blog

huecki

Praxisnahe Beiträge über Agenten, Automatisierung und Softwarearchitektur.

11. August 2026 · AI Agent Workflows

Agent Skills sind kein Markdown. Sie brauchen ein Qualitäts-Gate.

Ein praktisches Qualitäts-Gate für Agent Skills: Nutzen gegen eine No-Skill-Baseline messen, Aktivierung und Trajektorie prüfen, Rechte außerhalb des Skill-Texts binden und nur versionierte, überprüfbare Kandidaten promoten.

AI AgentsAgent SkillsAgent EvalsAI SecurityDeveloper Workflow
Artikel lesen

7. August 2026 · AI Agent Workflows

Wie ich aus einer Messenger-App ein Betriebssystem für Domain Agents gebaut habe

Ich betreibe nicht für jede Aufgabe einen eigenen Bot. Mehrere getrennte Chat-Sessions greifen auf dieselbe agentische Runtime zu. Im zentralen Boba-DM entwerfe ich nach einem festen Factory-Playbook neue Domain-Profile aus Regeln, Memory, Skills, Tools und überprüfbaren Flows.

AI AgentsAI GovernanceAgent WorkflowsAgent SkillsAutomationContext Engineering
Artikel lesen

6. August 2026 · AI Agent Infrastructure

Agent Plugins sind npm für Agent-Verhalten — aber ohne Lockfile

Agent Plugins machen aus Skills und MCP-Konfigurationen ein portables Paket. Der Guide zeigt den kleinsten Aufbau, die Integration in mehrere Clients sowie die fehlenden Produktionskontrollen für Permissions, Updates, Evals und Rollback.

AI AgentsAgent PluginsAgent SkillsMCPCodexCursorVS CodeAI Security
Artikel lesen

6. August 2026 · AI Agent Workflows

Dein AI Agent lernt nichts aus seinen Runs

Ein Agent verbessert sich nicht, nur weil seine Runs gespeichert werden. Ein Knowledge Flywheel extrahiert aus mehreren Runs belegte Lessons, prüft Widersprüche, versioniert das Ergebnis und liefert dem nächsten Agenten nur das Wissen, das zu seinem Task passt.

AI AgentsKnowledge FlywheelAgent MemoryAgent SkillsSelf-Improving AgentsAgent Evals
Artikel lesen

22. Juli 2026 · KI-Agent Reliability

Dein Agent scheiterte drei Schritte vor dem Fehler

Bei langen Agentenläufen ist der letzte Fehler oft nur das Symptom. Der bessere Debugging-Loop sucht den frühesten kausal verantwortlichen Schritt, formuliert eine minimale Korrektur und prüft sie in einem kontrollierten Rerun.

KI-AgentenAgent DebuggingObservabilityEvaluationDeveloper Workflow
Artikel lesen

16. Juni 2026 · AI-first Engineering

Automatisch generierte Agent Skills brauchen eine Supply Chain

Das OpenClaw-Skill-Paper ist ein starkes Signal: Agent Skills werden nicht nur manuell geschrieben, sondern aus Trajektorien, Skill-Bäumen und Transfer-Evals gelernt. Aber genau das macht eine Skill-Supply-Chain wichtiger, nicht unwichtiger.

AI EngineeringAgent SkillsCoding AgentsContext EngineeringAgent Security
Artikel lesen

15. Juni 2026 · AI-first Engineering

Dein Coding Agent braucht eine Verfassung und ein Logbuch

Coding Agents werden nicht nur durch bessere Modelle nützlich. Teams brauchen eine kleine Verfassung für Agent-Verhalten und ein kuratiertes Logbuch für Projektwissen, sonst wird Memory zu Kontext-Müll.

AI EngineeringCoding AgentsContext EngineeringDeveloper WorkflowAgent Memory
Artikel lesen

9. Juni 2026 · AI-first Engineering

RAG 2026: Vergiss GraphRAG als Default

RAG wird 2026 nicht dadurch besser, dass man GraphRAG auf alles wirft. Der robuste Default ist Contextual Hybrid RAG: saubere Ingestion, BM25 plus Embeddings, Reranking, Quellenpflicht und harte Evals.

RAGContext EngineeringAI EngineeringLLMEvals
Artikel lesen

7. Juni 2026 · AI-first Engineering

Agenten brauchen Runtime Contracts, nicht längere Prompts

Bessere Prompts machen Agenten nicht automatisch zuverlässig. Entwickler brauchen Runtime Contracts: explizite Verträge dafür, welche Tools ein Agent nutzen darf, was er erinnern darf, wann er stoppen muss und wie seine Behauptungen geprüft werden.

AI EngineeringAI AgentsAgent HarnessDeveloper WorkflowKI-WorkflowsEvals
Artikel lesen

28. Mai 2026 · AI-first Engineering

Bewerte KI-Code nicht am Diff

Besseres KI-Coding entsteht nicht primär durch bessere Prompts, sondern durch den Harness um das Modell: explizite Contracts, getrennte Builder- und Reviewer-Rollen, Belege und eine Schleife, die Fehler in bessere Spezifikationen zurückführt.

AI EngineeringKI-AgentenCoding AgentsDeveloper WorkflowAgent HarnessEvals
Artikel lesen

28. Mai 2026 · AI-first Engineering

Deine KI-generierte UI braucht einen Playtester, keinen Screenshot-Review

KI-generierte Interfaces sehen oft fertig aus, bevor sie sich korrekt verhalten. Eine GUI-Playtester-Loop schickt einen separaten Browser-Agenten in die App, protokolliert Interaktionen, speichert Screenshots und Logs, macht aus kaputten Flows reproduzierbare Bug Reports und rerunnt denselben Test nach dem Fix.

AI EngineeringKI-AgentenWebwrightPlaywrightUI TestingCoding AgentsDeveloper WorkflowEvals
Artikel lesen

23. Mai 2026 · AI-first Engineering

Spec-Driven Context Resets für Coding-Agenten

Lange Agenten-Chats verrotten. Besser ist es, Entscheidungen in kleine Spec-Dateien zu verschieben, zwischen den Ebenen bewusst den Kontext zu resetten und jede Coding-Agent-Session nur das lesen zu lassen, was sie wirklich braucht.

AI EngineeringCoding AgentsContext EngineeringSpec-Driven DevelopmentDeveloper Workflow
Artikel lesen

21. Mai 2026 · KI-Agent Workflows

KI-Agenten brauchen Belege, bevor sie klicken

Wenn ein Agent klickt, sendet, kauft oder Daten extrahiert, darf die entscheidende Wahrheit nicht nur aus Modell-Prosa kommen. Baue vor riskanten Tool Calls ein kleines Evidenz-Gate: Predicate, Belegtyp, Quelle, Entscheidung.

KI-AgentenMultimodal AIBrowser AgentsAI SafetyDeveloper Workflow
Artikel lesen

21. Mai 2026 · KI-Agent Workflows

Hör auf, KI zum kritischen Selbstcheck zu bitten

Offene Anweisungen wie „prüf das kritisch“ belohnen das Modell ungewollt dafür, Kritik zu produzieren. Die Lösung ist nicht weniger Review, sondern kalibriertes Review: klare Kriterien, PASS_NO_CHANGE, Evidenz pro Finding, Severity-Schwellen und ein kleines Änderungsbudget.

KI-AgentenPrompt EngineeringEvalsKI-SicherheitDeveloper Workflow
Artikel lesen

19. Mai 2026 · AI Agent Workflows

gib jedem Kundenprojekt einen kleinen Agenten

Der nützliche Move ist nicht ein Mega-Assistent für alle Kunden. Gib jedem Kundenprojekt einen kleinen, isolierten Agenten mit eigener Erinnerung, Aufgabenliste, Preview-URL-Gewohnheit und langweiligem Daily Standup.

AI AgentsFreelancingClient WorkAutomationWorkflow Design
Artikel lesen

18. Mai 2026 · AI-first Engineering

Prompt Decomposition: So zerlegst du KI-Aufgaben richtig

Nach Context Engineering kommt Decomposition: Entwickler sollten nicht alles in einen Prompt stopfen, sondern Aufgaben in direkte Prompts, Subtasks, Pipelines, Agent-Loops oder Skills zerlegen.

Prompt EngineeringDecompositionAI AgentsSkillsDeveloper Workflow
Artikel lesen

15. Mai 2026 · AI-first Engineering

LLM-native Entwickler brauchen mehr als gute Prompts

Die nächste Entwicklerfähigkeit ist nicht der cleverste Prompt. Es ist das Betriebssystem um LLMs herum: Datenqualität, Model-Versioning, Evals, Guardrails, Incident Response, Review-UX und Repo-Anweisungen, denen Agents wirklich folgen können.

AI EngineeringLLMSoftwarearchitekturAgentsDeveloper Workflow
Artikel lesen

15. Mai 2026 · Personal AI Workflows

Sprachnachrichten sind das beste Interface für kleine Agentenjobs

Voice ist nicht gut für alles. Aber für kleine Agentenjobs ist es brutal praktisch: unterwegs eine Aufgabe diktieren, lokal transkribieren, vom bestehenden Agenten ausführen lassen und nur eine kurze Antwort zurückbekommen.

AI AgentsVoice InterfaceAutomationOpen SourcePersonal AI
Artikel lesen

12. Mai 2026 · AI-first Engineering

Prompting ist tot. Context zählt.

2026 geht es nicht mehr um den einen magischen Prompt. Der bessere Ansatz: Kontext wählen, Tools und Schemas definieren, Agent-Regeln setzen und mit Evals prüfen.

Prompt EngineeringContext EngineeringAI AgentsKI-Workflows
Artikel lesen

11. Mai 2026 · KI-Agenten-Workflows

Hermes Agent: Self-Review statt One-Shot

Hermes wird interessant, wenn ein Agent nicht nur liefert, sondern die eigene Arbeit reviewed: ausführen, messen, kritisieren, Skill umbauen, nochmal laufen lassen. Der Nutzen entsteht vor allem bei wiederholbaren Workflows.

Hermes AgentKI-AgentenSelf-ImprovementNous Research
Artikel lesen

Brauchen Sie AI-first Architekturunterstützung?

Schreiben Sie mir eine kurze Nachricht zu Ihrem Projekt oder technischen Engpass.

Kontakt aufnehmen