Cluster

Agent Engineering

Coding Agents, MCP, Kontextsysteme, Evaluation und Kontrollen für verlässliche Automatisierung.

Blogbeiträge
80
Thema
AI und Agents

Mit dem Grundlagenartikel starten

Postfach, ohne Lärm

Erhalte die nächste Feldnotiz zu AI und Agents

Eine kurze E-Mail, wenn wir veröffentlichen. Ohne Tracking-Pixel und ohne Postfachfüller.

Neu in dieser Sammlung

Wavect-Artikelbild zu Google AX mit einem Schild als Symbol für kontrollierte Agentenausführung KI & Agenten

Google AX Agent Executor: Budgets und Selbsthosting

Eine Sandbox ist kein Kostenlimit. Was Google AX kontrolliert, welcher Zustand erhalten bleibt und welche Abhängigkeiten für die eigene KI entscheidend sind.

Rohe Agenten-Traces werden zu einem persistenten Wiki und einer validierten SKILL.md-Datei KI & Agenten

WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln

WikiSkill verdichtet Agenten-Traces zu einem persistenten Evidenz-Wiki und validiert atomare Änderungen an SKILL.md. Wir prüfen Benchmarks, Transfer, Grenzen und Produktionsarchitektur.

Octop verbindet Nutzer, KI-Agenten, Tools und selbst gehostete Daten in einem Anwendungs-Stack KI & Agenten

Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen

Tencent stellt Octop unter MIT bereit, inklusive Multi-User-Agenten, Dashboard, Automatisierung und Speicherung. Wir prüfen Lieferumfang, Grenzen und reale Produktionskosten.

Wigolo verteilt eine Agent-Anfrage auf Suchmaschinen, rankt Evidenz lokal neu und stellt zehn Web-Tools über MCP bereit KI & Agenten

Wigolo im Test: Lokale Web Intelligence für AI Agents

Wigolo bietet AI Agents lokale Suche, Fetching, Crawling und Research ohne Paid Search API. Wir prüfen zehn Tools, Cache, Datenschutz, AGPL und Produktionsgrenzen.

Überlagerte Kontextkarten als Symbol für ein dauerhaftes KI-Agentengedächtnis im Wavect-Editorial-Stil KI & Agenten

Supermemory: KI-Agenten mit Gedächtnis, RAG und lokalem Betrieb

Dein KI-Agent soll Nutzer auch in der nächsten Sitzung wiedererkennen. Dieser Supermemory-Leitfaden zeigt API, lokalen Betrieb und die Grenzen der Benchmark-Aussagen.

Wavect-Schutzschildmotiv zur Auswahl klar begrenzter Designmuster für KI-Agenten KI & Agenten

KI-Agenten-Designmuster: Einfach starten, Aktionen prüfen

Mehr Schleifen sind nicht automatisch besser. Wähle die kleinste Agentenarchitektur, die den Fehler löst, und trenne Aktionsvorschlag und Ausführungsberechtigung.

Vollständiges Artikelverzeichnis

  1. Google AX Agent Executor: Budgets und Selbsthosting
  2. WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln
  3. Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen
  4. Wigolo im Test: Lokale Web Intelligence für AI Agents
  5. Supermemory: KI-Agenten mit Gedächtnis, RAG und lokalem Betrieb
  6. KI-Agenten-Designmuster: Einfach starten, Aktionen prüfen
  7. Claude Mods: Einrichtung, Function Hooks und Sicherheit
  8. Voicebox: Lokales Voice Cloning, Diktieren und MCP-Setup
  9. Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz
  10. OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen
  11. Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen
  12. OpenBot im Check: KI-Kollegen selbst hosten
  13. Ramp Inspect Architektur 2026: Background Coding Agents skalieren
  14. Model Hardware Standard: MHS für Physical AI im Unternehmen
  15. Fonio AI Erfahrungen 2026: Preise, API, DSGVO & Build vs Buy
  16. Mosaic (YC S26) im Check: Shared Memory für Coding Agents
  17. Ripwire Review 2026: Repo-Kontext für KI-Agenten ohne Embeddings?
  18. Atomare Multi-Datei-Edits für KI-Coding-Agenten: die Semaprax-Lektion
  19. Wissenstransfer zwischen KI-Agenten: Einmal entdecken, günstiger skalieren
  20. claude-rotate: Ein Proxy für mehrere Claude-Max-Konten
  21. Feynman im Test: Ist der Open-Source AI Research Agent bereit für Teams?
  22. Obscura Browser im Test: Aussagen, Grenzen und Produktions-Fit
  23. Claude-Code-Designsystem: 4 Bausteine für markentreue UI
  24. ChatGPT-Login: Das Modell sieht dein Passwort nicht
  25. KI-Agenten-Harness erklärt: Die Zuverlässigkeitsschicht rund um ein LLM
  26. Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
  27. LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
  28. OpenViking im Überblick: Dateisystem-Memory für KI-Agenten
  29. LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
  30. TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
  31. Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
  32. Lokalisierte URL-Slugs und hreflang: Warum wir einen englischen Slug behalten
  33. Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
  34. Graft Review 2026: Gehört die Repo-Map ins Git?
  35. Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
  36. Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
  37. DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
  38. OpenSandbox im Review: Lohnt sich Self-Hosting?
  39. Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
  40. GitHub Spec Kit im Test: Lohnt sich der Prozess?
  41. Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
  42. Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
  43. MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
  44. KI-Texte menschlicher schreiben mit Agent Skills
  45. NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
  46. Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
  47. Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
  48. Hark Handoff im Test: Der Agent, der wirklich klickt
  49. Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
  50. PII vor LLM-Prompts entfernen: Eine praktische Pipeline
  51. Agent Reach im Test: Kosten, Sicherheit und Grenzen
  52. Cloudflare Wallets für KI-Agenten: Was ist live?
  53. YC QM Agent im Test: Ist Quartermaster bereit?
  54. jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
  55. Lightpanda Browser für KI-Agenten: Praxischeck 2026
  56. Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
  57. Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
  58. Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
  59. MCP ist keine Sicherheitsgrenze: Agentendaten schützen
  60. Können KI-Agenten miteinander kommunizieren? Band-Guide
  61. LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
  62. GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
  63. Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
  64. OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
  65. Meterless im Test 2026: Ist der Context Layer produktionsreif?
  66. Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
  67. Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
  68. KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
  69. T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
  70. Open Knowledge Format (OKF): Der Unternehmensleitfaden
  71. AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
  72. Claude Fable 5.1 in Claude Code nutzen
  73. Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
  74. Der Engpass war nie Intelligenz. Es war Kontext.
  75. ChatGPT Enterprise vs. Copilot vs. eigenes RAG
  76. MCP, RAG, Agent Skills oder Custom GPTs?
  77. KI-Agent-Pilot in 30/60/90 Tagen
  78. RAG über SharePoint, Confluence, Drive: Permissions-First
  79. RAG-Production-Readiness-Checkliste für EU-Unternehmen
  80. Warum KI-Agentenprojekte abgebrochen werden