Agent Engineering
Coding Agents, MCP, Kontextsysteme, Evaluation und Kontrollen für verlässliche Automatisierung.
- Blogbeiträge
- 80
- Thema
- AI und Agents
Mit dem Grundlagenartikel starten
Erhalte die nächste Feldnotiz zu AI und Agents
Eine kurze E-Mail, wenn wir veröffentlichen. Ohne Tracking-Pixel und ohne Postfachfüller.
Neu in dieser Sammlung
Google AX Agent Executor: Budgets und Selbsthosting
Eine Sandbox ist kein Kostenlimit. Was Google AX kontrolliert, welcher Zustand erhalten bleibt und welche Abhängigkeiten für die eigene KI entscheidend sind.
WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln
WikiSkill verdichtet Agenten-Traces zu einem persistenten Evidenz-Wiki und validiert atomare Änderungen an SKILL.md. Wir prüfen Benchmarks, Transfer, Grenzen und Produktionsarchitektur.
Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen
Tencent stellt Octop unter MIT bereit, inklusive Multi-User-Agenten, Dashboard, Automatisierung und Speicherung. Wir prüfen Lieferumfang, Grenzen und reale Produktionskosten.
Wigolo im Test: Lokale Web Intelligence für AI Agents
Wigolo bietet AI Agents lokale Suche, Fetching, Crawling und Research ohne Paid Search API. Wir prüfen zehn Tools, Cache, Datenschutz, AGPL und Produktionsgrenzen.
Supermemory: KI-Agenten mit Gedächtnis, RAG und lokalem Betrieb
Dein KI-Agent soll Nutzer auch in der nächsten Sitzung wiedererkennen. Dieser Supermemory-Leitfaden zeigt API, lokalen Betrieb und die Grenzen der Benchmark-Aussagen.
KI-Agenten-Designmuster: Einfach starten, Aktionen prüfen
Mehr Schleifen sind nicht automatisch besser. Wähle die kleinste Agentenarchitektur, die den Fehler löst, und trenne Aktionsvorschlag und Ausführungsberechtigung.
Vollständiges Artikelverzeichnis
- Google AX Agent Executor: Budgets und Selbsthosting
- WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln
- Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen
- Wigolo im Test: Lokale Web Intelligence für AI Agents
- Supermemory: KI-Agenten mit Gedächtnis, RAG und lokalem Betrieb
- KI-Agenten-Designmuster: Einfach starten, Aktionen prüfen
- Claude Mods: Einrichtung, Function Hooks und Sicherheit
- Voicebox: Lokales Voice Cloning, Diktieren und MCP-Setup
- Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz
- OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen
- Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen
- OpenBot im Check: KI-Kollegen selbst hosten
- Ramp Inspect Architektur 2026: Background Coding Agents skalieren
- Model Hardware Standard: MHS für Physical AI im Unternehmen
- Fonio AI Erfahrungen 2026: Preise, API, DSGVO & Build vs Buy
- Mosaic (YC S26) im Check: Shared Memory für Coding Agents
- Ripwire Review 2026: Repo-Kontext für KI-Agenten ohne Embeddings?
- Atomare Multi-Datei-Edits für KI-Coding-Agenten: die Semaprax-Lektion
- Wissenstransfer zwischen KI-Agenten: Einmal entdecken, günstiger skalieren
- claude-rotate: Ein Proxy für mehrere Claude-Max-Konten
- Feynman im Test: Ist der Open-Source AI Research Agent bereit für Teams?
- Obscura Browser im Test: Aussagen, Grenzen und Produktions-Fit
- Claude-Code-Designsystem: 4 Bausteine für markentreue UI
- ChatGPT-Login: Das Modell sieht dein Passwort nicht
- KI-Agenten-Harness erklärt: Die Zuverlässigkeitsschicht rund um ein LLM
- Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
- LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
- OpenViking im Überblick: Dateisystem-Memory für KI-Agenten
- LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
- TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
- Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
- Lokalisierte URL-Slugs und hreflang: Warum wir einen englischen Slug behalten
- Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
- Graft Review 2026: Gehört die Repo-Map ins Git?
- Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
- Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
- DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
- OpenSandbox im Review: Lohnt sich Self-Hosting?
- Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
- GitHub Spec Kit im Test: Lohnt sich der Prozess?
- Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
- Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
- MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
- KI-Texte menschlicher schreiben mit Agent Skills
- NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
- Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
- Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
- Hark Handoff im Test: Der Agent, der wirklich klickt
- Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
- PII vor LLM-Prompts entfernen: Eine praktische Pipeline
- Agent Reach im Test: Kosten, Sicherheit und Grenzen
- Cloudflare Wallets für KI-Agenten: Was ist live?
- YC QM Agent im Test: Ist Quartermaster bereit?
- jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
- Lightpanda Browser für KI-Agenten: Praxischeck 2026
- Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
- Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
- Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
- MCP ist keine Sicherheitsgrenze: Agentendaten schützen
- Können KI-Agenten miteinander kommunizieren? Band-Guide
- LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
- GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
- Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
- OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
- Meterless im Test 2026: Ist der Context Layer produktionsreif?
- Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
- Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
- KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
- T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
- Open Knowledge Format (OKF): Der Unternehmensleitfaden
- AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
- Claude Fable 5.1 in Claude Code nutzen
- Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
- Der Engpass war nie Intelligenz. Es war Kontext.
- ChatGPT Enterprise vs. Copilot vs. eigenes RAG
- MCP, RAG, Agent Skills oder Custom GPTs?
- KI-Agent-Pilot in 30/60/90 Tagen
- RAG über SharePoint, Confluence, Drive: Permissions-First
- RAG-Production-Readiness-Checkliste für EU-Unternehmen
- Warum KI-Agentenprojekte abgebrochen werden