Thema

AI und Agents

Engineering, Betrieb und Bewertung von AI-Systemen, Coding Agents und Modellinfrastruktur.

Blogbeiträge
137
Fokussierte Cluster
02

Fokussierte Cluster

Mit dem Grundlagenartikel starten

Postfach, ohne Lärm

Erhalte die nächste Feldnotiz zu AI und Agents

Eine kurze E-Mail, wenn wir veröffentlichen. Ohne Tracking-Pixel und ohne Postfachfüller.

Neu in dieser Sammlung

Wavect-Editorial-Grafik zur Trennung von Modellleistung und dauerhafter Produktdifferenzierung bei Laya vs Jev KI & Agenten

Laya vs Jev: Benchmarks und das Risiko für KI-Startups

Kann ein offener Spezialist zwei Jahre Vorsprung gefährden? Was Laya tatsächlich zeigt, was im Jev-Vergleich fehlt und wo belastbarer Kundennutzen entsteht.

Wavect-Artikelbild zu Google AX mit einem Schild als Symbol für kontrollierte Agentenausführung KI & Agenten

Google AX Agent Executor: Budgets und Selbsthosting

Eine Sandbox ist kein Kostenlimit. Was Google AX kontrolliert, welcher Zustand erhalten bleibt und welche Abhängigkeiten für die eigene KI entscheidend sind.

Rohe Agenten-Traces werden zu einem persistenten Wiki und einer validierten SKILL.md-Datei KI & Agenten

WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln

WikiSkill verdichtet Agenten-Traces zu einem persistenten Evidenz-Wiki und validiert atomare Änderungen an SKILL.md. Wir prüfen Benchmarks, Transfer, Grenzen und Produktionsarchitektur.

Octop verbindet Nutzer, KI-Agenten, Tools und selbst gehostete Daten in einem Anwendungs-Stack KI & Agenten

Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen

Tencent stellt Octop unter MIT bereit, inklusive Multi-User-Agenten, Dashboard, Automatisierung und Speicherung. Wir prüfen Lieferumfang, Grenzen und reale Produktionskosten.

Wigolo verteilt eine Agent-Anfrage auf Suchmaschinen, rankt Evidenz lokal neu und stellt zehn Web-Tools über MCP bereit KI & Agenten

Wigolo im Test: Lokale Web Intelligence für AI Agents

Wigolo bietet AI Agents lokale Suche, Fetching, Crawling und Research ohne Paid Search API. Wir prüfen zehn Tools, Cache, Datenschutz, AGPL und Produktionsgrenzen.

Wavect-Editorialgrafik einer typisierten Entscheidungsverzweigung für das KI-Modell Jev KI & Agenten

Jev AI im Test: Entscheidungsmodelle für Agenten

Jev trifft typisierte Entscheidungen statt Prosa zu erzeugen. So kann es Modelle routen, Agentenschritte steuern und begrenzte Automatisierung ergänzen, ohne harte Regeln zu ersetzen.

Vollständiges Artikelverzeichnis

  1. Laya vs Jev: Benchmarks und das Risiko für KI-Startups
  2. Google AX Agent Executor: Budgets und Selbsthosting
  3. WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln
  4. Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen
  5. Wigolo im Test: Lokale Web Intelligence für AI Agents
  6. Jev AI im Test: Entscheidungsmodelle für Agenten
  7. Supermemory: KI-Agenten mit Gedächtnis, RAG und lokalem Betrieb
  8. KI-Agenten-Designmuster: Einfach starten, Aktionen prüfen
  9. Claude Mods: Einrichtung, Function Hooks und Sicherheit
  10. Voicebox: Lokales Voice Cloning, Diktieren und MCP-Setup
  11. Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz
  12. OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen
  13. Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen
  14. OpenBot im Check: KI-Kollegen selbst hosten
  15. SwarmLLM Test 2026: Browser-P2P-Inferenz auf Smartphone und Laptop
  16. Ramp Inspect Architektur 2026: Background Coding Agents skalieren
  17. Model Hardware Standard: MHS für Physical AI im Unternehmen
  18. Fonio AI Erfahrungen 2026: Preise, API, DSGVO & Build vs Buy
  19. Mosaic (YC S26) im Check: Shared Memory für Coding Agents
  20. Ripwire Review 2026: Repo-Kontext für KI-Agenten ohne Embeddings?
  21. Atomare Multi-Datei-Edits für KI-Coding-Agenten: die Semaprax-Lektion
  22. Phonely Alma im Test: Ist das Voice-LLM produktionsreif?
  23. Utopia: Temporalen Wissensgraph im Unternehmen prüfen
  24. Wissenstransfer zwischen KI-Agenten: Einmal entdecken, günstiger skalieren
  25. claude-rotate: Ein Proxy für mehrere Claude-Max-Konten
  26. NVIDIA PAIR im Test: Lokales KI-Routing und die AMD-Lücke
  27. Feynman im Test: Ist der Open-Source AI Research Agent bereit für Teams?
  28. Obscura Browser im Test: Aussagen, Grenzen und Produktions-Fit
  29. Claude-Code-Designsystem: 4 Bausteine für markentreue UI
  30. Tencent Hy4 Preview im Test: Lohnt sich das 1M-Kontextmodell?
  31. PageLM im Check: Selbst hosten und kommerziell nutzen
  32. ChatGPT-Login: Das Modell sieht dein Passwort nicht
  33. M6 Mac mini vs. M5 Mac Studio für lokale KI: Kaufberatung
  34. KI-Agenten-Harness erklärt: Die Zuverlässigkeitsschicht rund um ein LLM
  35. FreeToken AI im Test: Frontier-MoE auf Consumer-GPUs?
  36. Darkbloom AI Test: Private Inferenz auf freien Macs
  37. Ox Alpha als GLM-5.3-Flash enthüllt: Was sich ändert
  38. Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
  39. LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
  40. Pika Audio API Preise: Sind Soundeffekte wirklich 20x günstiger?
  41. Thunder Computes 13-Mio.-Dollar-Wette auf GPU-Virtualisierung: Einkaufsleitfaden
  42. OpenViking im Überblick: Dateisystem-Memory für KI-Agenten
  43. LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
  44. AirLLM mit 4 GB VRAM: So funktioniert Layer-wise Inference
  45. TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
  46. Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
  47. Qwen3.8-27B: Computer-Use-Agenten selbst hosten, ohne Screenshots zu exportieren
  48. Lokalisierte URL-Slugs und hreflang: Warum wir einen englischen Slug behalten
  49. Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
  50. Graft Review 2026: Gehört die Repo-Map ins Git?
  51. Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
  52. Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
  53. DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
  54. Der vLLM- und Triton-Stack von Netflix: 7 Produktionslektionen
  55. OpenSandbox im Review: Lohnt sich Self-Hosting?
  56. Transformers.js im Browser: Wann lokale KI in dein Produkt gehört
  57. Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
  58. GitHub Spec Kit im Test: Lohnt sich der Prozess?
  59. Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
  60. LiteLLM selbst hosten: Production-Guide 2026
  61. KI-fähiges Unternehmenswiki: Architektur und Aufbau
  62. Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
  63. Versieht Claude Texte mit Wasserzeichen? API-Antwort 2026
  64. OpenKB Review: Knowledge Compiler vs. RAG
  65. Unsloth Desktop im Test: Private lokale KI-Workstation?
  66. NeMo Switchyard 0.2: Agenten-Routing ohne Training?
  67. Firecrawl AnyDoc im Test: 14 Formate zu Markdown
  68. MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
  69. Muse Glimmer 30B: Ist Metas lokales Agentenmodell produktionsreif?
  70. KI-Texte menschlicher schreiben mit Agent Skills
  71. NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
  72. OmniRoute KI-Routing: Setup und Produktions-Checkliste
  73. Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
  74. Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
  75. Gemini Robotics 2: Ganzkörpersteuerung und die Pilotentscheidung
  76. Hark Handoff im Test: Der Agent, der wirklich klickt
  77. Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
  78. pdf-inspector im Test: PDFs vor OCR lokal routen
  79. PII vor LLM-Prompts entfernen: Eine praktische Pipeline
  80. Agent Reach im Test: Kosten, Sicherheit und Grenzen
  81. Cloudflare Wallets für KI-Agenten: Was ist live?
  82. Lokaler multimodaler KI-Coding-Assistent: Sprache, OCR und Datenschutz
  83. DeepSeek V4 Flash 0731 auf einem KI-PC: Was funktioniert?
  84. YC QM Agent im Test: Ist Quartermaster bereit?
  85. jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
  86. Lightpanda Browser für KI-Agenten: Praxischeck 2026
  87. Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
  88. Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
  89. Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
  90. MCP ist keine Sicherheitsgrenze: Agentendaten schützen
  91. Gemma 4 kostenlos mit Unsloth und Colab tunen
  92. Können KI-Agenten miteinander kommunizieren? Band-Guide
  93. Taalas HC1 im Check: Lohnt sich ein fest verdrahteter LLM-ASIC?
  94. LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
  95. Welches lokale LLM läuft auf deiner Hardware? llmfit Guide
  96. GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
  97. Miso TTS selbst hosten oder API: Kosten, Latenz und VRAM
  98. Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
  99. RAG-Vektoren auf 2 Bit komprimieren: Ist datenunabhängige Quantisierung produktionsreif?
  100. LMCache meldet 13,7x niedrigere mittlere TTFT mit gemeinsamem KV Cache
  101. Verlustfreie LLM-Kompression vs. 8-bit GGUF: Was ist produktionsreif?
  102. OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
  103. Cisco Antares im Test: 1B Local AI für Vulnerability Localization
  104. Meterless im Test 2026: Ist der Context Layer produktionsreif?
  105. NVIDIA Nemotron 3.5 ASR: Ist Self-Hosted STT bereit für Voice Agents?
  106. Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
  107. Kimi K3 für EU-Unternehmen: API-Kosten, Datenschutz und Pilotplan
  108. Mesh LLM im Test: Ein großes LLM auf mehreren Rechnern ausführen?
  109. Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
  110. Bonsai 27B im Test: Läuft ein 27B-LLM wirklich auf dem Smartphone?
  111. KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
  112. Soofi S: Ist Deutschlands souveränes LLM bereit für Unternehmen?
  113. T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
  114. Colibri führt GLM-5.2 auf Consumer-Hardware aus. Der Haken.
  115. Open Knowledge Format (OKF): Der Unternehmensleitfaden
  116. AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
  117. Wann lokale Modelle APIs schlagen: Break-even-Rechner für EU-Unternehmen
  118. LLM-Kostenrechner 2026: Rechne pro Aufgabe, nicht pro Token
  119. Pxpipe im Test: Senken Bilder Claude-Code-Kosten um 60%?
  120. Pro Token günstiger kann pro Aufgabe teurer sein
  121. Claude Fable 5.1 in Claude Code nutzen
  122. Anthropic sagt Nein zum Open-Weights-Verbot. Der Kostenkampf bleibt real.
  123. Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
  124. LLM-Gateways im Vergleich 2026: LiteLLM vs OpenRouter vs Portkey vs RouteLLM
  125. LLMs in der EU selbst hosten: Wann sich Open Weights wirklich rechnen
  126. Beste Open-Weight-LLMs 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama
  127. Der Engpass war nie Intelligenz. Es war Kontext.
  128. ChatGPT Enterprise vs. Copilot vs. eigenes RAG
  129. MCP, RAG, Agent Skills oder Custom GPTs?
  130. LLM-Token-Kosten 2026 senken
  131. KI-Agent-Pilot in 30/60/90 Tagen
  132. RAG über SharePoint, Confluence, Drive: Permissions-First
  133. RAG-Production-Readiness-Checkliste für EU-Unternehmen
  134. Wann lohnt es sich, ein LLM-Eval zu bauen? Kosten, ROI und dem Judge vertrauen
  135. Warum KI-Agentenprojekte abgebrochen werden
  136. RAG, Fine-Tuning oder Long Context? Vergleich 2026
  137. LLM-API-Kosten 2026. Architektur-Shift