AUS DER PRAXIS Ausgabe №244

Meinungen, keine Pressemitteilungen

Eine kuratierte Startseite führt zu fokussierten Themen- und Cluster-Hubs, damit ältere Beiträge nicht allein durch ihr Alter an Sichtbarkeit verlieren.

Nach Thema erkunden
06
Fokussierte Cluster
12
Blogbeiträge
244

Neueste Artikel

Neun Artikel pro Seite, nach Veröffentlichungsdatum sortiert.

Eine Sprachwellenform teilt sich zwischen einer verwalteten Miso-TTS-API und einer privaten selbst gehosteten GPU KI & Agenten

Miso TTS selbst hosten oder API: Kosten, Latenz und VRAM

Miso TTS klingt ausdrucksstark und hat offene Gewichte. Die 110 ms gelten aber für die gehostete H100-API, nicht für lokale Inferenz. Vergleiche Hardware, Preis, Lizenz und Produktionsrisiko.

Ein MCP-Client übergibt ein audience-gebundenes Token an einen Resource Server, der es gegen einen Identity Provider validiert, bevor ein Tool läuft KI & Agenten

Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur

OAuth 2.1, audience-gebundene Tokens und kein Token-Passthrough sind die harten Regeln der Spec. Der Rest, Multi-Tenant-Isolation, Per-Tool-Scopes, delegierter Zugriff und Audit, ist Referenzdesign. Hier ist die komplette Trust Boundary in zwei Diagrammen.

AI Act Artikel 50: Transparenzpflichten als Build-Checkliste für SaaS-Chatbots, KI-Agenten und generierte Inhalte Business & Regulierung

AI Act Artikel 50 Checkliste für SaaS und KI-Agenten

Artikel 50 gilt seit 2. August 2026 und wird durchgesetzt. Die technische Checkliste für laufende Compliance und schnelle Nachbesserung bei Chatbots, KI-Agenten, generierten Inhalten, Logging und Nachweisen.

Datenunabhängige Vektorquantisierung wandelt float32-Embeddings in rohe 2-Bit-Codes mit 16x weniger Bytes um KI & Agenten

RAG-Vektoren auf 2 Bit komprimieren: Ist datenunabhängige Quantisierung produktionsreif?

TurboQuant ist seit Qdrant 1.18 verfügbar, TurboVec hat Version 1.0 erreicht. Was 16x genau bedeutet, wie die aktuellen Benchmarks aussehen und was du testen solltest.

Acht isolierte KV Caches pro Rank auf einem Server, die zu einer einzigen gemeinsamen host-seitigen Cache-Schicht verschmelzen, aus der jeder Serving-Prozess lesen kann KI & Agenten

LMCache meldet 13,7x niedrigere mittlere TTFT mit gemeinsamem KV Cache

LMCache meldete in einem Multi-Turn-Benchmark mit Qwen3-235B einen Rückgang der mittleren Time-to-first-token von 3,98s auf 0,29s. Was das Ergebnis zeigt, was es nicht beweist und wie du Wiederverwendung selbst testest.

Verlustfreie BF16-Gewichtskompression im Vergleich zu 8-bit GGUF nach Exaktheit, Runtime-Evidenz und Production Readiness KI & Agenten

Verlustfreie LLM-Kompression vs. 8-bit GGUF: Was ist produktionsreif?

Faktenbasierte Entscheidungshilfe zu GLM-5.2, exakter BF16-Decodierung, Q8-Quantisierung, Runtime-Evidenz, Fleet Economics und 14-Tage-Pilot.

Bezahltes Pilotprojekt, Proof of Concept und Design Partner im Vergleich nach ihrer kommerziellen Beweiskraft Produkt & MVP

Bezahlter Pilot vs. PoC vs. Design Partner: Was beweist Nachfrage?

Entscheidungshilfe für Machbarkeit, Kundenlernen oder Zahlungsbereitschaft, mit Sieben-Punkte-Scorecard und Commercial Brief für den Pilotvertrag.

Verschachtelte Eval-Sandbox für KI-Agenten mit isolierter Ausführung, kontrolliertem Egress, ephemeren Credentials und externer Überwachung KI & Agenten

OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten

Faktencheck und Procurement-Checkliste für verschachtelte Isolation, Egress, Credentials, getrennte Control Plane, Benchmark-Integrität, Monitoring und Forensik-Fallback.

Parallele KI-Coding-Agenten arbeiten in isolierten Git Worktrees oder Jujutsu Workspaces auf einem gemeinsamen Repository-Speicher Software Delivery & QA

Git Worktrees vs. Jujutsu für KI-Coding-Agenten: Entscheidungshilfe 2026

Buyer Guide zu Repository-Cache, Partial Clone, Git Worktrees und Jujutsu Workspaces, mit Kompatibilitätslücken, Kostenmetriken und messbarem 14-Tage-Pilot.

Postfach, ohne Lärm

Folge der Arbeit, die für dich zählt

Du bekommst eine kurze E-Mail, wenn wir etwas Neues veröffentlichen. Folge dem ganzen Blog oder nur den Themen, die dich interessieren.

Was möchtest du erhalten?
Themen auswählen

Kostenlos, Double-Opt-in, ohne Tracking-Pixel.