Zum Inhalt springen
batoon.ai
DE EN English: /en/status/

Stand

Wir zeigen das Messgerät.

Auf dieser Seite finden Sie keine Hochglanz-Traktion. Batoon misst sich wiederholbar an einem Katalog aus 94 Enterprise-Fähigkeiten, acht Schichten und 13 Branchenszenarien. Das Ergebnis steht hier vollständig, auch die Hälfte, die noch fehlt.

Stand: August 2026

Was läuft

Ein belastbarer Prototyp, kein Konzeptpapier.

Drei Szenarien end-to-end, über zwei Mandanten

Ein Produkt-Launch für ein B2B-SaaS-Unternehmen. Eine Churn-Rescue für einen Onlinehändler, mit Callcenter samt Kapazitätsgrenze und mit Vetos aus Consent und Sperrvermerk. Eine Creative-Ops-Schleife vom Briefing über drei Varianten bis zur Freigabe. Alle drei laufen in einer kuratierten Simulationswelt.

Echte Agenten, keine gescriptete Demo

Die Läufe orchestrieren KI-Agenten. Daneben gibt es einen deterministischen Modus ohne Modellzugriff. Damit lässt sich dieselbe Vorführung reproduzierbar und ohne API-Schlüssel zeigen.

Fünf echte MarTech-Systeme angebunden

Canva, Mailchimp, Meta Ads, HubSpot und Google BigQuery, jeweils nur lese- und entwurfsseitig. Nichts wird versendet, keine Kampagne startet.

Mandantenfähig, mit echtem Login

Batoon ist OIDC-Relying-Party. Es speichert keine Passwörter und betreibt kein eigenes Nutzerverzeichnis. Die Rechte ergeben sich aus Firmen- und Projektrolle zusammen: lesen, freigeben, konfigurieren.

Das Messergebnis

51,2 % von 94 Fähigkeiten.

51,2 %

471 von 920 Punkten · 2 von 13 Branchenszenarien ohne Änderung umsetzbar · 18 kritische Lücken

Nach Schicht

  • Mensch-Agent-Interaktion 65 %
  • Orchestrierung & Governance 64 %
  • Measurement 41 %
  • Distribution 39 %
  • Data Layer 33 %

Stark ist, was das Produktversprechen ausmacht. Schwach ist, was ein Prototyp ohne echte Kundendaten und ohne Live-Aussteuerung nicht beweisen kann.

Was fehlt

Die Lücken, ungeschönt.

Data Layer — 33 %
Die schwächste Schicht. Ohne echte Kundendaten fehlen Identitätsauflösung, Datenqualität und die Anbindung an Warehouses in der Breite.
Distribution — 39 %
Die Folge der Entscheidung gegen Live-Aussteuerung. Der Weg dorthin ist gebaut und getestet, aber nicht scharfgeschaltet.
Measurement — 41 %
Die Holdout-Mechanik steht. Es fehlt die Messung über längere Zeiträume und gegen echte Umsatzzahlen.
Kein Nachweis für Skalierung
Die Szenarien laufen auf Segmenten von rund hundert Kontakten, nicht auf Millionen.
Kein Enterprise-IdP im Einsatz
OIDC ist implementiert und gegen ein Keycloak-Profil getestet. Gegen den Identity Provider eines echten Konzerns lief es noch nie.
Das Assessment stellen wir uns selbst
Der Katalog aus 94 Fähigkeiten stammt von uns. Das macht die Zahl intern vergleichbar und über die Zeit belastbar. Eine externe Prüfung ersetzt es nicht.

Leitplanke

Was diese Seite nicht behauptet.

  • Keine Live-Aussteuerung. Nichts wird versendet, keine Kampagne startet.
  • Keine zahlenden Kunden, keine Referenzen, keine Fallstudien.
  • Keine Ergebniszahlen aus dem Echtbetrieb. Die Szenarien laufen in einer Simulationswelt.

Wir nennen diese Grenzen, weil sie in jeder Prüfung ohnehin auffallen würden. Der Prototyp kommt ohne solche Behauptungen aus.