Methodik · Testplanung

Welche Aufgaben soll die KI lösen?

Ein Kunde will ein Produkt vergleichen, ein Angebot anfragen oder eine Lieferung verfolgen. Die Aufgabenwahl legt vor dem Test fest, welche dieser Wege ein KI-Agent prüfen soll. Dazu gehören Ziel, Zugang und erlaubter Endpunkt. Mehrere Aufgaben zeigen verschiedene Hürden; ein einzelner Test bleibt eine begrenzte Beobachtung. So wird sichtbar, was Hyperize am Kundenweg verbessern kann.

Die Aufgabe steht vor dem Test fest. Das Ergebnis gilt für den geprüften Umfang.

Der Ausgangspunkt

Mit dem Kundenbedarf beginnen.

Ein fehlgeschlagener Weg erklärt noch nicht die ganze Marke. Entscheidend ist, ob die Aufgabe zum Kundenbedarf passt.

Die Methodik trennt Aufgabenwahl und Messung: erst Ziel und Grenzen festlegen, dann den Weg prüfen.

Ein einzelner Website-Check zeigt einen Ausschnitt. Ein breiter Markenvergleich braucht mehrere vergleichbare Aufgaben.

Die Regeln

Sechs Regeln für faire Tests

Regeln für den Testplan; kein Nachweis, dass jede historische Messung alle Kriterien erfüllt [S1].

01

Realen Kundenbedarf prüfen.

02

Zugänge im Verantwortungsbereich der Marke prüfen.

03

Für breite Vergleiche mehrere Aufgaben wählen.

04

Innerhalb einer Branche vergleichbare Schwierigkeit sichern.

05

Vermittlung und technische Hürden getrennt erfassen.

06

Aufgabenbeschreibungen vor der Vergleichswelle festlegen und veröffentlichen.

Typische Fehler

Fünf Fehler vermeiden

Diese Fehler verzerren einen Vergleich [S1].

FM1
Einzelfall verallgemeinern
Ein Weg gilt als ganze Marke.
Mehrere Aufgabenklassen wählen.
FM2
Ungleich vergleichen
Aufgaben sind unterschiedlich schwer.
Gemeinsames Branchenraster verwenden.
FM3
Vermittlung falsch werten
Übergabe gilt als technischer Fehler.
Zuständigkeit vorher klären.
FM4
Aufgaben verändern
Alte und neue Tests vermischen sich.
Versionen getrennt ausweisen.
FM5
Nur Einfaches testen
Messbarkeit verdrängt Kundenbedarf.
Nutzen und Prüfbarkeit verlangen.
Direkt oder über Vermittler

Den passenden Zielpunkt prüfen

Eigener Zugang

Der Weg bei der Marke

Was kann der Agent auf den Seiten und Systemen der Marke erledigen?

Vermittler

Der Weg über Dritte

Braucht die Aufgabe einen Vermittler, oder weicht der Agent vermeidbar dorthin aus?

Vermittler sind Kontext, kein zusätzlicher Faktor in der veröffentlichten Score-Formel [S2].

Angewendet

Vier Beispiele für die Aufgabenwahl

Beispiele für die Planung, keine neuen Markenmessungen. Ziel und Zugänge jeweils prüfen.

Versicherung

Allianz

Zugangsweg · Angebot und Beratung

Ziel kann eine passende Anfrage sein.

Passende Aufgabe

Deckung prüfen; Anfrage vorbereiten.

Unfair wäre

Einen Vermittlerfund als Website-Fehler zählen.

Vermeidet

FM1 · FM3

Automobil

Mercedes-Benz

Zugangsweg · Konfiguration und Kontakt

Endpunkt je Angebot festlegen.

Passende Aufgabe

Konfiguration prüfen; Probefahrt finden.

Unfair wäre

Für jeden Weg einen Online-Kauf verlangen.

Vermeidet

FM2 · FM3

Logistik

DHL

Zugangsweg · Versand und Sendung

Paketaufgabe und Zugang eingrenzen.

Passende Aufgabe

Preis ermitteln; Sendung verfolgen.

Unfair wäre

Preisabfrage und Login-Checkout gleichsetzen.

Vermeidet

FM2

Gesundheit

Bayer

Zugangsweg · Information und Bezugsweg

Produktinformation von Kauf trennen.

Passende Aufgabe

Produktdokumentation und Bezugsweg finden.

Unfair wäre

Direkten Hersteller-Checkout voraussetzen.

Vermeidet

FM1 · FM3

Vergleichbarkeit

Aufgaben festhalten. Änderungen erklären.

Für Vergleichswellen gilt: Aufgabenbeschreibungen vorab festlegen und veröffentlichen. Wiederholungen ergänzen die Historie [S1].

Ändert sich eine Aufgabe, erhält sie eine neue Version. Trends nur bei vergleichbaren Bedingungen lesen.

Befunde lassen sich mit Belegen hinterfragen. Eine Korrektur braucht einen nachvollziehbaren Änderungsvermerk.

Umfang und Grenzen

Was der Test belegt.

Regeln und Score-Gewichte sind öffentlich. Interne Prompts, Bewertungsdetails und Rohprotokolle bleiben im Projekt. Ein geplanter Stopp vor Kauf oder Versand ist kein technisches Scheitern. Beispiele belegen keine aktuelle Markenleistung; Rankings und Zitierungen sind nicht garantiert.

Quellen

Belege und Herkunft

S1

Intern

Regeln zur Aufgabenwahl

Hyperize · Methodik · Mai 2026

Interne Methodik, nicht öffentlich abrufbar.

Belegt: Sechs Regeln, fünf Fehlerquellen und versionierte Aufgabenbeschreibungen.

S2

Methodik

Agent Success Score

Hyperize · Oktober 2026

https://www.hyperize.ai/de/methodology/agent-success-score

Belegt: Öffentliche Gewichte 20/70/10 und Grenzen der Messung.

S3

Messbeleg · Englisch

DHL: historisches Aufgabenbeispiel

Hyperize · DAX-40-Index · Q2 2026

https://www.hyperize.ai/en/dax40-index/brands/dhl

Belegt: Eine Paketaufgabe; Checkout hinter Login nicht getestet. Kein vollständiger Aufgabenmix.

S4

Messbelege

DAX-40-Index

Hyperize · Veröffentlichte Messstände

https://www.hyperize.ai/de/dax40-index

Belegt: Ergebnisse im jeweiligen Umfang und mit eigenen Grenzen.

Interne Methodik ist keine öffentlich abrufbare Quelle. Öffentliche Beispiele zeigen jeweils ihren eigenen Testumfang.

Aktualisiert
Nächste Prüfung
Konfidenz A
BelegartEigene Methodik

Vom Test zur Umsetzung

Grundlage

Methodik

Wie wir Ihren Kundenweg für KI nutzbar machen.

Methodik verstehen

Bewertung

Agent Success Score

Was der Score zusammenfasst und wo seine Grenzen liegen.

Score verstehen

Mein nächster Schritt

Meine Aufgabe

Ziel, Zugänge und Umfang für Ihr Projekt gemeinsam klären.

Meine Aufgabe klären