Welche Aufgaben soll die KI lösen?
Ein Kunde will ein Produkt vergleichen, ein Angebot anfragen oder eine Lieferung verfolgen. Die Aufgabenwahl legt vor dem Test fest, welche dieser Wege ein KI-Agent prüfen soll. Dazu gehören Ziel, Zugang und erlaubter Endpunkt. Mehrere Aufgaben zeigen verschiedene Hürden; ein einzelner Test bleibt eine begrenzte Beobachtung. So wird sichtbar, was Hyperize am Kundenweg verbessern kann.
Die Aufgabe steht vor dem Test fest. Das Ergebnis gilt für den geprüften Umfang.
Der Ausgangspunkt
Mit dem Kundenbedarf beginnen.
Ein fehlgeschlagener Weg erklärt noch nicht die ganze Marke. Entscheidend ist, ob die Aufgabe zum Kundenbedarf passt.
Die Methodik trennt Aufgabenwahl und Messung: erst Ziel und Grenzen festlegen, dann den Weg prüfen.
Ein einzelner Website-Check zeigt einen Ausschnitt. Ein breiter Markenvergleich braucht mehrere vergleichbare Aufgaben.
Sechs Regeln für faire Tests
Regeln für den Testplan; kein Nachweis, dass jede historische Messung alle Kriterien erfüllt [S1].
01
Realen Kundenbedarf prüfen.
02
Zugänge im Verantwortungsbereich der Marke prüfen.
03
Für breite Vergleiche mehrere Aufgaben wählen.
04
Innerhalb einer Branche vergleichbare Schwierigkeit sichern.
05
Vermittlung und technische Hürden getrennt erfassen.
06
Aufgabenbeschreibungen vor der Vergleichswelle festlegen und veröffentlichen.
Fünf Fehler vermeiden
Diese Fehler verzerren einen Vergleich [S1].
Den passenden Zielpunkt prüfen
Eigener Zugang
Der Weg bei der Marke
Was kann der Agent auf den Seiten und Systemen der Marke erledigen?
Vermittler
Der Weg über Dritte
Braucht die Aufgabe einen Vermittler, oder weicht der Agent vermeidbar dorthin aus?
Vermittler sind Kontext, kein zusätzlicher Faktor in der veröffentlichten Score-Formel [S2].
Vier Beispiele für die Aufgabenwahl
Beispiele für die Planung, keine neuen Markenmessungen. Ziel und Zugänge jeweils prüfen.
Versicherung
Allianz
Zugangsweg · Angebot und Beratung
Ziel kann eine passende Anfrage sein.
Passende Aufgabe
Deckung prüfen; Anfrage vorbereiten.
Unfair wäre
Einen Vermittlerfund als Website-Fehler zählen.
Vermeidet
FM1 · FM3
Automobil
Mercedes-Benz
Zugangsweg · Konfiguration und Kontakt
Endpunkt je Angebot festlegen.
Passende Aufgabe
Konfiguration prüfen; Probefahrt finden.
Unfair wäre
Für jeden Weg einen Online-Kauf verlangen.
Vermeidet
FM2 · FM3
Logistik
DHL
Zugangsweg · Versand und Sendung
Paketaufgabe und Zugang eingrenzen.
Passende Aufgabe
Preis ermitteln; Sendung verfolgen.
Unfair wäre
Preisabfrage und Login-Checkout gleichsetzen.
Vermeidet
FM2
Gesundheit
Bayer
Zugangsweg · Information und Bezugsweg
Produktinformation von Kauf trennen.
Passende Aufgabe
Produktdokumentation und Bezugsweg finden.
Unfair wäre
Direkten Hersteller-Checkout voraussetzen.
Vermeidet
FM1 · FM3
Vergleichbarkeit
Aufgaben festhalten. Änderungen erklären.
Für Vergleichswellen gilt: Aufgabenbeschreibungen vorab festlegen und veröffentlichen. Wiederholungen ergänzen die Historie [S1].
Ändert sich eine Aufgabe, erhält sie eine neue Version. Trends nur bei vergleichbaren Bedingungen lesen.
Befunde lassen sich mit Belegen hinterfragen. Eine Korrektur braucht einen nachvollziehbaren Änderungsvermerk.
Umfang und Grenzen
Was der Test belegt.
Regeln und Score-Gewichte sind öffentlich. Interne Prompts, Bewertungsdetails und Rohprotokolle bleiben im Projekt. Ein geplanter Stopp vor Kauf oder Versand ist kein technisches Scheitern. Beispiele belegen keine aktuelle Markenleistung; Rankings und Zitierungen sind nicht garantiert.
Belege und Herkunft
S1
Intern
Regeln zur Aufgabenwahl
Hyperize · Methodik · Mai 2026
Interne Methodik, nicht öffentlich abrufbar.
Belegt: Sechs Regeln, fünf Fehlerquellen und versionierte Aufgabenbeschreibungen.
S2
Methodik
Agent Success Score
Hyperize · Oktober 2026
https://www.hyperize.ai/de/methodology/agent-success-score
Belegt: Öffentliche Gewichte 20/70/10 und Grenzen der Messung.
S3
Messbeleg · Englisch
DHL: historisches Aufgabenbeispiel
Hyperize · DAX-40-Index · Q2 2026
https://www.hyperize.ai/en/dax40-index/brands/dhl
Belegt: Eine Paketaufgabe; Checkout hinter Login nicht getestet. Kein vollständiger Aufgabenmix.
S4
Messbelege
DAX-40-Index
Hyperize · Veröffentlichte Messstände
https://www.hyperize.ai/de/dax40-index
Belegt: Ergebnisse im jeweiligen Umfang und mit eigenen Grenzen.
Interne Methodik ist keine öffentlich abrufbare Quelle. Öffentliche Beispiele zeigen jeweils ihren eigenen Testumfang.
Vom Test zur Umsetzung
Bewertung
Agent Success Score
Was der Score zusammenfasst und wo seine Grenzen liegen.
Score verstehenMein nächster Schritt
Meine Aufgabe
Ziel, Zugänge und Umfang für Ihr Projekt gemeinsam klären.
Meine Aufgabe klären