Bewährte Methoden zur Verbesserung der Leistung dialogfähiger Agents

Vermeiden Sie Leistungsprobleme bei dialogfähigen Agents, indem Sie häufige Fehlerpunkte verstehen und Best Practices befolgen.

Kontingente und Grenzwerte

Verstehen Sie Quoten und Grenzen, wie z. B. RPM (Anfragen pro Minute, wobei eine Anfrage eine an einen Agents gesendete Nachricht ist) und die Anzahl der innerhalb eines 24-Stunden-Zeitraums zulässigen Power Platform-Anfragen.

Für Ihre Agents gelten Quoten sowie die Kapazitätsbeschränkungen, die mit einem Microsoft Copilot Studio-Plan verbunden sind.

Optimieren Sie Ihren Agent auf Leistung

Um die Leistung Ihres Agents zu optimieren, beachten Sie die folgenden bewährten Verfahren:

  • Platzieren Sie API-Aufrufe und Connector-Aufrufe strategisch in Ihren Unterhaltungsabläufen, um zu vermeiden, dass Nutzer auf mehrere Abschlüsse warten.
  • Wo dies zutrifft, sollten Informationen mithilfe von Variablen zwischengespeichert werden, anstatt mehrere API- oder Flow-Aufrufe durchzuführen.
  • Cloud-Flows, die von Copilot Studio-Agents aufgerufen werden, können Wartezeiten verursachen. Erwägen Sie stattdessen die Verwendung von Direct Connector-Calls oder dem Knoten HTTP-Anforderung senden.
  • Verstehen Sie den Leistungs- und Komplexitätskompromiss von Classic NLU und generativer Orchestrierung in Copilot Studio. Modelle für das Verständnis natürlicher Sprache (NLU) funktionieren gut für spezifische Intents, haben jedoch Schwierigkeiten mit komplexen Anfragen. Generative KI-Modelle bearbeiten ein breiteres Spektrum an Eingaben, können aber Wartezeiten verursachen.
  • Expressmodus aktivieren.

Optimieren Sie Ihren Cloud-Flow für optimale Leistung

Wenn Ihr Agent einen Power Automate-Flow aufruft, stellen Sie sicher, dass Cloud-Flows optimiert sind.

Anmerkung

Power Automate-Flows und Agent-Flows unterstützen IVR-Integrationen, werden jedoch nicht als primärer Integrationsmechanismus für latenzempfindliche Anrufabläufe mit hoher Parallelität empfohlen. Ihr synchrones Ausführungsmodell und die Begrenzungen bei der Dienstdrosselung können zusätzliche Latenz verursachen, die mit steigendem Aufrufvolumen immer deutlicher wird. Prüfen Sie alternative Integrationsmuster, wenn eine vorhersehbare Leistung mit geringer Latenz erforderlich ist.