Tool zur Inhaltssicherheit (Text)

Warnung

Der Eingabeaufforderungsfluss in Microsoft Foundry und Azure Machine Learning wird am 20. April 2027 eingestellt. Der Aufforderungsfluss wird für die neue Entwicklung nicht mehr empfohlen. Migrieren Sie vorhandene Eingabeaufforderungsflussanwendungen und Bereitstellungen vor dem 20. April 2027 zu Microsoft Agent Framework.

Prompt flow-Containerimages erhalten keine Updates mehr, einschließlich Sicherheits- und Paketupdates. Dies gilt für Aufforderungsflusslaufzeitbilder, einschließlich promptflow-runtime, promptflow-runtime-stable, und promptflow-python.

Nach dem 20. April 2027 wird der Aufforderungsfluss, einschließlich der Weberstellungserfahrung in Microsoft Foundry und Azure Machine Learning, den VS Code-Erweiterungen und den zugehörigen Images für den Aufforderungsflussfluss nicht mehr unterstützt oder verfügbar.

Wenn Ihre Anwendung von Bereitstellungen oder Laufzeitimages für den Aufforderungsfluss abhängt, planen Sie, diese Workloads auf unterstützte Alternativen wie Microsoft Agent Framework vor dem Einstellungsdatum zu verschieben. Anleitungen zur Migration finden Sie im Leitfaden zur Eingabeaufforderungsflussmigration und im Migrationscodebeispiel.

Azure KI Inhaltssicherheit ist ein von Microsoft entwickelter Inhaltsmoderationsdienst, der Ihnen hilft, schädliche Inhalte aus verschiedenen Modalitäten und Sprachen zu erkennen. Das Tool zur Inhaltssicherheit (Text) ist ein Wrapper für die Azure KI Inhaltssicherheit Text-API, mit dem Sie Textinhalte erkennen und Moderationsergebnisse erhalten können. Weitere Informationen finden Sie unter Azure KI Inhaltssicherheit.

Voraussetzungen

  • Erstellen Sie eine Azure KI InhaltssicherheitRessource.
  • Fügen Sie eine Azure Content Safety-Verbindung im Eingabeaufforderungsfluss hinzu. Füllen Sie das API key Feld aus Primary key dem Keys and Endpoint Abschnitt der erstellten Ressource aus.

Eingaben

Sie können die folgenden Parameter als Eingaben für dieses Tool verwenden:

Name Typ Beschreibung Erforderlich
Text string Text, der moderiert werden muss. Ja
hate_category string Moderationsempfindlichkeit für die Hate Kategorie. Wählen Sie aus vier Optionen: disable, , low_sensitivity, medium_sensitivityoder high_sensitivity. Die disable Option bedeutet keine Moderation für die Hate Kategorie. Die anderen drei Optionen bedeuten unterschiedliche Strenge bei der Filterung von Hassinhalten. Der Standardwert ist medium_sensitivity. Ja
sexuelle Kategorie string Moderationsempfindlichkeit für die Sexual Kategorie. Wählen Sie aus vier Optionen: disable, , low_sensitivity, medium_sensitivityoder high_sensitivity. Die disable Option bedeutet keine Moderation für die Sexual Kategorie. Die anderen drei Optionen bedeuten unterschiedliche Strenge bei der Filterung sexueller Inhalte. Der Standardwert ist medium_sensitivity. Ja
self_harm_category string Moderationsempfindlichkeit für die Self-harm Kategorie. Wählen Sie aus vier Optionen: disable, , low_sensitivity, medium_sensitivityoder high_sensitivity. Die disable Option bedeutet keine Moderation für die Self-harm Kategorie. Die anderen drei Optionen bedeuten unterschiedliche Strenge bei der Filterung von Selbstverletzungsinhalten. Der Standardwert ist medium_sensitivity. Ja
Gewaltkategorie string Moderationsempfindlichkeit für die Violence Kategorie. Wählen Sie aus vier Optionen: disable, , low_sensitivity, medium_sensitivityoder high_sensitivity. Die disable Option bedeutet keine Moderation für die Violence Kategorie. Die anderen drei Optionen bedeuten unterschiedliche Strenge bei der Filterung von Gewaltinhalten. Der Standardwert ist medium_sensitivity. Ja

Weitere Informationen finden Sie unter Azure KI Inhaltssicherheit.

Ausgaben

Das folgende Beispiel ist eine Beispiel-JSON-Formatantwort, die vom Tool zurückgegeben wird:

{
    "action_by_category": {
      "Hate": "Accept",
      "SelfHarm": "Accept",
      "Sexual": "Accept",
      "Violence": "Accept"
    },
    "suggested_action": "Accept"
  }

Das action_by_category Feld enthält einen binärwert für jede Kategorie: Accept oder Reject. Dieser Wert zeigt, ob der Text die Vertraulichkeitsstufe erfüllt, die Sie in den Anforderungsparametern für diese Kategorie festgelegt haben.

Das suggested_action Feld gibt Ihnen eine allgemeine Empfehlung basierend auf den vier Kategorien. Wenn eine Kategorie einen Reject Wert aufweist, ist dies suggested_action ebenfalls Rejectder Fall.