modwall-Dokumentation

modwall ist eine API zur Moderation von Bildern und Text. Sie senden ein Bild (/v1/moderate) oder Text (/v1/moderate-text) und erhalten einen rohen Score zurück. Inhalte verarbeiten wir im Arbeitsspeicher und speichern sie nie — protokolliert werden nur Metadaten (Zeit, Score, Größe). Von Anfang an für den Produktivbetrieb gebaut: verständliche Fehlercodes, Webhooks und ein Audit-Log.

Erkennungsumfang (Bilder): nsfw (Nacktheit / Inhalte für Erwachsene) — immer; weapon (Waffen) und violence (Gewalt/Gore, Beta) — je Schlüsselprofil aktivierbar, Ergebnisse im Feld categories. Beleidigende Gesten erkennen wir nicht. Text: Toxizität, mehrsprachiges Modell (versteht Deutsch).

Den Umfang (Bilder / Text / beides) wählen Sie im Tarif — ein Endpunkt außerhalb Ihres Umfangs antwortet mit 403 capability_required.

Ziel: eine funktionierende Anfrage in 5 Minuten. Konto anlegen → Schlüssel erzeugen → drei Zeilen aus dem Schnellstart kopieren. Sie müssen nicht einmal curl schreiben — es gibt ein fertiges Widget und Copy-and-paste-Beispiele in Python, Node.js und PHP.

Zwei Wege der Anbindung

Server-APIWidget (Browser)
Schlüsselsk_live_ (geheim, Backend)pk_live_ (öffentlich + Domain-Allowlist)
AufrufBackend ↔ Backendaus dem Browser des Nutzers
Einsatzzweckdas Rückgrat der Compliance, nicht umgehbarschnelles Feedback beim Upload
DokumentationAPI — ReferenzWidget für Ihre Seite

Empfehlung: das Widget für die UX, die tatsächliche Durchsetzung aber immer serverseitig (API sk_live_). Ein öffentlicher Schlüssel plus Domain-Prüfung ist Schutz im Browser, nicht das Rückgrat Ihrer Compliance.

Womit anfangen