LogoKALKULERO.
← Alle RechnerStartups & SaaSAPI Unit Economics

API Call Cost & Infrastructure Unit Economics Rechner

Berechne die tatsächlichen Kosten pro API-Aufruf, Infrastruktur-Overhead, variable Cloud-Kosten und API-Bruttomargen für Software-Produkte.

Hinweis: Alle Berechnungen und Angaben erfolgen ohne Gewähr. Dies stellt keine rechtliche, steuerliche oder finanzielle Beratung dar. Eine Haftung für Entscheidungen, die auf Basis dieses Rechners getroffen werden, ist ausgeschlossen.
Deal-Szenarien:

1. API-Volumen & Umsatzmodell

50 M Calls/Mo.
Calls
/Mo.

2. Variable & Feste Infrastruktur-Kosten (COGS)

Gesamt-COGS: 288,00 €/Mo.
/1M
/1M
/1M
/Mo.

💡 FinOps Richtwert: Eine gesunde API- oder SaaS-Plattform erzielt eine Bruttomarge von über 75 % bis 85 %. Liegen die variablen Kosten pro 1.000 Calls (CPM) über 0,05 € (bei Standard-APIs) bzw. über 0,50 € (bei AI-Wrappern), droht bei Power-Usern eine unbemerkte Margenerosion.

API-Bruttomarge (Gross Margin)
95,6 %

Erwirtschaftet 6.213,00 €/Mo. Rohertrag bei 0,01 €/1k CPM (5,75 €/1M).

Unit Economics:🟢 Elite Software Marge (≥ 80 %)
Break-Even Limit / Kunde:173.333.333 Calls
Kosten / Einzel-Call:0,00 €
Kostenkategorie (COGS)MonatskostenKosten / 1k CallsAnteil an COGS
Compute / Execution (Serverless / CPU)17,50 €0,00 €6,1 %
AI Tokens / Upstream Third-Party APIs0,00 €0,00 €0 %
Egress Data Transfer, CDN & Logging20,00 €0,00 €7 %
Feste Infrastruktur (DB, Redis, NAT, VPC)250,00 €0,01 €87 %
COGS / 1k Calls (CPM)0,01 €inkl. Fixkosten
Monatliche COGS -288,00 €/Mo. Bereitstellung
Monatlicher Rohertrag6.213,00 €nach allen Serverkosten
Umsatz / Kunde130,00 €/Mo. (50 Kunden)

Infrastruktur-Ökonomie: API-Kosten pro Call, Serverless COGS und Margen-Sicherung

In modernen Cloud- und AI-getriebenen SaaS-Unternehmen sind Infrastruktur- und API-Kosten keine diffusen Gemeinkosten, sondern die entscheidende Komponente der Cost of Goods Sold (COGS). Eine millimetergenaue Aufschlüsselung der Compute-, Token-, Egress- und Datenbankkosten pro 1.000 Requests schützt vor bösen Überraschungen bei rasantem Nutzerwachstum.

1. Die Kernformeln der API Unit Economics

  • Variable Kosten / 1M Calls: Compute + AI-Tokens + Egress & Logging
  • Kosten pro 1.000 Calls (CPM): (Gesamte Monats-COGS / Monatliche Calls) × 1.000
  • API-Bruttomarge (%): ((Monatlicher Umsatz − Gesamte COGS) / Monatlicher Umsatz) × 100
  • Break-Even Call-Limit: Umsatz pro Kunde / Variable Kosten pro Einzel-Call

2. Drei Leitlinien für CTOs und FinOps-Leader

Sichern Sie Ihre Plattform-Rentabilität durch konsequentes Edge-Caching zur Reduzierung von Ursprungsserver-Hits, Durchsetzung harter Quotas bei AI-Inference-Endpunkten und kontinuierliches Monitoring der Bruttomarge oberhalb von 75 %.

Häufig gestellte Fragen (FAQ)

Was versteht man unter API Unit Economics?

API Unit Economics beziffern die exakten Bereitstellungskosten (COGS) für einen einzelnen API-Aufruf bzw. 1.000 Requests (CPM). Dazu zählen Serverless-Compute (z. B. AWS Lambda / Cloudflare Workers), AI-Inference-/Token-Gebühren, Datenbankabfragen, Egress-Bandbreite und Monitoring.

Wie berechnen sich die Kosten pro 1.000 API-Calls (CPM)?

CPM = ((Gesamte variable Infrastrukturkosten + anteilige fixe Serverkosten) / Gesamte API-Calls im Monat) × 1.000. Kostet eine Plattform mit 50 Millionen Requests monatlich 612,50 € an Gesamtkosten, beträgt der CPM exakt 0,01225 €.

Warum sind LLM-Tokens und AI-APIs ein Risiko für Flatrate-SaaS-Preise?

Während klassische REST-Calls oft weniger als 0,001 € pro 1.000 Aufrufe kosten, verursachen LLM-Aufrufe (z. B. GPT-4 oder Claude 3.5) zwischen 2,50 € und 30,00 € pro Million Tokens. Ohne strikte Token-Limits oder nutzungsbasierte Abrechnung können wenige Power-User ein Abonnement unprofitabel machen.

Welche Bruttomarge gilt für API- und Entwickler-Plattformen als gesund?

Best-in-Class API-Plattformen (wie Stripe oder Twilio) erzielen Bruttomargen zwischen 70 % und 85 %. Bei reinen AI-Wrapper-Tools sollten nach Abzug der Upstream-Modellkosten mindestens 60 % bis 70 % Marge verbleiben.

Was bedeutet das Break-Even Call-Limit pro zahlendem Nutzer?

Es beziffert die maximale Anzahl an API-Aufrufen, die ein Kunde innerhalb seines gebuchten Tarifs tätigen darf, bevor die variablen Infrastrukturkosten den monatlichen Abonnementpreis übersteigen.

Wie können API-Infrastrukturkosten am effektivsten gesenkt werden?

1. Implementierung von Edge-Caching (Cloudflare Cache Rules / Redis) zur Vermeidung redundanter Compute-Ausführungen. 2. Batching von Datenbankabfragen. 3. Payload-Komprimierung zur Senkung von Egress-Kosten. 4. Nutzung kleinerer LLM-Modelle (z. B. GPT-4o-mini / Llama 3) für Standardaufgaben.

Mehr Rechner