---
title: "Was KI 2026 wirklich kostet: drei Stufen, mit offener Rechnung - OkamiOps Insights"
description: "Zehn Personen mit fertigen Abos kosten $317 pro Monat. Die API-Automatisierung, die im selben Monat 4.000 Tickets bearbeitet, kostet $90 — $0,02 pro"
url: https://okamiops.com/de/insights/quanto-custa-implementar-ia-2026/
lang: de
alternates:
  en: https://okamiops.com/insights/quanto-custa-implementar-ia-2026/
  pt-BR: https://okamiops.com/pt/insights/quanto-custa-implementar-ia-2026/
  de: https://okamiops.com/de/insights/quanto-custa-implementar-ia-2026/
  x-default: https://okamiops.com/insights/quanto-custa-implementar-ia-2026/
lastmod: 2026-09-10
---

# Was KI 2026 wirklich kostet: drei Stufen, mit offener Rechnung

CONSULTORIA · AGO · 2026 · 6 min

Zehn Personen mit fertigen Abos kosten $317 pro Monat. Die API-Automatisierung, die im selben Monat 4.000 Tickets bearbeitet, kostet $90 — $0,02 pro Ticket, mit Routing und Cache. Die teure Stufe ist nicht die, die Sie erwarten, und die Zahl, die über das Projekt entscheidet, steht nicht auf der Lieferantenrechnung.

- **Kategorie**: Beratung
- **Datum**: AGO · 2026
- **Lesezeit**: 6 min
- **Quellen**: 8

## Drei verschiedene Käufe, nicht eine Entscheidung

Die Frage kommt immer in derselben Form: Was kostet es, KI ins Unternehmen zu bringen? Es gibt keine einzelne Zahl, weil es keinen einzelnen Kauf gibt. Es sind drei, und sie sind grundverschieden: Abo pro Person, Verbrauch pro Token und Engineering-Projekt. Alle drei stehen unten, mit offener Rechnung. Feste Annahme in allen Beispielen: ein Unternehmen mit 10 Personen, davon 3 im technischen Team, Listenpreise in Dollar, geprüft im September 2026.

Der Kontext hilft, die Dringlichkeit einzuordnen. In Brasilien gaben 52% der Kleinunternehmer an, in den zwei Wochen vor dem Interview KI genutzt zu haben, gegenüber 21% in den USA — eine Sebrae-Erhebung mit 7.182 Befragten, durchgeführt zwischen dem 24. März und dem 8. Mai 2026. Ihr Wettbewerber ist bereits in Stufe 1. Der Vorteil liegt nicht mehr im Einführen, sondern darin zu wissen, was Sie zahlen, wofür, und was die Rechnung nicht abdeckt.

## Stufe 1 — fertige Abos: $317 pro Monat für 10 Personen

Ein Claude-Team-Platz kostet $20 pro Person und Monat im Jahresplan und $25 im Monatsplan, für Teams von 2 bis 150 Personen. GitHub Copilot Pro kostet $10 und enthält $15 monatliche Credits; Pro+ kostet $39 und enthält $70 Credits, wobei ein Credit $0,01 wert ist. Zehn Standardplätze plus drei Pro+-Plätze für das technische Team ergeben $317 pro Monat. Das ist die realistische Untergrenze eines KI-Stacks im kleinen Unternehmen — und die Zahl, die die meisten überschätzen, bevor sie sich hinsetzen und rechnen.

Was diese Stufe kauft: Texten, Analyse, Lesen langer Dokumente, Recherche und Code, ab dem ersten Tag verfügbar, ohne Projekt. Was sie nicht kauft: nichts, was an Ihre Systeme angebunden ist, keine Aufzeichnung pro Prozess und keine Garantie, dass jemand es nutzt. Dazu kommt eine Preisfalle innerhalb der Stufe selbst. Dieselben 10 Plätze im Premium-Plan kosten $1.117 pro Monat, das 3,5-Fache. Das lohnt sich nur für Teams, die das Limit des Standardplans nachweislich sprengen — und das ermittelt man über die Nutzung, nicht über Meinungen.

**Zehn Plätze: Standard vs. Premium**

- **US$ 317** — Stufe 1 · 10 Standardplätze
- **US$ 1.117 3,5×** — Stufe 1 · 10 Premium-Plätze — lohnt sich nur, wenn das Standard-Limit gesprengt wird

## Stufe 2 — Automatisierung per API: die günstigste der drei, nicht die teuerste

Explizite Annahmen, damit Sie mit Ihren eigenen Volumina nachrechnen können: 4.000 Tickets pro Monat, 4 Modellaufrufe pro Ticket, 3.000 Eingabe-Token und 400 Ausgabe-Token pro Aufruf. Das ergibt 48 Millionen Eingabe- und 6,4 Millionen Ausgabe-Token pro Monat. Mit gpt-5-mini ($0,25 Eingabe und $2 Ausgabe je Million) landet die Rechnung bei $24,80. Mit Gemini 3.5 Flash-Lite ($0,30 und $2,50) bei $30,40. Mit Claude Sonnet 5 ($2 und $10) bei $160. Mit Claude Opus 5 ($5 und $25) bei $400. Dieselbe Last, ein Unterschied um das 16-Fache, allein durch die Modellwahl.

**Gleiches Volumen der Stufe 2, vier Modelle** (vs Claude Opus 5 (teuerstes Modell))

| Element | Wert |
| --- | --- |
| gpt-5-mini | $24.80 −94% |
| gemini 3.5 flash-lite | $30.40 |
| claude sonnet 5 | $160.00 |
| claude opus 5 | $400.00 |

Zwei Hebel senken diese Rechnung noch vor jeder Verhandlung. Routing: Schicken Sie die 80% einfachen Fälle an das kleine Modell und reservieren Sie das starke Modell für die schwierigen 20%; mit dieser Aufteilung fällt die Rechnung auf rund $52. Prompt-Caching: Bei OpenAI kostet ein zwischengespeichertes Eingabe-Token 10% des vollen Preises. Und Batching: Die Message Batches API von Anthropic verarbeitet innerhalb von 24 Stunden — die meisten Batches in unter einer — zum halben Preis, was für nächtliche Klassifikation und Anreicherung gut passt.

Es fehlt noch das Gateway. Es bündelt Schlüssel, deckelt Ausgaben pro Team, cacht und lässt Sie den Anbieter wechseln, ohne Code neu zu schreiben. Das AI Gateway von Cloudflare liefert Analytics, Caching und Rate Limiting ohne Zusatzkosten in jedem Plan, mit 10 Millionen Logs pro Gateway im kostenpflichtigen Workers-Plan; die gebündelte Credit-Abrechnung hat eine Gebühr von 5% und reicht den Inferenzpreis ohne Aufschlag durch. Zusammen mit gerouteten Tokens, Observability und Gateway liegt die gesamte Automatisierung bei rund $90 pro Monat: $0,02 pro Ticket. Ohne Routing und Cache kostet dasselbe Ticket $0,10.

Was Stufe 2 kauft: Durchsatz. Was sie nicht kauft: Richtigkeit. Ohne ein Evaluationsset — 200 von Hand annotierte Fälle mit der korrekten Antwort daneben — wissen Sie nicht, ob ein Modellwechsel das Ergebnis verbessert oder verschlechtert hat, und Ihr Kunde merkt es zuerst. Dieses Set aufzubauen kostet 3 bis 5 Tage von jemandem, der den Prozess von innen kennt. Es ist der teuerste Posten der Stufe 2 und der, den fast niemand einplant.

## Stufe 3 — KI im eigenen Produkt: die Rechnung täuscht

Hier irrt die Intuition gewaltig. Multiplizieren Sie das Volumen der Stufe 2 mit zehn, denn jetzt nutzt der Kunde das System und nicht das interne Team: Die gerouteten Tokens steigen auf rund $520 pro Monat. Dazu $200 für Observability und Evaluation im Team-Plan und $200 für Gateway, Logs und Staging-Umgebung. Summe: etwa $920 pro Monat an Lieferantenrechnungen. Das Dreifache der Stufe 1, nicht das Vierzigfache.

Der dominierende Kostenblock der Stufe 3 taucht in dieser Summe nirgends auf: Es sind Menschen und es ist Risiko. Gartner prognostiziert, dass mehr als 40% der agentischen KI-Projekte bis Ende 2027 gestrichen werden, wegen steigender Kosten, unklaren Geschäftsnutzens oder unzureichender Risikokontrollen. Was Stufe 3 kauft, ist eine Funktion, für die Kunden zahlen. Was sie nicht kauft, ist Entlastung: Logs mit Kundendaten, Prompt Injection, Aufbewahrungsrichtlinie und Auftragsverarbeitungsvertrag bleiben Ihre Sache. Die Rechnung ist die kleinste Position.

**Monatliche Lieferantenrechnung pro Stufe (USD/Monat, 10-Personen-Unternehmen)** (ohne Personalzeit)

| Element | Wert |
| --- | --- |
| faixa 1 · 10 assentos padrão | $317.00 −72% |
| faixa 1 · 10 assentos premium | $1117.00 |
| faixa 2 · API roteada + cache + gateway | $90.00 |
| faixa 2 · mesma carga, modelo de topo | $400.00 |
| faixa 3 · IA no produto (tokens + operação) | $920.00 |

**Was jede Stufe kauft — und was nicht** (Zusammenfassung aller drei Stufen)

|  | Kauft | Kauft nicht |
| --- | --- | --- |
| Stufe 1 · Abos | Texten, Analyse, Lesen langer Dokumente, Recherche und Code | Nichts, das mit den Systemen verbunden ist, keine Protokollierung pro Prozess oder Nutzungsgarantie |
| Stufe 2 · API | Volumen | Trefferquote — ohne Bewertungsset wissen Sie nicht, ob sie sich verschlechtert hat |
| Stufe 3 · Produkt | Eine Funktion, für die der Kunde bezahlt | Freistellung — Logs mit Kundendaten, Prompt Injection, Aufbewahrung und Vertrag bleiben Ihre Sache |

## Die Kosten, die nie auf der Rechnung stehen

Fünf Posten tauchen in jedem Projekt und auf keiner Preisliste auf. Integration: CRM, ERP oder Wissensbasis anzubinden misst man in Engineering-Tagen, nicht in Tokens. Evaluation: Jeder Modellwechsel bedeutet, die Regression erneut zu fahren, und Modelle bekommen mehrmals pro Jahr neue Versionen. Sicherheit: Schlüsselrotation, Log-Aufbewahrung und Prüfung auf Prompt Injection. Compliance: Auftragsverarbeitungsvertrag, Aufbewahrungsrichtlinie und Protokoll automatisierter Entscheidungen. Personalzeit: Schulung, Prozessänderung und die Woche, in der das Team gleichzeitig alt und neu arbeitet.

Wer den Business Case allein auf Tokenpreise baut, liegt um eine Größenordnung daneben. In den Stufen 2 und 3 sind Tokens meist die kleinste Position im Budget.

## Wann eine Stufe höher — und die Checkliste vor der Unterschrift

Zwei Auslöser, und nur zwei. Gehen Sie von Stufe 1 auf Stufe 2, wenn sich dieselbe Aufgabe mehr als 500-mal pro Monat mit stabilem Eingabeformat wiederholt; darunter ist eine Person mit Abo günstiger. Gehen Sie von Stufe 2 auf Stufe 3, wenn ein Kunde für das Ergebnis zahlt und nicht nur das interne Team es nutzt. Dass der Wettbewerber eine Stufe höher geht, ist kein Auslöser.

Checkliste vor jeder Unterschrift: Welche Aufgabe, gezählt pro Monat; was sie heute in Stunden kostet; welches Erfolgskriterium gilt und wer es prüft; wie viele Plätze in den letzten 30 Tagen ungenutzt blieben; was eine Aufgabe mit dem kleinen und mit dem großen Modell kostet; wo die Logs liegen und wie lange; und wie Sie aus dem Vertrag herauskommen. Passen diese sieben Antworten nicht auf eine Seite, ist das Problem nicht der Preis — es ist der Umfang.

**Checkliste vor der Unterschrift**

1. **Welche Aufgabe** — Gezählt pro Monat
2. **Was sie heute kostet** — In Arbeitsstunden
3. **Erfolgskriterium** — Und wer es überprüft
4. **Ungenutzte Plätze** — Wie viele in den letzten 30 Tagen ungenutzt blieben
5. **Kosten pro Aufgabe** — Mit dem kleinen und mit dem großen Modell
6. **Wo die Logs liegen** — Und wie lange sie aufbewahrt werden
7. **Ausstieg beim Anbieter** — Wie Sie aus dem Vertrag herauskommen

> **Was Sie morgen tun sollten**: Rechnen Sie alle drei Kalkulationen mit Ihren eigenen Volumina nach, bevor Sie eine Stufe wählen: Platz pro Person, Kosten pro Aufgabe und Personentage. Wenn die Kosten pro Aufgabe nicht gemessen sind, sparen Sie nicht — Sie raten.

## Quellen dieser Analyse

- **01**: [Claude · Pricing](https://claude.com/pricing)
- **02**: [OpenAI · API pricing](https://developers.openai.com/api/docs/pricing)
- **03**: [Google · Gemini API pricing](https://ai.google.dev/gemini-api/docs/pricing)
- **04**: [Anthropic · Batch processing with the Message Batches API](https://platform.claude.com/docs/en/build-with-claude/batch-processing)
- **05**: [GitHub · Copilot plans](https://github.com/features/copilot/plans)
- **06**: [Cloudflare · AI Gateway pricing](https://developers.cloudflare.com/ai-gateway/reference/pricing/)
- **07**: [Sebrae · Pequenos negócios do Brasil usam mais IA que os norte-americanos](https://agenciasebrae.com.br/dados/pequenos-negocios-do-brasil-usam-mais-ia-que-os-norte-americanos-aponta-sebrae/)
- **08**: [Gartner · Over 40% of agentic AI projects will be canceled by end of 2027](https://www.gartner.com/en/newsroom/press-releases/2025-06-25-gartner-predicts-over-40-percent-of-agentic-ai-projects-will-be-canceled-by-end-of-2027)

## Weiterlesen

- **GATEWAY · JUL · 2026**: [LLM-Output-Preise unterscheiden sich um 106×. Ihr KMU zahlt den Höchstpreis.](https://okamiops.com/de/insights/llm-cost-spread-2026/) (6 min)
- **APPSEC · ABR · 2026**: [OWASP LLM Top 10 (2025): fünf Risiken mit realen Vorfällen — und wie Sie jedes abdecken](https://okamiops.com/de/insights/owasp-llm-top-10-2025/) (8 min)
- **COMPLIANCE · MAR · 2026**: [Der EU AI Act nach dem Digital Omnibus: der echte Zeitplan und ein 90-Tage-Plan](https://okamiops.com/de/insights/eu-ai-act-timeline/) (7 min)

## Keine lose Meinung. Jede Zahl hat eine Quelle, jeder Artikel endet mit was zu tun ist.

Wir schreiben, was wir beim Lösen des Problems für einen Kunden lernen. Wenn Ihr Fall einem davon ähnelt, beginnt das Gespräch hier.
