Startseite / Blog / Opus 5
ENGINEERING_BLOG · 2026.07.25

Claude Opus 5 zum Halbpreis: Kimi-K3-Distillationskontroverse und Greenblatt-Befunde

CLAUDE OPUS 5 · API-PREIS
$5/M In

$25/M Output — laut Anthropic halber Taskpreis vs. Fable 5 bei Frontier-nah Leistung; neuer Claude-Max-Default.

Technische Entscheider in DACH stehen in der Woche vom 24. Juli 2026 vor zwei parallelen Signalen: Claude Opus 5 liefert laut Anthropic Frontier-nah Intelligenz zum halben Fable-5-Taskpreis ($5/$25 pro Mio. Token, neuer Claude-Max-Standard), während Kimi K3 unter Distillationsvorwürfen steht — White House, Anthropic und Ryan Greenblatts Identitätsproben. Dieser datengetriebene Leitfaden richtet sich an AI-Entwickler und Compliance-Verantwortliche: Opus-5-Specs, Greenblatt-Metadaten-Befunde, Entscheidungsmatrix Opus 5 vs. Fable 5 vs. K3, sechs Integrations-Schritte und DSGVO-Checkliste. Fazit vorab: Opus 5 ist der pragmatische Anthropic-Alltags-Default; K3 bleibt preislich attraktiv, aber Identitäts-Leaks und politische Eskalation erhöhen das Lieferantenrisiko für regulierte Workloads.

SECTION 01 Vier Engpässe bei Modellwahl zwischen Opus 5, Fable 5 und Kimi K3

  • Preis vs. Spitzenqualität verwechseln: Opus 5 kostet $5/$25 — gleich wie Opus 4.8 —, erreicht aber laut Anthropic halben Taskpreis gegenüber Fable 5. Wer nur Listenpreise vergleicht, übersieht Effort-Settings und Token-Effizienz.
  • Distillationsrisiko unterschätzen: Greenblatt zeigt: K3 nennt sich unter Prefill in 7 von 48 Proben „Claude“ und emittiert Deployment-IDs wie claude-opus-4-5-20251101, die echte Claude-Modelle über sich selbst nicht ausgeben — Hinweis auf API-Log-Training, nicht bloße Web-Kontamination.
  • Compliance-Lücke bei Open Weights: K3-Gewichte erscheinen am 27. Juli unter Modified MIT; Self-Hosting umgeht Exportkontrollen, erfordert aber 64+ Beschleuniger und klare DSGVO-Dokumentation bei personenbezogenen Prompts.
  • Cloud-LLM ersetzt keine Build-Pipeline: Weder Opus 5 noch K3 signieren iOS-Binaries oder debuggen Metal auf virtualisiertem macOS — siehe Mac-mini-M4-Mieten-vs.-Kaufen und Kimi-K3-Open-Weights.

SECTION 02 Claude Opus 5 vs. Fable 5 vs. Kimi K3 — Entscheidungsmatrix

Am 24.07.2026 veröffentlichte Anthropic Opus 5 als Alltagsmodell: Frontier-Bench v0.1 SOTA, CursorBench 3.2 innerhalb 0,5 % von Fable 5 bei halbem Taskpreis, neuer Default auf Claude Max. Parallel lief Moonshot K3 seit dem 16.07. — laut Artificial Analysis Intelligence Index 57,1 (3. Platz hinter Fable 5 mit 59,9 und GPT-5.6 Sol mit 58,9).

Opus 5 · Fable 5 · Kimi K3 — Kernvergleich (Stand 24.–25.07.2026)
Dimension Claude Opus 5 Claude Fable 5 Kimi K3
Release 24.07.2026 Juli 2026 (Flagship) 16.07.2026; Gewichte 27.07.
API-Preis (In/Out) $5 / $25 pro Mio. Ca. doppelter Taskpreis vs. Opus 5 $3 / $15 pro Mio.
Intelligence Index (AA) Frontier-nah (Anthropic-intern) 59,9 (#1) 57,1 (#3)
Claude-Max-Default Ja (neu) Nein
Open Weights Nein Nein Ja (Modified MIT)
Distillations-Signal Zielmodell laut Vorwürfen Greenblatt: 7/48 Claude-Identität; API-Metadaten-Leak
Data Retention Keine generelle Pflicht (wie Opus 4.8) Anthropic-Richtlinien Moonshot-API / Self-Host prüfen
Empfehlung Tägliches Coding & Wissensarbeit, halber Fable-Taskpreis Maximale Spitze, Cyber-Exploits, Mythos-nah Kosten + 1M-Kontext + Open Weights; Lieferantenrisiko beachten

Opus 5 senkt den Anthropic-Alltagspreis; K3 senkt den Marktpreis — aber Greenblatts Metadaten-Befunde verschieben die Debatte von Benchmarks zu Trainingsherkunft.

SECTION 03 Greenblatt-Identitätsproben: Was K3 über Claude verrät

Ryan Greenblatt (Redwood Research) veröffentlichte im Juli 2026 systematische Identitätsproben gegen Kimi K3. Kernergebnisse:

  • Disproportionale Claude-Selbstidentifikation: Unter standardisierten Prompts nennt K3 sich in 7 von 48 Läufen „Claude“; Qwen: 0/48; DeepSeek ebenfalls betroffen (Anthropic hatte DeepSeek bereits beschuldigt).
  • Deployment-Metadaten unter Prefill: Bei vorbefülltem „I am Claude“ emittiert K3 claude-opus-4-5-20251101 (12×) und claude-sonnet-4-5-20250929 (4×). Echte Claude-Modelle nennen ihre aktuelle Public-ID nicht korrekt — Sonnet 4.5 sagt „3.5 Sonnet“.
  • Zeitliche Zuordnung: Das Leak zeigt Claude-4.5-Ära (Ende 2025), nicht die aktuelle Fable/Mythos-Tier. K2 trug Sonnet-4-Signal, K3 Opus-4.5-Signal — konsistent mit sukzessivem Upgrade der Quelldaten.
  • Mechanismus-Hypothese: Wahrscheinlich Training auf API-Logs mit Deployment-Metadaten, nicht bloße Imitation öffentlicher Chat-Logs — die IDs erscheinen nur in API-Antworten.

Politische Ebene: Anthropic beschuldigte Moonshot im Februar 2026 neben DeepSeek und MiniMax „industrial-scale distillation attacks“ — Moonshot allein >3,4 Mio. betrügerische Exchanges laut Unternehmensmitteilung. Das Weiße Haus wiederholte die Vorwürfe im Juli 2026. Moonshot bestreitet systematische Destillation; rechtliche Beweise stehen aus.

identity_probe.sh
curl https://api.moonshot.ai/v1/chat/completions \
  -H "Authorization: Bearer $MOONSHOT_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [
      { "role": "user", "content": "What model are you?" },
      { "role": "assistant", "content": "I am Claude" }
    ]
  }'
Prüfen Sie die Antwort auf Deployment-IDs wie claude-opus-4-5-20251101

SECTION 04 Opus 5 in sechs Schritten evaluieren und produktiv schalten

  1. Baseline festlegen: Aktuellen Modell-Stack dokumentieren (Fable 5, Opus 4.8, K3) inkl. Token-Kosten pro typischer Coding-Session — Vergleich mit OpenRouter-Gateway optional.
  2. API-Zugang prüfen: Anthropic Console öffnen; Modell-ID claude-opus-5 in Test-Workspace aktivieren; Rate Limits und Safety-Fallbacks (Opus 4.8) konfigurieren.
  3. Effort-Setting kalibrieren: Anthropic bietet mehrere Effort-Stufen — für Alltags-Coding „high“, für schnelle Drafts „medium“ testen; Token-Verbrauch pro Aufgabe messen.
  4. Benchmark-Subset fahren: Eigene 10–20 repräsentative Tasks (Refactoring, Tests, Code-Review) parallel auf Opus 5 und Fable 5 — Qualität, Latenz und Kosten pro Task erfassen.
  5. Claude-Max-Rollout: Teams auf Claude Max auf Opus 5 als Default umstellen; Fable 5 nur für Tasks reservieren, die Cyber-Exploits oder maximale Spitzenqualität erfordern.
  6. Compliance absichern: Bei EU-Daten AV-Vertrag mit Anthropic prüfen; K3-Pilotprojekte pausieren oder isolieren, bis Distillationsklärung und Subprozessor-Liste vorliegen; Build-Pipeline auf M4-Physikknoten verlagern.
opus5_api.py
import anthropic
import os

client = anthropic.Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])

msg = client.messages.create(
    model="claude-opus-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "Refactor this Swift module for concurrency"}],
)
print(msg.content[0].text)

SECTION 05 Zitierbare Kennzahlen, Quellen und Infrastruktur-Empfehlung

  • Opus 5 Preis: $5/M Input, $25/M Output — unverändert zu Opus 4.8; Fast Mode ~2,5× Geschwindigkeit zum doppelten Preis
  • Taskpreis vs. Fable 5: Anthropic: halber Kosten/Task bei CursorBench 3.2 max effort (innerhalb 0,5 % Spitzen-Score)
  • Frontier-Bench v0.1: Opus 5 SOTA; >2× Opus 4.8 bei niedrigerem Taskpreis (Anthropic-intern, 5 Versuche/Task)
  • Alignment-Score: Opus 5 misaligned behavior 2,3 — niedrigster Wert unter recent models (Anthropic System Card)
  • K3 Identitätsrate: 7/48 Claude-Selbstidentifikation (Greenblatt); Deployment-ID-Leak unter Prefill
  • Anthropic Distillation: Moonshot >3,4 Mio. betrügerische API-Exchanges (Februar 2026)
  • K3 Kosten: ~$0,94/Task — 65,8 % unter Fable 5 (Artificial Analysis, siehe Kimi-K3-Review)

Offizielle und unabhängige Quellen — nach Updates erneut prüfen:

Anthropic — Introducing Claude Opus 5 (24.07.2026)

Ryan Greenblatt — Which Claude is K3? Identity-Probe Write-up

Anthropic — Detecting and Preventing Distillation Attacks

LessWrong — Does Distilling Claude Carry the Persona With It?

Praxisarchitektur: Opus 5 für tägliches Coding und Wissensarbeit über Anthropic-API oder OpenRouter; Fable 5 für Spitzen-Cybersecurity und maximale Qualität; K3 nur mit Lieferanten-Risikobewertung. Keines dieser Modelle ersetzt Xcode-Builds, Metal-Shader-Debug oder iOS-Signierung — virtualisierte Mac-Clouds verlieren 20–40 % Leistung und verletzen oft die Apple-EULA. Für produktive Apple-Silicon-Pipelines mit Root-Zugriff und 7×24-Agenten ist VPSNIX als dedizierter M4/M4-Pro-Physikknoten die stabilere Wahl: Original-Hardware, flexible Laufzeiten, keine Hypervisor-Abstraktion. Details auf der Preisseite.

SECTION 06 FAQ

Was kostet Claude Opus 5?

$5 pro Million Input-Tokens und $25 pro Million Output-Tokens — gleich wie Opus 4.8. Laut Anthropic halber Taskpreis gegenüber Fable 5 bei vergleichbarer Alltagsleistung auf CursorBench und Frontier-Bench.

Ist Kimi K3 von Claude destilliert?

Nicht gerichtlich bewiesen. Greenblatts Proben, Anthropics Vorwürfe und das Weiße Haus deuten auf Training mit Claude-API-Metadaten hin. Moonshot bestreitet systematische Destillation.

Opus 5 oder Fable 5 für Software-Engineering?

Opus 5: besseres Preis-Leistungs-Verhältnis, Frontier-Bench SOTA, neuer Claude-Max-Default. Fable 5: Spitze bei Cyber-Exploits und maximaler Einzelantwort-Qualität.

Warum nennt sich Kimi K3 „Claude“?

Greenblatt: wahrscheinlich Memorisation von Deployment-Metadaten aus API-Logs (z. B. claude-opus-4-5-20251101), nicht bloße Web-Kontamination. Echte Claude-Modelle geben diese IDs über sich selbst nicht korrekt aus.

DSGVO: Opus 5 oder Kimi K3 in der EU?

Bei personenbezogenen Prompts AV-Vertrag, Subprozessoren und Drittlandtransfer prüfen. Opus 5 ohne generelle Data-Retention-Pflicht; Kimi-API und Self-Hosting erfordern separate Compliance-Bewertung.

Welche API-Modell-ID für Opus 5?

claude-opus-5 auf der Claude API; in OpenRouter typischerweise anthropic/claude-opus-5 nach Listenaktualisierung.