Zum Hauptinhalt springen

DeepSeek Guide

Worum geht's?

DeepSeek besteht aus einer Consumer-App, einer offiziellen (in China gehosteten) API, einem Satz MIT-lizenzierter offener Gewichte und einem breiten Third-Party-Hosting-Ökosystem, das genau diese Gewichte anderswo betreibt. Dieser Guide kartiert diese Oberflächen, zeigt den OpenAI-kompatiblen Quickstart und benennt die Datenresidenz-Abwägungen klar, die für einen regulierten EU-Kontext entscheidend sind.

Quellenstand zum 23. Juni 2026

Basiert auf offiziellen DeepSeek-Quellen (api-docs.deepseek.com, huggingface.co/deepseek-ai, der DeepSeek-Datenschutzerklärung). Die aktuelle Generation ist DeepSeek-V4 (veröffentlicht am 24. April 2026). Die Legacy-API-Modell-IDs deepseek-chat und deepseek-reasoner lösen weiterhin auf, sind aber für die Abschaltung am 2026-07-24 vorgesehen – migriere auf die V4-IDs. Preise und Modellspezifikationen ändern sich; prüfe die Live-Preisseite erneut, bevor du Zahlen zitierst.

1. Das mentale Modell​

OberflächeWofür sie da istHauptnutzer
DeepSeek-App (chat.deepseek.com)Kostenloser Consumer-Chat mit einem DeepThink-Schalter (aus = schnell, an = Reasoning), Websuche und Datei-UploadEndnutzer
DeepSeek API (platform.deepseek.com)Pay-as-you-go-Entwickler-API; OpenAI- und Anthropic-kompatibelEntwickler
Offene Gewichte (Hugging Face, MIT-Lizenz)Herunterladen zum Selbst-Hosten oder Fine-TunenSelbst-Hoster, Forschende, compliance-getriebene Teams
Third-Party-Routing (OpenRouter, Together, Fireworks, DeepInfra, Bedrock, Azure)Die offenen Gewichte auf Nicht-China-Infrastruktur (US/EU) betreibenTeams, die keine Daten nach China senden dĂĽrfen oder eine API ĂĽber mehrere Modelle wollen

2. Modell-Lineup (aktuell, 2026)​

Die aktuelle Generation ist DeepSeek-V4 (veröffentlicht am 24. April 2026), ein hybrides Modell – Reasoning-Verhalten („Thinking") und schnelles Verhalten („Non-Thinking") werden über einen Modus gesteuert, nicht durch den Wechsel von Modellen. Das vereint, was früher zwischen einem Chat-Modell und dem eigenständigen R1-Reasoning-Modell aufgeteilt war.

ModellGesamt- / aktive ParameterKontextMax. OutputLizenz
DeepSeek-V4-Pro1,6 T / 49 B aktiv (MoE)1M Tokens384K TokensMIT
DeepSeek-V4-Flash284 B / 13 B aktiv (MoE)1M Tokens384K TokensMIT

Die V4-Pro-Karte beschreibt drei Reasoning-Modi – Non-Think, Think High, Think Max.

Ein paar Präzisierungen
  • Multimodalität liegt in separaten Modellen (DeepSeek-OCR / OCR-2, Janus-Pro, DeepSeek-VL2). Behandle die deepseek-v4-*-Text-API als Text-in / Text-out.
  • DeepSeek-Coder ist kein separates gehostetes Modell mehr – die Coding-Fähigkeit ist in die allgemeinen Modelle eingearbeitet. Die älteren DeepSeek-Coder-V2-offenen-Gewichte bleiben herunterladbar, sind aber Legacy.
  • Die V4-Flash-Parameterzahl wird in der offiziellen Release-Note mit 284 B gesamt / 13 B aktiv angegeben; einige Listings zeigten abweichende Zahlen – bestätige sie auf der Live-Modellkarte.

3. Die API​

Die DeepSeek API ist OpenAI-kompatibel (und Anthropic-kompatibel), also ein Drop-in für bestehende Codebases – du änderst base_url und den Schlüssel:

  • OpenAI-Format: https://api.deepseek.com (auch https://api.deepseek.com/v1)
  • Anthropic-Format: https://api.deepseek.com/anthropic

Aktuelle Modell-Identifier: deepseek-v4-flash und deepseek-v4-pro. Die Legacy-deepseek-chat und deepseek-reasoner funktionieren weiterhin, werden aber am 2026-07-24 15:59 UTC abgeschaltet (sie bilden derzeit auf die Non-Thinking- und Thinking-Modi von V4-Flash ab). Prompt Caching ist automatisch und macht zwischengespeicherten Input rund 50Ă— gĂĽnstiger als nicht zwischengespeicherten.

curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
-d '{"model": "deepseek-v4-pro", "messages": [{"role": "user", "content": "Hello!"}]}'

4. Datenresidenz und Compliance​

Wohin die Daten gehen, ist wichtig

Die offizielle API und die Consumer-App werden aus Festlandchina betrieben (laut DeepSeeks Datenschutzerklärung). Für einen regulierten EU-B2B-Kontext (DSGVO und Kunden, die Berufsgeheimnisträger sind) sollte die gehostete API als nicht geeignet für sensible oder personenbezogene Daten ohne vorherige rechtliche Prüfung behandelt werden. Als Präzedenzfall ordnete die italienische Datenschutzbehörde im Januar 2025 eine Sperre der Verarbeitung der Daten italienischer Nutzer an.

Zwei Wege, Daten aus China herauszuhalten:

  1. Die MIT-lizenzierten offenen Gewichte selbst hosten auf deiner eigenen EU-/US-Infrastruktur (z. B. vLLM) – Prompts und Outputs verlassen deine Umgebung nie.
  2. Über einen in den USA/EU gehosteten Drittanbieter routen – OpenRouter, Together, Fireworks, DeepInfra, AWS Bedrock oder Azure AI Foundry. Erwarte höhere Kosten pro Token als bei der offiziellen API im Tausch gegen Residenz und SLAs.

Inhaltsverhalten (faktisch, durch Dritte): Unabhängige Red-Team-Studien berichten, dass DeepSeek-Modelle Antworten zu Themen ablehnen oder umlenken, die in China politisch sensibel sind. Da dies auf Modellebene angewendet wird (Fine-Tuning), kann es selbst in selbst-gehosteten offenen Gewichten bestehen bleiben – es ist nicht nur ein Filter auf App-Ebene. Dies sind Erkenntnisse Dritter, keine offiziellen DeepSeek-Aussagen.


5. Preise (offiziell, Momentaufnahme)​

Momentaufnahme – an der Quelle verifizieren

Pro 1M Tokens, USD, von der offiziellen Preisseite. Drittanbieter setzen ihre eigenen (meist höheren) Preise. Off-Peak-Rabatte werden derzeit nicht angeboten.

ModellInput (Cache-Hit)Input (Cache-Miss)Output
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

Der herausragende Hebel ist die Cache-Hit-Input-Rate (~50× günstiger) – strukturiere lange, stabile System-Prompts oder RAG-Kontext so, dass sie den Cache treffen.


6. Entscheidungs-Guide​

SituationWähle …
Kosten haben Priorität, Daten sind nicht sensibel, China-Residenz ist akzeptabeldie offizielle DeepSeek API (am günstigsten, voller Funktionsumfang, OpenAI-Drop-in)
Daten mĂĽssen aus China herausbleiben; du willst Redundanz / SLAs / eine einheitliche Multi-Modell-APIThird-Party-Routing (Together / Fireworks / DeepInfra / OpenRouter / Bedrock / Azure)
strenge Compliance (DSGVO usw.) oder null Kosten pro Token im großen Maßstab, und du hast GPUsdie MIT-offenen-Gewichte selbst hosten (Hinweis: V4-Pro ist ein 1,6-T-Parameter-MoE – echte Infra und Ops)

Verwandte Guides