Model and Modality Playbooks16. September 2026Flatkey Team

DeepSeek V4-Migrations-Checkliste: Veraltete Aliase sicher ersetzen

Nutzen Sie diese DeepSeek V4-Migrations-Checkliste, um eingestellte Flash-Aliase zu ersetzen, den Thinking Mode zu testen, das Flatkey-Routing zu prüfen und bei Bedarf sicher zurückzurollen.

DeepSeek V4-Migrations-Checkliste: Veraltete Aliase sicher ersetzen

Die DeepSeek V4-Migration ist nicht mehr einfach nur eine allgemeine Aufgabe zum „Upgrade auf V4“. Seit dem 16. September 2026 ist das Migrationsrisiko konkret: DeepSeek sagt, dass die alten Namen deepseek-v4-flash und deepseek-v4-flash-vision-exp aus Kompatibilitätsgründen weiterhin akzeptiert werden, diese eingestellten Modellnamen jedoch von DeepSeek-V4.1-Flash bedient und zum Flash-Preis abgerechnet werden. DeepSeek sagt außerdem, dass der API-Service für deepseek-v4-pro nach dem 14. September 2026 mit der bestehenden Abrechnungsmethode fortgesetzt wird, sofern DeepSeek keine weiteren Hinweise gibt.

Das bedeutet, der sichere Weg ist nicht, jedem historischen Alias hinterherzulaufen. Der sichere Weg besteht darin, neue Arbeit standardmäßig auf deepseek-flash auszurichten, zu dokumentieren, wo deepseek-v4-pro noch absichtlich verwendet wird, und die genaue Route zu verifizieren, die Ihr Produkt aufruft. Wenn Sie über Flatkey routen, gilt dasselbe Prinzip: Richten Sie den OpenAI-kompatiblen Client auf https://router.flatkey.ai/v1 aus, wählen Sie die aktuelle DeepSeek-Zeile aus dem Live-Katalog, führen Sie einen Smoke-Test aus und bestätigen Sie die Nutzungsprotokolle, bevor Produktionsverkehr umgestellt wird.

Dieser Leitfaden DeepSeek V4-Migrations-Checkliste: Veraltete Aliase sicher ersetzen bietet Indie-Hackern und kleinen KI-Produktteams einen praktischen Rollout: veraltete Aliase prüfen, Modell-IDs aktualisieren, den Thinking-Modus testen, das Responses-API- und Tool-Call-Verhalten validieren, Preiseinheiten überprüfen und das Rollback einfach halten.

Kurze Antwort: Was sollte sich ändern?

Verwenden Sie deepseek-flash als aktuellen Namen des Flash-Modells. Behandeln Sie deepseek-v4-flash und deepseek-v4-flash-vision-exp als Kompatibilitäts-Aliase, die aus neuem Code, Routing-Richtlinien, Dokumentationen und Eval-Sheets entfernt werden sollten. Behalten Sie deepseek-v4-pro nur dort bei, wo Sie einen Grund haben, die Pro-Route direkt zu testen und zu überwachen.

Zeichenfolge, die in Ihrem Stack gefunden wird Aktueller offizieller Kontext Empfohlene Maßnahme Zu testendes Migrationsrisiko
deepseek-v4-flash Alter Name; Anfragen werden aus Kompatibilitätsgründen von DeepSeek-V4.1-Flash bedient. Nach einem Route-Smoke-Test durch deepseek-flash ersetzen. Model-not-found-Fehler in Routern, Dashboards, Allowlists oder veralteten Docs.
deepseek-v4-flash-vision-exp Alter Name; Anfragen werden aus Kompatibilitätsgründen von DeepSeek-V4.1-Flash bedient. Durch deepseek-flash ersetzen und anschließend Bild-Input-Pfade explizit testen. Verarbeitung von Vision-Payloads, Bilder in Tool-Ausgaben und Parser-Erwartungen.
deepseek-flash Aktueller Modellname für Flash in den DeepSeek-Dokumenten. Nach der Live-Route-Verifizierung als Standardziel für Flash-Workloads verwenden. Thinking-Standardeinstellungen, Preisfenster, Ausgabelänge, Streaming und Tool-Calls.
deepseek-v4-pro DeepSeek sagt, dass der API-Service nach dem 14. September 2026 mit der bestehenden Abrechnungsmethode fortgesetzt wird, sofern keine weiteren Hinweise gegeben werden. Nur beibehalten, wenn die Workload Pro absichtlich verwendet und das Monitoring aktuell ist. Änderungen im Provider-Lebenszyklus, höheres Kostenprofil, Drift der Routing-Richtlinie und Fallback-Verhalten.

Die praktische Regel für die DeepSeek V4-Migration ist einfach: Aliase gehören in einen Audit-Bericht, nicht in eine neue Produktionskonfiguration.

Warum sich diese Migration vom Juni-Checkliste unterscheidet

Die ursprüngliche Version dieses Artikels konzentrierte sich auf eine Außerbetriebnahme von deepseek-chat und deepseek-reasoner im Juli 2026. Das ist für diese Seite nicht mehr der sicherste Rahmen. Die aktuellen offiziellen DeepSeek-Dokumente betonen die V4.1-Flash-Veröffentlichung, den Modellnamen deepseek-flash, die außer Betrieb genommenen Flash- und Flash-Vision-Aliase sowie den weiterhin gültigen API-Service-Hinweis für deepseek-v4-pro.

Für ein kleines Team ändert das den Migrationsplan. Sie brauchen kein hektisches Umschreiben jeder DeepSeek-bezogenen Erwähnung. Sie brauchen eine kontrollierte Bereinigung von Aliasen mit datierten Nachweisen:

  • Welche Modellstrings existieren noch in Code, Umgebungsvariablen, Evaluierungsjobs und Dokumenten?
  • Welche Strings sind Kompatibilitäts-Aliase und welche Strings sind aktuelle Modell-IDs?
  • Welche Routen sind direkte DeepSeek-Routen und welche laufen über Flatkey oder ein anderes Gateway?
  • Welche Workloads hängen von Vision, Thinking, Responses API, Tool-Aufrufen, strukturiertem Output, langem Kontext oder Streaming ab?
  • Welche Dashboards belegen, dass die neue Modell-ID tatsächlich Traffic verarbeitet?

Das ist der Unterschied zwischen einem Alias-Austausch und einer zuverlässigen DeepSeek V4-Migration.

Quellenfakten vor dem Bearbeiten des Codes festhalten

Bevor Sie Modellstrings ändern, speichern Sie eine kurze Migrationsnotiz mit dem Quellendatum und den genauen Seiten, die Sie geprüft haben. Für dieses Update lauten die Quellenfakten:

Zu überprüfender Fakt Was die aktuellen Quellen sagen Wie man ihn verwendet
Aktueller Flash-Name Die DeepSeek-Dokumente sagen, dass deepseek-flash als Modellname verwendet werden soll. Machen Sie deepseek-flash zum Ziel-Modellstring für Flash-Routen.
Legacy-Flash-Aliase deepseek-v4-flash und deepseek-v4-flash-vision-exp werden weiterhin akzeptiert, aber ihre zugehörigen Modelle sind außer Betrieb und werden von V4.1 Flash bereitgestellt. Ersetzen Sie diese Aliase in neuem Code und planen Sie die Bereinigung in bestehenden Konfigurationen.
Pro-Lebenszyklus DeepSeek sagt, dass der API-Dienst von deepseek-v4-pro nach dem 14. September 2026 mit unverändertem Abrechnungsverfahren und vorbehaltlich weiterer Ankündigungen fortgesetzt wird. Behaupten Sie nicht, dass Pro abgeschaltet ist; überwachen Sie es als absichtliche Route.
Direkte DeepSeek-Base-URL DeepSeek dokumentiert https://api.deepseek.com für OpenAI-Format-Aufrufe und https://api.deepseek.com/anthropic für Anthropic-Format-Aufrufe. Halten Sie Änderungen der Base-URL getrennt von Änderungen des Modellnamens.
Flatkey-Base-URL Die Flatkey-Dokumente zeigen das OpenAI-SDK, das auf https://router.flatkey.ai/v1 verweist. Verwenden Sie beim Testen von Flatkey-Routen eine konfigurierbare Base-URL und ein Modellfeld.

Fügen Sie keine Preisangaben ohne Zeitstempel in Anwendungsdokumente ein. Auf der aktuellen Preisseite von DeepSeek sind die Preise pro 1 Mio. Tokens aufgeführt, Cache-Hit-Input, Cache-Miss-Input und Output-Tokens getrennt ausgewiesen und Spitzen- sowie Nebenzeiten angegeben. Das ist Grund genug, die Live-Preise zum Zeitpunkt des Rollouts zu prüfen, statt sich auf eine statische Schätzung im Migrationsskript zu verlassen.

Direktes DeepSeek-Routing im Vergleich zu Flatkey-Routing

Eine DeepSeek V4-Migration kann direkt, über Flatkey geroutet oder während des Tests beides zugleich sein.

Pfad Wann verwenden Was verifiziert werden muss
Direkte DeepSeek-API Sie möchten direkten Zugriff beim Anbieter und direkte Kontrollen des DeepSeek-Kontos. Basis-URL, API-Schlüssel, deepseek-flash, deepseek-v4-pro, Thinking-Modus, Responses API, Bildeingabe, Tool-Aufrufe, Preiseinheiten und 429-Handling.
Flatkey-Gateway-Route Sie möchten einen Schlüssel, eine OpenAI-kompatible Basis-URL, einen Modellkatalog und eine gemeinsame Nutzungsprüfung über mehrere Anbieter hinweg. Aktuelle Flatkey-Modellzeile, Routenstatus, Endpunktfamilie, Anforderungsprotokolle, Token- und Kostenfelder, Fallback-Richtlinie, Kontingent und Rollback-Modell.
Dual-Route-Validierung Sie benötigen Sicherheit, bevor Sie Produktionsverkehr verlagern oder kundennahe Workflows ändern. Gleiche Prompt-Menge, gleicher Parser, gleicher Streaming-Modus, gleicher Tool-Call-Test, gleiche Kennzahl für akzeptierte Ausgaben und dieselbe datierte Quell-Checkliste.

Flatkey ist nützlich, wenn das operative Problem größer ist als eine einzelne DeepSeek-Route: verstreute Anbieter-Schlüssel, wiederholte SDK-Anpassungen, unklare Kosten auf Anfrageebene und schwer prüfbare Fallback-Entscheidungen. Ein Gateway nimmt jedoch nicht die Notwendigkeit, die Modell-ID zu verifizieren. Testen Sie immer die exakte Modellzeile, die Ihr Konto aufrufen wird.

DeepSeek V4 Migrations-Checkliste

Verwenden Sie diese Checkliste, bevor Sie Aliase in der Produktion ersetzen.

  1. Quellendatum einfrieren. Notieren Sie das Datum, an dem Sie die DeepSeek-Dokumentation, die Flatkey-Dokumentation, das Flatkey-Modellverzeichnis, die Preisgestaltung und den Routenstatus geprüft haben. Für dieses Aktualisierungsfenster des Artikels ist dieses Datum der 16. September 2026.
  2. Den gesamten Stack durchsuchen. Suchen Sie nach deepseek-v4-flash, deepseek-v4-flash-vision-exp, deepseek-flash, deepseek-v4-pro und älteren Dokumenten, die Entwickler dazu auffordern, einen veralteten Wert zu kopieren.
  3. Jeden Treffer klassifizieren. Trennen Sie Produktionscode, Staging-Konfigurationen, Evaluierungsjobs, Prompt-Router-Richtlinien, Kundendokumente, Support-Makros, Notebooks, CI-Fixtures und Beispiele.
  4. Veraltete Flash-Aliase ersetzen. Migrieren Sie deepseek-v4-flash und deepseek-v4-flash-vision-exp erst zu deepseek-flash, nachdem Sie eine Testroute und einen Rollback-Plan haben.
  5. Pro explizit halten. Verschieben Sie Workloads von deepseek-v4-pro nicht stillschweigend auf Flash. Wenn Pro weiterhin verwendet wird, kennzeichnen Sie den Verantwortlichen, den Grund, das Prüfdatum und das Fallback-Modell.
  6. Den Denkmodus explizit machen. In den DeepSeek-Dokumenten heißt es, dass der Denkmodus standardmäßig mit dem Standardaufwand high aktiviert ist. Wenn Sie ein Verhalten ohne Denken benötigen, konfigurieren und testen Sie das bewusst.
  7. Bildinput testen, wenn Sie den Vision-Alias verwendet haben. Für Workloads, die deepseek-v4-flash-vision-exp verwendet haben, führen Sie Bildinput-Tests über die Route aus, die Sie tatsächlich ausliefern werden.
  8. Responses API separat testen. Die Kompatibilität der DeepSeek Responses API umfasst unterstützte, teilweise unterstützte, ignorierte und nicht unterstützte Felder. Leiten Sie das Verhalten nicht allein aus Chat Completions ab.
  9. Tool-Call- und strukturierte-Ausgabe-Tests ausführen. Validieren Sie Toolschemata, Funktionsargumente, JSON-Parsing, Wiederholungsversuche und Mehrturn-Verhalten.
  10. Streaming und Usage prüfen. Bestätigen Sie Chunk-Form, Timeout-Behandlung, finale Usage, Token-Zahlen und Billing-Felder in direkten Provider-Logs oder Flatkey Usage Logs.
  11. Dokumentation und Beispiele aktualisieren. Entfernen Sie veraltete Snippets, die beim nächsten Onboarding oder Bugfix veraltete Aliase wieder einführen würden.
  12. Hinter Konfiguration ausrollen. Legen Sie das Zielmodell in einer Umgebungsvariable oder Routing-Tabelle ab. Vermeiden Sie fest codierte Literale innerhalb der Geschäftslogik.
  13. Den ersten Produktionsabschnitt beobachten. Beginnen Sie mit risikoarmem Traffic, vergleichen Sie die Akzeptanzrate der Ausgaben und die Kosten pro akzeptierter Antwort und erhöhen Sie die Last erst, wenn die Logs sauber sind.

Vorlage für ein kopierbares Alias-Audit

Verwenden Sie diese Vorlage als kurzen Migrationsnachweis. Bewahren Sie sie in Ihrem Repository, Issue-Tracker oder Runbook auf, damit spätere Korrekturen wissen, warum sich der Alias geändert hat.

deepseek_v4_migration:
  checked_at_utc: "2026-09-16T00:00:00Z"
  source_pages:
    - "https://api-docs.deepseek.com/"
    - "https://api-docs.deepseek.com/quick_start/pricing"
    - "https://api-docs.deepseek.com/news/news260910"
    - "https://api-docs.deepseek.com/guides/thinking_mode"
    - "https://api-docs.deepseek.com/guides/responses_api"
    - "https://docs.flatkey.ai/quickstart.md"
    - "https://docs.flatkey.ai/guides/openai-sdk.md"
  replacements:
    - from: "deepseek-v4-flash"
      to: "deepseek-flash"
      reason: "Legacy-Flash-Alias; Route wird aus Kompatibilitätsgründen von V4.1 Flash bereitgestellt"
      owner: "engineering"
      status: "test_before_merge"
    - from: "deepseek-v4-flash-vision-exp"
      to: "deepseek-flash"
      reason: "Legacy-Alias für das Vision-Experiment; Verhalten bei Bildeingaben prüfen"
      owner: "engineering"
      status: "test_before_merge"
  intentionally_kept:
    - model: "deepseek-v4-pro"
      reason: "Pro-Route wird weiterhin absichtlich ausgewertet"
      next_review_date: "2026-09-30"
  required_tests:
    - plain_chat
    - thinking_enabled
    - thinking_disabled_if_used
    - responses_api
    - image_input_if_used
    - tool_calls
    - json_output
    - streaming
    - usage_log_readback
    - rollback

Flatkey-Konfigurationsmuster

Die sicherste Flatkey-Einrichtung hält die modellbezogene Auswahl des Anbieters in der Konfiguration, während die OpenAI-kompatible Client-Oberfläche stabil bleibt.

FLATKEY_API_KEY="sk-your-flatkey-key"
OPENAI_BASE_URL="https://router.flatkey.ai/v1"
FLATKEY_DEEPSEEK_MODEL="deepseek-flash"
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["FLATKEY_API_KEY"],
    base_url=os.environ.get("OPENAI_BASE_URL", "https://router.flatkey.ai/v1"),
)

response = client.chat.completions.create(
    model=os.environ.get("FLATKEY_DEEPSEEK_MODEL", "deepseek-flash"),
    messages=[
        {
            "role": "user",
            "content": "Gib einen Satz zurück, der bestätigt, dass die DeepSeek-Route erreichbar ist.",
        }
    ],
    stream=False,
)

print(response.choices[0].message.content)
print(response.usage)

Öffnen Sie nach der Anfrage die Flatkey-Nutzungsprotokolle und überprüfen Sie Modellname, Token-Anzahl, Latenz, Kosten, Schlüssel, Zeitstempel und Fehlerstatus. Wenn das Protokoll nicht mit der von Ihnen gesendeten Anfrage übereinstimmt, ist die Migration nicht abgeschlossen.

Testmatrix vor der Umstellung

Test Warum das wichtig ist Erfolgsanzeige
Einfacher Chat Bestätigt Authentifizierung, Basis-URL, Modell-ID und grundlegende Parser-Kompatibilität. Die Anfrage gibt den erwarteten Inhalt zurück und protokolliert das Zielmodell.
Thinking-Modus Das Denkverhalten von DeepSeek kann die Ausgabeform und den Token-Verbrauch ändern. Ihre App verarbeitet oder deaktiviert Reasoning-Ausgaben absichtlich.
Responses API Einige Parameter werden teilweise unterstützt, ignoriert oder nicht unterstützt. Ihr Client verlässt sich für die Korrektheit nicht auf ignorierte Felder.
Vision-Eingabe Der alte Vision-Alias impliziert Anwendungsfälle mit Bildeingaben, die einen echten Test benötigen. Bildeingaben werden über den tatsächlichen Pfad verarbeitet, den Sie ausliefern werden.
Tool-Aufrufe Agenten scheitern, wenn Tool-Argumente, IDs oder Mehrschritt-Nachrichten abweichen. Sowohl die Generierung von Tool-Aufrufen als auch die Fortsetzung von Tool-Ergebnissen bestehen.
Strukturierte Ausgabe Eine normale Antwort kann trotzdem einen JSON-Validator brechen. Die Bestehensrate des Validators bleibt innerhalb Ihrer Launch-Schwelle.
Streaming Streaming-Fehler treten oft erst nach dem ersten Chunk auf. Chunks, Abschlussnachricht, Timeout-Behandlung und Usage-Erfassung bestehen.
Kosten und Kontingent Verhalten bei Cache-Hit, Cache-Miss, Ausgabe, Peak-/Off-Peak-Zeiten, Retry und Fallback beeinflusst die tatsächlichen Kosten. Finanzen und Entwicklung können die Kosten pro akzeptierter Antwort erklären.
Rollback Alias-Migrationen sollten ohne überstürzten Deploy rückgängig gemacht werden können. Der Traffic kann per Konfiguration wieder auf einen bekannten Pfad zurückgeführt werden.

Häufige Fehler

  • DeepSeek V4-Migration als bloßen Textaustausch zu behandeln, ohne die aktuellen DeepSeek-Dokumente zu prüfen.
  • deepseek-v4-flash-vision-exp durch deepseek-flash zu ersetzen, aber Bildeingaben nie zu testen.
  • Anzunehmen, dass deepseek-v4-pro nach dem 14. September 2026 abgeschaltet wurde, obwohl die aktuellen Dokumente sagen, dass der Dienst weiterläuft.
  • Den Anwendungscode zu aktualisieren, aber veraltete Aliase in Eval-Jobs, Notebooks, Kundensnippets oder Fallback-Richtlinien zu belassen.
  • Nur die reinen Tokenpreise zu vergleichen statt die Kosten pro akzeptierter Antwort.
  • Anzunehmen, dass direktes DeepSeek-Verhalten und Flatkey-geroutetes Verhalten identisch sind, ohne den Live-Pfad und die Logs zu prüfen.
  • Nicht unterstützte Responses-API-Parameter stillschweigend das Produktverhalten ändern zu lassen.

Wenn Sie noch DeepSeek-Routen auswählen, kombinieren Sie diese Checkliste mit DeepSeek V4 Pro vs Flash und DeepSeek vs Qwen API routing checks. Wenn es bei dem größeren Projekt um Gateway-Standardisierung geht, lesen Sie den Flatkey API quickstart, den AI model catalog guide und AI routing API metrics. Für regionssensitive Provider-Entscheidungen nutzen Sie regional LLM provider routing.

FAQ

Wie lautet der aktuelle DeepSeek-Flash-Modellname?

Der aktuelle Flash-Modellname in der DeepSeek-Dokumentation ist deepseek-flash. Eine sichere DeepSeek V4 migration sollte veraltete Flash-Aliase nach dem Routentest auf diesen Modellstring umstellen.

Sind deepseek-v4-flash und deepseek-v4-flash-vision-exp defekt?

DeepSeek sagt, dass diese Legacy-Namen weiterhin akzeptiert werden, aber die zugehörigen Modelle wurden eingestellt und Anfragen werden von DeepSeek-V4.1-Flash bedient. Diese Kompatibilität ist während der Migration nützlich, aber neuer Code sollte sich nicht auf eingestellte Aliase verlassen.

Hat deepseek-v4-pro nach dem 14. September 2026 aufgehört zu funktionieren?

Nein. Die aktuelle DeepSeek-Dokumentation sagt, dass der API-Dienst für deepseek-v4-pro nach dem 14. September 2026 weiterläuft, wobei die Abrechnungsmethode unverändert bleibt, sofern DeepSeek keine weiteren Hinweise gibt. Halten Sie es explizit und überwacht, wenn Sie es verwenden.

Muss ich die DeepSeek Base URL ändern?

Nicht für einen direkten DeepSeek-Call im OpenAI-Format. DeepSeek dokumentiert https://api.deepseek.com als Base URL im OpenAI-Format. Für Flatkey verwenden Sie https://router.flatkey.ai/v1 mit einem Flatkey API-Schlüssel.

Ersetzt Flatkey provider-spezifische Routentests?

Nein. Flatkey kann den Schlüssel, die Base URL, den Katalog und die Nutzungsprüfung zentralisieren, aber Ihr Team muss weiterhin die genaue Modellzeile, das Feature-Verhalten, die Kostenfelder, den Routing-Status und den Fallback-Plan verifizieren.

Soll jede Arbeitslast auf deepseek-flash umgestellt werden?

Nein. deepseek-flash ist das aktuelle Flash-Ziel, aber Arbeitslasten, die absichtlich deepseek-v4-pro verwenden, sollten separat getestet und verfolgt werden. Wählen Sie nach Arbeitslast, nicht nach einer globalen Ersetzungsregel.

Abschließende Rollout-Empfehlung

DeepSeek V4-Migrations-Checkliste: Veraltete Aliase sicher ersetzen sollte mit Nachweisen enden, nicht nur mit einem zusammengeführten Diff. Ersetzen Sie eingestellte Flash-Aliase, halten Sie Pro-Routen bewusst, testen Sie die Funktionen, die Ihr Produkt tatsächlich nutzt, und überprüfen Sie die Anfrage in den Logs. Prüfen Sie dann das aktuelle Flatkey model directory und die Seite Flatkey pricing, bevor Sie Produktionsverkehr umstellen.