Model and Modality Playbooks16 tháng 9, 2026Flatkey Team

Danh sách kiểm tra di chuyển DeepSeek V4: Thay thế an toàn các bí danh đã ngừng hỗ trợ

Dùng danh sách kiểm tra di chuyển DeepSeek V4 này để thay thế các bí danh Flash đã ngừng hỗ trợ, kiểm tra chế độ thinking, xác minh định tuyến Flatkey và quay lui an toàn.

Danh sách kiểm tra di chuyển DeepSeek V4: Thay thế an toàn các bí danh đã ngừng hỗ trợ

Di chuyển DeepSeek V4 không còn là một tác vụ chung chung kiểu "nâng cấp lên V4" nữa. Tính đến ngày 16 tháng 9 năm 2026, rủi ro di chuyển là cụ thể: DeepSeek cho biết các tên cũ deepseek-v4-flashdeepseek-v4-flash-vision-exp vẫn được chấp nhận để tương thích, nhưng các tên model đã ngừng hỗ trợ này được phục vụ bởi DeepSeek-V4.1-Flash và được tính phí theo giá Flash. DeepSeek cũng cho biết dịch vụ API cho deepseek-v4-pro tiếp tục sau ngày 14 tháng 9 năm 2026, với phương thức tính phí hiện có trừ khi DeepSeek thông báo thêm.

Điều đó có nghĩa là con đường an toàn không phải là truy đuổi mọi bí danh lịch sử. Con đường an toàn là chuẩn hóa công việc mới trên deepseek-flash, ghi rõ nơi deepseek-v4-pro vẫn được dùng có chủ đích, và xác minh chính xác tuyến mà sản phẩm của bạn gọi. Nếu bạn định tuyến qua Flatkey, nguyên tắc tương tự cũng áp dụng: giữ client tương thích OpenAI trỏ tới https://router.flatkey.ai/v1, chọn dòng DeepSeek hiện tại từ danh mục trực tiếp, chạy kiểm tra nhanh và xác nhận nhật ký sử dụng trước khi lưu lượng production chuyển sang.

Hướng dẫn Danh sách kiểm tra di chuyển DeepSeek V4: Thay thế an toàn các bí danh đã ngừng hỗ trợ này cung cấp cho các indie hacker và nhóm sản phẩm AI nhỏ một lộ trình triển khai thực tế: kiểm tra các bí danh đã ngừng hỗ trợ, cập nhật ID model, kiểm thử chế độ thinking, xác thực hành vi của Responses API và gọi công cụ, kiểm tra đơn vị giá, và giữ cho việc quay lui đơn giản.

Trả lời nhanh: Điều gì cần thay đổi?

Dùng deepseek-flash làm tên model Flash hiện tại. Xem deepseek-v4-flashdeepseek-v4-flash-vision-exp là các bí danh tương thích nên được loại bỏ khỏi mã mới, chính sách định tuyến, tài liệu và bảng đánh giá. Chỉ giữ deepseek-v4-pro ở nơi bạn có lý do để kiểm thử và giám sát trực tiếp tuyến Pro.

Chuỗi được tìm thấy trong ngăn xếp của bạn Ngữ cảnh chính thức hiện tại Hành động được khuyến nghị Rủi ro di chuyển cần kiểm thử
deepseek-v4-flash Tên cũ; các yêu cầu được phục vụ bởi DeepSeek-V4.1-Flash để tương thích. Thay bằng deepseek-flash sau khi kiểm tra nhanh tuyến. Lỗi không tìm thấy model trong bộ định tuyến, bảng điều khiển, danh sách cho phép hoặc tài liệu cũ.
deepseek-v4-flash-vision-exp Tên cũ; các yêu cầu được phục vụ bởi DeepSeek-V4.1-Flash để tương thích. Thay bằng deepseek-flash, sau đó kiểm thử rõ ràng các đường dẫn đầu vào hình ảnh. Xử lý payload vision, hình ảnh đầu ra từ công cụ, và kỳ vọng của bộ phân tích.
deepseek-flash Tên model Flash hiện tại trong tài liệu DeepSeek. Dùng làm mục tiêu mặc định cho khối lượng công việc Flash sau khi xác minh tuyến trực tiếp. Thiết lập thinking mặc định, cửa sổ giá, độ dài đầu ra, streaming và gọi công cụ.
deepseek-v4-pro DeepSeek cho biết dịch vụ API tiếp tục sau ngày 14 tháng 9 năm 2026 với phương thức tính phí không đổi trừ khi có thông báo thêm. Chỉ giữ khi khối lượng công việc cố ý dùng Pro và việc giám sát vẫn cập nhật. Thay đổi vòng đời nhà cung cấp, cấu hình chi phí cao hơn, trôi chính sách tuyến, và hành vi fallback.

Quy tắc thực tế cho di chuyển DeepSeek V4 rất đơn giản: các bí danh thuộc về báo cáo kiểm tra, không phải cấu hình sản xuất mới.

Tại Sao Việc Di Chuyển Này Khác Với Danh Sách Kiểm Tra Tháng Sáu

Phiên bản gốc của bài viết này tập trung vào việc ngừng hỗ trợ deepseek-chatdeepseek-reasoner vào tháng 7 năm 2026. Hiện tại, đó không còn là cách diễn đạt an toàn nhất cho trang này nữa. Tài liệu chính thức hiện tại của DeepSeek nhấn mạnh bản phát hành V4.1 Flash, tên model deepseek-flash, các bí danh Flash và Flash Vision đã ngừng hỗ trợ, và ghi chú dịch vụ API vẫn tiếp tục cho deepseek-v4-pro.

Đối với một nhóm nhỏ, điều này làm thay đổi kế hoạch di chuyển. Bạn không cần viết lại vội vàng mọi đề cập liên quan đến DeepSeek. Bạn cần dọn dẹp bí danh một cách có kiểm soát, kèm bằng chứng có ngày tháng:

  • Những chuỗi model nào vẫn còn trong code, biến môi trường, tác vụ đánh giá và tài liệu?
  • Chuỗi nào là bí danh tương thích và chuỗi nào là mã định danh model hiện tại?
  • Những tuyến nào là tuyến DeepSeek trực tiếp và những tuyến nào đi qua Flatkey hoặc một cổng khác?
  • Những workload nào phụ thuộc vào vision, thinking, Responses API, gọi công cụ, đầu ra có cấu trúc, ngữ cảnh dài hoặc streaming?
  • Những dashboard nào chứng minh rằng mã định danh model mới thực sự đang xử lý lưu lượng?

Đó là sự khác biệt giữa việc thay thế bí danh và một di chuyển DeepSeek V4 đáng tin cậy.

Các Sự Thật Nguồn Cần Khóa Lại Trước Khi Bạn Chỉnh Sửa Code

Trước khi thay đổi các chuỗi model, hãy lưu một ghi chú di chuyển ngắn với ngày nguồn và các trang chính xác bạn đã kiểm tra. Đối với lần làm mới này, các sự thật nguồn là:

Sự Thật Cần Xác Minh Các Nguồn Hiện Tại Nói Gì Cách Sử Dụng
Tên Flash hiện tại Tài liệu DeepSeek cho biết nên dùng deepseek-flash làm tên model. Đặt deepseek-flash làm chuỗi model mục tiêu cho các tuyến Flash.
Các bí danh Flash cũ deepseek-v4-flashdeepseek-v4-flash-vision-exp vẫn được chấp nhận, nhưng các model tương ứng đã ngừng hỗ trợ và được phục vụ bởi V4.1 Flash. Thay thế các bí danh đó trong code mới và lập kế hoạch dọn dẹp trong các cấu hình hiện có.
Vòng đời Pro DeepSeek cho biết dịch vụ API deepseek-v4-pro tiếp tục sau ngày 14 tháng 9 năm 2026 với phương thức tính phí không đổi, chờ thông báo tiếp theo. Không khẳng định Pro đã bị tắt; hãy giám sát nó như một tuyến có chủ đích.
Base URL DeepSeek trực tiếp DeepSeek tài liệu hóa https://api.deepseek.com cho các lời gọi định dạng OpenAI và https://api.deepseek.com/anthropic cho các lời gọi định dạng Anthropic. Giữ thay đổi base URL tách biệt với thay đổi tên model.
Flatkey base URL Tài liệu Flatkey cho thấy OpenAI SDK trỏ tới https://router.flatkey.ai/v1. Sử dụng một base URL có thể cấu hình và một trường model khi kiểm thử các tuyến Flatkey.

Không dán các con số về giá vào tài liệu ứng dụng nếu không có dấu thời gian. Trang giá hiện tại của DeepSeek liệt kê giá theo 1M token, tách riêng token đầu vào cache-hit, đầu vào cache-miss và token đầu ra, đồng thời ghi chú các khung giờ cao điểm/thấp điểm. Chỉ riêng điều đó đã đủ lý do để kiểm tra giá trực tiếp vào thời điểm triển khai thay vì dựa vào một ước tính tĩnh trong script di chuyển.

DeepSeek trực tiếp so với định tuyến Flatkey

Một di chuyển DeepSeek V4 có thể đi trực tiếp, được định tuyến qua Flatkey, hoặc cả hai trong quá trình kiểm thử.

Đường đi Khi nào sử dụng Cần xác minh điều gì
API DeepSeek trực tiếp Bạn muốn truy cập trực tiếp từ nhà cung cấp và các điều khiển tài khoản DeepSeek trực tiếp. Base URL, API key, deepseek-flash, deepseek-v4-pro, chế độ thinking, Responses API, đầu vào hình ảnh, lệnh gọi công cụ, đơn vị giá, và xử lý 429.
Tuyến gateway Flatkey Bạn muốn một key, một base URL tương thích OpenAI, một danh mục model, và việc xem xét sử dụng chung giữa các nhà cung cấp. Hàng model Flatkey hiện tại, tình trạng tuyến, họ endpoint, nhật ký yêu cầu, các trường token và chi phí, chính sách dự phòng, hạn mức, và model khôi phục.
Xác thực hai tuyến Bạn cần sự tự tin trước khi chuyển lưu lượng production hoặc thay đổi các luồng làm việc hướng tới khách hàng. Cùng bộ prompt, cùng parser, cùng chế độ streaming, cùng bài kiểm tra gọi công cụ, cùng chỉ số đầu ra được chấp nhận, và cùng danh sách kiểm tra nguồn có gắn ngày.

Flatkey hữu ích khi vấn đề vận hành lớn hơn một tuyến DeepSeek: các key nhà cung cấp bị phân tán, chỉnh sửa SDK lặp đi lặp lại, chi phí cấp yêu cầu không rõ ràng, và các quyết định dự phòng khó kiểm toán. Nhưng một gateway không làm mất đi nhu cầu phải chứng minh model ID. Luôn kiểm tra đúng hàng model mà tài khoản của bạn sẽ gọi.

Danh sách kiểm tra di chuyển DeepSeek V4

Sử dụng danh sách kiểm tra này trước khi thay thế các bí danh trong production.

  1. Đóng băng ngày nguồn. Ghi lại ngày bạn đã kiểm tra tài liệu DeepSeek, tài liệu Flatkey, thư mục mô hình Flatkey, giá cả và trạng thái tuyến. Đối với bản cập nhật bài viết này, ngày đó là 16 tháng 9 năm 2026.
  2. Tìm kiếm toàn bộ ngăn xếp. Tìm deepseek-v4-flash, deepseek-v4-flash-vision-exp, deepseek-flash, deepseek-v4-pro, và các tài liệu cũ yêu cầu nhà phát triển sao chép một giá trị đã lỗi thời.
  3. Phân loại từng kết quả khớp. Tách riêng mã sản xuất, cấu hình staging, job đánh giá, chính sách prompt-router, tài liệu khách hàng, macro hỗ trợ, notebook, fixture CI và các ví dụ.
  4. Thay thế các bí danh Flash đã ngừng hỗ trợ. Chuyển deepseek-v4-flashdeepseek-v4-flash-vision-exp sang deepseek-flash chỉ sau khi bạn đã có tuyến kiểm thử và kế hoạch khôi phục.
  5. Giữ Pro ở trạng thái tường minh. Không âm thầm chuyển các workload deepseek-v4-pro sang Flash. Nếu Pro vẫn đang được dùng, hãy ghi rõ chủ sở hữu, lý do, ngày đã kiểm tra và mô hình dự phòng.
  6. Làm rõ chế độ suy luận. Tài liệu DeepSeek cho biết chế độ suy luận được bật theo mặc định với mức nỗ lực mặc định high. Nếu bạn cần hành vi không suy luận, hãy cấu hình và kiểm thử điều đó một cách có chủ đích.
  7. Kiểm thử đầu vào hình ảnh nếu bạn đã dùng bí danh vision. Với các workload đã dùng deepseek-v4-flash-vision-exp, hãy chạy các bài kiểm thử đầu vào hình ảnh qua tuyến mà bạn thực sự sẽ triển khai.
  8. Kiểm thử riêng API Responses. Khả năng tương thích API Responses của DeepSeek bao gồm các trường được hỗ trợ, hỗ trợ một phần, bị bỏ qua và không được hỗ trợ. Đừng suy ra hành vi chỉ từ Chat Completions.
  9. Chạy kiểm thử gọi công cụ và đầu ra có cấu trúc. Xác thực lược đồ công cụ, đối số hàm, phân tích JSON, cơ chế thử lại và hành vi nhiều lượt.
  10. Kiểm tra streaming và usage. Xác nhận dạng chunk, xử lý timeout, usage cuối cùng, số token và các trường thanh toán trong log trực tiếp của nhà cung cấp hoặc Flatkey Usage Logs.
  11. Cập nhật tài liệu và ví dụ. Xóa các đoạn trích lỗi thời có thể đưa các bí danh đã ngừng hỗ trợ trở lại trong lần onboarding hoặc sửa lỗi tiếp theo.
  12. Triển khai sau lớp cấu hình. Đặt mô hình mục tiêu trong biến môi trường hoặc bảng định tuyến. Tránh dùng literal hard-coded trong logic nghiệp vụ.
  13. Theo dõi lô sản xuất đầu tiên. Bắt đầu với lưu lượng rủi ro thấp, so sánh tỷ lệ đầu ra được chấp nhận và chi phí trên mỗi phản hồi được chấp nhận, rồi chỉ tăng dần sau khi log sạch.

Mẫu Kiểm Toán Bí Danh Có Thể Sao Chép

Hãy dùng mẫu này như một bản ghi di chuyển ngắn gọn. Giữ nó trong repo, hệ thống theo dõi issue hoặc runbook để các bản sửa lỗi trong tương lai biết vì sao bí danh đã thay đổi.

deepseek_v4_migration:
  checked_at_utc: "2026-09-16T00:00:00Z"
  source_pages:
    - "https://api-docs.deepseek.com/"
    - "https://api-docs.deepseek.com/quick_start/pricing"
    - "https://api-docs.deepseek.com/news/news260910"
    - "https://api-docs.deepseek.com/guides/thinking_mode"
    - "https://api-docs.deepseek.com/guides/responses_api"
    - "https://docs.flatkey.ai/quickstart.md"
    - "https://docs.flatkey.ai/guides/openai-sdk.md"
  replacements:
    - from: "deepseek-v4-flash"
      to: "deepseek-flash"
      reason: "bí danh Flash cũ; route được phục vụ bởi V4.1 Flash để tương thích"
      owner: "engineering"
      status: "test_before_merge"
    - from: "deepseek-v4-flash-vision-exp"
      to: "deepseek-flash"
      reason: "bí danh thử nghiệm thị giác cũ; xác minh hành vi đầu vào hình ảnh"
      owner: "engineering"
      status: "test_before_merge"
  intentionally_kept:
    - model: "deepseek-v4-pro"
      reason: "Route Pro vẫn được đánh giá có chủ đích"
      next_review_date: "2026-09-30"
  required_tests:
    - plain_chat
    - thinking_enabled
    - thinking_disabled_if_used
    - responses_api
    - image_input_if_used
    - tool_calls
    - json_output
    - streaming
    - usage_log_readback
    - rollback

Mẫu Cấu Hình Flatkey

Thiết lập Flatkey an toàn nhất là giữ việc chọn model theo nhà cung cấp trong cấu hình, trong khi bề mặt client tương thích OpenAI vẫn ổn định.

FLATKEY_API_KEY="sk-your-flatkey-key"
OPENAI_BASE_URL="https://router.flatkey.ai/v1"
FLATKEY_DEEPSEEK_MODEL="deepseek-flash"
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["FLATKEY_API_KEY"],
    base_url=os.environ.get("OPENAI_BASE_URL", "https://router.flatkey.ai/v1"),
)

response = client.chat.completions.create(
    model=os.environ.get("FLATKEY_DEEPSEEK_MODEL", "deepseek-flash"),
    messages=[
        {
            "role": "user",
            "content": "Return one sentence confirming the DeepSeek route is alive.",
        }
    ],
    stream=False,
)

print(response.choices[0].message.content)
print(response.usage)

Sau khi gửi yêu cầu, hãy mở Flatkey Usage Logs và xác minh tên model, số lượng token, độ trễ, chi phí, key, dấu thời gian và trạng thái lỗi. Nếu log không khớp với yêu cầu bạn đã gửi, việc di chuyển chưa hoàn tất.

Ma Trận Kiểm Thử Trước Khi Chuyển Đổi

Bài kiểm tra Vì sao quan trọng Tín hiệu đạt
Trò chuyện đơn giản Xác nhận xác thực, URL gốc, ID mô hình và khả năng tương thích cơ bản của bộ phân tích. Yêu cầu trả về nội dung như mong đợi và ghi lại mô hình mục tiêu.
Chế độ suy nghĩ Hành vi suy nghĩ của DeepSeek có thể thay đổi dạng đầu ra và mức sử dụng token. Ứng dụng của bạn chủ động xử lý hoặc tắt đầu ra suy luận.
Responses API Một số tham số chỉ được hỗ trợ một phần, bị bỏ qua, hoặc không được hỗ trợ. Client của bạn không phụ thuộc vào các trường bị bỏ qua để đảm bảo tính đúng đắn.
Đầu vào hình ảnh Bí danh vision cũ ngụ ý các trường hợp sử dụng đầu vào ảnh cần một bài kiểm tra thực tế. Đầu vào hình ảnh được xử lý qua đúng lộ trình thực tế mà bạn sẽ triển khai.
Gọi công cụ Agent sẽ thất bại khi đối số công cụ, ID, hoặc tin nhắn nhiều lượt bị lệch. Cả việc tạo lời gọi công cụ và tiếp tục kết quả công cụ đều đạt.
Đầu ra có cấu trúc Một câu trả lời bình thường vẫn có thể làm hỏng trình kiểm tra JSON. Tỷ lệ vượt qua của trình kiểm tra vẫn nằm trong ngưỡng ra mắt của bạn.
Streaming Lỗi streaming thường chỉ xuất hiện sau chunk đầu tiên. Các chunk, thông điệp cuối, xử lý timeout và ghi nhận usage đều đạt.
Chi phí và hạn ngạch Hành vi cache-hit, cache-miss, đầu ra, cao điểm/thấp điểm, retry và fallback ảnh hưởng đến chi phí thực tế. Bộ phận tài chính và kỹ thuật có thể giải thích chi phí cho mỗi phản hồi được chấp nhận.
Khôi phục Các lần di chuyển bí danh nên có thể đảo ngược mà không cần triển khai gấp. Lưu lượng có thể quay lại một lộ trình đã biết thông qua cấu hình.

Các lỗi thường gặp

  • Xem di chuyển DeepSeek V4 như một thao tác thay thế văn bản mù quáng mà không kiểm tra tài liệu DeepSeek hiện tại.
  • Thay deepseek-v4-flash-vision-exp bằng deepseek-flash nhưng không bao giờ kiểm thử đầu vào hình ảnh.
  • Cho rằng deepseek-v4-pro đã bị ngắt sau ngày 14 tháng 9, 2026 trong khi tài liệu hiện tại nói dịch vụ vẫn tiếp tục.
  • Cập nhật mã ứng dụng nhưng vẫn để các bí danh cũ trong job đánh giá, notebook, đoạn trích khách hàng, hoặc chính sách fallback.
  • Chỉ so sánh giá token ở tiêu đề thay vì chi phí cho mỗi phản hồi được chấp nhận.
  • Cho rằng hành vi DeepSeek trực tiếp và hành vi qua Flatkey là giống hệt nhau mà không kiểm tra lộ trình thực tế và nhật ký.
  • Để các tham số Responses API không được hỗ trợ âm thầm thay đổi hành vi sản phẩm.

Liên kết nội bộ cho bước tiếp theo

Nếu bạn vẫn đang chọn các tuyến DeepSeek, hãy ghép danh sách kiểm tra này với DeepSeek V4 Pro vs Flashkiểm tra định tuyến API DeepSeek vs Qwen. Nếu dự án lớn hơn là chuẩn hóa gateway, hãy đọc hướng dẫn bắt đầu nhanh Flatkey API, hướng dẫn danh mục mô hình AI, và các chỉ số API định tuyến AI. Đối với các quyết định nhà cung cấp nhạy cảm theo khu vực, hãy dùng định tuyến nhà cung cấp LLM theo khu vực.

Câu hỏi thường gặp

Tên mô hình DeepSeek Flash hiện tại là gì?

Tên mô hình Flash hiện tại trong tài liệu DeepSeek là deepseek-flash. Một quá trình di chuyển DeepSeek V4 an toàn nên chuyển các bí danh Flash đã ngừng hỗ trợ sang chuỗi mô hình đó sau khi kiểm thử tuyến.

deepseek-v4-flashdeepseek-v4-flash-vision-exp có bị hỏng không?

DeepSeek cho biết các tên cũ đó vẫn được chấp nhận, nhưng các mô hình tương ứng đã được ngừng cung cấp và các yêu cầu đang được phục vụ bởi DeepSeek-V4.1-Flash. Khả năng tương thích này hữu ích trong quá trình di chuyển, nhưng mã mới nên tránh phụ thuộc vào các bí danh đã ngừng hỗ trợ.

deepseek-v4-pro có ngừng hoạt động sau ngày 14 tháng 9 năm 2026 không?

Không. Tài liệu DeepSeek hiện tại cho biết dịch vụ API cho deepseek-v4-pro tiếp tục sau ngày 14 tháng 9 năm 2026, với phương thức tính phí không đổi trừ khi DeepSeek có thông báo thêm. Hãy giữ nó rõ ràng và được giám sát nếu bạn sử dụng nó.

Tôi có cần thay đổi URL cơ sở của DeepSeek không?

Không nếu gọi trực tiếp DeepSeek theo định dạng OpenAI. DeepSeek ghi nhận https://api.deepseek.com là URL cơ sở theo định dạng OpenAI. Với Flatkey, hãy dùng https://router.flatkey.ai/v1 cùng khóa API Flatkey.

Flatkey có thay thế việc kiểm thử tuyến theo từng nhà cung cấp không?

Không. Flatkey có thể tập trung hóa khóa, URL cơ sở, danh mục và việc xem xét mức sử dụng, nhưng nhóm của bạn vẫn cần xác minh chính xác hàng mô hình, hành vi tính năng, các trường chi phí, tình trạng tuyến và kế hoạch dự phòng.

Có nên chuyển mọi khối lượng công việc sang deepseek-flash không?

Không. deepseek-flash là đích Flash hiện tại, nhưng các khối lượng công việc cố ý dùng deepseek-v4-pro nên được kiểm thử và theo dõi riêng. Hãy chọn theo khối lượng công việc, không theo một quy tắc thay thế toàn cục.

Lời khuyên triển khai cuối cùng

Danh sách kiểm tra di chuyển DeepSeek V4: Thay thế an toàn các bí danh đã ngừng hỗ trợ nên kết thúc bằng bằng chứng, không chỉ là một diff đã hợp nhất. Hãy thay thế các bí danh Flash đã ngừng hỗ trợ, giữ các tuyến Pro có chủ đích, kiểm thử các tính năng mà sản phẩm của bạn thực sự sử dụng, và xác minh yêu cầu trong log. Sau đó kiểm tra thư mục mô hình Flatkey và trang bảng giá Flatkey hiện tại trước khi bạn chuyển lưu lượng sản xuất.