Di chuyển DeepSeek V4 giờ đây là một tác vụ dọn dẹp theo hạn chót, không chỉ là nâng cấp mô hình. Tài liệu API chính thức của DeepSeek cho biết các bí danh cũ deepseek-chat và deepseek-reasoner sẽ được ngừng hoàn toàn và không thể truy cập sau July 24, 2026 at 15:59 UTC. Các ID mô hình V4 được hỗ trợ là deepseek-v4-flash và deepseek-v4-pro.
Tin tốt là với nhiều đội nhóm, đây sẽ là một thay đổi cấu hình có kiểm soát. DeepSeek cho biết hãy giữ nguyên base_url trực tiếp và cập nhật tên mô hình. Nếu bạn định tuyến mô hình qua Flatkey, hãy dùng cùng một ý tưởng: giữ ứng dụng của bạn trỏ tới https://router.flatkey.ai/v1, thay bí danh bằng một hàng mô hình Flatkey DeepSeek V4 hiện tại, và xác minh hành vi phản hồi, chế độ suy luận, nhật ký sử dụng, giá cả, và khả năng khôi phục trước khi lưu lượng production được chuyển sang.
Danh sách kiểm tra di chuyển DeepSeek V4 này cung cấp cho bạn các bước cụ thể: ánh xạ các bí danh cũ, chọn deepseek-v4-flash hoặc deepseek-v4-pro, kiểm tra hành vi có suy luận và không suy luận, cập nhật cấu hình SDK, và tránh chuyển đổi mô hình chưa được rà soát gần ngày cắt giảm.
Câu trả lời nhanh: Điều gì thay đổi trong quá trình di chuyển DeepSeek V4?
Thay đổi khẩn cấp là chuỗi model. Đừng để mã production, biến môi trường, bộ định tuyến prompt, job đánh giá, hoặc chính sách fallback bị hard-code thành deepseek-chat hoặc deepseek-reasoner.
| Old Alias | Current Official Behavior | Migration Target To Test | Risk To Verify |
|---|---|---|---|
deepseek-chat |
Hiện tại chuyển sang chế độ không suy luận của deepseek-v4-flash |
deepseek-v4-flash với thinking bị tắt, trừ khi bạn chủ động chọn một chế độ V4 khác |
Phong cách đầu ra, độ trễ, chi phí, khả năng tương thích của bộ phân tích cú pháp, và mọi tham số bị bỏ qua |
deepseek-reasoner |
Hiện tại chuyển sang chế độ thinking của deepseek-v4-flash |
deepseek-v4-flash hoặc deepseek-v4-pro với thinking được kiểm thử rõ ràng |
reasoning_content, mức sử dụng token, xử lý nhiều lượt, và hỗ trợ SDK |
| Tên model kiểu Claude trong DeepSeek Anthropic API | DeepSeek ánh xạ các tên Claude Opus sang V4 Pro và các tên Claude Haiku/Sonnet sang V4 Flash | Ưu tiên các ID model DeepSeek V4 rõ ràng nơi tầng định tuyến của bạn cho phép | Các trường Anthropic không được hỗ trợ, hỗ trợ nội dung hình ảnh/tài liệu, và hành vi gọi tool |
Đối với một lệnh gọi DeepSeek trực tiếp, base URL định dạng OpenAI chính thức vẫn là https://api.deepseek.com. Đối với Flatkey, base URL của bộ định tuyến vẫn là https://router.flatkey.ai/v1. Ở cả hai hướng, quá trình di chuyển DeepSeek V4 nên được kiểm thử như một thay đổi về model và hành vi, chứ không chỉ là thay thế chuỗi.
Tại sao hạn chót của alias lại quan trọng
Trang xem trước V4 của DeepSeek cho biết API hiện đã khả dụng, cả deepseek-v4-pro và deepseek-v4-flash đều hỗ trợ ngữ cảnh 1M và cả chế độ suy luận lẫn không suy luận, và các alias cũ sẽ được ngừng hỗ trợ sau 15:59 UTC ngày 24 tháng 7 năm 2026. Điều đó có nghĩa là một alias cũ có thể chuyển từ trạng thái “hôm nay vẫn hoạt động” sang “lỗi hoàn toàn” sau khi cửa sổ ngừng hỗ trợ kết thúc.
Bảng quick-start trên trang chủ cũng liệt kê deepseek-chat và deepseek-reasoner là các alias sẽ bị ngừng dùng vào 2026/07/24. Trang này ghi chú rằng, để tương thích, các alias đó tương ứng với chế độ không suy luận và suy luận của deepseek-v4-flash.
Chi tiết tương thích đó rất hữu ích, nhưng không phải là lý do để chờ đợi. Một chuyển đổi sang DeepSeek V4 gọn gàng sẽ cho bạn thời gian để so sánh đầu ra, cập nhật runbook, đào tạo đội hỗ trợ và đảm bảo các dashboard sản xuất hiển thị các model ID mới trước hạn chót.
Direct DeepSeek so với định tuyến qua Flatkey
Có hai lộ trình di chuyển phổ biến.
| Quyết định | API DeepSeek trực tiếp | DeepSeek qua Flatkey |
|---|---|---|
| Base URL | https://api.deepseek.com |
https://router.flatkey.ai/v1 |
| Khóa API | Khóa API DeepSeek | Khóa API Flatkey |
| Lựa chọn mô hình | ID mô hình DeepSeek chính thức | Dòng mô hình DeepSeek hiện tại của Flatkey |
| Lợi ích chính | Thiết lập trực tiếp từ nhà cung cấp | Một khóa, một bộ định tuyến, nhật ký sử dụng dùng chung, hạn mức và khả năng hiển thị thanh toán trên nhiều nhà cung cấp |
| Kiểm tra sản xuất | Phản hồi DeepSeek, chế độ thinking, giá và lỗi | Phản hồi, trạng thái tuyến, dòng mô hình đã chọn, nhật ký sử dụng, đơn vị giá, hạn mức và khôi phục |
Phần giới thiệu sản phẩm công khai của Flatkey định vị nền tảng xoay quanh một khóa API, base URL tương thích với OpenAI, giá minh bạch, thanh toán hợp nhất, và một bảng điều khiển cho khóa, sử dụng và định tuyến. Với các đội nhóm đã chuyển lưu lượng GPT, Claude, Gemini, Qwen, MiniMax và DeepSeek qua một cổng duy nhất, một chuyển đổi DeepSeek V4 là thời điểm tốt để chuẩn hóa ID mô hình và ghi nhật ký trên toàn bộ hệ thống.
Kiểm tra danh mục Flatkey cho DeepSeek V4
Trong bài viết này, tôi đã kiểm tra API giá công khai của Flatkey vào ngày 16 tháng 6 năm 2026. Ảnh chụp nhanh trả về 638 dòng mô hình tổng cộng và 19 dòng mang tên DeepSeek. Nó liệt kê cả deepseek-v4-pro và deepseek-v4-flash trong nhóm Standard với hỗ trợ endpoint openai.
Hãy xem đó là bằng chứng danh mục theo thời điểm, không phải lời hứa rằng tài khoản và tuyến của bạn đã sẵn sàng. Trong cùng ảnh chụp nhanh đó, cả hai dòng V4 đều có trạng thái khả dụng unknown_failure, nghĩa là khả dụng nên được xác nhận trong chế độ xem Flatkey pricing hoặc bảng điều khiển hiện tại trước khi lưu lượng thực tế phụ thuộc vào tuyến này. Một quá trình chuyển đổi DeepSeek V4 cẩn thận nên bao gồm kiểm tra thử nhanh trực tiếp và xem lại nhật ký sử dụng vào ngày bạn chuyển đổi.
Danh sách kiểm tra di chuyển DeepSeek V4
Sử dụng danh sách kiểm tra này trước khi bạn thay thế các bí danh trong môi trường production.
- Kiểm kê mọi bí danh. Tìm trong mã ứng dụng, biến môi trường, quy tắc prompt-router, cấu hình eval, tác vụ nền, notebook, tài liệu và runbook hỗ trợ các
deepseek-chatvàdeepseek-reasoner. - Phân loại từng workload. Đánh dấu mỗi tuyến là chat, reasoning, sử dụng tool của agent, output có cấu trúc, ngữ cảnh dài, batch eval, hoặc chỉ fallback. Đừng giả định mọi tuyến đều nên chuyển sang cùng một chế độ V4.
- Chọn model đích. Bắt đầu với
deepseek-v4-flashkhi bạn muốn phương án thay thế gần nhất cho các bí danh hiện tại. Đánh giádeepseek-v4-prokhi workload cần năng lực mạnh hơn và bạn có thể chấp nhận hồ sơ chi phí và độ trễ sau khi kiểm thử. - Làm rõ chế độ suy nghĩ. Với hành vi cũ của
deepseek-chat, hãy kiểm thử chế độ không suy nghĩ. Với hành vi cũ củadeepseek-reasoner, hãy kiểm thử chế độ suy nghĩ và xác nhận SDK của bạn xử lýreasoning_contentnhư thế nào. - Giữ ID model trong cấu hình. Đặt model đích trong biến môi trường hoặc bảng định tuyến, không đặt trực tiếp trong logic ứng dụng.
- Chạy kiểm thử đầu ra theo cặp. So sánh phản hồi của bí danh cũ với phản hồi V4 mới trên các prompt đại diện, bộ phân tích, tác vụ chế độ JSON, lời gọi tool và các trường hợp từ chối/lỗi.
- Xác minh streaming và ghi nhận usage. Kiểm tra xem usage cuối cùng có xuất hiện ở nơi mã thanh toán hoặc quan sát của bạn mong đợi hay không, đặc biệt là với phản hồi streaming.
- Kiểm tra chi phí và hạn mức. Xác nhận giá của nhà cung cấp hoặc giá Flatkey, rồi đặt hạn mức thấp hoặc ngân sách thử nghiệm trước khi lưu lượng production tăng lên.
- Ghi lại ID model mới. Đảm bảo trace, cảnh báo và bản xuất thanh toán hiển thị
deepseek-v4-flashhoặcdeepseek-v4-pro, chứ không chỉ nhãn nhà cung cấp chung chung. - Chuẩn bị rollback. Giữ cấu hình nhà cung cấp trước đó hoặc model dự phòng cho đến khi tuyến V4 vượt qua các kiểm thử workload thực tế.
- Xóa tài liệu lỗi thời. Cập nhật các hướng dẫn thiết lập nội bộ để nhà phát triển mới không sao chép các bí danh đã bị deprecate trở lại production.
Mẫu cấu hình cho Flatkey
Chỉ là mẫu: hãy chạy phần này với một Flatkey key hợp lệ và một model ID Flatkey DeepSeek V4 đã được xác nhận từ danh mục hiện tại. Cấu trúc là cách dùng OpenAI SDK thông thường, nhưng route, trạng thái model, hành vi thinking và usage log vẫn cần được kiểm thử.
FLATKEY_API_KEY="sk-fk-your-key"
OPENAI_BASE_URL="https://router.flatkey.ai/v1"
FLATKEY_DEEPSEEK_MODEL="deepseek-v4-flash"
# Giữ target dễ thay đổi trong quá trình rollout.
# Để so sánh trực tiếp với DeepSeek:
DEEPSEEK_BASE_URL="https://api.deepseek.com"
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["FLATKEY_API_KEY"],
base_url=os.environ.get("OPENAI_BASE_URL", "https://router.flatkey.ai/v1"),
)
response = client.chat.completions.create(
model=os.environ.get("FLATKEY_DEEPSEEK_MODEL", "deepseek-v4-flash"),
messages=[
{
"role": "user",
"content": "Reply with one sentence confirming the DeepSeek V4 route is configured.",
}
],
)
print(response.choices[0].message.content)
print(response.usage)
Để kiểm thử DeepSeek trực tiếp, hãy làm theo các ví dụ OpenAI SDK chính thức của DeepSeek cho chế độ thinking. Hướng dẫn thinking cho biết công tắc thinking mặc định được bật, tham số effort theo định dạng OpenAI hỗ trợ high và max, và các nhãn effort thấp hơn sẽ được ánh xạ lên trên để tương thích. Nếu ứng dụng của bạn phụ thuộc vào phản hồi không dùng thinking, hãy chọn rõ ràng và kiểm thử điều đó thay vì dựa vào một alias.
Ma trận kiểm thử trước khi chuyển đổi
Một quá trình di chuyển sang DeepSeek V4 chỉ nên được chấp nhận sau khi bạn kiểm tra hành vi mà sản phẩm của bạn thực sự sử dụng.
| Kiểm thử | Cần kiểm tra gì | Tín hiệu đạt |
|---|---|---|
| Chat cơ bản | Prompt đơn giản, hình dạng phản hồi, hành vi bộ phân tích | Ứng dụng nhận được nội dung mong đợi mà không có lỗi lược đồ hoặc lỗi vai trò |
| Chế độ suy nghĩ | thinking, reasoning_effort, và reasoning_content |
Đầu ra suy luận được xử lý hoặc cố ý ẩn đi theo chính sách sản phẩm của bạn |
| Streaming | Định dạng chunk, usage cuối cùng, hành vi timeout | Bộ phân tích phía client và các hook tính phí vẫn hoạt động |
| Tool calls | Lược đồ công cụ, đối số, các lượt tác nhân nhiều bước | Các lời gọi công cụ được tạo và tiêu thụ mà không có JSON sai định dạng hoặc thiếu ID |
| Structured output | Prompt chế độ JSON và xác thực | Tỷ lệ vượt qua của bộ kiểm tra vẫn nằm trong ngưỡng ra mắt của bạn |
| Long context | Prompt lớn, cắt ngắn, giả định về cache | Xử lý ngữ cảnh có thể dự đoán được và chi phí chấp nhận được |
| Flatkey observability | Trạng thái tuyến, ID mô hình, mức sử dụng token, chi phí, và log lỗi | Các mục trên dashboard khớp với request bạn đã gửi |
| Rollback | Nhà cung cấp trước đó hoặc mô hình dự phòng | Traffic có thể chuyển lại bằng cấu hình mà không cần triển khai |
Các lỗi thường gặp
- Xem việc di chuyển sang DeepSeek V4 như một thao tác tìm kiếm và thay thế toàn cục mà không đánh giá đầu ra.
- Thay thế
deepseek-reasonernhưng quên kiểm trareasoning_contenttrong các cuộc hội thoại nhiều lượt. - Để lại các bí danh trong các job eval, ví dụ hỗ trợ, hoặc quy tắc dự phòng trong khi mã sản xuất dùng các ID V4.
- Giả định hành vi trực tiếp của DeepSeek và hành vi được định tuyến qua Flatkey là giống hệt nhau mà không kiểm tra trạng thái tuyến và nhật ký sử dụng.
- Sao chép ID mô hình từ một bài viết cũ thay vì từ trang giá Flatkey hoặc bảng điều khiển hiện tại.
- Bỏ qua kiểm tra chi phí vì bài kiểm tra nhanh đầu tiên trả về một câu trả lời bình thường.
- Chờ đến ngày 24 tháng 7 năm 2026 rồi mới phát hiện một job đã lên lịch hoặc worker nền vẫn đang dùng một bí danh không còn truy cập được.
Cách Phù Hợp Với Các Hướng Dẫn Di Chuyển Flatkey Khác
Nếu bạn chưa tập trung cấu hình nhà cung cấp, hãy bắt đầu với hướng dẫn rộng hơn về di chuyển API tương thích OpenAI. Hướng dẫn này bao gồm thay đổi base URL, kiểm tra smoke test và các mẫu rollback áp dụng ngoài DeepSeek.
Nếu bạn vẫn đang cân nhắc nên định tuyến DeepSeek trực tiếp hay qua một gateway duy nhất, hãy so sánh trang này với hướng dẫn truy cập API DeepSeek hiện có. Để lập ngân sách và kiểm tra theo từng dòng model, hãy dùng quy trình so sánh giá model AI và trang bảng giá Flatkey hiện tại.
Câu hỏi thường gặp
Khi nào deepseek-chat và deepseek-reasoner bị ngừng hỗ trợ?
Tài liệu chính thức của DeepSeek liệt kê 15:59 UTC ngày 24 tháng 7 năm 2026 là thời điểm ngừng hoạt động, sau đó deepseek-chat và deepseek-reasoner sẽ không còn truy cập được. Hãy lập kế hoạch di chuyển sang DeepSeek V4 trước ngày đó.
Nên thay deepseek-chat bằng gì?
Để có hành vi gần giống nhất, hãy thử deepseek-v4-flash với chế độ không suy luận. DeepSeek cho biết deepseek-chat hiện đang chuyển hướng sang chế độ không suy luận của deepseek-v4-flash.
Nên thay deepseek-reasoner bằng gì?
Hãy thử deepseek-v4-flash hoặc deepseek-v4-pro với chế độ suy luận bật, tùy theo nhu cầu về chất lượng, chi phí và độ trễ của bạn. DeepSeek cho biết deepseek-reasoner hiện đang chuyển hướng sang chế độ suy luận của deepseek-v4-flash.
Tôi có cần đổi URL gốc của DeepSeek không?
Đối với các lệnh gọi DeepSeek OpenAI-format trực tiếp, URL gốc chính thức vẫn là https://api.deepseek.com. Đối với các lệnh gọi Flatkey, hãy dùng https://router.flatkey.ai/v1 và khóa API Flatkey.
Flatkey có hỗ trợ DeepSeek V4 không?
Bản chụp API giá của Flatkey ngày 16 tháng 6 năm 2026 liệt kê deepseek-v4-pro và deepseek-v4-flash với hỗ trợ endpoint openai. Cùng bản chụp đó hiển thị trạng thái khả dụng unknown_failure cho các dòng này, vì vậy hãy xác minh trang giá hiện tại, trạng thái tuyến đường trên dashboard và thực hiện kiểm tra nhanh trực tiếp trước khi đưa lưu lượng sản xuất vào.
Tôi nên chọn deepseek-v4-flash hay deepseek-v4-pro?
Hãy dùng deepseek-v4-flash làm ứng viên thay thế đầu tiên để tương thích với các bí danh cũ. Hãy thử deepseek-v4-pro khi khối lượng công việc cần khả năng suy luận hoặc tác tử mạnh hơn và các kiểm tra về độ trễ cùng chi phí của bạn đạt yêu cầu.
Xem giá trước khi bạn chuyển lưu lượng sản xuất
Việc di chuyển DeepSeek V4 là thời điểm thích hợp để loại bỏ các bí danh đã lỗi thời, làm rõ hành vi suy luận, và đưa việc chọn mô hình vào cấu hình. Trước khi triển khai, hãy xác nhận dòng mô hình Flatkey hiện tại, trạng thái tuyến, nhật ký sử dụng, và giá cho deepseek-v4-flash hoặc deepseek-v4-pro.
Xem giá để kiểm tra các dòng Flatkey DeepSeek V4 hiện tại trước khi bạn chuyển lưu lượng sản xuất.



