Định giá API tạo ảnh bằng AI khó so sánh vì các nhà cung cấp không bán cùng một đơn vị. OpenAI GPT Image sử dụng ước tính chi phí ảnh dựa trên token, các mô hình ảnh Google Gemini kết hợp định giá token cho văn bản, ảnh đầu vào và ảnh đầu ra, còn Google Imagen thường được hiển thị như một mức giá trực tiếp theo mỗi ảnh. Nếu chỉ so sánh con số nổi bật, bạn có thể bỏ sót phí ảnh đầu vào, các bậc độ phân giải đầu ra, chiết khấu batch/flex, các lần thử lại, và trạng thái danh mục theo từng tuyến.
Hướng dẫn này chuẩn hóa các đơn vị hiện tại phía sau GPT Image, Gemini Image và Imagen, rồi cho thấy cách kiểm tra cùng các hàng đó trong bảng giá Flatkey. Kiểm tra nguồn được thực hiện vào ngày 17 tháng 6 năm 2026 theo giờ Asia/Shanghai, sử dụng hướng dẫn định giá tạo ảnh của OpenAI chính thức, bảng giá Google Gemini API, bảng giá Google Vertex AI, và một ảnh chụp trực tiếp trang giá công khai của Flatkey. Hãy coi mọi mức giá bên dưới là công cụ lập kế hoạch tại một thời điểm và xác minh các hàng hiện tại trên nhà cung cấp và bảng điều khiển Flatkey trước khi có lưu lượng production.
Câu trả lời nhanh: Cách so sánh giá API tạo ảnh AI
Hãy dùng bốn cột bất cứ khi nào bạn so sánh giá API tạo ảnh AI:
- Đơn vị tạo: đầu ra ảnh theo token, mỗi ảnh được tạo, mỗi ảnh đầu vào, hoặc một đơn vị được định tuyến riêng theo dashboard.
- Độ phân giải và chất lượng: vuông, ngang, dọc, 1K, 2K, 4K, thấp, trung bình, cao, tiêu chuẩn, nhanh, hoặc cực cao.
- Đầu vào bổ sung: văn bản prompt, ảnh tham chiếu, mặt nạ, chỉnh sửa, grounding/tìm kiếm, ảnh một phần, và thử lại.
- Bằng chứng tuyến: hàng model Flatkey chính xác, loại endpoint, trạng thái, nhật ký sử dụng, và nhãn giá hiện tại.
Về mặt thực tế: GPT Image cần tính toán token và chất lượng, Gemini Image cần tính toán quy đổi token sang ảnh tương đương, và Imagen cần kiểm tra theo mỗi ảnh cộng với deprecation và tuyến tính năng. Flatkey có thể giúp tập trung hóa các hàng model, hỗ trợ endpoint, và nhật ký sử dụng, nhưng hàng được chọn vẫn cần được xác minh.
So sánh Đơn vị Định giá
Bảng dưới đây là chế độ xem chuẩn hóa cốt lõi cho định giá API tạo ảnh bằng AI. Bảng cố ý không xếp hạng các mô hình theo “rẻ nhất” vì mỗi nhà cung cấp sử dụng các đơn vị khác nhau và mỗi mô hình nhắm tới một quy trình làm việc khác nhau.
| Nhóm Nhà Cung Cấp | Đơn Vị Chính Thức Hiện Tại | Các Mức Giá Công Khai Ví Dụ Đã Kiểm Tra | Kiểm Tra Chi Phí Ẩn | Kiểm Tra Flatkey |
|---|---|---|---|---|
| OpenAI GPT Image 2 | Ước tính token đầu ra hình ảnh cộng với token đầu vào văn bản và hình ảnh. | Máy tính trong hướng dẫn hình ảnh của OpenAI liệt kê GPT Image 2 ở mức $0.006, $0.053 và $0.211 cho các ví dụ 1024x1024 low, medium và high; 1536x1024 medium được liệt kê ở mức $0.041. | Token prompt, token đầu vào của ảnh tham chiếu, chất lượng, kích thước, định dạng đầu ra, phát trực tuyến ảnh một phần, thử lại và chỉnh sửa. | Kiểm tra gpt-image-2 hoặc openai/gpt-image-2, loại endpoint, loại hạn mức, nhãn giá hiện tại và trạng thái. |
| Google Gemini 3 Pro Image | Đầu vào văn bản/ảnh trên 1M token và đầu ra ảnh trên 1M token ảnh, được biểu thị theo tương đương ảnh. | Google AI liệt kê đầu vào tiêu chuẩn trả phí ở mức $2.00 cho 1M token văn bản/ảnh và đầu ra ảnh ở mức $120 cho 1M token, tương đương $0.134 cho ảnh 1K/2K và $0.24 cho ảnh 4K. | Token ảnh đầu vào, độ phân giải đầu ra, phí grounding tìm kiếm web/ảnh, loại tầng, và liệu batch/flex hay priority có áp dụng hay không. | Kiểm tra các hàng gemini-3-pro-image và gemini-3-pro-image-preview, loại endpoint và trạng thái khả dụng. |
| Google Gemini 2.5 Flash Image | Đầu vào văn bản/ảnh trên 1M token và đầu ra được hiển thị dưới dạng tương đương trên mỗi ảnh. | Google AI liệt kê đầu vào tiêu chuẩn ở mức $0.30 cho 1M token văn bản/ảnh và đầu ra ở mức $0.039 cho mỗi ảnh 1024x1024; đầu ra batch/flex là $0.0195 mỗi ảnh. | Hành vi của mô hình preview, điều kiện batch/flex, token đầu vào, kích thước đầu ra, thử lại và hỗ trợ tuyến. | Ảnh chụp nhanh ngày 17 tháng 6 của Flatkey cho thấy gemini-2.5-flash-image khả dụng với các loại endpoint gemini và openai. |
| Google Imagen 4 | Tính trên mỗi ảnh được tạo trong bảng giá của Gemini API và Vertex AI. | Google AI liệt kê Imagen 4 Fast ở mức $0.02, Standard ở mức $0.04 và Ultra ở mức $0.06 mỗi ảnh. | Lộ trình ngừng hỗ trợ, loại tính năng, nâng cấp độ phân giải, chỉnh sửa, tái ngữ cảnh sản phẩm, thử đồ ảo và trạng thái tuyến. | Ảnh chụp nhanh ngày 17 tháng 6 của Flatkey liệt kê các hàng Imagen 4 với các loại endpoint image-generation, gemini và openai, nhưng có trạng thái unknown_failure. |
Định giá OpenAI GPT Image: Ưu tiên tính token trước
Hướng dẫn tạo ảnh hiện tại của OpenAI cho biết các mô hình GPT Image có thể tạo và chỉnh sửa ảnh thông qua Image API, đồng thời cũng có thể được dùng qua công cụ image-generation của Responses API. Với gpt-image-2, phần chi phí chính thức cho biết cần ước tính token đầu ra từ chất lượng và kích thước được yêu cầu, rồi tính đến token đầu vào văn bản và token đầu vào hình ảnh nếu yêu cầu chỉnh sửa hoặc tham chiếu ảnh.
Điều đó khiến GPT Image khác với một SKU tính phí đơn giản theo từng ảnh. Giá hiển thị cho một tài sản được tạo có thể thay đổi khi bạn đổi quality, size, ảnh đầu vào, các phần phát trực tuyến từng phần, hoặc hành vi thử lại. Các ví dụ trong công cụ tính của OpenAI cho thấy GPT Image 2 ở các ước tính tại thời điểm này như sau:
| Cài đặt GPT Image 2 | 1024x1024 | 1024x1536 | 1536x1024 | Ghi chú lập kế hoạch |
|---|---|---|---|---|
| Thấp | $0.006 | $0.005 | $0.005 | Hữu ích cho bản nháp, ảnh thu nhỏ và lặp lại nhanh. |
| Trung bình | $0.053 | $0.041 | $0.041 | Mức mặc định thực tế để benchmark trước chất lượng cuối cùng. |
| Cao | $0.211 | $0.165 | $0.165 | Dùng cho tài sản cuối cùng, không phải mọi bản xem trước. |
Hai chi tiết quan trọng đối với định giá API tạo ảnh AI: OpenAI lưu ý rằng các yêu cầu chỉnh sửa có ảnh tham chiếu có thể dùng nhiều token đầu vào hơn, và mỗi ảnh một phần trong chế độ streaming sẽ thêm 100 token đầu ra hình ảnh. Với ngân sách sản xuất, hãy tách riêng các thiết lập \"xem trước\" và \"kết xuất cuối\" thay vì để mọi hành động của người dùng gọi một tuyến đường chất lượng cuối.
Gemini Image Pricing: Giá token với tương đương theo hình ảnh
Trang giá của Google Gemini API tách riêng các mô hình tạo ảnh gốc khỏi các mô hình văn bản tổng quát. Các mô hình ảnh Gemini vẫn sử dụng định giá theo token ở bên trong, nhưng trang giá thường cung cấp con số tương đương theo từng hình ảnh để các đội có thể lập kế hoạch mà không cần tự nhân số token đầu ra của ảnh.
Đối với Gemini 3 Pro Image, Google AI niêm yết giá đầu vào trả phí tiêu chuẩn là $2.00 cho mỗi 1M token văn bản/ảnh và cho biết đầu vào ảnh được đặt ở mức 560 token, tương đương $0.0011 mỗi ảnh. Cùng trang đó niêm yết đầu ra ảnh là $120 cho mỗi 1M token, với các ví dụ $0.134 cho ảnh đầu ra 1K/2K và $0.24 cho ảnh đầu ra 4K. Các ví dụ batch/flex giảm các mức đầu ra đó xuống còn $0.067 và $0.12 tương ứng.
Đối với Gemini 2.5 Flash Image, Google AI niêm yết đầu vào trả phí tiêu chuẩn là $0.30 cho mỗi 1M token văn bản/ảnh và đầu ra là $0.039 mỗi ảnh. Chú thích cho biết đầu ra ảnh được tính giá $30 cho mỗi 1M token, với ảnh đầu ra 1024x1024 tiêu thụ 1290 token. Cùng trang đó niêm yết đầu ra batch và flex ở mức $0.0195 mỗi ảnh và ưu tiên ở mức $0.0702 mỗi ảnh.
Trên trang giá Google Cloud Vertex AI, giá Gemini image có thể xuất hiện với tên mô hình và ngữ cảnh tuyến khác nhau. Ví dụ, trang Vertex niêm yết đầu ra ảnh Gemini 3 Pro Image ở mức $120 cho mỗi 1M token và có chú thích ánh xạ 1120 token thành $0.134 cho 1K/2K và 2000 token thành $0.24 cho 4K. Trang này cũng niêm yết các ví dụ đầu ra Gemini 3.1 Flash Image theo độ phân giải. Nếu nhóm của bạn dùng Vertex AI thay vì Gemini API, đừng giả định cùng một tuyến, tên mô hình hoặc hành vi theo tầng như trên trang Gemini API.
Định giá Imagen: Tính theo mỗi ảnh, nhưng hãy lưu ý việc ngừng hỗ trợ và loại tính năng
Imagen trông đơn giản hơn vì Google niêm yết giá trực tiếp theo từng ảnh. Trên trang định giá Gemini API được kiểm tra cho bài viết này, Imagen 4 Fast có giá $0.02 mỗi ảnh, Imagen 4 Standard là $0.04 mỗi ảnh, và Imagen 4 Ultra là $0.06 mỗi ảnh. Trang định giá Vertex AI cũng niêm yết Imagen 4 Fast ở mức $0.02, Imagen 4 ở mức $0.04, và Imagen 4 Ultra ở mức $0.06 cho mỗi ảnh được tạo.
Điểm cần lưu ý là tính cập nhật. Trang định giá Gemini API của Google có cảnh báo rằng các mô hình Imagen 4 imagen-4.0-generate-001, imagen-4.0-ultra-generate-001, và imagen-4.0-fast-generate-001 đã bị ngừng hỗ trợ và dự kiến sẽ dừng hoạt động vào ngày 17 tháng 8, 2026, với hướng dẫn chuyển đổi sang Gemini 2.5 Flash Image. Cảnh báo đó là một vấn đề vận hành lớn hơn nhiều so với chênh lệch một xu.
Loại tính năng cũng rất quan trọng. Vertex AI niêm yết các mức giá Imagen riêng cho upscaling, chú thích hình ảnh, hỏi đáp hình ảnh, product recontext, và thử đồ ảo. Mức giá “mỗi ảnh” cho tạo ảnh từ văn bản không tự động giống với giá của một bước chỉnh sửa, upscaling, hay quy trình ảnh sản phẩm.
Ảnh chụp Catalog Flatkey cho các mô hình hình ảnh
Trang định giá công khai của Flatkey đã được kiểm tra vào ngày 17 tháng 6 năm 2026 theo giờ Asia/Shanghai. Trang định giá được render phía máy chủ báo cáo 638 mô hình AI và phiên bản định giá 5a90f2b86c08bd983a9a2e6d66c255f4eaef9c4bc934386d2b6ae84ef0ff1f1f. Cùng trang đó hiển thị các nhóm endpoint bao gồm gemini, image-generation, openai, và openai-response. Điều đó quan trọng vì định giá API tạo ảnh bằng AI thông qua một gateway phải khớp cả hàng mô hình lẫn kiểu endpoint.
| Hàng Flatkey đã kiểm tra | Kiểu endpoint | Các trường định giá đã thấy | Trạng thái trong snapshot | Hành động trước khi đưa vào production |
|---|---|---|---|---|
gpt-image-2 |
openai |
model_ratio: 3.325, completion_ratio: 6, image_ratio: 1.6 |
unknown_failure |
Xác nhận liệu hàng được chọn có hỗ trợ đúng dạng yêu cầu ảnh mà bạn định dùng hay không trước bất kỳ lần ra mắt nào. |
openai/gpt-image-2 |
openai |
quota_type: 1, model_price: 0.063 |
unknown_failure |
Đừng sao chép con số này nếu chưa xác nhận đơn vị và hành vi route hiện tại trên dashboard. |
gemini-2.5-flash-image |
gemini, openai |
model_ratio: 0.15, completion_ratio: 100 |
available |
Chạy một bài test route nhỏ và xác nhận ứng dụng nên gọi endpoint kiểu Gemini hay kiểu OpenAI. |
gemini-3-pro-image-preview |
gemini, openai |
model_ratio: 1, completion_ratio: 60 |
available |
Xác nhận tên gọi preview/stable và giới hạn tốc độ trước khi xây dựng một route dài hạn. |
imagen-4.0-fast-generate-001, imagen-4.0-generate-001, imagen-4.0-ultra-generate-001 |
image-generation, gemini, openai |
model_ratio: 37.5, completion_ratio: 1 |
unknown_failure |
Chỉ xem đây là sự hiện diện trong catalog có ngày tháng; đồng thời tính đến cảnh báo tắt Imagen 4 của Google vào ngày 17 tháng 8 năm 2026. |
Bằng chứng từ Flatkey này không có nghĩa là mọi hàng ảnh đều sẵn sàng cho production ngay hôm nay. Nó có nghĩa là catalog hiện tại có thể được dùng làm điểm khởi đầu cho việc so sánh nhà cung cấp, chọn route, rà soát quota và ghi log. Cửa chặn production thực sự là một lần kiểm tra dashboard hiện tại kèm theo một bài smoke test nhỏ.
Một công thức chuẩn hóa để lập kế hoạch chi phí hình ảnh
Sử dụng công thức chuẩn hóa này trước khi chọn nhà cung cấp hoặc tuyến:
Chi phí ước tính của quy trình làm việc với hình ảnh =
chi phí văn bản prompt
+ chi phí ảnh đầu vào hoặc chỉnh sửa
+ chi phí đầu ra ảnh được tạo
+ chi phí ảnh một phần hoặc ảnh xem trước
+ chi phí thử lại và lỗi
+ chi phí đơn vị theo gateway hoặc theo tuyến cụ thể
Với GPT Image, chi phí đầu ra ảnh được tạo được chi phối bởi token đầu ra của hình ảnh. Với Gemini Image, các con số tương đương theo hình ảnh đã công bố được suy ra từ giá token và số lượng token kỳ vọng. Với Imagen, chi phí ảnh được tạo thường hiển thị dưới dạng giá theo mỗi ảnh, nhưng phần chỉnh sửa và các tính năng hình ảnh liên quan có thể có mức giá riêng. Sau đó Flatkey bổ sung lớp vận hành: dòng chính xác, hỗ trợ endpoint, nhóm, loại hạn mức, trạng thái tuyến và nhật ký sử dụng thực tế.
Danh sách kiểm tra mua sắm cho API tạo ảnh
Một nhóm đang so sánh giá API tạo ảnh AI nên thu thập các trường sau trước khi phê duyệt một mô hình cho môi trường sản xuất:
| Trường | Vì sao bộ phận Tài chính quan tâm | Vì sao bộ phận Kỹ thuật quan tâm |
|---|---|---|
| ID mô hình chính xác | Ngăn việc lập ngân sách theo sai SKU. | Ngăn các lệnh gọi tới alias, bản xem trước hoặc các hàng đã bị ngừng hỗ trợ. |
| Đường dẫn endpoint | Xác nhận sổ cái sử dụng nào sẽ được tính phí. | Xác nhận body yêu cầu, hành vi SDK và dạng phản hồi. |
| Độ phân giải và chất lượng đầu ra | Tách riêng chi phí xem trước khỏi chi phí kết xuất cuối cùng. | Kiểm soát độ trễ, trải nghiệm người dùng, áp lực retry và lưu trữ. |
| Xử lý ảnh đầu vào | Chỉnh sửa và ảnh tham chiếu có thể làm tăng chi phí. | Mặt nạ, ảnh tham chiếu và tải ảnh lên làm thay đổi cấu trúc yêu cầu. |
| Trạng thái ngừng hỗ trợ hoặc bản xem trước | Một tuyến đường rẻ có thể trở thành chi phí di chuyển. | Các tuyến đường xem trước và đã ngừng hỗ trợ cần phương án dự phòng. |
| Flatkey usage logs | Cho thấy chi phí thực tế sau khi có các lần thử lại và lỗi. | Cho thấy hàng mô hình, trạng thái tuyến, tỷ lệ lỗi và tín hiệu rollback. |
Mẫu: So sánh một Prompt trên các tuyến
Sử dụng một prompt được kiểm soát và một thiết lập đầu ra khi bạn benchmark các tuyến. Chỉ thay đổi một biến tại một thời điểm.
Lần chạy benchmark
- Loại prompt: ý tưởng sản phẩm, tài sản marketing, mockup UI, hoặc chỉnh sửa
- Mục tiêu đầu ra: bản nháp, bản xem trước, hoặc bản cuối
- Kích thước: cố định giữa các nhà cung cấp nếu có thể
- Chất lượng/bậc: cố định hoặc được ghi rõ là đặc thù theo nhà cung cấp
- Ảnh đầu vào: không có, một ảnh tham chiếu, hoặc chỉnh sửa bằng mặt nạ
- Tuyến A: baseline trực tiếp của nhà cung cấp
- Tuyến B: hàng được Flatkey chọn và endpoint
- Ghi log: trạng thái, độ trễ, số lần thử lại, đầu ra được chấp nhận, đơn vị sử dụng, chi phí cuối cùng
Điều này giúp bạn có một so sánh giá API tạo ảnh AI thực sự thay vì một bảng tính bỏ qua ảnh bị từ chối, chặn kiểm duyệt, các lần thử lại và khác biệt về định tuyến.
Khi Flatkey Hỗ Trợ Định Giá Hình Ảnh
Flatkey hữu ích khi việc tạo hình ảnh là một phần của quy trình làm việc đa phương thức lớn hơn. Một ứng dụng production có thể dùng một mô hình để viết lại prompt, GPT Image hoặc Gemini Image để tạo ảnh, một dòng Imagen cho một hướng sáng tạo cụ thể, và một mô hình có khả năng thị giác để kiểm duyệt. Giá trị của Flatkey là lớp truy cập API dùng chung: một khóa, khả năng hiển thị theo dòng mô hình, các lựa chọn endpoint, nhật ký sử dụng, hạn mức, và một bề mặt định giá duy nhất.
Điều đó không loại bỏ việc thẩm định ở cấp nhà cung cấp. Nó chỉ làm cho các kiểm tra dễ lặp lại hơn. Với định giá API tạo ảnh AI, quy trình Flatkey an toàn nhất là:
- Mở giá của Flatkey và tìm đúng dòng mô hình.
- Xác nhận họ nhà cung cấp, kiểu endpoint, nhóm, loại hạn mức, và nhãn giá hiện tại.
- Đối chiếu với tài liệu giá chính thức của OpenAI hoặc Google cho cùng mô hình và tuyến.
- Chạy một bài kiểm tra smoke rủi ro thấp qua endpoint đã xác nhận.
- Xem lại log của Flatkey để kiểm tra dòng mô hình, trạng thái, đơn vị sử dụng, và chi phí.
- Thiết lập giới hạn hạn mức trước khi đưa tính năng cho người dùng production.
- Ghi lại các tuyến dự phòng cho mô hình xem trước hoặc mô hình đã ngừng hỗ trợ.
Hướng dẫn định giá liên quan
Nếu bạn đang xây dựng một mô hình chi phí rộng hơn, hãy ghép trang này với Định giá OpenAI Image API, So sánh định giá các mô hình AI, và GPT Image 2 API qua Flatkey. Những bài viết đó đề cập đến các kiểm tra theo từng nhà cung cấp và các mẫu định giá mô hình rộng hơn; hướng dẫn này tập trung vào các đơn vị định giá hình ảnh giữa nhiều nhà cung cấp.
Câu hỏi thường gặp
Cách tốt nhất để so sánh giá API tạo ảnh AI là gì?
Hãy so sánh các đơn vị đã chuẩn hóa, không chỉ nhìn vào giá niêm yết. Ghi lại chi phí văn bản prompt, chi phí ảnh đầu vào, chi phí ảnh đầu ra được tạo, độ phân giải, chất lượng, hành vi thử lại và tuyến Flatkey hoặc tuyến nhà cung cấp được dùng chính xác.
GPT Image có tính giá theo từng ảnh không?
Hướng dẫn hiện tại của GPT Image 2 từ OpenAI dùng ước tính token đầu ra dựa trên chất lượng và kích thước, cùng với token văn bản và ảnh đầu vào. Hướng dẫn này có các ví dụ tính chi phí theo từng ảnh, nhưng mô hình chi phí là dựa trên token.
Gemini Image có tính giá theo từng ảnh không?
Google liệt kê giá token và các đầu ra tương đương ảnh. Gemini 3 Pro Image dùng giá token đầu ra ảnh với các ví dụ như $0.134 cho đầu ra tiêu chuẩn 1K/2K, trong khi Gemini 2.5 Flash Image liệt kê các ví dụ đầu ra như $0.039 cho mỗi ảnh 1024x1024.
Imagen có tính giá theo từng ảnh không?
Các trang giá của Gemini API và Vertex AI của Google liệt kê việc tạo Imagen 4 dưới dạng giá trực tiếp theo từng ảnh, chẳng hạn $0.02 cho Fast, $0.04 cho Standard và $0.06 cho Ultra. Hãy kiểm tra loại tính năng và trạng thái ngừng hỗ trợ trước khi dựa vào Imagen 4 cho công việc sản xuất mới.
Tôi nên kiểm tra giá API tạo ảnh AI trong Flatkey như thế nào?
Tìm đúng hàng mô hình trong bảng giá Flatkey, xác nhận loại endpoint, nhóm, loại quota, trạng thái khả dụng và nhãn giá hiện tại, sau đó chạy một bài kiểm tra nhanh nhỏ và so sánh nhật ký sử dụng với ước tính của bạn.
Khuyến nghị cuối cùng: hãy xem giá API tạo ảnh AI như một chi phí quy trình làm việc, không phải là giá của một mô hình đơn lẻ. Bắt đầu với các đơn vị chính thức của nhà cung cấp, chuẩn hóa các thiết lập yêu cầu, rồi dùng Flatkey để xác minh hàng mô hình, endpoint, nhật ký sử dụng và kiểm soát quota. Xem Bảng giá trước khi đưa lưu lượng ảnh vào môi trường sản xuất.



