Trang chủ / Gemini 3.6 Flash

Chi phí API Gemini 3.6 Flash: Đánh giá giá trị thực tế

Theo hệ số nhóm mặc định, Gemini 3.6 Flash có giá cơ bản là $1.50 cho mỗi 1M token đầu vào và $7.50 cho mỗi 1M token đầu ra, cùng mức giá cache hit là $0.15. Mô hình này rẻ hơn các tùy chọn Claude và GPT cao cấp được liệt kê ở cả đầu vào và đầu ra, nhưng mô hình rẻ nhất còn tùy thuộc vào tỷ lệ đầu vào trên đầu ra, tỷ lệ cache hit và yêu cầu của workload.

Chi phí Gemini 3.6 Flash so với các mô hình tương tự là bao nhiêu?

Giao diện giá hiển thị mức giá cơ bản bằng USD cho mỗi 1M token. Bảng so sánh dưới đây tập trung vào các mô hình hội thoại và chat được liệt kê, có thể dùng làm tham chiếu giá thực tế. Đây là so sánh giá, không phải khẳng định rằng các mô hình này có năng lực, độ trễ, giới hạn ngữ cảnh hoặc hành vi trong môi trường production tương đương nhau.

Model Input / 1M tokens Output / 1M tokens Cache hit / 1M tokens Gemini 3.6 Flash $1.50 $7.50 $0.15 Gemini 3.5 Flash $1.50 $9.00 $0.15 Gemini 3.1 Flash Lite $0.25 $1.50 $0.025 Gemini 2.5 Flash $0.30 $2.502 $0.03 DeepSeek-V4-Flash $1.00 $2.00 $0.02 GPT-5 mini $0.25 $2.00 $0.025 Claude Haiku 4.5 $1.00 $5.00 $0.10 GPT-4o mini $0.15 $0.60 $0.075

Đây là mức giá tham chiếu trước khi áp dụng hệ số nhóm người dùng. Với Gemini 3.6 Flash, giá cơ bản là $1.50 cho đầu vào, $7.50 cho đầu ra và $0.15 cho cache hit. Một mô hình có giá đầu ra thấp hơn có thể rẻ hơn đối với workload tạo ra lượng đầu ra lớn hơn đáng kể so với đầu vào, vì vậy chỉ so sánh cột đầu vào có thể dẫn đến kết luận sai.

Chi phí Gemini 3.6 Flash mỗi tháng ở mức sử dụng điển hình là bao nhiêu?

Ước tính hàng tháng đơn giản được tính riêng cho đầu vào và đầu ra: số token đầu vào tính theo triệu nhân với đơn giá đầu vào, cộng với số token đầu ra tính theo triệu nhân với đơn giá đầu ra. Với 10M token đầu vào và 2M token đầu ra, Gemini 3.6 Flash có chi phí 10 × $1.50 + 2 × $7.50 = $30.00 theo hệ số cơ bản 1.0.

Theo hệ số nhóm mặc định là ×0.07353, cùng mức sử dụng này có chi phí $30.00 × 0.07353 = $2.2059. Với 100M token đầu vào và 20M token đầu ra, phép tính là 100 × $1.50 + 20 × $7.50 = $300.00 theo giá cơ bản, sau đó $300.00 × 0.07353 = $22.059.

Nếu toàn bộ 10M token đầu vào trong ví dụ đầu tiên được tính là cache hit, phép tính sẽ là 10 × $0.15 + 2 × $7.50 = $16.50 theo giá cơ bản, hoặc $16.50 × 0.07353 = $1.213245 theo nhóm mặc định. Đây là ước tính sử dụng tỷ lệ cache hit được liệt kê; các dữ kiện được cung cấp không xác định liệu một ứng dụng cụ thể có đạt được mô hình cache hit đó hay không.

Số tiền thực tế phụ thuộc vào nhóm được gán cho tài khoản của bạn. Ví dụ, các hệ số được liệt kê bao gồm ×0.03383 cho huawei-gemini-banana, ×0.17647 cho Aistudio-Gemini-1, ×0.44118 cho Aistudio-Gemini-3 và ×0.80883 cho Vertex-Gemini-1. Hãy sử dụng mức giá hiển thị trong panel để tính toán cuối cùng.

Mô hình rẻ nhất có đồng thời là lựa chọn có giá trị tốt nhất cho workload của bạn không?

Không. Giá token thấp hơn chỉ giải quyết phần chi phí của quyết định. Gemini 3.6 Flash được mô tả là tối ưu cho các tác vụ thực tế với tốc độ cao hơn và chi phí thấp hơn, có thế mạnh về sinh mã, thực thi agent và suy luận không gian. Những mô tả này không cung cấp số liệu độ trễ đo được, điểm benchmark, độ dài ngữ cảnh hoặc thông tin về khả dụng.

Về dung lượng ngữ cảnh, Gemini 3.6 Flash được ghi là Chưa được đo lường trong các dữ kiện được cung cấp. Về tốc độ, mô tả hiện có mang tính định tính thay vì định lượng, nên độ trễ production phù hợp cũng là Chưa được đo lường. Không có SLA hoặc tỷ lệ khả dụng nào được cung cấp. Hãy xem mọi tuyên bố về các số liệu này là chưa được xác minh cho đến khi bạn tự đo workload.

Gemini 3.1 Flash Lite có giá thấp hơn Gemini 3.6 Flash ở cả hai nhóm token được liệt kê, trong khi Gemini 3.5 Flash có cùng giá đầu vào nhưng giá đầu ra cao hơn. DeepSeek-V4-Flash có giá đầu ra thấp hơn Gemini 3.6 Flash. Những chênh lệch giá này có thể quan trọng hơn đối với các phản hồi được tạo dài, nhưng dữ liệu được cung cấp không có phép so sánh có kiểm soát về chất lượng hoặc độ trễ giữa các mô hình.

Làm thế nào để giảm chi phí API Gemini 3.6 Flash?

Trước tiên, hãy sử dụng cache hit cho các đầu vào lặp lại nếu ứng dụng và mô hình request của bạn hỗ trợ. Gemini 3.6 Flash có giá cache hit là $0.15 cho mỗi 1M token, so với $1.50 cho mỗi 1M token đầu vào. Theo dõi riêng khối lượng cache hit và khối lượng đầu vào thông thường để ước tính hàng tháng phản ánh đúng các nhóm tính phí thực tế.

Thứ hai, hãy chọn mô hình theo tác vụ thay vì gửi mọi request đến Gemini 3.6 Flash. Các lựa chọn Gemini được liệt kê gồm Gemini 3.1 Flash Lite với giá $0.25 đầu vào và $1.50 đầu ra cho mỗi 1M token, Gemini 2.5 Flash với giá $0.30 đầu vào và $2.502 đầu ra, và Gemini 3.5 Flash với giá $1.50 đầu vào và $9.00 đầu ra. Hãy kiểm thử ứng viên rẻ nhất đáp ứng được hành vi yêu cầu; không có benchmark nào được cung cấp có thể quyết định lựa chọn đó thay cho bạn.

Thứ ba, hãy đánh giá xử lý batch đối với các workload không cần phản hồi ngay lập tức. Dữ liệu giá được cung cấp không liệt kê mức giá batch riêng, chiết khấu batch hoặc hành vi dịch vụ đặc thù cho batch, vì vậy đừng áp dụng mức chiết khấu giả định vào dự báo. Hãy so sánh mức giá hiện tại trong panel với yêu cầu xử lý đã đo lường trước khi thay đổi chế độ thực thi.

Có thể xác minh giá Gemini 3.6 Flash hiện tại ở đâu?

Nguồn được nêu là https://api.openlux.ai/api/pricing, tức giao diện giá của chính panel thay vì một bảng được duy trì thủ công. Dữ liệu được lấy tại 2026-08-04T16:16:08Z. Hãy sử dụng response trực tiếp để xác minh giá cơ bản hiện tại của Gemini 3.6 Flash, giá cache hit và hệ số được gán cho nhóm của bạn.

Giao diện báo cáo tổng cộng 452 mô hình. Bảng so sánh được cung cấp chỉ gồm 150 mô hình có lưu lượng gọi cao nhất, để lại 302 mô hình nằm ngoài bảng đó. Vì vậy, trang này không thể xác lập rằng các mô hình được liệt kê là những lựa chọn duy nhất hiện có.

Dữ liệu nguồn không chỉ rõ tier miễn phí, giới hạn rate API miễn phí, phương thức thanh toán hoặc đơn vị xử lý thanh toán. Dữ liệu cũng không chỉ rõ một tuyến mua cụ thể có hỗ trợ tùy chọn thanh toán nhất định hay không. Đối với các câu hỏi đó, hãy sử dụng thông tin liên quan trong panel mua hàng hoặc tài khoản thay vì suy luận từ giá token.

Khi nào giá Gemini 3.6 Flash có thể thay đổi?

Giá trên trang này nên được xem là ảnh chụp tại một thời điểm cụ thể, không phải báo giá cố định vĩnh viễn. Thời điểm lấy dữ liệu được ghi nhận là 2026-08-04T16:16:08Z, và giá cuối cùng được tính bằng giá cơ bản nhân với hệ số nhóm của người dùng. Một trong hai giá trị này có thể thay đổi trong response sau đó từ giao diện giá.

Trước khi cam kết ngân sách hàng tháng, hãy ghi lại tên mô hình, đơn giá đầu vào, đơn giá đầu ra, đơn giá cache hit nếu có, tên nhóm và hệ số được endpoint trực tiếp trả về. Tính toán lại dựa trên cơ cấu token đã đo lường. Nếu một mô hình hoặc mức giá bị thiếu trong response hiện tại, giá trị của nó là Chưa được đo lường cho phép so sánh này, chứ không phải cơ sở để giả định rằng nó miễn phí hoặc không khả dụng.

Vẫn gặp khó khăn? Tài liệu đầy đủ và hỗ trợ có tại Trang web chính thức của OpenLux.

Xem thêm trên trang này

Bắt đầu

Kiểm tra bản ghi định giá hiện tại và xác thực Gemini 3.6 Flash trong quá trình tích hợp của bạn.

Bắt đầu với credit miễn phí

Trang web chính thức: OpenLux Gemini 3.6 Flash API

Cập nhật lần cuối 05/08/2026 | Được viết và duy trì bởi OpenLux.
Các số liệu về độ trễ và giá được lấy từ phép đo của chúng tôi. Nếu khác với trang web của nhà cung cấp, thông tin trên trang trực tiếp của nhà cung cấp được ưu tiên.