Gemini 3.6 Flash đã có mặt trên APIMaster.ai — Tác nhân tốt hơn với giá giảm 80%
Gemini 3.6 Flash đã có mặt trên APIMaster.ai với giá giảm 80%. Khám phá các cải tiến về lập trình, sử dụng máy tính, đa phương thức, hiệu quả token, giá cả và an toàn.
Published 2026-07-22
Gemini 3.6 Flash hiện đã có mặt trên APIMaster.ai với mã model gemini-3.6-flash. Google niêm yết mức giá 1,50 USD cho mỗi triệu token đầu vào và 7,50 USD cho mỗi triệu token đầu ra. Đường dẫn giảm giá hiện tại của APIMaster là khoảng 0,20 USD/M token đầu vào và 1,00 USD/M token đầu ra — giảm hơn 80% so với giá chính thức.
Thông báo chính thức của Google (blog.google: không có dữ liệu Similarweb độc lập) mô tả Gemini 3.6 Flash là model chủ lực mới cho các tác nhân sản xuất. So với Gemini 3.5 Flash, model này sử dụng ít hơn 17% token đầu ra, thực hiện ít bước suy luận và gọi công cụ hơn, đồng thời cải thiện khả năng lập trình, sử dụng máy tính, làm việc tri thức và phân tích đa phương thức.
Gemini 3.6 Flash là gì?
Gemini 3.6 Flash là model đa năng thông lượng cao của Google dành cho các nhà phát triển xây dựng tác nhân AI sản xuất. Nó được thiết kế để nằm ở vị trí trung gian thực tế giữa các model nhẹ, chi phí thấp và các model tiên tiến chậm hơn: đủ nhanh cho các lệnh gọi công cụ lặp đi lặp lại, nhưng đủ khả năng cho lập trình, nghiên cứu, phân tích tài liệu và quy trình làm việc nhiều bước.
Cải tiến lớn nhất là hiệu quả tác vụ, không chỉ là điểm chuẩn cao hơn. Google báo cáo rằng 3.6 Flash đạt được câu trả lời với ít token đầu ra hơn, ít bước suy luận hơn và ít lệnh gọi công cụ hơn so với 3.5 Flash. Điều này có thể giảm cả độ trễ và tổng chi phí để hoàn thành một tác vụ tác nhân.
Các tính năng và lợi thế của Gemini 3.6 Flash
| Lĩnh vực | Lợi thế của Gemini 3.6 Flash |
|---|---|
| Hiệu quả token | Sử dụng ít hơn 17% token đầu ra so với 3.5 Flash trên Chỉ số Phân tích Nhân tạo |
| Lập trình | Độ chính xác cao hơn, ít chỉnh sửa không mong muốn và ít vòng lặp thực thi hơn |
| Quy trình tác nhân | Hoàn thành các tác vụ nhiều bước với ít bước suy luận và gọi công cụ hơn |
| Sử dụng máy tính | Công cụ sử dụng máy tính phía máy khách được tích hợp sẵn thông qua Gemini API |
| Làm việc tri thức | Phân tích tài liệu, biểu đồ, phân tích dữ liệu và soạn thảo báo cáo mạnh mẽ hơn |
| Làm việc đa phương thức | Hiểu biết tốt hơn về văn bản, hình ảnh, tài liệu, biểu đồ và giao diện trực quan |
| An toàn | Các biện pháp bảo vệ mạnh mẽ hơn chống lại lạm dụng CBRN và tấn công mạng, với khả năng chống tấn công jailbreak tốt hơn |
1. Lập trình chính xác hơn với ít vòng lặp hơn
Trên DeepSWE, Gemini 3.6 Flash đạt 49%, so với 37% của 3.5 Flash. Google cho biết model này thực hiện ít chỉnh sửa mã không mong muốn và cần ít vòng lặp thực thi hơn, điều này rất có giá trị cho việc sửa lỗi quy mô kho lưu trữ, di chuyển và các tác nhân lập trình liên tục kiểm tra, chỉnh sửa và kiểm thử tệp.
Model cũng cải thiện từ 49,7% lên 63,9% trên MLE Bench, cho thấy hiệu suất mạnh mẽ hơn trong các tác vụ nghiên cứu và kỹ thuật học máy.
2. Sử dụng máy tính tốt hơn cho các tác nhân thực tế
Gemini 3.6 Flash đạt 83,0% trên OSWorld-Verified, tăng từ 78,4% của 3.5 Flash. Sử dụng máy tính có sẵn dưới dạng công cụ phía máy khách được tích hợp sẵn thông qua Gemini API và Gemini Enterprise, giúp model thực tế hơn cho các quy trình làm việc trên trình duyệt, tự động hóa máy tính để bàn và các tác nhân phải tương tác với giao diện trực quan.
3. Làm việc tri thức và đa phương thức mạnh mẽ hơn
Trên GDPval-AA v2, 3.6 Flash đạt 1421, so với 1349 của 3.5 Flash. Google nhấn mạnh các trường hợp sử dụng của khách hàng bao gồm phân tích dữ liệu tài chính, xử lý bản ghi, phân tích tài liệu, biểu đồ, phân tích dữ liệu và soạn thảo báo cáo.
Đối với các nhà phát triển, điều này có nghĩa là một model có thể xử lý các đầu vào hỗn hợp—văn bản, bảng biểu, ảnh chụp màn hình, biểu đồ và tài liệu—mà không buộc mọi giai đoạn của quy trình làm việc phải dùng một model chuyên biệt riêng.
4. Sử dụng token ít hơn và chi phí mỗi tác vụ thấp hơn
Google báo cáo ít hơn 17% token đầu ra trên Chỉ số Phân tích Nhân tạo và giảm tới 65% trong một số tác vụ như DeepSWE. Vì việc thanh toán API dựa trên token, các đầu ra ngắn hơn và ít lặp lại hơn có thể làm giảm chi phí thực tế ngoài mức giá niêm yết thấp hơn.
Điều này quan trọng nhất đối với các tác nhân. Một khoản tiết kiệm nhỏ trên một phản hồi sẽ trở thành khoản tiết kiệm đáng kể khi một quy trình làm việc bao gồm lập kế hoạch, gọi công cụ, thử lại, chỉnh sửa mã và xác minh cuối cùng.
5. Được xây dựng với các biện pháp an toàn mạnh mẽ hơn
Gemini 3.6 Flash bổ sung các biện pháp bảo vệ An toàn Tiên tiến mạnh mẽ hơn chống lại lạm dụng hóa học, sinh học, phóng xạ, hạt nhân và tấn công mạng. Google cho biết các biện pháp bảo vệ này giúp model chống lại các cuộc tấn công jailwork tốt hơn đáng kể trong khi được huấn luyện để giảm thiểu các từ chối không cần thiết đối với các yêu cầu có lợi.
Giá Gemini 3.6 Flash trên APIMaster.ai: Giảm 80%
Gemini 3.6 Flash hiện có sẵn trong thị trường model APIMaster. Sử dụng gemini-3.6-flash làm tên model và so sánh các đường dẫn trực tiếp trước khi gửi lưu lượng sản xuất.
Live pricing
Post-recharge USD per 1M tokens · lowest listed route per platform
| Platform | GPT-5.6 Sol | GPT-5.6 Terra | GPT-5.6 Luna | Claude Opus 4.8 | Pricing Notes |
|---|---|---|---|---|---|
| APIMaster.aiLowest Price | $0.2945/M in · $2.3562/M out (5.9% of official)save 92% | $0.1473/M in · $1.1781/M out (5.9% of official)save 92% | $0.0589/M in · $0.4712/M out (5.9% of official)save 92% | $0.4411/M in · $2.2055/M out (8.8% of official)save 91% | Aggregated gateway — auto-routes to available, lower-cost verified channels |
| OpenRouter | $5.0000/M in · $30.0000/M out (100.0% of official) | $2.5000/M in · $15.0000/M out (100.0% of official) | $1.0000/M in · $6.0000/M out (100.0% of official) | $5.0000/M in · $25.0000/M out (100.0% of official) | Single-route relay — published per-token rates from openrouter.ai |
Source: APIMaster marketplace + openrouter.ai/api/v1/models · Updated 08:47 22 thg 7, 2026 UTC
| Cơ sở giá | Đầu vào | Đầu ra |
|---|---|---|
| Giá niêm yết chính thức của Google | 1,50 USD/M | 7,50 USD/M |
| Đường dẫn giảm giá của APIMaster | ~0,20 USD/M | ~1,00 USD/M |
| Tiết kiệm | Hơn 80% | Hơn 80% |
Giá APIMaster hiển thị là giá đường dẫn trực tiếp và có thể thay đổi tùy theo nguồn cung, hạn ngạch và khả năng cung cấp. Hãy kiểm tra thẻ thị trường trước khi mở rộng khối lượng công việc sản xuất.
Khi nào bạn nên sử dụng Gemini 3.6 Flash?
Gemini 3.6 Flash là lựa chọn mạnh mẽ khi bạn cần cân bằng giữa chất lượng, tốc độ và chi phí:
- Tác nhân lập trình: phân tích kho lưu trữ, sửa lỗi, di chuyển, tạo kiểm thử và sửa chữa lặp đi lặp lại.
- Tác nhân trình duyệt và máy tính để bàn: quy trình làm việc sử dụng khả năng sử dụng máy tính của model.
- Tự động hóa tài liệu: hóa đơn, hợp đồng, báo cáo, bản ghi, PDF, bảng biểu và biểu đồ.
- Quy trình nghiên cứu: phân tích dữ liệu, thí nghiệm học máy và tạo báo cáo.
- Sản xuất khối lượng lớn: các tác vụ phân loại, trích xuất, tóm tắt và sử dụng công cụ lặp đi lặp lại mà hiệu quả token là quan trọng.
- Ứng dụng đa phương thức: các tác vụ kết hợp ngôn ngữ với ảnh chụp màn hình, hình ảnh, biểu đồ hoặc trạng thái giao diện.
Làm thế nào để mua Gemini 3.6 Flash?
Bạn có thể đăng ký và gọi Gemini 3.6 Flash thông qua API tương thích OpenAI của APIMaster:
- Đăng ký tài khoản APIMaster.
- Nạp tiền vào ví; bạn có thể bắt đầu với số dư thanh toán theo mức sử dụng nhỏ từ 1 USD.
- Mở thị trường model và chọn Gemini 3.6 Flash.
- Tạo khóa API trong bảng điều khiển.
- Gửi yêu cầu với mã model
gemini-3.6-flash.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_APIMASTER_KEY",
base_url="https://apimaster.ai/v1",
)
response = client.chat.completions.create(
model="gemini-3.6-flash",
messages=[
{
"role": "user",
"content": "Hãy xem xét kế hoạch di chuyển này, xác định rủi ro và đề xuất các bài kiểm thử.",
}
],
)
print(response.choices[0].message.content)
Trước khi gửi lưu lượng sản xuất, hãy sử dụng trình kiểm tra vân tay model API miễn phí để kiểm tra hành vi đường dẫn và giảm rủi ro thay thế model không mong muốn.
Tại sao nên sử dụng APIMaster.ai cho Gemini 3.6 Flash?
1. Giảm hơn 80%
APIMaster tổng hợp các đường dẫn model giảm giá. Đường dẫn Gemini 3.6 Flash hiện tại có giá khoảng 0,20 USD/M token đầu vào và 1,00 USD/M token đầu ra, so với giá niêm yết chính thức của Google là 1,50 USD/M và 7,50 USD/M.
2. Một API tương thích OpenAI
Sử dụng một khóa API và một SDK quen thuộc cho Gemini, Claude, GPT, DeepSeek và các model hàng đầu khác. Việc chuyển đổi model thường chỉ yêu cầu thay đổi giá trị model thay vì xây dựng lại tích hợp xung quanh một SDK nhà cung cấp khác.
3. Ổn định đa kênh
APIMaster hiển thị giá và khả năng cung cấp của đường dẫn và có thể định tuyến qua nhiều kênh. Điều này giảm sự phụ thuộc vào một nguồn cung cấp duy nhất khi nhà cung cấp bị giới hạn tốc độ, không khả dụng hoặc hết hạn ngạch.
4. Xác minh model
Giá thấp chỉ có ý nghĩa khi đường dẫn cung cấp đúng model như đã tuyên bố. APIMaster kết hợp dữ liệu kênh công khai, lịch sử phát hiện và trình kiểm tra vân tay model để các nhà phát triển có thể đánh giá độ trung thực của model trước khi mở rộng.
Đăng ký và bắt đầu xây dựng
Gemini 3.6 Flash mang đến khả năng lập trình tốt hơn, sử dụng máy tính mạnh mẽ hơn, làm việc tri thức đa phương thức được cải thiện và sử dụng token ít hơn cho dòng Flash của Google. APIMaster cung cấp model này thông qua điểm cuối tương thích OpenAI với giá giảm hơn 80% so với giá niêm yết chính thức.
Đăng ký ngay · So sánh các đường dẫn Gemini 3.6 Flash · Kiểm tra tính xác thực của model
FAQ
Gemini 3.6 Flash có sẵn trên APIMaster.ai không?
Có. Model này đã có mặt trong thị trường model APIMaster với mã model gemini-3.6-flash.
Gemini 3.6 Flash có giá bao nhiêu? Giá chính thức của Google là 1,50 USD/M token đầu vào và 7,50 USD/M token đầu ra. Đường dẫn giảm giá hiện tại của APIMaster là khoảng 0,20 USD/M token đầu vào và 1,00 USD/M token đầu ra, giảm hơn 80%.
Gemini 3.6 Flash có tốt hơn Gemini 3.5 Flash không? Google báo cáo kết quả tốt hơn trên các lĩnh vực lập trình, nghiên cứu ML, sử dụng máy tính và làm việc tri thức, cùng với việc giảm 17% token đầu ra trên Chỉ số Phân tích Nhân tạo.
Gemini 3.6 Flash phù hợp nhất cho việc gì? Nó phù hợp nhất cho các tác nhân lập trình, quy trình làm việc sử dụng máy tính, phân tích tài liệu và biểu đồ, ứng dụng đa phương thức, nghiên cứu và các tác vụ sản xuất khối lượng lớn.
Gemini 3.6 Flash có hỗ trợ sử dụng máy tính không? Có. Google cho biết sử dụng máy tính có sẵn dưới dạng công cụ phía máy khách được tích hợp sẵn thông qua Gemini API và Gemini Enterprise.
Tôi có thể sử dụng SDK OpenAI với Gemini 3.6 Flash không?
Có. APIMaster cung cấp điểm cuối tương thích OpenAI, vì vậy bạn có thể sử dụng SDK OpenAI với model="gemini-3.6-flash".
Làm cách nào để xác minh model đằng sau một đường dẫn giảm giá? Sử dụng trình kiểm tra vân tay model của APIMaster và xem xét kênh công khai cũng như dữ liệu phát hiện của đường dẫn trước khi mở rộng.
Đọc thêm
- Google — Giới thiệu Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber — blog.google: không có dữ liệu Similarweb độc lập
- Google DeepMind — Thẻ model Gemini 3.6 Flash — deepmind.google: không có dữ liệu Similarweb độc lập
- Thị trường model APIMaster
- Trình kiểm tra vân tay model API miễn phí