Gemini 3.7 Flash đã có mặt trên APIMaster.ai — Giảm tới 80%
Gemini 3.7 Flash đã có mặt trên APIMaster.ai. Khám phá những lợi thế về lập trình agentic, suy luận, đa phương thức, ngữ cảnh dài, benchmark và giá cả.
Published 2026-08-14
Gemini 3.7 Flash hiện đã có mặt trên APIMaster.ai với mã model gemini-3.7-flash. Route trực tiếp rẻ nhất hiện tại của APIMaster là khoảng $0,233 cho mỗi triệu token đầu vào và $1,165 cho mỗi triệu token đầu ra. Mức giá này thấp hơn 80% so với mức giá tiêu chuẩn $1,50/$7,50 của Google có hiệu lực từ ngày 1 tháng 1 năm 2027. So với mức giá giới thiệu $0,75/$3,75 của Google đến hết ngày 31 tháng 12 năm 2026, cùng route APIMaster này rẻ hơn khoảng 69%.
Trang chính thức Gemini 3.7 Flash của Google DeepMind (deepmind.google: không có dữ liệu Similarweb độc lập) gọi đây là model làm việc thông minh nhất của Google dành cho lập trình và agent. Model kết hợp khả năng suy luận tiên tiến với độ trễ và quy mô cấp Flash, hỗ trợ ngữ cảnh đầu vào 1 triệu token và hoạt động trên văn bản, hình ảnh, video, âm thanh, PDF và mã nguồn.
Gemini 3.7 Flash là gì?
Gemini 3.7 Flash là model Google phát hành rộng rãi (GA), được xây dựng cho các tác vụ agentic phức tạp ở quy mô sản xuất. Model này hướng đến các khối lượng công việc thực tế, nơi model phải suy luận, sử dụng công cụ, khắc phục sự cố, kiểm tra đầu vào đa phương thức và hoàn thành nhiệm vụ mà không phải chịu chi phí hoặc độ trễ của một model frontier lớn hơn.
Google định vị 3.7 Flash cho các tác vụ hàng ngày, lập trình agentic, suy luận nâng cao, hiểu đa phương thức và công việc tri thức. Model có sẵn qua Gemini API và Google AI Studio, với function calling, tìm kiếm như một công cụ và sử dụng máy tính.
Model chấp nhận tối đa 1 triệu token đầu vào và tạo ra tối đa 64.000 token đầu ra. Điều này phù hợp với các kho mã nguồn lớn, báo cáo dài, nhiều tài liệu, video dài và các quy trình làm việc cần lượng lớn mã hoặc phân tích được tạo ra.
Tính năng và lợi thế của Gemini 3.7 Flash
| Lĩnh vực | Lợi thế của Gemini 3.7 Flash |
|---|---|
| Thực thi agentic | Vượt qua các rào cản và giải quyết các vấn đề lập trình hoặc quy trình thực tế đáng tin cậy hơn |
| Kỹ thuật phần mềm | Cải thiện mạnh mẽ trong lập trình sản xuất, phát triển dài hạn, làm việc trên terminal và phát triển web |
| Suy luận | Suy luận chặt chẽ hơn trong khi vẫn giữ độ trễ và thông lượng cấp Flash |
| Hiểu đa phương thức | Xử lý văn bản, hình ảnh, âm thanh, video, PDF, mã nguồn, biểu đồ và giao diện trực quan |
| Ngữ cảnh dài | Hỗ trợ tối đa 1M token đầu vào và 64K token đầu ra |
| Sử dụng công cụ | Hỗ trợ function calling, tìm kiếm như một công cụ và sử dụng máy tính |
| Công việc tri thức | Xử lý tài liệu phân tích, tự động hóa quy trình, công việc pháp lý, báo cáo và tổng hợp dữ liệu |
| Sẵn sàng sản xuất | Phát hành rộng rãi qua Gemini API và Google AI Studio |
1. Lập trình agentic mạnh mẽ hơn
Gemini 3.7 Flash được thiết kế để làm nhiều hơn là tạo ra các đoạn mã rời rạc. Model có thể lập kế hoạch thay đổi, thao tác trong terminal, điều phối công cụ, tự kiểm tra công việc và khôi phục khi một hướng triển khai thất bại.
Các đánh giá được Google công bố cho thấy sự cải thiện rõ rệt so với Gemini 3.6 Flash:
| Benchmark | Đo lường điều gì | Gemini 3.7 Flash | Gemini 3.6 Flash |
|---|---|---|---|
| FrontierCode 1.1 Main | Chất lượng mã sản xuất | 43,6% | 34,4% |
| DeepSWE v1.1 | Kỹ thuật phần mềm dài hạn | 65,3% | 48,6% |
| Code Arena | Elo phát triển web | 1588 | 1538 |
| Terminal-bench 2.1 | Lập trình terminal agentic | 85,8% | 78,0% |
| Terminal-bench 3.0 | Khả năng agent tổng quát | 14,9% | 5,4% |
Những cải thiện này quan trọng đối với công việc ở quy mô kho mã nguồn: triển khai tính năng, gỡ lỗi, di chuyển, sửa chữa kiểm thử, đánh giá mã và các tác vụ thiết kế-thành-mã, nơi model phải hoàn thành nhiều bước phụ thuộc nhau thay vì trả lời một prompt duy nhất.
2. Suy luận tốt hơn cho các quy trình phức tạp
Trên Chỉ số Trí tuệ Artificial Analysis do Google hiển thị, Gemini 3.7 Flash đạt 56 điểm, tăng từ 52 điểm của Gemini 3.6 Flash. Sự cải thiện cũng thể hiện rõ trong các bài kiểm tra hướng quy trình: AutomationBench tăng từ 17,0% lên 30,4%, trong khi Agent's Last Exam tăng từ 24,2% lên 26,3%.
Lợi thế thực tế là sự cân bằng tốt hơn giữa trí tuệ và thông lượng. Các nhóm có thể sử dụng model cho các vòng lặp lập kế hoạch, trích xuất, đánh giá và sử dụng công cụ lặp đi lặp lại mà không tự động chuyển mọi tác vụ sang một model chậm hơn hoặc đắt hơn.
3. Đầu vào đa phương thức thực sự
Gemini 3.7 Flash hiểu văn bản, âm thanh, hình ảnh, mã nguồn, video và PDF trong cùng một quy trình. Google minh họa phạm vi này bằng nhiều ví dụ:
- Xây dựng một trò chơi 3D có thể chơi được từ một prompt văn bản, với Nano Banana tạo ra nhân vật, vật phẩm và họa tiết.
- Điều phối các sub-agent để tạo ra một trang đích parallax tương tác.
- Sử dụng vòng lặp đồ thị ba agent và quan sát đa phương thức để tăng tốc đào tạo model robot.
- Biến một báo cáo thường niên tĩnh thành một câu chuyện dữ liệu tương tác với biểu đồ và thông tin chi tiết tổng hợp.
Kết quả công bố bao gồm 85,4% trên LVBench cho hiểu video dài và 34,0% trên GDP.pdf cho hiểu PDF chuyên sâu, so với 84,2% và 22,0% của Gemini 3.6 Flash.
4. Khả năng sử dụng máy tính và công việc tri thức tốt hơn
Gemini 3.7 Flash đạt 47,9% trên OSWorld-2.0, tăng từ 33,8% của 3.6 Flash. Benchmark này tập trung vào việc sử dụng máy tính agentic, nơi model phải hiểu giao diện và thực hiện các hành động nhiều bước.
Đối với quy trình doanh nghiệp và chuyên nghiệp, Google cũng báo cáo cải thiện trong các tác vụ pháp lý, tài liệu phân tích, truy xuất ngữ cảnh dài, nghiên cứu sinh học và tự động hóa quy trình. Điều này làm cho model phù hợp với các hoạt động tài liệu, hỗ trợ nghiên cứu, agent trình duyệt, phân tích dữ liệu và tự động hóa kinh doanh nội bộ — không chỉ phát triển phần mềm.
5. Hiệu quả chi phí tốt hơn cho agent
Chi phí mỗi token chỉ là một phần trong tổng chi phí của một agent. Lỗi công cụ, kế hoạch thất bại, thử lại không cần thiết và vòng lặp thực thi dài có thể tiêu tốn nhiều token và thời gian hơn chính phản hồi cuối cùng.
Trong thử nghiệm đối tác ban đầu do Google công bố, Browser Use nhận thấy agent Gemini 3.7 Flash của họ rẻ hơn 35% so với phiên bản 3.6 Flash, với tỷ lệ trúng prompt-cache cao hơn và ít lỗi công cụ hơn. Đây là kết quả từ đối tác chứ không phải cam kết phổ quát, nhưng nó minh họa lý do tại sao độ tin cậy thực thi tốt hơn có thể giảm chi phí agent tổng thể.
Giá Gemini 3.7 Flash trên APIMaster.ai
Gemini 3.7 Flash hiện có sẵn trong thị trường model APIMaster. Sử dụng gemini-3.7-flash làm tên model. Giá là trực tiếp và có thể thay đổi theo nguồn cung, dung lượng và khả năng sẵn có của kênh.
Live pricing
Post-recharge USD per 1M tokens · lowest listed route per platform
| Platform | GPT-5.6 Sol | GPT-5.6 Terra | GPT-5.6 Luna | Claude Opus 4.8 | Pricing Notes |
|---|---|---|---|---|---|
| APIMaster.aiLowest Price | $0.1665/M in · $0.9987/M out (3.3% of official)save 97% | $0.0832/M in · $0.4994/M out (3.3% of official)save 92% | $0.0888/M in · $0.5328/M out (8.9% of official)save 11% | $0.4375/M in · $2.1875/M out (8.8% of official)save 91% | Aggregated gateway — auto-routes to available, lower-cost verified channels |
| OpenRouter | $5.0000/M in · $30.0000/M out (100.0% of official) | $1.0000/M in · $6.0000/M out (40.0% of official) | $0.1000/M in · $0.6000/M out (10.0% of official) | $5.0000/M in · $25.0000/M out (100.0% of official) | Single-route relay — published per-token rates from openrouter.ai |
Source: APIMaster marketplace + openrouter.ai/api/v1/models · Updated 02:00 16 thg 8, 2026 UTC
| Cơ sở giá | Đầu vào | Đầu ra | Tiết kiệm với route rẻ nhất hiện tại của APIMaster |
|---|---|---|---|
| Giá giới thiệu của Google đến hết ngày 31/12/2026 | $0,75/M | $3,75/M | Khoảng 69% |
| Giá tiêu chuẩn của Google từ ngày 1/1/2027 | $1,50/M | $7,50/M | Hơn 80% |
| Route rẻ nhất hiện tại của APIMaster | ~$0,233/M | ~$1,165/M | — |
Điểm dữ liệu: Tại mức giá quan sát được vào ngày 14 tháng 8 năm 2026, APIMaster thấp hơn khoảng 68,9% so với giá giới thiệu của Google và 84,5% so với giá tiêu chuẩn của Google cho cả token đầu vào và đầu ra.
Google tuyên bố giá giới thiệu Gemini 3.7 Flash hết hạn vào ngày 31 tháng 12 năm 2026. Luôn kiểm tra thẻ thị trường trực tiếp trước khi gửi lưu lượng sản xuất, vì giá route và khả năng sẵn có của APIMaster cũng có thể thay đổi.
Khi nào nên sử dụng Gemini 3.7 Flash?
Gemini 3.7 Flash là lựa chọn mạnh mẽ khi một quy trình cần nhiều trí tuệ hơn một model nhẹ nhưng vẫn phải hoạt động ở thông lượng cao:
- Agent lập trình: Phân tích kho mã nguồn, triển khai tính năng, gỡ lỗi, di chuyển, kiểm thử và sửa chữa lặp đi lặp lại.
- Agent trình duyệt và sử dụng máy tính: Quy trình nhiều bước điều hướng giao diện, biểu mẫu và ứng dụng web.
- Phân tích đa phương thức: Video dài, ảnh chụp màn hình, sơ đồ, âm thanh, PDF, biểu đồ và bộ tài liệu hỗn hợp.
- Công việc tri thức: Tổng hợp nghiên cứu, tài liệu pháp lý và kinh doanh, báo cáo phân tích và tự động hóa quy trình.
- Tác vụ ngữ cảnh dài: Kho mã nguồn lớn, tài liệu mở rộng, nhiều tệp hoặc bản ghi dài.
- Sản xuất khối lượng lớn: Phân loại, trích xuất, tóm tắt, định tuyến và gọi công cụ lặp lại, nơi cả độ trễ và chi phí đều quan trọng.
Làm thế nào để mua Gemini 3.7 Flash?
Bạn có thể đăng ký và gọi Gemini 3.7 Flash thông qua API tương thích OpenAI của APIMaster:
- Tạo tài khoản APIMaster.
- Nạp tín dụng trả theo mức sử dụng, với mức nạp tối thiểu từ $1.
- Mở thị trường model và chọn Gemini 3.7 Flash.
- Tạo API key trong console.
- Gửi yêu cầu bằng mã model
gemini-3.7-flash.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_APIMASTER_KEY",
base_url="https://apimaster.ai/v1",
)
response = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[
{
"role": "user",
"content": "Audit this implementation plan, find risks, and propose tests.",
}
],
)
print(response.choices[0].message.content)
Trước khi mở rộng quy mô, hãy sử dụng trình kiểm tra dấu vân tay model AI miễn phí và xem xét dữ liệu kênh công khai để xác minh cách một route hoạt động.
Tại sao nên sử dụng Gemini 3.7 Flash qua APIMaster.ai?
1. Giảm tới 80% so với giá tiêu chuẩn
APIMaster tổng hợp các route chiết khấu và hiển thị giá trực tiếp của chúng. Route Gemini 3.7 Flash rẻ nhất quan sát được tại thời điểm xuất bản thấp hơn hơn 80% so với giá tiêu chuẩn 2027 của Google và khoảng 69% so với giá giới thiệu hiện tại của Google.
2. API tương thích OpenAI
Sử dụng một định dạng API quen thuộc cho Gemini, Claude, GPT, DeepSeek, Kimi và các model hàng đầu khác. Trong nhiều ứng dụng, chuyển đổi model chỉ cần thay đổi giá trị model thay vì xây dựng lại xung quanh SDK của nhà cung cấp khác.
3. Trả theo mức sử dụng từ $1
Không có cam kết đăng ký. Bắt đầu với một khoản nạp nhỏ, đo lường chất lượng và chi phí trên khối lượng công việc của riêng bạn và mở rộng chỉ khi route đáp ứng yêu cầu của bạn.
4. Nhiều kênh và dự phòng
APIMaster hiển thị giá route và khả năng sẵn có trên nhiều kênh. Định tuyến đa kênh giảm sự phụ thuộc vào một nhà cung cấp thượng nguồn khi nhà cung cấp gặp giới hạn tốc độ, thiếu hạn ngạch hoặc sự cố.
5. Xác minh model minh bạch
Giá thấp chỉ có giá trị khi route cung cấp đúng model mà nó tuyên bố. APIMaster kết hợp dữ liệu kênh công khai, lịch sử uptime, kết quả phát hiện và trình kiểm tra dấu vân tay model để nhà phát triển có thể đánh giá độ trung thực của route trước khi cam kết lưu lượng sản xuất.
Bắt đầu xây dựng với Gemini 3.7 Flash
Gemini 3.7 Flash mang lại khả năng lập trình agentic mạnh mẽ hơn, suy luận nâng cao, hiểu đa phương thức, sử dụng máy tính và hiệu suất ngữ cảnh dài cho phân khúc Flash thông lượng cao của Google. APIMaster cung cấp model này qua endpoint tương thích OpenAI, với quyền truy cập trả theo mức sử dụng và các route có giá thấp hơn tới 80% so với giá tiêu chuẩn của Google.
Đăng ký APIMaster · So sánh các route Gemini 3.7 Flash · Xác minh model
FAQ
Gemini 3.7 Flash có sẵn trên APIMaster.ai không?
Có. Model đã có mặt trong thị trường model APIMaster với mã model gemini-3.7-flash.
Gemini 3.7 Flash có giá bao nhiêu trên APIMaster?
Route rẻ nhất quan sát được tại thời điểm xuất bản là khoảng $0,233/M token đầu vào và $1,165/M token đầu ra. Giá trực tiếp có thể thay đổi.
Gemini 3.7 Flash có thực sự giảm 80% không?
Có, thấp hơn hơn 80% so với giá tiêu chuẩn $1,50/$7,50 của Google bắt đầu từ ngày 1 tháng 1 năm 2027. So với giá giới thiệu $0,75/$3,75 của Google đến hết ngày 31 tháng 12 năm 2026, mức tiết kiệm hiện tại là khoảng 69%.
Gemini 3.7 Flash tốt hơn Gemini 3.6 Flash như thế nào?
Google báo cáo cải thiện trong lập trình sản xuất, kỹ thuật phần mềm dài hạn, agent terminal, tự động hóa quy trình, sử dụng máy tính, hiểu PDF, ngữ cảnh dài và chỉ số trí tuệ tổng thể.
Gemini 3.7 Flash hỗ trợ cửa sổ ngữ cảnh bao nhiêu?
Model hỗ trợ tối đa 1 triệu token đầu vào và tối đa 64.000 token đầu ra.
Gemini 3.7 Flash có hỗ trợ hình ảnh, video và âm thanh không?
Có. Model chấp nhận văn bản, hình ảnh, video, âm thanh, PDF và mã nguồn làm đầu vào và trả về đầu ra văn bản.
Tôi có thể sử dụng OpenAI SDK với Gemini 3.7 Flash không?
Có. APIMaster cung cấp endpoint tương thích OpenAI, vì vậy bạn có thể sử dụng OpenAI SDK với model="gemini-3.7-flash".
Làm thế nào để xác minh một route Gemini chiết khấu?
Chạy trình kiểm tra dấu vân tay model miễn phí và kiểm tra dữ liệu kênh công khai, uptime và phát hiện của route trước khi mở rộng lưu lượng sản xuất.
Nguồn và đọc thêm
- Google DeepMind — Gemini 3.7 Flash — deepmind.google: không có dữ liệu Similarweb độc lập
- Thị trường model APIMaster
- Trình kiểm tra dấu vân tay model AI miễn phí