APIMaster.ai

Gemini 4 Argon: mô hình frontier của Google cho quy trình dài hạn

Google công bố Gemini 4 Argon vào ngày 30 tháng 9 năm 2026 cho kỹ thuật phần mềm phức tạp, công việc tri thức doanh nghiệp và phòng thủ mạng. Xem giá được báo cáo, benchmark, quyền truy cập Fairwind giới hạn và các tuyến Gemini có thể dùng hôm nay.

Gemini 4 ArgonGemini 4 APIGemini APIGoogle DeepMindAI benchmarksAI pricingAPIMaster

Published 2026-09-30 · Updated 2026-10-01

##Trả lời nhanh Gemini 4 Argon là mô hình biên giới Gemini 4 được Google công bố lần đầu tiên, nhưng nó chưa phải là API công khai. Google đã công bố Argon vào ngày 30 tháng 9 năm 2026, định vị nó cho công nghệ phần mềm lâu dài, công việc tri thức doanh nghiệp và phòng thủ mạng. Quyền truy cập đầu tiên được Google mô tả là thông qua chương trình Fairwind dành cho những người bảo vệ mạng đáng tin cậy; ngày ra mắt API trả phí rộng rãi hoặc Google AI Ultra vẫn chưa được công bố. Khả năng tiêu đề được báo cáo là lên tới 1 triệu mã thông báo đầu ra trong một phản hồi, so với giới hạn đầu ra nhỏ hơn nhiều mà các nhà phát triển thường sử dụng trên hầu hết các API biên giới hiện tại. Google cho biết các nhóm nội bộ của họ đã sử dụng Argon cho các công cụ tái cấu trúc lớn, di chuyển C/C++ sang Rust, tối ưu hóa bộ nhớ và các tác vụ dài hạn khác. Bảng điểm chuẩn được xuất bản cùng với báo cáo thông báo 77,9% trên DeepSWE v1.1, 68,9% trên công việc kiến ​​thức của Vals Index, 19,6% trên Điểm chuẩn đại lý pháp lý của Harvey và kết quả rõ ràng trên một số đánh giá mã hóa và doanh nghiệp khác. Đây là kết quả do nhà cung cấp công bố, không phải là thử nghiệm APIMaster độc lập. Giá giới thiệu được báo cáo là $2 / 1 triệu mã thông báo đầu vào và 10 đô la / 1 triệu mã thông báo đầu ra, với đầu vào được lưu vào bộ nhớ đệm được báo cáo ở mức $0,10 / 1 triệu mã thông báo. Google dự kiến ​​sẽ chuyển sang $4 / $20 sau thời gian giới thiệu, nhưng danh mục API công khai và lộ trình Argon có sẵn rộng rãi sẽ được coi là nguồn thông tin chính xác khi chúng xuất hiện. Argon hiện chưa có lộ trình APIMaster được xác nhận. Đối với API Gemini, bạn thực sự có thể gọi ngay hôm nay, APIMaster có các lộ trình hoạt động cho Gemini 3.8 Flash, Gemini 3.7 Flash và Gemini 3.6 Flash. Như đã kiểm tra vào ngày 1 tháng 10 năm 2026, tuyến Flash Gemini 3.8 hoạt động thấp nhất là $0,2999 đầu vào / $1,4993 đầu ra trên mỗi 1 triệu mã thông báo, với bảy tuyến đang hoạt động. Kiểm tra thẻ trực tiếp trước khi gửi lưu lượng vì dung lượng tuyến và giá có thể thay đổi.

ID mẫu Giá niêm yết chính thức (mỗi 1 triệu đầu vào/đầu ra) Giá hiện tại của APIMaster Các tuyến đang hoạt động Giảm giá Thẻ mẫu
gemini-4-argon Báo cáo giới thiệu $2 / $10; sau $4 / $20 Không có tuyến đường công cộng nào được xác nhận 0 — Xem mẫu thẻ
gemini-3.8-flash $1,50 / $7,50 $0,2999 / $1,4993 7 khoảng 80% Xem giảm giá
gemini-3.7-flash $1,50 / $7,50 $0,2999 / $1,4993 7 khoảng 80% Xem giảm giá
gemini-3.6-flash $1,50 / $7,50 $0,36 / $1,80 4 khoảng 76% Xem giảm giá
gpt-6-astra $10 / $50 $0,4465 / $2,2327 14 khoảng 96% Xem giảm giá
claude-fable-5-1 $10 / $50 $2,3755 / $11,8774 7 khoảng 76% Xem giảm giá
claude-opus-5-5 $4 / $20 $1,3359 / $6,6794 9 khoảng 67% Xem giảm giá
Ảnh chụp nhanh về giá được kiểm tra vào ngày 1 tháng 10 năm 2026. Giá APIMaster là tuyến hoạt động thấp nhất được điểm cuối thị trường công cộng trả về tại thời điểm đó; thẻ thị trường trực tiếp là có thẩm quyền. Giá và tính sẵn có của Argon là thông tin ra mắt được báo cáo, không phải danh sách APIMaster đã được xác nhận.

Dùng thử GPT(GPT-6 Astra, GPT-6 Sol, GPT-5.6 và GPT-5.5 khả dụng)

Đăng ký và nhận $20 dùng thử GPT

Nhận ngay

Song Tử 4 Argon là gì?

Gemini 4 Argon là thành viên đầu tiên được công bố thuộc thế hệ Gemini 4 của Google. Không giống như lần ra mắt đầu tiên dành cho người tiêu dùng tập trung vào các tính năng trò chuyện, Google đã trình bày Argon như một mô hình cho công việc thực hiện nhiều bước, sử dụng lượng lớn ngữ cảnh và có thể chạy trong thời gian dài trước khi tạo ra kết quả hữu ích. Để biết lộ trình đào tạo và tính khả dụng rộng hơn của Gemini 4, hãy xem Tổng quan về Gemini 4. Ba khu vực khởi động là:

  • Kỹ thuật phần mềm: thay đổi quy mô kho lưu trữ, gỡ lỗi, di chuyển và vòng lặp tác nhân mã hóa.
  • Công việc tri thức doanh nghiệp: nghiên cứu pháp lý, tài chính và hoạt động trong đó mô hình phải theo dõi nhiều ràng buộc và nguồn.
  • Phòng thủ mạng: bản phân tích bảo mật mang tính phòng thủ được phát hành lần đầu tiên cho những người tham gia đáng tin cậy trong chương trình Fairwind của Google. Định vị này quan trọng đối với người mua API. Điểm chuẩn cao không giống như tính khả dụng công khai, độ trễ có thể dự đoán được hoặc hợp đồng thanh toán ổn định. Cho đến khi Argon được liệt kê trong tài liệu API của Google cùng với ID mẫu và giới hạn, nhà phát triển nên coi thông báo này là bản cập nhật khả năng và quyền truy cập—chứ không phải là điểm cuối mà họ có thể gọi.

Argon có thể làm gì?

Mức trần sản lượng một triệu token

Thông báo của Google nêu bật tối đa 1 triệu mã thông báo đầu ra trong một phản hồi. Nếu giới hạn được phân phối như mô tả, nó có thể thay đổi cách các nhà phát triển thiết kế các bộ tái cấu trúc lớn, các báo cáo dài và quy trình làm việc của tác nhân nhiều giai đoạn: mô hình có thể giữ được nhiều kết quả trung gian của nhiệm vụ hơn trong một phản hồi thay vì buộc ứng dụng phải chia công việc thành nhiều lệnh gọi tiếp tục. Không nên nhầm lẫn con số đó với sản lượng hữu ích được đảm bảo, dung lượng bối cảnh, giới hạn tốc độ hoặc mức sử dụng sản xuất hợp lý. Phản hồi một triệu mã thông báo cũng là một hóa đơn triệu mã thông báo ở tỷ lệ đầu ra. Các nhóm nên đo lường chất lượng hoàn thành, hành vi hủy, độ trễ và tổng chi phí cho các nhiệm vụ đại diện trước khi coi giới hạn là lý do để loại bỏ các điểm kiểm tra phía ứng dụng.

Công việc tri thức và kỹ thuật có tầm nhìn dài hạn

Google mô tả các dự án nội bộ của Argon bao gồm tối ưu hóa bộ nhớ trung tâm dữ liệu, di chuyển C/C++ sang Rust và tăng tốc bộ giải mã video. Những ví dụ này là những tín hiệu hữu ích về khối lượng công việc dự kiến, nhưng chúng là những nghiên cứu điển hình nội bộ chứ không phải là những đánh giá công khai có thể lặp lại. Thử nghiệm sản xuất chính xác là chạy một kho lưu trữ hoặc bộ tài liệu cố định dựa trên Argon và các lựa chọn thay thế hiện tại với cùng các công cụ, ngân sách và phiếu tự chấm điểm.

Phòng thủ mạng trước tiên

Quyền truy cập Fairwind ban đầu là một phần có ý nghĩa trong câu chuyện sản phẩm. Điều đó có nghĩa là những người dùng đầu tiên là những người bảo vệ mạng đáng tin cậy chứ không phải là cộng đồng nhà phát triển nói chung. Điều đó có thể cho phép Google học hỏi từ các quy trình phòng thủ có rủi ro cao trong khi vẫn hạn chế quyền truy cập, kiểm soát lạm dụng và vòng phản hồi. Điều đó cũng có nghĩa là “đã thông báo” không có nghĩa là “có sẵn trong AI Studio, API Gemini hoặc APIMaster”. Nhà phát triển không nên sao chép mã nhận dạng được đoán như gemini-4-argon vào sản xuất và suy ra thành công từ nhãn lộ trình của bên thứ ba.

Kết quả điểm chuẩn: những gì Google đã công bố

Ảnh chụp màn hình so sánh thông báo liệt kê Argon bên cạnh GPT-6 Astra, Claude Fable 5.1 và Claude Opus 5.5. Các giá trị đại diện thể hiện trong bảng được công bố bao gồm:

Đánh giá Song Tử 4 Argon GPT-6 Astra Truyện ngụ ngôn Claude 5.1 Claude Opus 5.5
Công việc kiến ​​thức Vals Index 68,9% 63,1% 65,8% 67,0%
Tự động hóa 51,3% 41,4% 31,4% 42,5%
Đại lý tài chính Vals v2 65,4% 53,5% 58,9% 58,6%
Điểm chuẩn của Đại lý Hợp pháp của Harvey 19,6% 5,4% 6,7% 3,8%
DeepSWE v1.1 77,9% 74,1% 67,4% 74,2%
FrontierSWE v2 55,0% 65,5% 56,3% 62,3%
Ghế Mã Vibe 91,9% 89,6% 90,3% 90,3%
Băng ghế đầu cuối 4.0 57,4% 58,2% 57,9% 66,4%
CWE-băng ghế v1 68,0% 68,0% 58,0% 67,0%
Ảnh chụp màn hình do người dùng cung cấp hiển thị bài đăng GEEKPark có hình ảnh thông báo Google DeepMind và so sánh điểm chuẩn Gemini 4 Argon
Hình ảnh biên tập: ảnh chụp màn hình do người dùng cung cấp. Bài đăng hiển thị được cho là của GEEKPark và bao gồm hình ảnh về thông báo có mục đích của Google DeepMind; đây không phải là bản chụp gốc, được xác thực độc lập từ bài đăng X của Google. Hãy xác minh bài viết gốc và phương pháp trước khi coi điểm số là được xác thực độc lập.
Thế trận không hề thuận lợi cho Argon. Ảnh chụp màn hình cho thấy GPT-6 Astra dẫn đầu trên FrontierSWE v2 và OSWorld-2.0, trong khi Claude Opus 5.5 dẫn đầu Terminal-bench 4.0 và PostTrainBench. Đó là lý do tại sao dòng tiêu đề như “Argon thắng mọi điểm chuẩn” sẽ gây hiểu nhầm. Kết quả của Google hỗ trợ một kết luận cụ thể hơn: Argon có tính cạnh tranh hoặc đi trước trong nhiều đánh giá dài hạn, doanh nghiệp và công việc phòng thủ, trong khi các mô hình khác vẫn mạnh hơn trong các nhiệm vụ sử dụng máy tính, mã hóa và sau đào tạo được chọn.
Bình luận độc lập đã được chia. Phân tích nhân tạo mô tả Argon được gắn với GPT-6 Astra trên Chỉ số thông minh của nó và nêu bật tỷ lệ ảo giác thấp hơn cũng như hành vi của tác nhân được cải thiện. Các nhà nghiên cứu khác đặt câu hỏi bao nhiêu trong số điểm đó đến từ hành vi từ chối, trọng số điểm chuẩn và phương pháp luận vẫn đang thay đổi. Hãy coi những tuyên bố đó là phân tích bên ngoài chứ không phải là sự thay thế cho các định nghĩa điểm chuẩn chính.

Ai đã công bố Argon trên X?

Cuộc trò chuyện ra mắt tập trung xung quanh một nhóm nhỏ tài khoản phân tích và chính thức:

  • Google DeepMind đã công bố Argon và mô hình truy cập đầu tiên của Fairwind.
  • Google nhấn mạnh đến mức trần sản lượng một triệu mã thông báo và kết quả biên giới.
  • Sundar Pichai giải thích lý do Google chia sẻ thông báo sớm và nhấn mạnh việc sử dụng nội bộ, các biện pháp bảo vệ an toàn và quyền truy cập theo giai đoạn.
  • Logan Kilpatrick đã thảo luận về mức giá giới thiệu $2 / $10 được báo cáo và kế hoạch mở rộng quyền truy cập.
  • Artificial Analysis đã công bố một bài so sánh độc lập và bình luận về Chỉ số Thông minh. Phản hồi định kỳ của nhà phát triển rất đơn giản: điểm chuẩn có vẻ hấp dẫn, nhưng hầu hết các nhà phát triển vẫn chưa thể gọi Argon. Các câu hỏi thực tế là khi API trả phí mở ra, liệu Google AI Ultra có nhận được quyền truy cập hay không, công việc có hàng triệu mã thông báo ổn định như thế nào và liệu giá giới thiệu có còn tồn tại hay không.

Những mô hình Song Tử nào mà các nhà phát triển có thể sử dụng ngày nay?

Song Tử 3.8 Flash

Gemini 3.8 Flash là tuyến Gemini mạnh nhất hiện có trên thị trường APIMaster. Đây là một lựa chọn thiết thực cho công việc văn bản có khối lượng lớn, trợ lý mã hóa, trích xuất có cấu trúc và quy trình làm việc đa phương thức, trong đó mô hình cấp Flash được phát hành quan trọng hơn vị trí biên giới của Argon. Mở thẻ Flash Gemini 3.8 trực tiếp để biết các nhà cung cấp hiện tại, tín hiệu sức khỏe và giá cả tuyến đường. Ảnh chụp nhanh thị trường hiện tại đã tìm thấy bảy tuyến đang hoạt động, với tuyến thấp nhất ở mức khoảng 0,2999 USD / 1,4993 USD cho mỗi 1 triệu mã thông báo đầu vào / đầu ra.

Song Tử 3.7 Flash và 3.6 Flash

Gemini 3.7 Flash và Gemini 3.6 Flash vẫn là những lựa chọn dự phòng hữu ích khi khối lượng công việc cần nhiều kênh, hồ sơ dung lượng cụ thể hoặc phiên bản mô hình đã được ứng dụng thử nghiệm. Ảnh chụp nhanh tìm thấy bảy tuyến 3,7 đang hoạt động và bốn tuyến 3,6 đang hoạt động. Đây không phải là chất thay thế Argon trong các tuyên bố về khả năng. Chúng có sẵn các tùy chọn Gemini để xây dựng tích hợp, thu thập đường cơ sở của khối lượng công việc và chuẩn bị chuyển đổi mô hình được kiểm soát sau này.

Các lựa chọn thay thế biên giới khác trên APIMaster

Nếu nhiệm vụ của bạn hiện có sẵn thay vì chờ Argon, APIMaster cũng hiển thị các tuyến hoạt động cho GPT-6 Astra, Claude Fable 5.1 và Claude Opus 5.5. Bảng trên sử dụng cùng một ảnh chụp nhanh thị trường cho cả ba, do đó, việc so sánh sẽ tách biệt giá tham chiếu chính thức với lộ trình APIMaster hoạt động thấp nhất. Sự lựa chọn đúng đắn phụ thuộc vào khối lượng công việc:

Khối lượng công việc Bắt đầu với Tại sao
Vòng lặp tác nhân mã hóa lớn Gemini 3.8 Flash hoặc GPT-6 Astra So sánh việc hoàn thành kho lưu trữ, lượt sửa chữa và độ tin cậy của lệnh gọi công cụ.
Phân tích pháp lý và doanh nghiệp Claude Opus 5.5 hoặc Truyện ngụ ngôn 5.1 Đo lường chất lượng trích dẫn, theo dõi ràng buộc và hành vi từ chối.
Tích hợp Gemini khối lượng lớn Song Tử 3.7 Flash hoặc 3.8 Flash Giữ cho nhà cung cấp và hình dạng API ổn định trong khi quyền truy cập Argon bị hạn chế.
Nghiên cứu an ninh-quốc phòng Một mô hình hiện đã được phát hành với các công cụ đã được phê duyệt Không gửi dữ liệu nhạy cảm đến tuyến đường Argon chưa được xác minh.

Cách chuẩn bị cho API Argon

Không xây dựng mã sản xuất xung quanh điểm cuối chưa được xác nhận. Thay vì:

  1. Luôn cập nhật các lời nhắc, công cụ, đồ đạc đầu vào và tiêu chí chấm điểm.
  2. Thiết lập đường cơ sở với lộ trình Song Tử đã phát hành và ít nhất một lộ trình thay thế không phải Song Tử.
  3. Ghi lại chất lượng đầu ra được chấp nhận, thành công của cuộc gọi công cụ, độ trễ, số lần thử lại, mức sử dụng mã thông báo và chi phí.
  4. Khi Google xuất bản tài liệu API Argon, hãy kiểm tra ID mẫu chính xác trong một môi trường riêng biệt.
  5. Chỉ quảng cáo nó sau khi thẻ mẫu, giới hạn, chính sách an toàn và hành vi thanh toán được xác minh. Yêu cầu tối thiểu tương thích với OpenAI thông qua APIMaster trông như thế này sau khi bạn chọn mô hình đã phát hành:
curl "$API_BASE/v1/chat/completions" \
  -H "Authorization: Bearer $APIMASTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.8-flash",
    "messages": [{"role": "user", "content": "Summarize this repository plan."}]
  }'

Tạo tài khoản APIMaster, thêm khóa trong console, sử dụng API base và chọn một mẫu xuất hiện trên thị trường trực tiếp. Không thay thế gemini-3.8-flash bằng gemini-4-argon cho đến khi Google và danh mục tuyến đường xác nhận mã nhận dạng đó.

Điểm mấu chốt

Gemini 4 Argon là một thông báo quan trọng vì nó nhắm đến phần biên giới nơi chất lượng mô hình được đo lường bằng cách hoàn thành các quy trình làm việc dài và lộn xộn thay vì trả lời một lời nhắc. Bảng được công bố của Google trình bày kết quả mạnh mẽ về đánh giá công việc tri thức, đại lý pháp lý, kỹ thuật phần mềm và an ninh mạng, đồng thời mức trần sản lượng một triệu mã thông báo được báo cáo là tham vọng bất thường. Nhưng việc ra mắt được dàn dựng một cách có chủ ý. Kể từ ngày 1 tháng 10 năm 2026, Argon không phải là API Gemini có sẵn rộng rãi hoặc lộ trình APIMaster đã được xác nhận. Hành động hữu ích hôm nay là đánh giá khối lượng công việc thực tế của bạn trên lộ trình Gemini đã phát hành—đặc biệt là Gemini 3.8 Flash—hoặc trên một kênh biên giới đang hoạt động khác, sau đó giữ cho khai thác đánh giá sẵn sàng cho API công khai cuối cùng của Argon.

Câu hỏi thường gặp

Gemini 4 Argon có sẵn thông qua API Gemini không?

Không nói chung. Google đã công bố Argon vào ngày 30 tháng 9 năm 2026 và mô tả quyền truy cập ban đầu thông qua Fairwind dành cho những người bảo vệ mạng đáng tin cậy. Việc ra mắt API trả phí rộng rãi chưa được xác nhận trong thông tin công khai được đề cập ở đây.

Tôi có thể sử dụng Gemini 4 Argon thông qua APIMaster không?

Không có lộ trình APIMaster Argon nào được xác nhận kể từ ngày 1 tháng 10 năm 2026. Hãy sử dụng mô hình đã phát hành được hiển thị trên thị trường trực tiếp, chẳng hạn như gemini-3.8-flash và kiểm tra thẻ mô hình trước khi tích hợp.

Gemini 4 Argon giá bao nhiêu?

Giá giới thiệu được báo cáo là 2 USD cho mỗi 1 triệu mã thông báo đầu vào và 10 USD cho mỗi 1 triệu mã thông báo đầu ra, với đầu vào được lưu vào bộ nhớ đệm được báo cáo là gần 0,10 USD. Mức giá $4 / $20 sau đó cũng đã được báo cáo. Hãy coi cả hai là báo cáo khởi chạy cho đến khi trang định giá API công khai của Google xuất bản hợp đồng cuối cùng.

Bối cảnh hoặc giới hạn đầu ra của Argon là gì?

Tài liệu khởi chạy làm nổi bật tới 1 triệu mã thông báo đầu ra trong một phản hồi. Nhà phát triển vẫn cần xác minh giới hạn ngữ cảnh, giới hạn tốc độ, độ trễ, hành vi cắt ngắn và thanh toán trong tài liệu API cuối cùng.

Argon có đánh bại GPT-6 Astra và Claude Opus 5.5 ở mọi nơi không?

Không. So sánh của Google cho thấy Argon dẫn đầu hoặc cạnh tranh trên nhiều đánh giá được liệt kê, nhưng GPT-6 Astra và Claude Opus 5.5 dẫn đầu các nhiệm vụ mã hóa, sử dụng máy tính và sau đào tạo được chọn. Phương pháp chuẩn và khối lượng công việc phù hợp với vấn đề.

Hôm nay tôi nên sử dụng mô hình Song Tử nào?

Bắt đầu với lộ trình Gemini đã phát hành phù hợp với khối lượng công việc của bạn và xuất hiện trong danh mục trực tiếp. Ảnh chụp nhanh ngày 1 tháng 10 năm 2026 đã tìm thấy các tuyến APIMaster đang hoạt động cho Gemini 3.8 Flash, Gemini 3.7 Flash và Gemini 3.6 Flash. Kiểm tra thẻ Flash Gemini 3.8 để biết giá hiện tại và tính khả dụng của nhà cung cấp.

Nguồn và ghi chú xác minh

  • [Google DeepMind trên XXXQPROTECT0QXZ — tài khoản thông báo chính được tham chiếu bởi ảnh chụp màn hình khởi chạy.
  • [Google trên HzXQPROTECT1QXZ — thông báo sản phẩm và đóng khung truy cập.
  • [Sundar Pichai trên XXXQPROTECT2QXZ — bối cảnh truy cập theo giai đoạn, sử dụng nội bộ và an toàn.
  • [Logan Kilpatrick trên XXXQPROTECT3QXZ — API Gemini và báo cáo cuộc thảo luận về giá giới thiệu.
  • [Phân tích nhân tạo trên XXXQPROTECT4QXZ — điểm chuẩn độc lập và bình luận Chỉ số thông minh.
  • Google DeepMind Gemini models — tài liệu tham khảo chính thức về mô hình-gia đình.
  • Tài liệu mô hình Google AI dành cho nhà phát triển — Tính khả dụng của mô hình API phải được kiểm tra tại đây khi Argon mở. Các số liệu điểm chuẩn và thông tin chi tiết về quyền truy cập Argon trong bài viết này được lấy từ tài liệu ra mắt và tách biệt rõ ràng với ảnh chụp nhanh thị trường APIMaster trực tiếp. Kiểm tra lại cả hai trước khi đưa ra quyết định sản xuất.