Site Logo
ctdohub
cong-nghe • 21 min read
0

Google Gemini 4 Argon: chỉ mở cho cyber defender trước

Đ
Đỗ Thành Xem hồ sơ → Xuất bản ngày October 1, 2026
Google Gemini 4 Argon: chỉ mở cho cyber defender trước
Xem ảnh phóng to

Ngày 30/9/2026 (giờ Mỹ), Google công bố Gemini 4 Argon - mẫu frontier mới của dòng Gemini 4. Công ty nói Argon mạnh ở phần mềm thực tế, công việc kiến thức doanh nghiệp (pháp lý, tài chính) và phòng thủ mạng, nhưng chưa mở rộng cho công chúng: giai đoạn đầu chỉ đưa cho nhóm "trusted cyber defenders" qua chương trình Fairwind. TechCrunch, The Verge và Reuters đều xếp đây là tin AI lớn ngay sau DevDay của OpenAI.

Argon là gì và ai được dùng trước?

Koray Kavukcuoglu - SVP Google DeepMind kiêm Chief AI Architect - mô tả Argon được xây để duy trì suy luận sâu trên các workflow dài, nhiều bước. Google đang tham gia quy trình tự nguyện của chính phủ Mỹ về truy cập mô hình trước khi phát hành công khai, và sẽ thu feedback từ tester trước khi mở rộng.

Theo blog chính thức, Argon sẽ ra mắt với giá giới thiệu khoảng $2 / 1 triệu token đầu vào và $10 / 1 triệu token đầu ra; token cache giảm ~95% giá input. Sau giai đoạn giới thiệu, mức giá áp dụng là $4 / $20 tương ứng. Google nói sẽ mở dần cho developer, doanh nghiệp và người dùng, bắt đầu từ khách API trả phí và thuê bao Google AI Ultra - chưa công bố ngày cụ thể.

Reuters dẫn phát ngôn viên Google: Argon lớn hơn dòng Pro trước đó; công ty so sánh nó với GPT-6 Astra (OpenAI) và Opus (Anthropic) trên một số benchmark coding và cyber. Cùng bài Reuters cũng ghi rõ Argon vẫn tụt hậu trên một số chỉ số khác, gồm hai trong bốn benchmark coding mà Google đưa vào thông cáo - nên đừng đọc chart marketing như "thắng tuyệt đối".

Gemini 3.5 Pro - từng được Sundar Pichai hẹn khoảng tháng 6 - sẽ không ra mắt nữa, theo Reuters.

Coding, kiến thức doanh nghiệp và multimodal

Google nói hàng nghìn nhân viên nội bộ đã dùng Argon cho debug hàng ngày, nghiên cứu sâu hơn và migration codebase lớn. Trên DeepSWE v1.1 (kỹ thuật phần mềm dài hạn), Google báo 77,9%. Trên Vals Index (tài chính, coding, pháp lý, thuế - trọng số theo đóng góp GDP Mỹ), Argon đứng đầu theo số liệu Google công bố; bảng Vals công khai ghi khoảng 68,90%.

AutomationBench của Zapier: Google đặt Argon #1 với 51,3%. LVBench (hiểu video dài): Google báo 91,7%.

Một số ví dụ nội bộ Google nêu: tối ưu thuật toán lượng tử (một case giảm ~40% "spacetime" so baseline đã công bố trong vài phút); agent Argon phân tích telemetry để tối ưu bộ nhớ data center (hơn 300 TiB đã giải phóng, ước tính tổng có thể tới 500 TiB–1 PiB); migration C/C++ sang Rust trên thư viện như re2, libgav1 và kernel Fuchsia Zircon (hàng trăm nghìn dòng), kèm audit và test trước khi lên production. Với libgav1, Google nói agent thay ~32K dòng SIMD bằng Rust an toàn hơn và nhanh hơn ~2,7× bản port Rust trước đó, output video giống hệt.

Argon cũng được nhấn mạnh khả năng đọc chart, video dài và chuỗi tài liệu - hữu ích khi kiến thức doanh nghiệp không chỉ là text thuần.

Google mở rộng giới hạn output token lên tới 1 triệu token (trước đó 64K theo blog) để mô hình có "đầu" suy nghĩ dài hơn trong một lượt.

Phòng thủ mạng: Fairwind và Wiz

Điểm khác biệt marketing rõ nhất là cybersecurity defense. Argon được huấn luyện để tự tìm, xác minh và vá lỗ hổng phần mềm nghiêm trọng. Với đối tác Fairwind và đội nội bộ Google, công ty sẽ mở Argon không kèm cyber guardrail để tận dụng đủ năng lực phòng thủ.

Wiz đã dùng Argon trong sáng kiến Scan for Good. Google kể một demo sớm: mô hình phát hiện lỗ hổng nghiêm trọng trên phần mềm y tế dùng ở nhiều bệnh viện toàn cầu - lộ dữ liệu cá nhân nhạy cảm - mà các mẫu frontier trước đó bỏ sót. Trên CWE-bench v1 (remediate lỗ hổng), Google báo Argon hòa hạng nhất với 68%. So với 3.8 Flash Cyber, Google nói Argon mạnh hơn trên benchmark lỗ hổng nội bộ (nhiều ngôn ngữ) và black-box pentest nội bộ của Wiz.

Straits Times / AFP nhấn mạnh lý do hạn chế truy cập: lo ngại hacker lợi dụng. Google nói Argon được thiết kế từ chối yêu cầu hỗ trợ tấn công mạng hoặc phát triển vũ khí hóa học / sinh học / hạt nhân, theo Frontier Safety Framework.

An toàn trước khi mở rộng

Trước khi mở rộng, Google nêu bốn hướng củng cố: chống misuse (kèm giám sát activation nội bộ), chống prompt injection gián tiếp (Google tự nhận dẫn đầu Gray Swan IPI), giám sát misalignment trên chain-of-thought và hành động để dừng khi vượt ý định user, và cứng hóa sandbox khi test agent. Bối cảnh: OpenAI từng công bố mô hình thoát môi trường test và xâm nhập Hugging Face; Anthropic cũng hạn chế Claude Mythos Preview với tổ chức tin cậy.

The Verge lưu ý Argon ra chỉ một ngày sau DevDay OpenAI (Dots, GPT-6.1 Sol) và ngay sau tuần Google hủy / hoãn lộ trình cũ - Kavukcuoglu mới nắm DeepMind từ tháng 8.

Ý nghĩa với người dùng Việt Nam

Hiện người dùng phổ thông và hầu hết developer **chưa** gọi được Argon. ChatGPT / Claude / Gemini Pro–Flash hiện tại vẫn là lựa chọn thực tế. Khi Google mở API và Ultra, team bảo mật, doanh nghiệp lớn và đối tác cyber sẽ là nhóm đầu tiên cần theo dõi benchmark độc lập (không chỉ chart Google) và chi phí token thực tế.

Tóm lại: Gemini 4 Argon là bước nâng cấp frontier rõ ràng của Google, đặt nặng phòng thủ mạng và workflow dài - nhưng "mạnh nhất" vẫn là tuyên bố tự báo cáo, và cửa công khai chưa mở.

Nguồn

  • https://blog.google/innovation-and-ai/models-and-research/gemini-models-gemini-4-argon/

  • https://techcrunch.com/2026/09/30/google-releases-gemini-4-argon-called-its-most-powerful-model-yet/

  • https://www.theverge.com/tech/1002980/google-gemini-4-argon

  • https://www.thestar.com.my/tech/tech-news/2026/10/01/google-announces-gemini-4-flagship-ai-model-after-months-of-delays (Reuters)

  • https://www.straitstimes.com/world/united-states/google-announces-gemini-4-flagship-ai-model-after-months-of-delays

  • https://www.vals.ai/models/google_gemini-4-argon

Thảo luận

0 ý kiến
Đang kiểm tra tài khoản...
Đang tải thảo luận...