Gemini 4 Argon (High) của Google: Chỉ số thông minh 53 điểm, giá 2 USD mỗi triệu token đầu vào
Google vừa ra mắt Gemini 4 Argon (High), mô hình lý luận đạt 53 điểm trên Chỉ số Thông minh của Artificial Analysis - cao gần gấp đôi mức trung vị 26 của các mô hình cùng phân khúc giá. Mô hình hỗ trợ đầu vào văn bản và hình ảnh, cửa sổ ngữ cảnh 1 triệu token, với mức giá 2 USD mỗi triệu token đầu vào và 10 USD mỗi triệu token đầu ra.
Google vừa chính thức bổ sung Gemini 4 Argon (High) vào danh mục mô hình AI của mình, đánh dấu một bước tiến mới trong cuộc đua mô hình lý luận (reasoning model) giữa các ông lớn công nghệ. Theo dữ liệu phân tích độc lập từ Artificial Analysis, mô hình này đạt 53 điểm trên Chỉ số Thông minh (Intelligence Index) phiên bản 4.3.2 — một con số được giới chuyên môn đánh giá là vượt trội so với mặt bằng chung.
Vị thế trên bảng xếp hạng
Với 53 điểm, Gemini 4 Argon (High) xếp thứ 8 trong tổng số 223 mô hình lý luận được Artificial Analysis đánh giá. Để so sánh, mức trung vị của các mô hình cùng phân khúc giá chỉ là 26 điểm — nghĩa là mô hình của Google đạt điểm số cao gần gấp đôi.
Chỉ số Thông minh phiên bản 4.3.2 là một thước đo tổng hợp gồm 10 bài đánh giá khác nhau, bao gồm:
- AA-Briefcase v1.1 — công việc tri thức dạng tác tử
- GDPval-AA v2.1 — tác vụ công việc thực tế
- AutomationBench-AA — quy trình làm việc SaaS tự động
- Terminal-Bench 4.0 — lập trình và sử dụng terminal
- SciCode — lập trình khoa học
- Humanity's Last Exam — lý luận và kiến thức chuyên sâu
- GDP.pdf — lý luận trên tài liệu chuyên nghiệp
- CritPt — lý luận vật lý
- AA-Omniscience — độ chính xác kiến thức và tỷ lệ ảo giác
- AA-LCR v1.1 — lý luận ngữ cảnh dài
Thông số kỹ thuật nổi bật
Gemini 4 Argon (High) là mô hình độc quyền (proprietary) của Google, ra mắt ngày 30/9/2026. Các thông số chính bao gồm:
- Đầu vào: hỗ trợ cả văn bản và hình ảnh
- Đầu ra: chỉ hỗ trợ văn bản
- Cửa sổ ngữ cảnh: 1 triệu token, tương đương khoảng 1.500 trang A4 cỡ chữ 12
- Khả năng đa phương thức: có, có thể phân tích và trả lời câu hỏi về hình ảnh
- Mô hình lý luận: có, sử dụng suy luận chuỗi dài trước khi đưa ra câu trả lời
Đáng chú ý, đây là phiên bản High của dòng Argon — tức là phiên bản lý luận chuyên sâu. Google có thể cũng phát hành một biến thể không lý luận (non-reasoning) song song.
Mô hình này đạt hiệu suất cao nhưng cũng khá "nói nhiều": khi chạy trên Chỉ số Thông minh, nó tạo ra tới 110 triệu token đầu ra, cao hơn đáng kể so với mức trung vị 82 triệu của các mô hình cùng phân khúc.
Chi phí sử dụng
Về giá cả, Gemini 4 Argon (High) được đánh giá là hợp lý so với các mô hình có mức thông minh tương đương:
- Token đầu vào: 2 USD mỗi triệu token (ngang mức trung vị thị trường)
- Token đầu ra: 10 USD mỗi triệu token (ngang mức trung vị thị trường)
- Giảm giá cache: lên tới 95% cho các prompt đã xử lý trước đó
- Chi phí trung bình mỗi tác vụ trên Chỉ số Thông minh: khoảng 1,99 USD
- Giá hỗn hợp (theo tỷ lệ 7:2:1 giữa cache hit/input/output): khoảng 1,47 USD mỗi triệu token
Mức chiết khấu cache 95% là điểm cộng đáng kể, đặc biệt với những ứng dụng có ngữ cảnh lặp lại như chatbot chăm sóc khách hàng hay hệ thống RAG (Retrieval Augmented Generation).
Ý nghĩa với người dùng Việt Nam
Với cửa sổ ngữ cảnh lên tới 1 triệu token, Gemini 4 Argon (High) mở ra nhiều khả năng ứng dụng thực tế cho các doanh nghiệp Việt Nam — từ phân tích tài liệu pháp lý dài, xử lý hợp đồng, đến xây dựng trợ lý ảo hiểu ngữ cảnh doanh nghiệp.
Tuy nhiên, chi phí 10 USD mỗi triệu token đầu ra vẫn là con số đáng cân nhắc với các startup trong nước. Lời khuyên là nên tận dụng tối đa cơ chế cache để giảm chi phí, đồng thời cân nhắc kỹ khối lượng token đầu ra — vốn là điểm yếu của mô hình này do xu hướng trả lời dài dòng.
So với các đối thủ như GPT series của OpenAI, Claude của Anthropic hay các mô hình từ DeepSeek, Z.AI, Gemini 4 Argon (High) đang cho thấy Google vẫn giữ được vị thế cạnh tranh ở phân khúc mô hình lý luận cao cấp — nơi yếu tố thông minh được đặt lên trên yếu tố tốc độ và chi phí.

