Google ra mắt Gemini 3.8 Flash: 'Làm việc chăm chỉ hơn' nhưng có thể tốn kém hơn
Google vừa công bố mô hình Gemini 3.8 Flash, hứa hẹn 'làm việc chăm chỉ hơn' nhờ tăng cường lý luận và gọi công cụ lặp lại, vượt trội trong các chuẩn đo lường lập trình và tác tử AI. Tuy nhiên, dù giá mỗi token không đổi, mô hình này có thể tiêu tốn nhiều token hơn, dẫn đến chi phí thực tế tăng tới 40% so với phiên bản tiền nhiệm.

Google vừa chính thức phát hành Gemini 3.8 Flash, chỉ vài tuần sau khi ra mắt phiên bản tiền nhiệm 3.7 Flash. Theo hãng, mô hình mới này được thiết kế để "làm việc chăm chỉ hơn" bằng cách thực hiện nhiều bước lý luận hơn cho các tác vụ phức tạp và "gọi công cụ một cách lặp lại" nhằm nâng cao hiệu suất tổng thể.
Điểm đáng chú ý là mặc dù mức giá khởi điểm cho mỗi token được giữ nguyên, nhưng chi phí thực tế cho người dùng có thể sẽ tăng lên. Google cảnh báo rằng "mô hình có thể sử dụng nhiều token hơn để tối đa hóa hiệu suất, đặc biệt là ở các mức độ nỗ lực (effort levels) cao hơn". Điều này đồng nghĩa với việc các nhà phát triển muốn tối ưu chi phí có thể cân nhắc tiếp tục sử dụng Gemini 3.7 Flash.
Hình ảnh minh họa về mô hình Google Gemini
Hiệu năng vượt trội nhưng chi phí tiềm ẩn
Ngay sau khi ra mắt, Gemini 3.8 Flash đã nhận được những đánh giá tích cực từ cộng đồng công nghệ. Tổ chức nghiên cứu Artificial Analysis đánh giá đây là mô hình "rẻ nhất mà chúng tôi từng đo được ở mức độ thông minh này". Tuy nhiên, họ cũng chỉ ra rằng chi phí thực tế đã tăng khoảng 40% so với Gemini 3.7 Flash, nguyên nhân đến từ việc số token đầu ra cho mỗi tác vụ tăng 30% và có nhiều lượt tương tác hơn trong các bài đánh giá tác tử (agentic evaluations).
"Gemini 3.8 Flash mang lại chất lượng mã nguồn như Opus 5 của Anthropic nhưng với chi phí chỉ bằng một phần nhỏ và tốc độ cực nhanh. Điều này sẽ rất tuyệt vời cho những thứ như tạo video remotion." - John Ennis, CEO của Aigora.ai, nhận xét.
Đột phá trong lập trình và tác tử AI
Theo công bố, Gemini 3.8 Flash mang đến những "cải tiến đáng kể" cho kỹ thuật phần mềm và các tác tử AI tự động. Mô hình này đã vượt qua người tiền nhiệm cũng như nhiều mô hình tiên tiến khác trên chuẩn đo lường lập trình phần mềm DeepSWE v1.1, bao gồm cả mô hình Fable 5 của Anthropic – vốn mới được nâng cấp với lời hứa về hiệu năng mạnh mẽ hơn và giá thấp hơn.
Ngoài ra, Gemini 3.8 Flash cũng thể hiện sự vượt trội trên chuẩn đo lường Vals Finance Agent V2 và chuẩn Legal Agent của Harvey. Tuy nhiên, để đảm bảo an toàn, Google cho biết mô hình mới đi kèm "các biện pháp bảo vệ chống lại việc sử dụng sai mục đích trong các lĩnh vực Hóa học, Sinh học, Phóng xạ và Hạt nhân (CBRN) cũng như tấn công mạng".
Phiên bản Cyber và Chương trình Fairwind
Đi kèm với Gemini 3.8 Flash, Google cũng giới thiệu phiên bản Gemini 3.8 Flash Cyber dành riêng cho Chương trình Fairwind mới. Chương trình này chỉ giới hạn cho các chính phủ và "đối tác đáng tin cậy", với 650 thành viên bao gồm cả CrowdStrike và Trung tâm An ninh Mạng (Center for Internet Security). Người tham gia sẽ được tiếp cận với 3.8 Flash Cyber và tác tử CodeMender, công cụ mà Google tuyên bố có thể "tự động tìm và sửa các lỗ hổng bảo mật, bảo vệ cơ sở hạ tầng quan trọng, dịch vụ công và an ninh quốc gia".
Gemini 3.8 Flash hiện đã có mặt cho người dùng phổ thông với gói đăng ký Google AI Pro hoặc Ultra, cũng như cho các nhà phát triển và doanh nghiệp. Với bối cảnh phát triển AI tại Việt Nam đang ngày càng sôi động, việc sở hữu một mô hình có chi phí thấp nhưng hiệu năng cao như Gemini 3.8 Flash sẽ là lựa chọn đáng cân nhắc cho các lập trình viên và doanh nghiệp công nghệ trong nước muốn ứng dụng AI vào sản phẩm thực tế.
Bài viết liên quan

Công nghệ
Nộp đơn xin việc lẽ ra nên khó hơn. Thật đấy
25 tháng 8, 2026

Công nghệ
RonanRX (YC S26): Cá nhân hóa GLP-1 và peptide với quy trình khép kín từ sản xuất đến phân phối
02 tháng 9, 2026

Công nghệ
Sân khấu Builders tại TechCrunch Disrupt 2026: Chiến lược thực chiến để mở rộng quy mô startup
02 tháng 9, 2026