Google ra mắt Gemini 3.8 Flash: 'Làm việc chăm chỉ hơn' nhưng có thể tốn kém hơn

Công nghệ02 tháng 9, 2026·3 phút đọc

Google vừa công bố mô hình Gemini 3.8 Flash, hứa hẹn 'làm việc chăm chỉ hơn' nhờ tăng cường lý luận và gọi công cụ lặp lại, vượt trội trong các chuẩn đo lường lập trình và tác tử AI. Tuy nhiên, dù giá mỗi token không đổi, mô hình này có thể tiêu tốn nhiều token hơn, dẫn đến chi phí thực tế tăng tới 40% so với phiên bản tiền nhiệm.

Google ra mắt Gemini 3.8 Flash: 'Làm việc chăm chỉ hơn' nhưng có thể tốn kém hơn

Google vừa chính thức phát hành Gemini 3.8 Flash, chỉ vài tuần sau khi ra mắt phiên bản tiền nhiệm 3.7 Flash. Theo hãng, mô hình mới này được thiết kế để "làm việc chăm chỉ hơn" bằng cách thực hiện nhiều bước lý luận hơn cho các tác vụ phức tạp và "gọi công cụ một cách lặp lại" nhằm nâng cao hiệu suất tổng thể.

Điểm đáng chú ý là mặc dù mức giá khởi điểm cho mỗi token được giữ nguyên, nhưng chi phí thực tế cho người dùng có thể sẽ tăng lên. Google cảnh báo rằng "mô hình có thể sử dụng nhiều token hơn để tối đa hóa hiệu suất, đặc biệt là ở các mức độ nỗ lực (effort levels) cao hơn". Điều này đồng nghĩa với việc các nhà phát triển muốn tối ưu chi phí có thể cân nhắc tiếp tục sử dụng Gemini 3.7 Flash.

Hình ảnh minh họa về mô hình Google GeminiHình ảnh minh họa về mô hình Google Gemini

Hiệu năng vượt trội nhưng chi phí tiềm ẩn

Ngay sau khi ra mắt, Gemini 3.8 Flash đã nhận được những đánh giá tích cực từ cộng đồng công nghệ. Tổ chức nghiên cứu Artificial Analysis đánh giá đây là mô hình "rẻ nhất mà chúng tôi từng đo được ở mức độ thông minh này". Tuy nhiên, họ cũng chỉ ra rằng chi phí thực tế đã tăng khoảng 40% so với Gemini 3.7 Flash, nguyên nhân đến từ việc số token đầu ra cho mỗi tác vụ tăng 30% và có nhiều lượt tương tác hơn trong các bài đánh giá tác tử (agentic evaluations).

"Gemini 3.8 Flash mang lại chất lượng mã nguồn như Opus 5 của Anthropic nhưng với chi phí chỉ bằng một phần nhỏ và tốc độ cực nhanh. Điều này sẽ rất tuyệt vời cho những thứ như tạo video remotion." - John Ennis, CEO của Aigora.ai, nhận xét.

Đột phá trong lập trình và tác tử AI

Theo công bố, Gemini 3.8 Flash mang đến những "cải tiến đáng kể" cho kỹ thuật phần mềm và các tác tử AI tự động. Mô hình này đã vượt qua người tiền nhiệm cũng như nhiều mô hình tiên tiến khác trên chuẩn đo lường lập trình phần mềm DeepSWE v1.1, bao gồm cả mô hình Fable 5 của Anthropic – vốn mới được nâng cấp với lời hứa về hiệu năng mạnh mẽ hơn và giá thấp hơn.

Ngoài ra, Gemini 3.8 Flash cũng thể hiện sự vượt trội trên chuẩn đo lường Vals Finance Agent V2 và chuẩn Legal Agent của Harvey. Tuy nhiên, để đảm bảo an toàn, Google cho biết mô hình mới đi kèm "các biện pháp bảo vệ chống lại việc sử dụng sai mục đích trong các lĩnh vực Hóa học, Sinh học, Phóng xạ và Hạt nhân (CBRN) cũng như tấn công mạng".

Phiên bản Cyber và Chương trình Fairwind

Đi kèm với Gemini 3.8 Flash, Google cũng giới thiệu phiên bản Gemini 3.8 Flash Cyber dành riêng cho Chương trình Fairwind mới. Chương trình này chỉ giới hạn cho các chính phủ và "đối tác đáng tin cậy", với 650 thành viên bao gồm cả CrowdStrike và Trung tâm An ninh Mạng (Center for Internet Security). Người tham gia sẽ được tiếp cận với 3.8 Flash Cyber và tác tử CodeMender, công cụ mà Google tuyên bố có thể "tự động tìm và sửa các lỗ hổng bảo mật, bảo vệ cơ sở hạ tầng quan trọng, dịch vụ công và an ninh quốc gia".

Gemini 3.8 Flash hiện đã có mặt cho người dùng phổ thông với gói đăng ký Google AI Pro hoặc Ultra, cũng như cho các nhà phát triển và doanh nghiệp. Với bối cảnh phát triển AI tại Việt Nam đang ngày càng sôi động, việc sở hữu một mô hình có chi phí thấp nhưng hiệu năng cao như Gemini 3.8 Flash sẽ là lựa chọn đáng cân nhắc cho các lập trình viên và doanh nghiệp công nghệ trong nước muốn ứng dụng AI vào sản phẩm thực tế.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗