Google ra mắt Gemini 3.8 Flash: 'Ngựa thồ' cho tác tử AI và 'song sinh' an ninh mạng Flash Cyber
Google vừa công bố hai phiên bản mới của dòng mô hình Flash: Gemini 3.8 Flash dành cho các tác tử AI, phát triển phần mềm và suy luận đa bước, cùng Gemini 3.8 Flash Cyber được tối ưu để phát hiện và vá lỗ hổng bảo mật. Mô hình này có giá rẻ hơn nhiều so với các đối thủ nhưng đạt hiệu suất vượt trội trên nhiều chuẩn đánh giá, đặc biệt là trong lĩnh vực an ninh mạng khi đã giúp Google vá các lỗ hổng Chrome và phát hiện một lỗi tồn tại 13 năm trong Chromium.

Google tiếp tục "bơm" ra các mô hình Flash mới với tốc độ chóng mặt. Mới đây, hãng đã công bố hai phiên bản của Gemini 3.8 Flash: một bản tiêu chuẩn được ví như "ngựa thồ" cho các tác tử AI, phát triển phần mềm và suy luận đa bước, và một bản đặc biệt mang tên Flash Cyber được tối ưu cho việc phát hiện và xử lý lỗ hổng bảo mật. Đây là lần phát hành Flash thứ ba chỉ trong vòng sáu tuần của Google, cho thấy tham vọng thống trị phân khúc mô hình nhẹ nhưng mạnh mẽ.
Gemini 3.8 Flash: Làm việc "chăm chỉ" hơn với "sự tỉ mỉ" cao hơn
Giám đốc điều hành Google Sundar Pichai cho biết trên X rằng 3.8 Flash mang đến những "bước nhảy vọt đáng kể" so với phiên bản 3.7 Flash trước đó về kỹ thuật phần mềm, tác vụ tác tử và suy luận đa bước. Điểm đáng chú ý là mô hình này vượt qua nhiều mô hình frontier lớn khác trên chuẩn đánh giá lập trình DeepSWE, nhưng với chi phí thấp hơn nhiều lần.
Hiệu suất vượt trội với chi phí thấp: Gemini 3.8 Flash hiện đã có mặt trên Gemini Enterprise và các nhà phát triển có thể dùng thử qua Gemini API, Google AI Studio, Google Antigravity hoặc Android Studio. Giá của nó được giữ nguyên ở mức $0.75 cho mỗi triệu token đầu vào và $3.75 cho mỗi triệu token đầu ra — tương đương với mức giá giới thiệu của Gemini 3.7 Flash.
Theo đại diện Google, 3.8 Flash "làm việc chăm chỉ hơn" và thể hiện "sự tỉ mỉ cao hơn" trong các tác vụ phức tạp như thực hiện các bước suy luận bổ sung. Mô hình có cửa sổ đầu vào lên tới 1 triệu token và giới hạn đầu ra 64.000 token, đồng thời có thể xử lý văn bản, hình ảnh, âm thanh, video và file PDF.
Kết quả ấn tượng trên nhiều chuẩn đánh giá: Gemini 3.8 Flash không chỉ giỏi lập trình mà còn thể hiện tốt trong các lĩnh vực chuyên môn như tài chính và luật. Cụ thể, mô hình này vượt qua người tiền nhiệm trên chuẩn Vals Finance Agent V2 và Harvey's Legal Agent Benchmark. Trên chuẩn HLE-Verified, mô hình đạt 54,9%, phản ánh khả năng suy luận đa bước mạnh mẽ trong toán học, khoa học và nhân văn.
Theo Arena.ai, 3.8 Flash đạt vị trí thứ 14 trên Agent Arena, vượt qua DeepSeek-V4-Pro và thể hiện sự nhảy vọt đáng kể so với Gemini 3.7 Flash (đang đứng ở vị trí 32). Mô hình cũng debut ở vị trí thứ 7 trên Text Arena, đứng trước cả Claude Opus 5.
Google nhấn mạnh rằng 3.8 Flash cho phép người dùng tùy chỉnh mức độ "nỗ lực" của mô hình dựa trên nhu cầu về chất lượng, chi phí và độ trễ. Khi cần tối ưu hiệu suất tính toán, người dùng có thể điều chỉnh để giảm token tiêu tốn hoặc tiếp tục dùng 3.7 Flash.
Gemini 3.8 Flash Cyber: Vũ khí mới cho "cuộc chiến" an ninh mạng
Bên cạnh bản Flash tiêu chuẩn, Google còn giới thiệu Gemini 3.8 Flash Cyber — mô hình an ninh mạng "mạnh mẽ nhất" của hãng. Theo Sundar Pichai, mô hình này đạt hiệu suất ngang tầm frontier trong việc phát hiện và vá lỗ hổng ở quy mô lớn, với 86,2% trên chuẩn CyberGym và 47,2% trên CWE-Bench (đánh giá khả năng vá lỗi bằng AI). Trong chuẩn nội bộ của Google, mô hình đạt tỷ lệ thành công hơn 70% khi phát hiện lỗ hổng trên 20 ngôn ngữ lập trình.
Chỉ dành cho "người bảo vệ" đáng tin cậy: Flash Cyber ban đầu chỉ được cung cấp cho "những người bảo vệ đáng tin cậy" thông qua Chương trình Fairwind của Google, ưu tiên các cơ quan chính phủ, đơn vị vận hành hạ tầng trọng yếu và các đối tác khác có nhu cầu phòng thủ mạng tiên tiến. Lý do là mô hình này được trang bị các biện pháp giảm thiểu an toàn "thoáng" hơn cho các nhiệm vụ an ninh mạng, đồng thời có các cơ chế ngăn chặn lạm dụng trong tấn công mạng và các lĩnh vực nhạy cảm như hóa học, sinh học, phóng xạ và hạt nhân (CBRN).
Thành tích thực tế đã được kiểm chứng: Google cho biết đang sử dụng 3.8 Flash Cyber để bảo vệ mã nguồn của chính mình. Mô hình này đã tạo ra số bản vá chính xác cho các lỗ hổng Chrome cao gấp 2,6 lần so với các mô hình thương mại lớn hơn nhiều. Trong một thử nghiệm nội bộ của Wiz (công ty Google mua lại với giá 32 tỷ USD), Flash Cyber có độ chính xác nhớ lại (recall) các lỗ hổng thực tế cao hơn từ 7,5% đến 9,7% nhưng chi phí thấp hơn từ 2,3 đến 5,2 lần so với các mô hình frontier hàng đầu.
"Trong an ninh mạng, kẻ tấn công chỉ cần tìm một lỗ hổng đáng kể trong hàng triệu dòng mã. Còn người phòng thủ phải loại bỏ tất cả các lỗ hổng đó để có thể chống lại kẻ tấn công," Raluca Ada Popa, trưởng nhóm bảo mật Gemini, chia sẻ.
Một trong những phát hiện thú vị nhất là Flash Cyber đã tìm ra một lỗ hổng tồn tại trong Chromium và Chrome suốt 13 năm — một lỗi rất tinh vi mà hàng chục, thậm chí hàng trăm kỹ sư đã xem xét nhưng không ai phát hiện ra. Doug Turner, giám đốc kỹ thuật Chrome, mô tả tình trạng "ngày tận thế lỗ hổng" hiện nay khi các mô hình AI tạo sinh đang khiến số lượng lỗ hổng bảo mật được báo cáo tăng vọt theo cấp số nhân.
Google khẳng định mục tiêu của họ là trang bị cho người phòng thủ khả năng ngang tầm chuyên gia để tạo lợi thế trước các tác nhân đe dọa — dù là tin tặc, tác tử AI độc hại hay hacker con người. Công ty nhấn mạnh: "Chúng tôi đã đầu tư vào việc sửa lỗ hổng ngay từ đầu và ưu tiên điều này hơn các khả năng tấn công như khai thác lỗ hổng."
Gemini 3.8 Flash Cyber hiện có thể được các tổ chức đăng ký truy cập thông qua Chương trình Fairwind, hứa hẹn trở thành công cụ đắc lực giúp các đội ngũ bảo mật vốn đang quá tải có thể quét mã nguồn quy mô lớn một cách hiệu quả và kinh tế hơn.