Google đã phát hành Gemini 3.8 Flash vào thứ Tư, cùng với một biến thể tập trung vào an ninh mạng mới có tên Gemini 3.8 Flash Cyber, khiến đây là mẫu Flash thứ ba ra mắt sau sáu tuần. Thông báo, được xuất bản trên blog chính thức của Google, được đưa ra vài ngày sau khi có báo cáo rằng công ty đang chuẩn bị phát hành và đi kèm với các tuyên bố chuẩn mực giúp đưa mô hình ngân sách vào khoảng cách vượt trội so với các đối thủ có giá mỗi mã thông báo cao hơn nhiều lần.
Nhịp điệu nhanh chóng là câu chuyện trong câu chuyện. Google đã xuất xưởng Gemini 3.7 Flash khoảng ba tuần trước và 3.8 Flash hiện đã thay thế nó thành mô hình phù hợp mặc định của công ty. Trong khi đó, Google đã không phát hành mẫu Gemini Pro cấp cao nhất kể từ đầu năm 2026 và mẫu Gemini 3.5 Pro được hứa hẹn từ lâu vẫn rõ ràng là vắng bóng. Để biết thêm bối cảnh về câu chuyện này, hãy xem bài viết những phát triển AI mới nhất của chúng tôi.
##Hai mô hình, một nền tảng
Gemini 3.8 Flash có hai phiên bản. Mô hình tiêu chuẩn được định vị là một hệ thống lập luận và mã hóa có mục đích chung cho các tác vụ tác nhân, phát triển phần mềm và các ứng dụng có khối lượng lớn. Gemini 3.8 Flash Cyber chạy trên cùng một nền tảng nhưng được điều chỉnh đặc biệt để phát hiện và giảm thiểu lỗ hổng bảo mật, thay thế cho Flash Cyber 3.5 trước đó.
Theo số liệu được công bố của Google, Gemini 3.8 Flash đạt 73,7% trên DeepSWE v1.1, một chuẩn mực đo lường các tác vụ kỹ thuật phần mềm có tầm nhìn dài hạn. Điều đó đặt nó ngay dưới Claude Opus 5 ở mức 74,0% và trước GPT-5.6 Sol của OpenAI ở mức 72,7% và Claude Sonnet 5 ở mức 53,8%. Gemini 3.7 Flash trước đó đạt 65,3% trên cùng điểm chuẩn, nghĩa là phần lớn lợi ích của phiên bản này tập trung vào mã hóa.
Theo dữ liệu của nền tảng, nền tảng đo điểm chuẩn độc lập Phân tích nhân tạo mang lại cho mô hình mới điểm Chỉ số thông minh là 59, cao hơn ba điểm so với 56 của phiên bản tiền nhiệm. Điều đó liên kết nó với GPT-5.6 Sol ở nỗ lực lý luận cao và Grok 4,6 ở lý luận trung bình, theo dữ liệu của nền tảng, với lợi ích chủ yếu đạt được nhờ các điểm chuẩn tác nhân như sử dụng công cụ và mã hóa.
Định giá linh hoạt, có cơ hội nắm bắt
Google sẽ tung ra mô hình này với mức giá giới thiệu là 0,75 USD trên một triệu mã thông báo đầu vào và 3,75 USD trên một triệu mã thông báo đầu ra, khớp với mức giá của 3,7 Flash cho đến cuối năm. Từ tháng 1 năm 2027, giá thông thường tăng gấp đôi lần lượt lên 1,50 USD và 7,50 USD. Sự so sánh với các đối thủ vẫn còn rõ ràng ngay cả khi đó: Claude Opus 5 có giá 5,00 USD cho mỗi triệu mã thông báo đầu vào và 25,00 USD cho mỗi triệu mã thông báo đầu ra, trong khi GPT-5.6 Sol ở mức 4,00 USD và 20,00 USD.
Có một điểm đáng chú ý đối với các nhóm nhạy cảm với chi phí. Google cho rằng một phần của bước nhảy vọt về hiệu suất là do mô hình chạy các bước lý luận bổ sung đối với các tác vụ phức tạp và gọi các công cụ lặp đi lặp lại - theo cách nói của công ty, mô hình "làm việc chăm chỉ hơn". Điều đó dẫn đến mức tiêu thụ mã thông báo cao hơn. Phân tích nhân tạo chốt chi phí cho mỗi nhiệm vụ đã hoàn thành ở mức 0,58 USD, tăng khoảng 40% so với 0,40 USD của 3,7 Flash, mặc dù giá mỗi mã thông báo không thay đổi. Bản thân Google khuyến nghị các nhà phát triển có ngân sách tính toán eo hẹp nên hạ thấp mức lý luận hoặc duy trì phiên bản 3.7 Flash, phiên bản vẫn được hỗ trợ.
Flash Cyber nhắm tới các hoạt động bảo mật
Biến thể Cyber là một nửa khác thường hơn của bản phát hành. Theo Google, thử nghiệm nội bộ cho thấy Gemini 3.8 Flash Cyber xác định được nhiều lỗ hổng hơn và tạo ra các bản vá hoạt động thường xuyên hơn so với phiên bản tiền nhiệm. Nhóm bảo mật Chrome của Google đã báo cáo độ chính xác của bản vá tăng gấp 2,6 lần trong quá trình sử dụng nội bộ và công ty cho biết nhóm Đám mây của họ đã sử dụng mô hình này để phát hiện lỗ hổng nghiêm trọng trong vòng hai giờ. Google cũng trích dẫn chứng thực từ các đối tác bảo mật Wiz và Palo Alto Networks.
Tuy nhiên, quyền truy cập bị hạn chế. Mặc dù Flash 3.8 tiêu chuẩn đã được cung cấp rộng rãi bắt đầu từ hôm nay, nhưng Flash Cyber hiện chỉ giới hạn cho những người thử nghiệm và chính phủ đáng tin cậy.
Câu hỏi về mô hình biên giới còn thiếu
Việc ra mắt khiến chiến lược phát hành của Google bị chú ý một cách khó chịu. Ars Technica lưu ý rằng Google đã không xuất xưởng mẫu Gemini Pro cao cấp nhất kể từ đầu năm 2026 và báo cáo hồi đầu năm nay cho thấy việc phát hành Gemini 3.5 Pro đã bị trì hoãn sau khi hiệu suất mã hóa của nó không sánh được với các đối thủ cạnh tranh. Phạm vi đưa tin của Bộ giải mã về buổi ra mắt coi nhịp Flash nhanh như một dấu hiệu của động lực kỹ thuật hoặc sự phân tâm khỏi chiếc hạm vẫn còn thiếu, tùy thuộc vào người bạn yêu cầu.
Koray Kavukcuoglu, người đảm nhận vị trí lãnh đạo Google DeepMind, đã bác bỏ khuôn khổ trong tài liệu ra mắt, nói rằng Google không chỉ theo đuổi hiệu suất giá cả và vẫn có ý định dẫn đầu về năng lực thô. Nếu các con số điểm chuẩn nằm ngoài những đánh giá của chính Google, thì công ty có thể đã tự mua được thời gian: ngay cả cấp Flash ngân sách của họ hiện đang cạnh tranh với các công ty dẫn đầu thị trường về mã hóa, khả năng mà các doanh nghiệp hiện quan tâm nhất.
Không phải mọi thứ đều được cải thiện. Trên OSWorld-2.0, một chuẩn mực về việc sử dụng máy tính tác nhân, 3.8 Flash tốt hơn phiên bản trước nhưng vẫn kém Claude Opus một khoảng cách lớn, theo biểu đồ của chính Google.
Sẵn có
Gemini 3.8 Flash có sẵn ngay lập tức thông qua Google AI Studio, công cụ mã hóa tác nhân chống trọng lực và Android Studio dành cho nhà phát triển, với các doanh nghiệp có quyền truy cập thông qua Gemini Enterprise. Người tiêu dùng có thể sử dụng nó trong ứng dụng Gemini, nơi ứng dụng này yêu cầu đăng ký Pro hoặc Ultra, trong Chế độ AI trong Google Tìm kiếm và đối với những người đăng ký trả phí, trong Google Trang tính. Vẫn có thể thử nghiệm miễn phí thông qua AI Studio.
Google cũng nhấn mạnh thế hệ 3D được cải tiến của mô hình, hiển thị một trò chơi 3D được cho là được xây dựng từ một lời nhắc duy nhất trong AntiGravity, với kết cấu được tạo bởi mô hình hình ảnh Nano Banana của công ty.
Toán học cạnh tranh rất đơn giản. Ba phòng thí nghiệm lớn hiện đã xuất xưởng các mô hình mã hóa hàng đầu cách nhau vài tuần và sự gia nhập của Google đã hạ giá các đối thủ của mình theo hệ số từ năm đến bảy trong khi tuyên bố hiệu suất mã hóa tương đương. Trải nghiệm của nhà phát triển trong thế giới thực có phù hợp với tiêu chuẩn hay không sẽ quyết định liệu bản phát hành này có làm dịu đi những lời chỉ trích về chiếc hạm bị thiếu của Google hay chỉ trì hoãn nó.
---
Đi trước AINhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.
Đọc thêm tin tức về AI →