Google đã giới thiệu bộ ba mô hình Gemini mới vào ngày 21 tháng 7 năm 2026, giúp tăng gấp đôi hiệu quả và tiết kiệm chi phí mà các nhà phát triển cần để xây dựng các tác nhân AI sản xuất trên quy mô lớn. Công ty đã ra mắt Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, mỗi phiên bản nhắm đến một phân khúc khác nhau trong bối cảnh mô hình AI ngày càng cạnh tranh. Để đưa tin toàn diện về những phát triển mới nhất trong tin nóng về AI, những bản phát hành này đánh dấu nỗ lực mạnh mẽ nhất của Google nhằm giành được thị trường nhà phát triển nhạy cảm với chi phí.

Thông báo này được đưa ra vào thời điểm quan trọng đối với gã khổng lồ tìm kiếm. Trong khi các đối thủ cạnh tranh như OpenAI và Anthropic đã thu hút sự chú ý bằng các mô hình hàng đầu của họ, thì dòng Flash của Google đã tạo ra một vị trí thích hợp cho các nhà phát triển cần vận hành các tác nhân AI một cách kinh tế và đáng tin cậy. Các mô hình mới thể hiện một bước tiến đáng kể cả về chất lượng và hiệu quả trong các quy trình làm việc tổng đài.

Gemini 3.6 Flash: Mô hình ngựa thồ mới

Gemini 3.6 Flash được định vị là mô hình đặc trưng của Google, được xây dựng trực tiếp dựa trên phản hồi từ các nhà phát triển sử dụng Flash 3.5 trước đó. Theo thông báo của Google, do Giám đốc cấp cao về quản lý sản phẩm Tulsee Doshi đưa ra, mô hình này mang lại cải tiến về mã hóa, công việc kiến ​​thức và hiệu suất đa phương thức đồng thời giảm đáng kể mức tiêu thụ mã thông báo.

Về Chỉ số phân tích nhân tạo, Gemini 3.6 Flash tiêu thụ mã thông báo đầu ra ít hơn 17% so với phiên bản tiền nhiệm. Trong một số điểm chuẩn, chẳng hạn như DeepSWE của Datacurve, mức giảm lên tới 65%. Mô hình cũng yêu cầu ít bước suy luận và lệnh gọi công cụ hơn để thực hiện quy trình làm việc nhiều bước.

Giá đã được đặt ở mức 1,50 đô la cho mỗi triệu mã thông báo đầu vào và 7,50 đô la cho mỗi triệu mã thông báo đầu ra, thấp hơn thế hệ trước. Điều này giúp các tác nhân xây dựng và vận hành trên quy mô lớn hiệu quả hơn về mặt chi phí, một yếu tố quan trọng đối với các doanh nghiệp triển khai AI trên hàng nghìn tác vụ đồng thời.

Cải tiến điểm chuẩn

Google đã báo cáo một số mức tăng hiệu suất đáng chú ý so với 3.5 Flash:

  • DeepSWE: 49% so với 37%, phản ánh độ chính xác cao hơn trong việc chỉnh sửa mã với ít chỉnh sửa không mong muốn hơn và giảm vòng lặp thực thi
  • MLE Bench: 63,9% so với 49,7%, một bước nhảy vọt đáng kể về khả năng nghiên cứu máy học
  • OSWorld-Được xác minh: 83,0% so với 78,4%, cho thấy khả năng sử dụng máy tính được cải thiện
  • GDPval-AA v2: 1421 so với 1349, phản ánh mức tăng trong các nhiệm vụ công việc tri thức

Việc sử dụng máy tính hiện có sẵn dưới dạng công cụ tích hợp phía máy khách thông qua API Gemini và Gemini Enterprise, loại bỏ nhu cầu về các lớp điều phối của bên thứ ba.

Gemini 3.5 Flash-Lite: Được xây dựng cho tốc độ và quy mô

Cùng với việc nâng cấp Flash, Google đã phát hành Gemini 3.5 Flash-Lite, được thiết kế cho các tác vụ có độ trễ thấp và khối lượng công việc có thông lượng cao như tìm kiếm tác nhân và xử lý tài liệu. Đây là mô hình nhanh nhất trong dòng 3.5, chạy ở tốc độ 350 mã thông báo đầu ra mỗi giây được đo bằng Phân tích nhân tạo.

Được định giá mạnh mẽ ở mức 0,30 USD trên một triệu mã thông báo đầu vào và 2,50 USD trên một triệu mã thông báo đầu ra, Flash-Lite cung cấp tỷ lệ giá trên hiệu suất hấp dẫn cho các nhà phát triển đang chạy lưu lượng sản xuất trên quy mô lớn. Google lưu ý rằng trong nhiều đánh giá tác nhân và mã hóa, mô hình này thậm chí còn hoạt động tốt hơn Gemini 3 Flash lớn hơn, bao gồm cả trên SWE-Bench Pro (54,2% so với 49,6%) và OSWorld-Được xác minh (74,0% so với 65,1%).

Mô hình này hỗ trợ các cấp độ tư duy có thể định cấu hình, cho phép các nhà phát triển ưu tiên thực thi có độ trễ thấp cho các tác vụ có khối lượng lớn hoặc thu hút các cấp độ tư duy cao hơn cho khối lượng công việc phức tạp gồm nhiều bước của tác nhân phụ.

Gemini 3.5 Flash Cyber: AI để bảo mật mã

Bản phát hành thứ ba, Gemini 3.5 Flash Cyber, là một mô hình chuyên biệt được tinh chỉnh để tìm và sửa các lỗ hổng an ninh mạng. Được xây dựng dựa trên Flash 3.5, nó được ghép nối với tác nhân CodeMender của Google, sử dụng nhiều tác nhân Flash Cyber ​​làm việc cùng nhau để tạo ra các báo cáo bảo mật kết hợp.

Trên tiêu chuẩn CyberGym, mô hình này đạt hiệu suất cạnh tranh ở mức cao nhất. Tuy nhiên, do tính chất sử dụng kép của công nghệ, Google đang thực hiện một cách tiếp cận thận trọng trong việc triển khai. Mô hình này sẽ được cung cấp độc quyền cho các chính phủ và đối tác đáng tin cậy thông qua CodeMender như một phần của chương trình thí điểm có quyền truy cập hạn chế.

Điều này giúp những người bảo vệ tuyến đầu có một khởi đầu thuận lợi trong việc tìm kiếm và sửa các lỗ hổng nghiêm trọng trước khi chúng có thể bị khai thác, đồng thời giảm thiểu nguy cơ lạm dụng trên diện rộng.

Gemini 3.5 Pro Vẫn đang trong quá trình thử nghiệm

Google xác nhận rằng Gemini 3.5 Pro, mẫu máy hàng đầu được theo dõi chặt chẽ về độ trễ, hiện đang thử nghiệm với các đối tác và sẽ được cung cấp rộng rãi ngay khi sẵn sàng. Công ty trước đó đã hoãn việc ra mắt Pro do các mục tiêu về hiệu quả hoạt động nội bộ và làn sóng các nhà nghiên cứu rời đi.

Có lẽ đáng chú ý nhất là Google tiết lộ rằng nhóm đã bắt đầu quá trình đào tạo trước đầy tham vọng nhất cho Gemini 4, báo hiệu rằng thế hệ mô hình tiếp theo đang được tiến hành.

Các biện pháp bảo vệ an toàn nâng cao

Gemini 3.6 Flash được trang bị các biện pháp bảo vệ An toàn Biên giới nâng cao trong các lĩnh vực đe dọa Hóa học, Sinh học, Phóng xạ và Hạt nhân (CBRN) cũng như lạm dụng hành vi tấn công mạng. Google cho biết những biện pháp bảo vệ này làm cho mô hình này có khả năng chống bẻ khóa cao hơn đáng kể đồng thời giảm thiểu việc từ chối sử dụng có lợi.

Bản phát hành được đưa ra trong bối cảnh sự giám sát chặt chẽ về độ an toàn của mô hình AI ở Washington, nơi chính quyền Trump đã thúc đẩy các công ty chia sẻ các mô hình chưa được phát hành với những người thử nghiệm của chính phủ trước khi phát hành rộng rãi. Google DeepMind và Microsoft đều đã ký thỏa thuận với Trung tâm Tiêu chuẩn và Đổi mới AI của chính phủ vào tháng 5 năm 2026 để chia sẻ các mô hình tiên phong của họ nhằm thử nghiệm an ninh quốc gia.

Sẵn có

Gemini 3.6 Flash và 3.5 Flash-Lite có sẵn ngay lập tức cho các nhà phát triển thông qua API Gemini, Google AI Studio và Android Studio. Khách hàng doanh nghiệp có thể truy cập chúng thông qua Nền tảng đại lý doanh nghiệp Gemini. Ứng dụng Gemini cũng hỗ trợ cả hai mô hình dành cho người tiêu dùng sử dụng và 3.5 Flash-Lite đang được triển khai trên Google Tìm kiếm.

Đi trước AI

Muốn nhiều hơn từ thế giới trí tuệ nhân tạo? Đánh dấu trang AI Buzz Wire để biết thông tin mới nhất về ngành AI mà bạn có thể tin tưởng.

Đọc thêm tin tức về AI →