Công dân khuyến học

Google ra mắt Gemini 3.6 Flash: Mạnh hơn, rẻ hơn và tiết kiệm token hơn 17%

Google ra mắt Gemini 3.6 Flash: Mạnh hơn, rẻ hơn và tiết kiệm token hơn 17%

Đỗ Tho

Đỗ Tho

14:00 - 22/07/2026
Công dân & Khuyến học trên

Google vừa giới thiệu Gemini 3.6 Flash - phiên bản mới nhất trong dòng mô hình AI Gemini, với trọng tâm là nâng cao hiệu năng nhưng đồng thời giảm chi phí vận hành.

 Google ra mắt Gemini 3.6 Flash: Mạnh hơn, rẻ hơn và tiết kiệm token hơn 17% - Ảnh 1.

So sánh mô hình Gemini 3.6 Flash với các mô hình khác hiện nay.

Google đã công bố loạt mô hình Gemini mới, nổi bật là Gemini 3.6 Flash. Cùng với đó, hãng cũng giới thiệu Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, hướng đến các nhu cầu xử lý dữ liệu quy mô lớn và an ninh mạng.

Gemini 3.6 Flash được tối ưu hiệu năng và chi phí

Theo Google, Gemini 3.6 Flash là bản nâng cấp trực tiếp của Gemini 3.5 Flash, tập trung vào ba yếu tố gồm chất lượng, tốc độ và hiệu quả chi phí.

Một trong những cải tiến đáng chú ý nhất là mô hình mới giảm hơn 17% lượng token đầu ra trên chỉ số Artificial Analysis Intelligence Index so với Gemini 3.5 Flash. Điều này đồng nghĩa AI có thể đưa ra câu trả lời ngắn gọn và hiệu quả hơn, qua đó giảm chi phí sử dụng API cho doanh nghiệp.

Google cũng cho biết Gemini 3.6 Flash cần ít bước suy luận (reasoning steps) hơn khi xử lý các tác vụ phức tạp, đồng thời giảm số lần gọi công cụ (tool calls) trong các quy trình nhiều bước. Những cải tiến này đặc biệt hữu ích với các AI agent - nhóm ứng dụng đang được nhiều doanh nghiệp triển khai để tự động hóa quy trình làm việc.

Bên cạnh việc cải thiện hiệu quả xử lý, Google còn điều chỉnh giá dịch vụ. Gemini 3.6 Flash có mức giá 1,50 USD cho mỗi triệu token đầu vào và 7,50 USD cho mỗi triệu token đầu ra, thấp hơn so với Gemini 3.5 Flash. Theo Google, việc giảm giá kết hợp với khả năng sử dụng ít token hơn sẽ giúp doanh nghiệp tiết kiệm đáng kể chi phí vận hành các ứng dụng AI.

Gemini 3.6 Flash có thể là bước đệm trước khi Gemini 3.5 Pro ra mắt

Việc Google giới thiệu Gemini 3.6 Flash cũng diễn ra trong bối cảnh Gemini 3.5 Pro tiếp tục lỡ nhiều mốc phát hành quan trọng. Theo Reuters, Google cho biết mô hình này vẫn cần thêm thời gian để cải thiện chất lượng, đặc biệt ở các bài kiểm tra lập trình, trước khi chính thức đến tay người dùng.

Theo một số nhà phân tích, việc Google liên tục cập nhật dòng Flash có thể là cách để duy trì sức cạnh tranh trong khi phiên bản Pro vẫn đang được hoàn thiện. Trong thời gian qua, thị trường AI đã chứng kiến hàng loạt mô hình mới ra mắt từ các đối thủ, khiến cuộc cạnh tranh ở phân khúc mô hình nền tảng ngày càng gay gắt.

Xét theo cách đặt tên của dòng Gemini, Gemini 3.6 Flash nhiều khả năng là bản nâng cấp kế nhiệm Gemini 3.5 Flash, tập trung cải thiện những điểm còn hạn chế như hiệu quả sử dụng token, khả năng xử lý ngữ cảnh dài và độ ổn định khi sử dụng công cụ trong các tác vụ nhiều bước, thay vì là một mô hình hoàn toàn mới. Tuy nhiên, Google hiện chưa công bố chi tiết về kiến trúc hay lộ trình phát triển tiếp theo của dòng Gemini, vì vậy những nhận định trên vẫn chỉ dừng ở mức phân tích từ giới quan sát.

Google mở rộng hệ sinh thái Gemini với hai mô hình mới

Ngoài Gemini 3.6 Flash, Google cũng công bố Gemini 3.5 Flash-Lite, phiên bản được tối ưu cho các tác vụ có khối lượng lớn nhưng yêu cầu chi phí thấp, như phân loại dữ liệu, tóm tắt văn bản hay xây dựng chatbot quy mô lớn.

Trong khi đó, Gemini 3.5 Flash Cyber được phát triển dành riêng cho lĩnh vực an ninh mạng. Mô hình này được huấn luyện để hỗ trợ phát hiện lỗ hổng, phân tích mã nguồn và xử lý các tác vụ liên quan đến bảo mật. Ban đầu, Google sẽ cung cấp Flash Cyber cho chính phủ và các đối tác được lựa chọn thông qua nền tảng CodeMender.

Gemini 3.6 Flash cũng được tối ưu cho các lĩnh vực như lập trình, xử lý tri thức, AI agent và các tác vụ đa phương thức (multimodal). Trên nhiều bài đánh giá nội bộ về lập trình và quy trình AI agent, mô hình mới đạt kết quả tốt hơn Gemini 3.5 Flash trong khi vẫn duy trì tốc độ phản hồi nhanh và chi phí thấp.

Theo Reuters, công ty cho biết mô hình này cần thêm thời gian để cải thiện chất lượng, đặc biệt ở các bài kiểm tra lập trình, trước khi được đưa đến tay người dùng. Điều đó cho thấy Google đang ưu tiên hoàn thiện sản phẩm thay vì đẩy nhanh tiến độ phát hành.

Khi AI ngày càng được ứng dụng rộng rãi trong doanh nghiệp, những yếu tố như tốc độ xử lý, chi phí vận hành và khả năng hỗ trợ tác nhân AI được xem là lợi thế cạnh tranh quan trọng không kém các bài kiểm tra hiệu năng truyền thống.

Bình luận của bạn

Bình luận

icon icon