Danh mục
Danh Mục

Google Ra Mắt Gemini 3.6 Flash, 3.5 Flash-Lite Và 3.5 Flash Cyber

Đóng góp bởi: Trang SEO / Ngày 24-07-2026

Vừa qua, gã khổng lồ công nghệ Google đã chính thức phát hành bộ ba mô hình trí tuệ nhân tạo thế hệ mới thuộc dòng Flash bao gồm: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, và Gemini 3.5 Flash Cyber. Cả ba mô hình đều chia sẻ một mục tiêu cốt lõi: xử lý được nhiều công việc phức tạp hơn nhưng tiêu tốn ít token hơn, từ đó tối ưu hóa chi phí vận hành và tốc độ cho các hệ thống AI.

Trong đợt nâng cấp này, Gemini 3.6 Flash đóng vai trò là phiên bản chủ lực đa năng, Gemini 3.5 Flash-Lite tối ưu tuyệt đối về chi phí và tốc độ, còn Gemini 3.5 Flash Cyber là công cụ an ninh mạng chuyên biệt. Bài viết này Thành Nhân TNC sẽ cùng bạn phân tích chi tiết tính năng, thông số benchmark, tác dụng của AI trong thực tế cũng như định vị của từng mô hình trong hệ sinh thái Google.

Tổng Quan Điểm Nổi Bật Của Dòng Mô Hình Gemini Mới Ra Mắt

Trong môi trường triển khai thực tế, các nhà phát triển và doanh nghiệp khi xây dựng các AI Agent luôn đòi hỏi hiệu quả sử dụng token cao hơn, độ trễ thấp hơn và độ tin cậy tuyệt đối. Dòng mô hình Flash của Google được thiết kế nhằm đạt đến tối ưu giữa chi phí vận hành và chất lượng xử lý.

Tổng Quan Điểm Nổi Bật Của Dòng Mô Hình Gemini Mới Ra Mắt

Phát triển dựa trên nền tảng Gemini 3.5 Flash, Google mang đến những bước tiến vượt bậc:

  • Gemini 3.6 Flash: Mô hình chủ lực toàn diện, mang lại hiệu suất vượt trội trong khả năng lập trình, xử lý tri thức và tư duy đa phương thức. Theo Artificial Analysis Index, mô hình giúp giảm 17% lượng token đầu ra so với Gemini 3.5 Flash, thậm chí giảm tới 65% trên một số bài kiểm tra chuyên biệt như DeepSWE.
  • Gemini 3.5 Flash-Lite: Mô hình nhanh nhất và tiết kiệm chi phí nhất trong phân khúc 3.5 của Google. Với tốc độ xử lý ấn tượng lên tới 350 token đầu ra mỗi giây, mô hình này vượt trội hơn đáng kể so với các thế hệ Flash-Lite trước đây trong quy trình làm việc tự động của tác nhân.
  • Gemini 3.5 Flash Cyber trong CodeMender: Công cụ an ninh mạng chuyên dụng kết hợp giữa mô hình tinh chỉnh hiệu năng cao và cơ sở hạ tầng tác nhân CodeMender của Google, mang lại khả năng phát hiện và khắc phục lỗ hổng bảo mật hàng đầu hiện nay.

Ngoài ra, Google cũng xác nhận phiên bản cao cấp Gemini 3.5 Pro hiện đang được thử nghiệm tích cực với các đối tác chiến lược và sẽ sớm ra mắt. Đồng thời, hãng đã khởi động quá trình huấn luyện trước tham vọng nhất từ trước đến nay cho thế hệ Gemini 4.

Chi Tiết Tính Năng Và Lựa Chọn Phiên Bản Gemini Phù Hợp

Mỗi phiên bản trong đợt ra mắt này được Google định vị ở một vị trí khác nhau trên biểu đồ cân bằng giữa chi phí và năng lực xử lý.

Gemini 3.6 Flash Là Gì?

Gemini 3.6 Flash được Google gọi là mô hình chủ lực dành cho các hệ thống cần sự cân bằng giữa trí tuệ, tốc độ và chi phí. Mô hình được nâng cấp trực tiếp từ những phản hồi của cộng đồng lập trình viên đang vận hành Gemini 3.5 Flash, tập trung mạnh vào lập trình, công việc tri thức, xử lý đa phương thức và quy trình gọi công cụ nhiều bước. Hiện tại, Gemini 3.6 Flash đã ở trạng thái giới thiệu rộng rãi. Các nhà phát triển có thể truy cập ngay thông qua Gemini API trong Google AI Studio, Android Studio và Google Antigravity. Khách hàng doanh nghiệp có thể triển khai qua Gemini Enterprise Agent Platform và ứng dụng Gemini Enterprise. Người dùng phổ thông cũng có thể trải nghiệm trực tiếp ngay trên ứng dụng Gemini.

Gemini 3.6 Flash Là Gì?

Về năng lực kỹ thuật, Gemini 3.6 Flash tiếp nhận đầu vào đa dạng bao gồm văn bản, hình ảnh, video, âm thanh và tài liệu PDF. Mô hình hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token với giới hạn đầu ra là 64.000 token. Tính năng thao tác máy tính đã được tích hợp sẵn vào API và Gemini Enterprise, song song cùng tính năng gọi hàm , xuất dữ liệu có cấu trúc và tìm kiếm như một công cụ. Điểm ăn tiền nhất của Gemini 3.6 Flash là việc tiết kiệm token. Nhờ khả năng tư duy thông minh hơn, mô hình đưa ra câu trả lời ngắn gọn, súc tích hơn, đồng thời đi đến kết luận qua ít bước suy luận và ít lượt gọi công cụ hơn.

Gemini 3.5 Flash-Lite Là Gì?

Không hướng tới vị trí mô hình thông minh nhất, Gemini 3.5 Flash-Lite đặt cược hoàn toàn vào tốc độ và chi phí. Đây là mô hình đạt tốc độ phản hồi cực nhanh với 350 token đầu ra/giây và mức giá siêu rẻ chỉ 0,30 USD cho mỗi triệu token đầu vào và 2,50 USD cho mỗi triệu token đầu ra.

Gemini 3.5 Flash-Lite Là Gì?

Ứng dụng AI này cực kỳ phù hợp cho các luồng công việc khối lượng lớn như tìm kiếm agentic, phân loại dữ liệu, tóm tắt tài liệu hàng loạt hay các tác vụ chạy hàng nghìn lần mỗi ngày. Lập trình viên có thể linh hoạt điều chỉnh mức độ tư duy của mô hình. Bao gồm việc thiết lập ở mức tối thiểu để thực thi nhanh, rẻ cho khối lượng công việc khổng lồ, hoặc nâng cao hơn cho các sub-agent cần suy luận nhiều bước.

Gemini 3.5 Flash Cyber Là Gì?

Gemini 3.5 Flash Cyber là phiên bản chuyên biệt được tinh chỉnh riêng cho lĩnh vực an ninh mạng. Mô hình này hoạt động bên trong hệ thống CodeMender của Google, nơi nhiều agent AI phối hợp cùng nhau để phân tích mã nguồn, phát hiện và vá các lỗ hổng bảo mật rồi xuất ra báo cáo tổng hợp.

Gemini 3.5 Flash Cyber Là Gì?

Mặc dù có kích thước gọn nhẹ hơn các mô hình tiên phong lớn, Gemini 3.5 Flash Cyber cho thấy khả năng cạnh tranh đáng kinh ngạc trên CyberGym - bộ tiêu chuẩn đánh giá an ninh mạng uy tín. Nhằm đảm bảo an toàn, quyền truy cập mô hình này hiện bị giới hạn cho các cơ quan chính phủ và đối tác tin cậy thông qua chương trình thí điểm CodeMender, chưa có giá bán hay ngày phát hành rộng rãi.

Đánh Giá Benchmark Chi Tiết Và So Sánh Hiệu Năng

Dưới đây là bảng tổng hợp kết quả thử nghiệm thực tế (benchmark) và chi phí sử dụng của Gemini 3.6 Flash so với các mô hình đối thủ trên thị trường:

Benchmark Gemini 3.6 Flash Gemini 3.5 Flash Gemini 3.1 Pro GPT-5.6 Luna Grok 4.5 Claude Sonnet 5
Giá input ($/1M) 1,50 1,50 2,00 1,00 2,00 3,00
Giá output ($/1M) 7,50 9,00 12,00 6,00 6,00 15,00
SWE-Bench Pro 58,7% 55,1% 54,2% 62,7% 64,7% 63,2%
DeepSWE v1.1 49% 37% 12% 67% 54% 54%
Terminal-Bench 2.1 78,0% 76,2% 73,8% 84,7% 83,3% 80,4%
MLE-Bench 63,9% 49,7% 42,6% 47,6% 43,2% 66,9%
OSWorld-Verified 83,0% 78,4% 76,2% 72,6% - 81,2%
GDPVal-AA v2 (Elo) 1421 1349 965 1584 1535 1607
CharXiv Reasoning (không công cụ) 85,2% 84,2% 83,3% 82,7% 81,6% 77,0%
GDM-MRCR v2, 128k 91,8% 77,3% 84,9% 74,8% 81,4% 71,6%

Phân tích kết quả:

  • So với các đối thủ ngoài hệ sinh thái Google, ở các bài kiểm tra lập trình chuyên sâu như SWE-Bench Pro hay DeepSWE, GPT-5.6 Luna và Grok 4.5 vẫn duy trì vị thế dẫn đầu. Claude Sonnet 5 chiếm ưu thế ở các tác vụ tri thức chuyên môn và MLE-Bench.
  • Tuy nhiên, điểm sức mạnh áp đảo của Gemini 3.6 Flash nằm ở khả năng truy xuất thông tin ngữ cảnh dài (Long-Context Retrieval) và suy luận dựa trên biểu đồ. Trên bài test GDM-MRCR v2 ở mức 128k context, Gemini 3.6 Flash đạt tới 91.8%, bỏ xa hoàn toàn các đối thủ. Đồng thời, mức giá đầu ra $7.50/1M token thấp hơn đáng kể so với các mô hình cùng phân khúc.

Thông tin phát hành của các công cụ mới từ Google

Hiện tại, hai mô hình Gemini 3.6 Flash và Gemini 3.5 Flash-Lite đã sẵn sàng thương mại hóa trên thị trường:

  • Môi trường lập trình & API: Khả dụng trên Gemini API, Google AI Studio, Android Studio, và Google Antigravity (dành riêng cho 3.6 Flash).
  • Doanh nghiệp: Khách hàng tiếp cận thông qua Gemini Enterprise Agent Platform và ứng dụng Gemini Enterprise.
  • Người dùng cuối: Cả hai đã tích hợp trong ứng dụng Gemini, riêng Flash-Lite đang được triển khai vào AI Mode trên Google Search.

Bảng giá niêm yết:

  • Gemini 3.6 Flash: 1.50 USD / 1 triệu token đầu vào | 7.50 USD / 1 triệu token đầu ra.
  • Gemini 3.5 Flash-Lite: 0.30 USD / 1 triệu token đầu vào | 2.50 USD / 1 triệu token đầu ra.
  • Gemini 3.5 Flash Cyber: Chưa công bố giá công khai (chỉ áp dụng trong thử nghiệm CodeMender).

Kết Luận

Việc Google ra mắt Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber là đại diện cho chiến lược tinh chỉnh toàn bộ tầng Flash để phục vụ cho kỷ nguyên tác nhân AI vận hành quy mô lớn. Thay vì cố gắng chiến thắng trên mọi bảng xếp hạng, Google tập trung giải quyết đúng bài toán thực tế của người dùng từ tốc độ phản hồi nhanh, khả năng xử lý ngữ cảnh dài vượt trội và chi phí tối ưu trên từng token. Đây chắc chắn sẽ là bệ phóng vững chắc giúp các nhà phát triển bứt phá trong việc ứng dụng trí tuệ nhân tạo vào thực tiễn.

>>> Xem thêm:

Câu hỏi thường gặp

Sự kiện Google ra mắt Gemini 3.6 Flash mang lại lợi ích lớn nhất gì cho doanh nghiệp?

Lợi ích lớn nhất là tối ưu hóa chi phí và tốc độ vận hành AI Agent. Nhờ khả năng tư duy thông minh hơn, mô hình giảm 17% lượng token đầu ra và giảm tới 65% số bước suy luận/gọi công cụ thừa, giúp doanh nghiệp tiết kiệm ngân sách API đáng kể mà vẫn đảm bảo hiệu suất công việc.

Sự khác biệt cốt lõi giữa Gemini 3.6 Flash và Gemini 3.5 Flash-Lite là gì?

Gemini 3.6 Flash là mô hình chủ lực cân bằng giữa trí tuệ, khả năng lập trình, xử lý ngữ cảnh dài và chi phí. Trong khi đó, Gemini 3.5 Flash-Lite tập trung tối đa vào tốc độ (350 token/giây) và mức giá siêu rẻ ($0.30/1M input), chuyên phục vụ các tác vụ xử lý hàng loạt khối lượng lớn.

Tác dụng của AI Gemini 3.5 Flash Cyber là gì và ai có thể tiếp cận?

Gemini 3.5 Flash Cyber là mô hình chuyên biệt được thiết kế riêng để phát hiện, phân tích và hỗ trợ vá các lỗ hổng bảo mật mã nguồn trong hệ thống CodeMender. Hiện tại, mô hình chỉ được Google cung cấp giới hạn cho các cơ quan chính phủ và đối tác tin cậy.

Gemini 3.6 Flash xử lý file đầu vào và độ dài ngữ cảnh như thế nào?

Mô hình hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token (giới hạn đầu ra 64k) và có thể nhận đầu vào đa dạng dạng văn bản, hình ảnh, âm thanh, video và file PDF. Khả năng truy xuất dữ liệu trong ngữ cảnh dài của mô hình hiện đứng đầu thị trường.

Khi nào phiên bản Gemini 3.5 Pro và Gemini 4 chính thức ra mắt?

Google cho biết Gemini 3.5 Pro hiện đang được thử nghiệm chuyên sâu với các đối tác và sẽ phát hành ngay khi đạt độ hoàn thiện cao nhất. Trong khi đó, Gemini 4 đã bắt đầu giai đoạn huấn luyện trước (pre-training) và sẽ là bước nhảy vọt tiếp theo của hãng.
Hotline
Hotline: 19006078 (8h-18h30)
Zalo
Tư vấn Zalo (8h-18h30)
Facebook
Chat Messenger (8h-18h30)
Xóa lịch sử chat?
Toàn bộ lịch sử trò chuyện sẽ bị xóa vĩnh viễn. Bạn sẽ bắt đầu một cuộc hội thoại mới.