Google ra mắt Gemini 3.6 Flash: Rẻ hơn, ít nói hơn, code tốt hơn — kèm model chuyên săn lỗ hổng bảo mật

Google tung 3 model Gemini Flash mới cùng lúc: 3.6 Flash (rẻ hơn 17%, code tốt hơn 32%), 3.5 Flash-Lite (350 token/s, $2.5/M output), và Flash Cyber chuyên tìm-sửa lỗ hổng. Phân tích giá, benchmark thật và nên dùng model nào.

googleaigeminillmcodingsecurity

Hôm nay (21/7), Google vừa công bố một lúc ba model Gemini Flash mới: 3.6 Flash, 3.5 Flash-Lite, và 3.5 Flash Cyber. Không phải kiểu “nâng cấp nhẹ” — mỗi model có một vị trí rất rõ ràng trong stack sản phẩm. Dưới đây là phân tích dựa trên số liệu chính thức từ Google và Artificial Analysis Index.

Ba model, ba vai trò

ModelGiá inputGiá outputĐiểm mạnh
3.6 Flash$1.50/1M$7.50/1MCode & knowledge work chính
3.5 Flash-Lite$0.30/1M$2.50/1MTốc độ cao, throughput lớn
3.5 Flash CyberChưa công bốChưa công bốSăn & sửa lỗ hổng bảo mật

Gemini 3.6 Flash — “workhorse” mới

Đây là model chính để thay thế 3.5 Flash (ra tháng 5/2026). Điểm đáng chú ý nhất: vừa khỏe hơn, vừa rẻ hơn, vừa ít nói hơn.

  • Rẻ hơn: Output token giảm từ $9.00 → $7.50/1M token (~17%).
  • Ít token hơn: Theo Artificial Analysis Index, 3.6 Flash dùng ít hơn 17% output token so với 3.5 Flash. Trên benchmark DeepSWE, có task giảm tới 65% token.
  • Code tốt hơn: DeepSWE (sửa lỗi phần mềm tự động) đạt 49% vs 37% của 3.5 Flash. MLE Bench (ML research) đạt 63.9% vs 49.7%.
  • Computer use: Đã tích hợp sẵn qua Gemini API và Gemini Enterprise — không cần cấu hình phức tạp.
  • Knowledge work: GDPval-AA v2 đạt 1421 vs 1349. Khách hàng như Hebbia, Harvey đánh giá cao khả năng phân tích tài liệu đa phương thức.

Kết luận: Nếu bạn đang dùng 3.5 Flash để code, phân tích dữ liệu, hoặc build AI agent — nâng cấp lên 3.6 Flash là no-brainer. Rẻ hơn, code tốt hơn, ít token thừa hơn.

Gemini 3.5 Flash-Lite — vừa nhanh vừa rẻ

Model này nhắm đến các tác vụ throughput cao: tìm kiếm với agent, xử lý tài liệu hàng loạt, dịch thuật quy mô lớn.

  • 350 token/s output — nhanh nhất trong dòng 3.5 (theo Artificial Analysis).
  • Giá chỉ $0.30/M input, $2.50/M output — rẻ hơn 5 lần so với 3.6 Flash.
  • Chất lượng bất ngờ: SWE-Bench Pro đạt 54.2%, đánh bại cả Gemini 3 Flash (49.6%). OSWorld-Verified đạt 74% vs 65.1% của 3 Flash.
  • Hỗ trợ computer use và có thể config thinking level (thấp cho task nhanh, cao cho multi-step subagent).

Dùng Flash-Lite làm subagent trong hệ thống multi-agent là use case rất hợp lý: vừa rẻ, vừa nhanh, vừa đủ thông minh cho các task đơn giản.

3.5 Flash Cyber + CodeMender — AI đi săn bug

Đây là model thú vị nhất trong đợt này. Google fine-tune 3.5 Flash thành model chuyên về cybersecurity, đóng gói cùng agent CodeMender — hệ thống tự động tìm, xác nhận, và sửa lỗ hổng bảo mật trong code.

  • CyberGym benchmark: Đạt mức cạnh tranh ở frontier (ngang các model lớn hơn nhiều).
  • Không mở đại trà: Chỉ dành cho chính phủ và đối tác tin cậy qua chương trình limited-access pilot. Lý do: dùng được cho cả phòng thủ lẫn tấn công.
  • Mô hình: nhiều agent Flash Cyber chạy song song, tổng hợp thành một báo cáo duy nhất.

Đây không phải tool cho developer thông thường, mà là vũ khí cho các đội bảo mật quốc gia. Một hướng đi thú vị: tận dụng model nhỏ (Flash) fine-tune cho domain cụ thể thay vì dùng model khổng lồ đắt đỏ.

Và còn phía trước…

Google cũng hé lộ Gemini 3.5 Pro đang test với đối tác và Gemini 4 đã bắt đầu pre-training (“ambitious pre-training run”). Nếu Flash đã thế này, Pro và 4 sẽ là cuộc chơi khác.

Bắt đầu từ đâu?

  • Google AI Studio: aistudio.google.com — dùng thử miễn phí 3.6 Flash và 3.5 Flash-Lite.
  • Gemini API: Có sẵn developer guide chính thức.
  • Gemini Enterprise: Cho doanh nghiệp muốn triển khai agent quy mô lớn.

Nguồn: Google Blog — Introducing Gemini 3.6 Flash, 9to5Google, Artificial Analysis Index. Số liệu benchmark trích từ bài blog chính thức của Google, truy cập 21/07/2026.