Asset 15

Google Ra Mắt Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber

Asset 15

Google vừa cho ra mắt đồng thời 3 phiên bản Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber nhằm giải quyết 2 bài toán lớn của doanh nghiệp đó chính là tối ưu chi phí vận hành agents và tăng tốc độ xử lý tác vụ mà không làm suy giảm chất lượng đầu ra. Bên cạnh các mô hình mới được công bố vào ngày 21/7/2026, Gemini 3.5 Pro hiện đang được thử nghiệm và dự kiến sẽ được áp dụng sau khi hoàn tất quá trình đánh giá. Google Cloud cũng cho biết đang triển khai chương trình training lớn nhất từ trước đến nay cho Gemini 4, đánh dấu bước tiến tiếp theo trong lộ trình phát triển các mô hình AI thế hệ mới. Cùng Cloud Ace tìm hiểu 3 mô hình mới vừa được công bố nhé.

Gemini 3.6 Flash:

Được phát triển từ những phản hồi của cộng đồng nhà phát triển và khách hàng sử dụng Gemini 3.5 Flash, Gemini 3.6 Flash mang đến nhiều cải tiến về khả năng lập trình, xử lý tri thức và hiệu quả sử dụng token. Theo Artificial Analysis Index, mô hình này tiêu thụ ít hơn khoảng 17% output tokens so với phiên bản trước đó, đồng thời giảm số bước suy luận và số lần gọi công cụ cần thiết để hoàn thành các tác vụ nhiều bước.

Gemini 3.6 Flash còn có mức giá thấp hơn Gemini 3.5 Flash, với chi phí $1.5/ 1mil input tokens and $7.5/ 1mil output tokens. Việc cải thiện hiệu quả xử lý kết hợp với chi phí thấp hơn giúp giảm tổng chi phí vận hành AI agent,giúp việc triển khai và mở rộng các ứng dụng AI một cách hiệu quả.

Thông số mô hình Gemini 3.6 Flash:

Hạng mụcThông tin
Tên3.6 Flash
Trạng tháiĐã phát hành chính thức
Dữ liệu đầu vào

Text document - Free interface iconsImage - Free interface icons Video - Free multimedia icons Audio Icons & Symbols Pdf - Free files and folders icons

Dữ liệu đầu raText document - Free interface icons
Giới hạn đầu vào1M
Giới hạn đầu ra64k
Tool useFunction calling, Search as a tool, Computer use
Tối ưu nhất cho các tác vụCác tác vụ hàng ngày, Lập trình Agentic, Suy luận nâng cao, Xử lý đa phương thức, Phân tích ngữ cảnh dài
Được áp dụng choGemini App, Gemini Enterprise App, Gemini Enterprise Agent Platform, Google AI Studio, Gemini API, Google Antigravity

Dù tiết kiệm chi phí hơn, mô hình 3.6 Flash lại có bước tiến rõ rệt ở nhiều kịch bản phức tạp:

  • Lập trình nâng cao: Kết quả trên DeepSWE đạt 49% (so với 37% của 3.5 Flash), giảm bớt các thao tác chỉnh sửa mã lỗi và rút ngắn các vòng lặp thực thi. Kết quả nghiên cứu máy học trên MLE Bench tăng lên 63.9%.
  • Thao tác máy tính (Computer Use): Chỉ số OSWorld-Verified tăng từ 78.4% lên 83.0%. Tính năng này hiện đã được tích hợp sẵn dưới dạng client-side tool trong Gemini API và Gemini Enterprise.
  • Xử lý đa phương thức: Đạt điểm số 1421 trên GDPval-AA v2. Các doanh nghiệp như Hebbia hay Harvey ghi nhận mô hình trích xuất bảng biểu, phân tích tài liệu và lập báo cáo tài chính rất chính xác.

Gemini 3.5 Flash-Lite:

Bên cạnh Gemini 3.6 Flash, Google Cloud cũng giới thiệu Gemini 3.5 Flash-Lite, mô hình được tối ưu cho các tác vụ yêu cầu độ trễ thấp và khả năng xử lý khối lượng lớn dữ liệu, như tìm kiếm bằng AI agent hay xử lý tài liệu quy mô lớn.

Đây là mô hình có tốc độ nhanh nhất trong dòng Gemini 3.5, đạt khoảng 350 token đầu ra mỗi giây theo Artificial Analysis. Với mức giá $0.3/1M input token và $2.5/1M output token, cùng chất lượng vượt trội đáng kể so với 3.1 Flash-Lite, mô hình phù hợp với các hệ thống AI cần xử lý thông lượng lớn trong môi trường sản xuất.

Về hiệu suất, mô hình này vượt trội đáng kể so với phiên bản tiền nhiệm 3.1 Flash-Lite trong các bài kiểm tra như Terminal-Bench 2.1 (54% so với 31%) và bài kiểm tra hiệu năng ngữ cảnh dài (long-context benchmark) GDM-MRCR v2 (72,2% so với 60,1%); đáng chú ý hơn, trên SWE-Bench Pro (54,2% so với 49,6%) và OSWorld-Verified (74,0% so với 65,1%), nó thậm chí còn vượt qua Gemini 3 Flash vốn nằm ở phân khúc cao hơn. Các nhà phát triển có thể linh hoạt cấu hình mức độ tư duy dựa trên khối lượng công việc: định tuyến các tác vụ có tần suất cao sang phân khúc độ trễ thấp, chi phí thấp, đồng thời gọi các mức độ tư duy cao hơn cho các tác vụ sub-agent nhiều bước.

Gemini 3.5 Flash Cyber

Paradigm Gemini 3.5 Flash Cyber chuyên phát hiện và vá các lỗ hổng phần mềm, với mức giá trên mỗi token thấp hơn so với các mô hình lớn hơn. Bên trong CodeMender, nhiều Agent 3.5 Flash Cyber phối hợp làm việc cùng nhau để tạo ra một báo cáo tổng hợp duy nhất, giúp mô hình đạt hiệu suất cạnh tranh hàng đầu trên bài kiểm tra CyberGym.

Do tính chất lưỡng dụng của công nghệ này, Google đã áp dụng một chiến lược triển khai thận trọng: Flash Cyber sẽ sớm được cung cấp độc quyền cho các chính phủ và đối tác đáng tin cậy thông qua CodeMender dưới dạng chương trình thử nghiệm giới hạn.

Với tư cách là Google Cloud Diamond Partner tại thị trường Việt Nam, Cloud Ace hỗ trợ từ tư vấn, triển khai đến vận hành, mở rộng quy mô các giải pháp đám mây, dữ liệu, bảo mật và các ứng dụng AI. Đăng ký ngay để nhận tư vấn 1-1 và các ưu đãi độc quyền nhé.

Asset 7

Cloud Ace - Managed Service Partner của Google Cloud

  • Trụ sở: Tòa Nhà H3, Lầu 1, 384 Hoàng Diệu, Phường 6, Quận 4, TP. HCM.
  • Văn phòng đại diện: Tầng 2, 25t2 Hoàng Đạo Thúy, Phường Trung Hoà, Quận Cầu Giấy, Thành phố Hà Nội.
  • Email: sales.vn@cloud-ace.com
  • Hotline: 028 6686 3323
  • Website: https://cloud-ace.vn/

Related News:

Shopping Basket
en_USEnglish