Giám đốc cấp cao phụ trách quản lý sản phẩm của Google, Tulsee Doshi, đã đăng bài blog chính thức vào ngày 21 tháng 7, thông báo việc ra mắt Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber—tất cả đều được thiết kế riêng cho các luồng công việc của AI agent. Ngoài ra, việc huấn luyện trước của Gemini 4 đã được khởi động.
Gemini 3.6 Flash là mô hình chủ lực trong dòng mới, với hiệu suất được nâng cấp đáng kể trong việc viết mã nguồn, các tác vụ tri thức và nhiệm vụ đa phương thức. Hiệu suất đánh giá năng lực sử dụng máy tính (OSWorld-Verified) đạt 83,0%; theo Artificial Analysis Index, lượng token đầu ra của mô hình này giảm 17% so với thế hệ trước, và có thể giảm tối đa 65% trong các bài benchmark như DeepSWE.
Các công cụ sử dụng máy tính (computer use tools) hiện đã được tích hợp trực tiếp trong Gemini API và phiên bản doanh nghiệp, không cần cấu hình bổ sung. Về giá: 1,50 USD cho mỗi 1 triệu token đầu vào và 7,50 USD cho mỗi 1 triệu token đầu ra.
Gemini 3.5 Flash-Lite được thiết kế cho các tác vụ độ trễ thấp và thông lượng cao (như tìm kiếm bằng agent và xử lý tài liệu). Các thông số chính như sau:
Tốc độ đầu ra: 350 tokens/s
Giá: 0,30 USD cho mỗi 1 triệu token đầu vào và 2,50 USD cho mỗi 1 triệu token đầu ra
Mức thinking: hỗ trợ các mức thinking có thể điều chỉnh; nhà phát triển có thể chuyển đổi giữa chế độ thinking thấp (phù hợp cho các tác vụ tần suất cao) và chế độ thinking cao (xử lý các luồng công việc phức tạp của các agent con)
Hiệu suất đánh giá: vượt phiên bản chuẩn Gemini 3 Flash trong các bài đánh giá ngữ cảnh dài và mã hóa bằng agent
Gemini 3.5 Flash Cyber là mô hình được tinh chỉnh dựa trên 3.5 Flash, chuyên cho các kịch bản phòng thủ an ninh mạng. Mô hình này có thể phối hợp với hệ thống đa agent CodeMender để tạo nhanh các báo cáo tổng hợp, giúp bên phòng thủ phát hiện và khắc phục lỗ hổng an ninh mạng. Do cân nhắc rủi ro về mục đích sử dụng kép của công nghệ, hiện Gemini 3.5 Flash Cyber bị giới hạn truy cập nghiêm ngặt, chỉ dành cho cơ quan chính phủ và các đối tác hợp tác được tin cậy thông qua các chương trình thí điểm để được tiếp cận giới hạn.
Trong bài blog chính thức ngày 21 tháng 7 năm 2026, Tulsee Doshi cho biết Google đã chính thức khởi động công việc huấn luyện trước của Gemini 4 và mô tả đây là kế hoạch “tham vọng nhất” của Google. Ngoài ra, Gemini 3.5 Pro hiện đang trong quá trình thử nghiệm với các đối tác; dự kiến sau khi Gemini 3.5 Pro được triển khai rộng rãi thì các tiến triển tiếp theo của Gemini 4 cũng sẽ lần lượt được công bố; chi tiết về thời gian sẽ theo thông báo chính thức từ Google.
Hiện tại, nhà phát triển có thể truy cập Gemini 3.6 Flash và Gemini 3.5 Flash-Lite thông qua các kênh như Gemini API.
Theo bài blog chính thức của Google, giá của Gemini 3.6 Flash là 1,50 USD cho mỗi 1 triệu token đầu vào và 7,50 USD cho mỗi 1 triệu token đầu ra; trong đánh giá năng lực sử dụng máy tính (OSWorld-Verified) đạt 83,0%, lượng token đầu ra giảm 17% so với thế hệ trước (trong benchmark DeepSWE có thể giảm tối đa 65%).
Tốc độ đầu ra của Gemini 3.5 Flash-Lite đạt 350 token mỗi giây, giá là 0,30 USD cho mỗi 1 triệu token đầu vào và 2,50 USD cho mỗi 1 triệu token đầu ra; hỗ trợ các mức thinking có thể điều chỉnh, phù hợp cho các tác vụ độ trễ thấp như tìm kiếm bằng agent và xử lý tài liệu.
Gemini 3.5 Flash Cyber hiện chỉ giới hạn cho cơ quan chính phủ và các đối tác hợp tác được tin cậy thông qua các chương trình thí điểm để được truy cập giới hạn, vì Google cân nhắc rằng các công nghệ liên quan đến an ninh mạng này có rủi ro mục đích sử dụng kép; cách thức nộp đơn truy cập cụ thể sẽ theo thông báo chính thức từ Google.
Tin tức liên quan
Google Ra Mắt Ba Mô Hình AI Gemini Mới Với Chi Phí Thấp Hơn
Google, AMD, TSMC mở rộng đầu tư AI dù thị trường biến động
Google phát triển chip AI Frozen v2, thúc đẩy cổ phiếu Alphabet tăng 1,52%
AMD ra mắt MI450 với dung lượng bộ nhớ vượt NVIDIA, cổ phiếu Samsung Electronics và SK hynix được hưởng lợi