Google nâng cấp Gemini 3.6 Flash với cải tiến hiệu suất và lập trình

Tại sự kiện I/O tháng 5, Google ra mắt mẫu AI Gemini 3.5 Flash với nhiều kỳ vọng về tính năng mới. Tuy nhiên, phiên bản này nhanh chóng bị thay thế bởi Gemini 3.6 Flash - phiên bản cải tiến nhằm đổi mới hiệu suất và khả năng tạo mã lập trình. Google cho biết phiên bản 3.6 được phát triển dựa trên phản hồi của người dùng từ mẫu 3.5, mang lại hiệu quả mã hóa tốt hơn và khả năng đa phương tiện tiên tiến hơn.

Kết quả các bài kiểm tra cho thấy Gemini 3.6 Flash đạt 49% điểm trong bài đánh giá DeepSWE về lập trình, vượt trội so với 37% của phiên bản 3.5 Flash. Đáng chú ý, phiên bản mới còn có khả năng hỗ trợ sử dụng máy tính như một tính năng mặc định qua API Gemini. Trên bài kiểm tra OSWorld về khả năng sử dụng máy tính, Gemini 3.6 Flash cũng có bước tiến nhẹ từ 78,4% lên 83%.

Google cũng tập trung mạnh vào hiệu quả sử dụng tài nguyên, giúp phiên bản mới giảm khoảng 17% số lượng token cần dùng so với phiên bản trước. Điều này đồng nghĩa với việc các tác vụ trên Gemini 3.6 Flash có thể hoàn thành chính xác hơn, trong ít bước hơn và tiết kiệm chi phí cho cả nhà phát triển và Google. Giá API của Gemini 3.6 Flash cũng được hạ xuống còn $1,50 cho mỗi 1 triệu token đầu vào và $7,50 cho mỗi 1 triệu token đầu ra, giảm đáng kể so với $9 của phiên bản 3.5 Flash.

Mở rộng dòng 3.5 với phiên bản Flash Lite tối ưu chi phí và AI an ninh mạng

Bên cạnh Gemini 3.6 Flash, Google còn ra mắt hai phiên bản mới cho dòng 3.5: Gemini 3.5 Flash Lite và Gemini 3.5 Flash Cyber. Flash Lite là mẫu AI hiện đại nhất của hãng về hiệu suất tiết kiệm, có thể xử lý đến 350 token mỗi giây, phù hợp cho các hệ thống agentic quy mô lớn với chi phí thấp. Mức giá của Flash Lite được thiết lập ở mức $0,30 cho 1 triệu token đầu vào và $2,50 cho token đầu ra, tuy cao hơn một chút so với phiên bản 3.1 Flash Lite trước đó.

Đặc biệt, Gemini 3.5 Flash Cyber là phiên bản AI đầu tiên của Google chuyên về lĩnh vực an ninh mạng. Mô hình này được thiết kế để phát hiện và khắc phục các lỗ hổng bảo mật hiệu quả, gần tương đương với Claude Mythos - một trong những AI lớn và tốn kém nhất của thị trường. Tuy nhiên, do tính chất "sử dụng kép" của AI an ninh mạng (vừa có thể giúp sửa lỗi vừa có thể bị lạm dụng), Google sẽ giới hạn phát hành mô hình này cho các đối tác tin cậy và chính phủ thông qua chương trình thử nghiệm CodeMender của DeepMind, thay vì công khai rộng rãi.

Tiến trình phát triển Gemini 3.5 Pro và dự án Gemini 4 tham vọng

Google từng thông báo sẽ phát hành Gemini 3.5 Pro vào tháng 6, tuy nhiên đến nay sản phẩm này vẫn chưa ra mắt. Công ty chỉ cho biết phiên bản cao cấp nhất này đang trong giai đoạn thử nghiệm cùng các đối tác chưa được tiết lộ và sẽ được phát hành khi sẵn sàng. Gemini 3.5 Pro được kỳ vọng cạnh tranh với những AI hàng đầu như GPT 5.6 và Claude Fable/Sonnet 5, đặc biệt trong lĩnh vực lập trình, tuy phiên bản này từng bị hoãn do chưa đạt kỳ vọng về hiệu suất mã hóa.

Song song với đó, Google đã khởi động quá trình tiền đào tạo cho Gemini 4, dự án AI mới đầy tham vọng với quy mô lớn và tính năng vượt trội hơn so với các thế hệ trước. Hiện tại vẫn chưa có thông tin cụ thể về thời điểm ra mắt hoặc kế hoạch cho các phiên bản 3.x kế tiếp trước khi Gemini 4 lên sóng.

Những điều bổ ích từ bài viết

  • Gemini 3.6 Flash cải thiện đáng kể khả năng lập trình và hiệu quả so với 3.5 Flash.
  • Phiên bản Flash Lite có tốc độ xử lý nhanh nhất của Google hiện nay với giá thành hợp lý cho ứng dụng công nghiệp.
  • Gemini 3.5 Flash Cyber là mô hình AI chuyên về an ninh mạng, phát hành giới hạn cho các đối tác và chính phủ.
  • Google trì hoãn phát hành Gemini 3.5 Pro do các vấn đề về hiệu quả lập trình và vẫn đang thử nghiệm.
  • Gemini 4 đang được đào tạo với quy mô lớn, hứa hẹn sẽ là bước tiến quan trọng trong AI của Google.

Đăng ký bản tin QMVN

Nhận tin tổng hợp mỗi sáng - chỉ những bài đáng đọc, không spam.

Bài viết được biên tập với sự hỗ trợ của công cụ trí tuệ nhân tạo (AI), tổng hợp từ các nguồn tin dẫn bên dưới và đã qua kiểm duyệt của toà soạn Quang Minh Việt Nam.