Công nghệ

Google tung ba mẫu Gemini mới giữa cuộc đua AI ngày càng nóng

Ngọc Hân

Google đồng loạt giới thiệu ba mô hình Gemini mới với trọng tâm là tốc độ, chi phí và khả năng xử lý tác vụ AI quy mô lớn.

Cuộc đua trí tuệ nhân tạo tiếp tục tăng tốc khi Google DeepMind chính thức công bố ba mô hình Gemini mới gồm Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber. 

Đây được xem là đợt nâng cấp lớn dành cho dòng Flash, hướng đến nhóm khách hàng doanh nghiệp và nhà phát triển đang xây dựng các hệ thống AI tự động với yêu cầu tốc độ cao, chi phí thấp và khả năng vận hành ổn định.

Google DeepMind giới thiệu ba mô hình Gemini mới nhằm tăng tốc cuộc cạnh tranh trong lĩnh vực trí tuệ nhân tạo. Ảnh: TechCrunch.
Google DeepMind giới thiệu ba mô hình Gemini mới nhằm tăng tốc cuộc cạnh tranh trong lĩnh vực trí tuệ nhân tạo. Ảnh: TechCrunch.

Trong ba sản phẩm vừa ra mắt, Gemini 3.6 Flash được Google định vị là mô hình "chủ lực" mới. Theo công bố từ hãng, mô hình này cải thiện đáng kể hiệu suất trong lập trình, xử lý tri thức và các tác vụ đa phương thức như phân tích hình ảnh, tài liệu, bảng biểu hay video. Điểm đáng chú ý nằm ở việc Gemini 3.6 Flash giảm khoảng 17% lượng token đầu ra so với Gemini 3.5 Flash, đồng nghĩa doanh nghiệp có thể thực hiện cùng một khối lượng công việc với chi phí thấp hơn. Ở một số bài kiểm tra chuyên sâu về lập trình, mức tiết kiệm token thậm chí đạt tới 65%.

Google cũng điều chỉnh mức giá của Gemini 3.6 Flash thấp hơn thế hệ trước, đồng thời cải thiện tốc độ suy luận, giảm số bước xử lý và số lần gọi công cụ trong các quy trình nhiều bước. Điều này giúp các hệ thống AI vận hành hiệu quả hơn khi xử lý lượng lớn yêu cầu cùng lúc.

Việc ưu tiên dòng Flash cho thấy Google đang tập trung tối ưu hiệu quả vận hành AI thay vì chỉ chạy đua về quy mô mô hình. Ảnh: TechCrunch.
Việc ưu tiên dòng Flash cho thấy Google đang tập trung tối ưu hiệu quả vận hành AI thay vì chỉ chạy đua về quy mô mô hình. Ảnh: TechCrunch.

Song song với đó, Gemini 3.5 Flash-Lite được phát triển cho những bài toán cần tốc độ cực cao. Google cho biết mô hình có thể tạo khoảng 350 token mỗi giây, trở thành phiên bản nhanh nhất trong dòng Gemini 3.5. Với mức giá chỉ khoảng 0,3 USD cho một triệu token đầu vào và 2,5 USD cho một triệu token đầu ra, Flash-Lite được xem là lựa chọn phù hợp cho các hệ thống AI xử lý tài liệu, tìm kiếm thông minh hoặc trợ lý AI phục vụ hàng triệu người dùng mỗi ngày.

Theo Google, Flash-Lite vẫn đạt bước tiến lớn so với thế hệ Flash-Lite trước đây ở nhiều bài kiểm tra về lập trình, xử lý ngữ cảnh dài và khả năng thực hiện chuỗi nhiệm vụ tự động. Thậm chí trong một số phép đo, mô hình còn vượt qua cả Gemini 3 Flash cũ dù có chi phí vận hành thấp hơn.

Khác với hai mô hình phổ thông, Gemini 3.5 Flash Cyber hướng đến lĩnh vực an ninh mạng. Đây là phiên bản được tinh chỉnh chuyên biệt nhằm phát hiện và vá các lỗ hổng bảo mật trong mã nguồn. Google cho biết Flash Cyber hoạt động kết hợp với hệ thống CodeMender gồm nhiều tác nhân AI để kiểm tra, xác thực và đề xuất bản vá cho các đoạn mã có nguy cơ bị khai thác.

Sự chậm trễ của Gemini 3.5 Pro khiến Google chịu thêm sức ép trong cuộc cạnh tranh với OpenAI, Anthropic và Meta. Ảnh: TechCrunch.
Sự chậm trễ của Gemini 3.5 Pro khiến Google chịu thêm sức ép trong cuộc cạnh tranh với OpenAI, Anthropic và Meta. Ảnh: TechCrunch.

Trong quá trình thử nghiệm nội bộ, Flash Cyber đã phát hiện 55 vấn đề trong mã nguồn mở V8 JavaScript Engine, trong đó có 10 lỗ hổng mà các mô hình AI khác chưa từng nhận diện. Google hiện chỉ triển khai Flash Cyber cho chính phủ và các đối tác được lựa chọn trong chương trình thử nghiệm giới hạn nhằm hạn chế nguy cơ công nghệ bị lạm dụng phục vụ các cuộc tấn công mạng.

Việc Google ưu tiên phát hành các mô hình Flash cũng phản ánh xu hướng mới của thị trường AI. Thay vì chỉ tập trung vào những mô hình lớn với khả năng suy luận phức tạp, các hãng công nghệ đang tìm cách tối ưu hiệu suất trên từng token để doanh nghiệp có thể triển khai AI với quy mô hàng triệu người dùng mà vẫn kiểm soát được chi phí.

Tuy nhiên, điều khiến giới công nghệ bàn luận nhiều nhất sau sự kiện lại không nằm ở ba mô hình mới, mà là việc Gemini 3.5 Pro tiếp tục vắng bóng. Đây vốn là dòng AI cao cấp nhất của Google dành cho các bài toán lập trình phức tạp và suy luận chuyên sâu. Mô hình gần nhất được cập nhật từ tháng 2, trong khi Google từng hé lộ tại hội nghị I/O rằng Gemini 3.5 Pro sẽ ra mắt trong tháng 6.

Trong khoảng thời gian Google trì hoãn, hàng loạt đối thủ đã liên tiếp tung ra sản phẩm mới. OpenAI phát hành GPT-5.5 rồi bắt đầu triển khai GPT-5.6, Anthropic giới thiệu Claude Sonnet 5, Claude Opus 4.8 cùng Fable 5, còn Meta và nhiều công ty AI Trung Quốc cũng tăng tốc với các mô hình cạnh tranh trực tiếp. Theo Bloomberg, Gemini 3.5 Pro gặp khó khăn trong việc đạt các tiêu chuẩn hiệu suất nội bộ nên thời điểm phát hành phải lùi lại.

Đại diện Google DeepMind xác nhận Gemini 3.5 Pro hiện vẫn được thử nghiệm với các đối tác và sẽ phát hành rộng rãi khi đáp ứng đầy đủ yêu cầu chất lượng. Cùng lúc đó, hãng cũng tiết lộ đã bắt đầu giai đoạn tiền huấn luyện cho Gemini 4, được mô tả là chương trình đào tạo AI tham vọng nhất từ trước đến nay của Google.

Ba mô hình Gemini mới được xem là bước đi chiến lược giúp Google duy trì vị thế trong cuộc đua AI toàn cầu đang thay đổi từng tuần. Ảnh: TechCrunch.
Ba mô hình Gemini mới được xem là bước đi chiến lược giúp Google duy trì vị thế trong cuộc đua AI toàn cầu đang thay đổi từng tuần. Ảnh: TechCrunch.

Sự kiện lần này cho thấy Google đang lựa chọn chiến lược củng cố toàn bộ dòng Flash trước khi tung ra quân bài quan trọng nhất. Trong bối cảnh cuộc cạnh tranh AI giữa Google, OpenAI, Anthropic, Meta và các công ty Trung Quốc ngày càng khốc liệt, tốc độ phát triển, chi phí vận hành và khả năng thương mại hóa đang trở thành yếu tố quyết định bên cạnh sức mạnh thuần túy của mô hình. Gemini 3.6 Flash và hai phiên bản mới có thể chưa phải câu trả lời cuối cùng của Google, nhưng là bước đi quan trọng để giữ vị trí trong một thị trường AI thay đổi gần như từng tuần.

Chia sẻ FacebookChia sẻ

Bài viết

Ngọc Hân

ĐƯỢC QUAN TÂM

TIN MỚI