Google thương ba mô hình AI mới: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, tất cả đều được thiết kế để giảm chi phí và nâng cao hiệu quả. Mẫu Gemini 3.5 Pro hàng đầu vẫn vắng mặt.
Ba biến thể Gemini cho hiệu quả
Gemini 3.6 Flash nổi bật là mô hình tham chiếu mới của Google, được trình bày dưới dạng mô hình hiệu suất cao. Nó mang lại lợi ích trong việc lập trình, xử lý kiến thức và các tác vụ đa phương thức, đồng thời giảm mức tiêu thụ mã thông báo xuống 17% so với Gemini 3.5 Flash. Chi phí của nó là 1,50 USD trên một triệu mã thông báo đầu vào và 7,50 USD trên một triệu mã thông báo đầu ra. Nó có sẵn trong ứng dụng Gemini và các nhà phát triển có thể truy cập thông qua AntiGravity, AI Studio và Android Studio.
Gemini 3.5 Flash-Lite hoàn thành ưu đãi này với tư cách là phiên bản tiết kiệm nhất, được thiết kế để tối đa hóa lợi nhuận. Chi phí của nó là 0,30 USD cho mỗi triệu mã thông báo đầu vào và 2,50 USD cho mỗi triệu mã thông báo đầu ra. Mô hình này có sẵn trong ứng dụng Gemini cũng như trong công cụ tìm kiếm Google, nhắm mục tiêu sử dụng khối lượng lớn trong đó chi phí cho mỗi truy vấn quan trọng hơn năng lượng thô.
Mô hình thứ ba, Gemini 3.5 Flash Cyber, đặc biệt nhắm đến an ninh mạng. Được xây dựng trên nền tảng Gemini 3.5 Flash, nó được cung cấp với mức giá hợp lý và ban đầu dành riêng cho các chính phủ và đối tác đáng tin cậy thông qua nền tảng CodeMender. Hiệu suất của nó có thể cạnh tranh với các mẫu lớn hơn nhiều trong các thử nghiệm của CyberGym. Kết quả cụ thể của nó trên công cụ JavaScript V8 minh họa cho hiệu quả này: 55 lỗ hổng được phát hiện, so với 47 lỗ hổng trên Gemini 3.5 Flash và chỉ 36 lỗ hổng trên Claude Opus 4.6, trong đó có 10 lỗ hổng mà không mô hình nào khác có thể phát hiện ra.
Sự vắng mặt nặng nề của Gemini 3.5 Pro
Thông báo này không lấp đầy khoảng trống mà Gemini 3.5 Pro để lại, ban đầu được Google mong đợi nhưng vẫn chưa có. Bloomberg xác nhận gần đây đã xuất hiện sự chậm trễ nội bộ trong quá trình phát triển mô hình này. Điều này được giải thích là do mô hình khó có khả năng viết mã giỏi so với các đối thủ Claude và ChatGPT.
Sự vắng mặt này xảy ra khi sự cạnh tranh tiếp tục gia tăng trong phân khúc mô hình AI tiên tiến. OpenAI đã triển khai GPT-5.5 Và GPT-5.6trong khi Anthropic nhân lên với Claude Opus 4.8, bài sonnet 5 Và Truyện ngụ ngôn 5đặt Google vào thế phòng thủ trên nền tảng chính xác này.
Google đang tập trung nỗ lực vào hiệu quả, độ trễ và độ tin cậy, những tiêu chí mang tính quyết định để triển khai các tác nhân AI trên quy mô lớn. Chiến lược này trái ngược với chiến lược của Anthropic, mô hình Mythos 5, đặc biệt mạnh mẽ, có giá cao gấp đôi so với Opus 4.8.
Cuộc thi cũng đang mang tính quốc tế hóa, với sự xuất hiện của Z.ai, một model Trung Quốc được coi là cạnh tranh với Mythos 5. Ngoài ra còn có Kimi K3 cũng đang được rất nhiều người chú ý. Về phần mình, Google đã chuẩn bị phần tiếp theo của Gemini 4. “Chúng tôi đã triển khai chiến dịch đào tạo sơ bộ đầy tham vọng nhất của mình cho Gemini 4 và chúng tôi rất nóng lòng được thông báo thêm cho bạn”chỉ đơn giản là chỉ ra nhóm.

















