Google Cloud: Tự triển khai model AI độc quyền ngay trong VPC của doanh nghiệp | CMC Telecom

Google Cloud: Tự triển khai model AI độc quyền ngay trong VPC của doanh nghiệp

Jul 1, 2026
-
82 views

Ngày 7/10/2025, Google Cloud đã công bố một bước tiến quan trọng về quyền lựa chọn và kiểm soát cho doanh nghiệp: khả năng tự triển khai các mô hình AI độc quyền từ các đối tác hàng đầu trực tiếp vào môi trường Virtual Private Cloud (VPC) của khách hàng. Cập nhật này trên nền tảng Vertex AI cho phép các tổ chức tận dụng những mô hình chuyên dụng, kể cả model mã nguồn đóng, trong khi vẫn đảm bảo dữ liệu không bao giờ rời khỏi hạ tầng của mình.

Nền tảng Vertex AI của Google Cloud, với danh mục hơn 200 mô hình nền tảng trong Vertex AI Model Garden, bao gồm gia đình model Gemini, các model mã nguồn mở và model từ bên thứ ba, nay được mở rộng để cung cấp một danh mục duy nhất, được tuyển chọn kỹ lưỡng, giúp doanh nghiệp khám phá, thử nghiệm và triển khai model lý tưởng cho ứng dụng của mình.

Triển khai các mô hình độc quyền vào VPC của bạn trên Google Cloud

Tăng cường kiểm soát và bảo mật với model AI trong VPC

Đối với các tổ chức yêu cầu mức độ kiểm soát tối đa đối với dữ liệu và cơ sở hạ tầng, Google Cloud hiện cho phép tự triển khai các model độc quyền mạnh mẽ từ các nhà xây dựng mô hình AI hàng đầu trực tiếp trong VPC của họ. Với khả năng mới này, doanh nghiệp có thể mua giấy phép thương mại qua Google Cloud Marketplace và triển khai các mô hình một cách an toàn trong môi trường của mình, đồng thời đáp ứng các tiêu chuẩn bảo mật và tuân thủ cao của Google Cloud.

Việc tự triển khai các mô hình độc quyền với Google Cloud mang lại nhiều lợi ích chính:

  • Bảo mật dữ liệu tuyệt đối: Triển khai các mô hình trong VPC tuân thủ đầy đủ các chính sách VPC-SC, cung cấp sự đảm bảo cao nhất rằng dữ liệu kinh doanh độc quyền của bạn không bao giờ rời khỏi môi trường của bạn. Doanh nghiệp có thể đánh giá và triển khai các mô hình của bên thứ ba vào môi trường production trên một nền tảng đáng tin cậy.
  • Tối ưu hóa hiệu năng và chi phí: Doanh nghiệp có thể lựa chọn từ một loạt các loại máy (machine types) có sẵn để tối ưu hóa hiệu năng hoặc chi phí. Mở rộng hoặc thu hẹp số lượng replica theo cách thủ công để đáp ứng nhu cầu workload, hoặc cấu hình chính sách tự động mở rộng (auto-scaling) để quản lý mà không cần can thiệp. Triển khai đến các khu vực (region) Google Cloud cụ thể để đạt được tuân thủ dữ liệu tại các thị trường mục tiêu hoặc chọn các vị trí có độ trễ thấp.
  • Danh mục model đa dạng: Khám phá, cấp phép và triển khai một bộ sưu tập các mô hình độc quyền được tuyển chọn từ các nhà cung cấp hàng đầu, tất cả ở cùng một nơi. Google Cloud đã ra mắt với các mô hình từ tám đối tác: AI21 Labs, CAMB.AI, Contextual AI, CSM, Mistral AI, Qodo, Virtue AI, và WRITER.
  • Triển khai dễ dàng: Chuyển từ khám phá mô hình sang production một cách dễ dàng. Doanh nghiệp có thể mua giấy phép thương mại và triển khai các mô hình chỉ với vài cú nhấp chuột trực tiếp từ giao diện điều khiển Model Garden. Dịch vụ inference AI được quản lý hoàn toàn của Google sẽ xử lý hạ tầng cơ bản, giúp bạn tập trung vào việc xây dựng ứng dụng.
  • Định giá linh hoạt: Bắt đầu với mô hình định giá pay-as-you-go đơn giản, chỉ trả tiền cho những gì bạn sử dụng. Doanh nghiệp có thể tối ưu hóa chi phí hơn nữa bằng cách áp dụng các cam kết sử dụng (CUDs) hoặc các đặt chỗ (reservations) hiện có của Google Cloud.

Các model tiêu biểu tại thời điểm ra mắt

Khám phá các mô hình mới có sẵn để tự triển khai trong VPC của bạn:

Logo của các đối tác cung cấp model AI trên Google Cloud
  • AI21 Labs – Jamba Large 1.6: Cung cấp chất lượng mô hình hàng đầu với tốc độ nhanh, là lựa chọn tuyệt vời cho việc triển khai riêng tư trong doanh nghiệp.
  • CAMB.AI – MARS7: Cho phép bạn cung cấp các ứng dụng giọng nói sẵn sàng cho production với đầu ra chuyển văn bản thành giọng nói (TTS) đa ngôn ngữ siêu thực, có tùy chọn nhân bản giọng nói và kiểm soát cảm xúc chi tiết.
  • Contextual AI – Reranker: Được thiết kế để cải thiện đáng kể sự liên quan và chất lượng của các hệ thống RAG (Sinh tăng cường truy xuất).
  • CSM – Cube: Một mô hình AI tạo sinh giúp chuyển đổi hình ảnh 2D thành các mô hình 3D chi tiết với độ chính xác và hiệu quả vượt trội.
  • Mistral AI – Codestral (25.01): Được thiết kế đặc biệt cho các tác vụ tạo mã (code generation), giúp các lập trình viên viết và tương tác với mã nguồn.
  • Qodo – Embed-1: Một bộ các mô hình embedding mã nguồn quy mô lớn giúp tăng cường độ chính xác tìm kiếm cho RAG bằng cách cho phép truy xuất mã và văn bản hiệu quả.
  • Virtue AI – VirtueGuard: Một mô hình “hàng rào” AI (AI guardrail) dành cho doanh nghiệp, cho phép bảo mật nội dung theo thời gian thực, thực thi chính sách và tuân thủ quy định với hỗ trợ đa ngôn ngữ cho các hệ thống AI tạo sinh.
  • WRITER – Palmyra X4: LLM cấp doanh nghiệp kết hợp cửa sổ ngữ cảnh (context window) 128K token với một bộ khả năng nâng cao, bao gồm lý luận, gọi công cụ (tool calling), RAG tích hợp, tạo mã, và hỗ trợ đa phương thức, đa ngôn ngữ.

Hướng dẫn bắt đầu

Doanh nghiệp có thể triển khai các mô hình mới này qua ba bước đơn giản:

  1. Truy cập Vertex AI Model Garden. Trong tab điều hướng bên trái, dưới mục “Model Collections”, chọn “Self-deploy partner models”.
  2. Chọn mô hình từ một đối tác bạn muốn triển khai. Để sử dụng mô hình đã chọn, hãy mua giấy phép bằng cách nhấp vào “Enable”.
  3. Giấy phép của bạn sẽ được kích hoạt sau vài giây. Chỉ cần nhấp vào “Deploy” để cấu hình và triển khai endpoint của mô hình trong VPC của bạn bằng quy trình triển khai bằng một cú nhấp chuột của Model Garden.

Với nhiều lựa chọn hơn cùng khả năng kiểm soát chi tiết và bảo mật trong môi trường của riêng mình, các doanh nghiệp có mọi thứ cần thiết để đổi mới một cách có trách nhiệm trên nền tảng của Google Cloud.

Tin liên quan

CMC Telecom cam kết hỗ trợ doanh nghiệp của bạn kịp thời

Hãy gửi phản hồi và câu hỏi của bạn cho chúng tôi để được giải đáp

    Hi! Bạn đang cần tư vấn về dịch vụ của Google?