CMC Telecom cam kết hỗ trợ doanh nghiệp của bạn kịp thời
Hãy gửi phản hồi và câu hỏi của bạn cho chúng tôi để được giải đáp
Kỳ vọng của người dùng đối với các hệ thống tìm kiếm ngày càng cao, và kết quả không chính xác có thể khiến doanh nghiệp mất khách hàng. Để giải quyết thách thức này, ngày 31/05/2025, Google Cloud đã ra mắt Vertex AI Ranking API, một dịch vụ giúp tăng cường đáng kể độ chính xác của thông tin trong các ứng dụng tìm kiếm, AI agent và hệ thống RAG.
Trong bối cảnh người dùng đưa ra các truy vấn phức tạp hơn, việc cung cấp kết quả chính xác là tối quan trọng. Các phương pháp tìm kiếm truyền thống thường trả về nhiều kết quả nhiễu, với tới 70% các đoạn văn bản được truy xuất không chứa câu trả lời thật sự. Điều này làm giảm trải nghiệm người dùng và khiến các quy trình của AI agent trở nên kém tin cậy. Vertex AI Ranking API được thiết kế để giúp doanh nghiệp nâng cấp hệ thống tìm kiếm và ứng dụng AI của mình chỉ trong vài phút thay vì vài tháng.
Vertex AI Ranking API hoạt động như một bộ lọc chính xác ở giai đoạn cuối của pipeline truy xuất dữ liệu. Nó sàng lọc một cách thông minh danh sách kết quả ban đầu, xác định và đẩy những thông tin phù hợp nhất lên hàng đầu. Bước tinh chỉnh này là chìa khóa để tạo ra các ứng dụng AI chất lượng cao, đáng tin cậy và hiệu quả hơn.
Bằng cách tích hợp một lớp tinh chỉnh mạnh mẽ, Vertex AI Ranking API giúp các doanh nghiệp:

Trong lần ra mắt này, Google Cloud đã giới thiệu các mô hình sắp xếp lại theo ngữ nghĩa (semantic reranker) mới:
Các mô hình này thiết lập một tiêu chuẩn mới về hiệu suất xếp hạng:
Hiệu suất xếp hạng hàng đầu: Dựa trên các đánh giá sử dụng bộ dữ liệu tiêu chuẩn ngành BEIR, mô hình của Google Cloud dẫn đầu về độ chính xác so với các dịch vụ API reranking cạnh tranh. Các đánh giá này sử dụng chỉ số nDCG (Normalized Discounted Cumulative Gain), một thước đo chất lượng hệ thống xếp hạng bằng cách ưu tiên các kết quả liên quan ở vị trí cao nhất.

Latency thấp hàng đầu thị trường: Mô hình mặc định (semantic-ranker-default-004) nhanh hơn ít nhất 2 lần so với các dịch vụ API reranking cạnh tranh ở mọi quy mô. Mô hình nhanh (semantic-ranker-fast-004) được tối ưu hóa cho các ứng dụng nhạy cảm về độ trễ và thường có latency thấp hơn 3 lần so với mô hình mặc định.
Ngoài ra, Google Cloud cũng ra mắt tính năng xếp hạng với context dài, hỗ trợ tổng cộng 200.000 token cho mỗi yêu cầu API. Việc cung cấp các tài liệu dài hơn cho phép Ranking API hiểu rõ hơn các mối quan hệ phức tạp giữa truy vấn và thông tin, chẳng hạn như đánh giá của khách hàng hoặc thông số kỹ thuật sản phẩm trong ngành bán lẻ.
Các lợi ích của Ranking API không chỉ dừng lại ở lý thuyết. Các bài kiểm tra trên các bộ dữ liệu chuyên ngành cho thấy việc tích hợp API này có thể tăng cường đáng kể chất lượng kết quả tìm kiếm trong nhiều lĩnh vực có giá trị cao như bán lẻ, tin tức, tài chính và y tế.

Google Cloud đã thiết kế Vertex AI Ranking API để có thể tích hợp một cách liền mạch. Việc bổ sung lớp xếp hạng liên quan mạnh mẽ này rất đơn giản, với nhiều tùy chọn khác nhau:
ai.rank() được tích hợp sẵn trực tiếp trong AlloyDB để đơn giản hóa các trường hợp sử dụng tìm kiếm.Hãy gửi phản hồi và câu hỏi của bạn cho chúng tôi để được giải đáp