Zinn Hub
0
Giỏ hàng của bạn
0

Tổng quan

Thông tin chi tiết về dịch vụ này để giúp bạn quyết định. Được tạo bởi Zinn Hub, không phải người bán.

Mục tiêu triển khai

Vertex AI hoặc Cloud Run
Bạn chọn dịch vụ GCP; nhà cung cấp chọn kiến trúc phù hợp dựa trên kích thước mô hình và nhu cầu độ trễ của bạn.

Tùy chọn GPU

T4, L4, hoặc A100
Cấp độ GPU được khớp với yêu cầu VRAM thực tế của mô hình của bạn - không cấp phát quá mức, không cấp phát thiếu.

Phương pháp bảo mật

Điểm cuối VPC-Native
Không có điểm cuối công khai. Trọng số mô hình và dữ liệu của bạn vẫn nằm ngoài internet mở - được bảo mật ở cấp độ mạng.

Tốt nhất cho

Nhà phát triển & Người sáng lập kỹ thuật
Lý tưởng cho các nhóm có mô hình Hugging Face sẵn sàng triển khai nhưng thiếu chuyên môn về cơ sở hạ tầng GCP để triển khai an toàn ở quy mô lớn.

Những gì bạn sẽ nhận được

Định dạng:
Mã tùy chỉnh
Tệp nguồn
Báo cáo bằng văn bản
Phương thức giao hàng:
Quản lý đơn hàng
Ghi chú: Đối với các cấp tư vấn, bản tóm tắt các khuyến nghị bằng văn bản được gửi qua trình quản lý đơn hàng. Đối với các cấp triển khai, tất cả mã nguồn, cấu hình Docker, tập lệnh triển khai và tập lệnh kiểm tra điểm cuối Python được gửi qua trình quản lý đơn hàng. Điểm cuối trực tiếp được triển khai trực tiếp vào dự án GCP của bạn.

Mô tả đầy đủ

Bạn đã tìm thấy mô hình phù hợp. Bây giờ bạn cần nó chạy đáng tin cậy trong sản xuất — không chỉ cục bộ, không trong sổ ghi chép, mà đằng sau một API an toàn, có thể mở rộng mà ứng dụng của bạn thực sự có thể gọi.

Đó chính xác là những gì dịch vụ này mang lại.

Zinn Digital là các chuyên gia Google Cloud có trụ sở tại London. Chúng tôi lấy mô hình Hugging Face bạn đã chọn và triển khai nó vào môi trường sẵn sàng sản xuất trên Vertex AI hoặc Cloud Run — được đóng gói hoàn toàn, cung cấp GPU và được bảo vệ phía sau một điểm cuối VPC-native an toàn. Khi công việc hoàn tất, bạn sẽ nhận được một API trực tiếp mà bạn có thể tích hợp ngay lập tức vào sản phẩm của mình.

**Điều gì làm cho điều này khác với "chỉ chạy một tập lệnh"**

Bất cứ ai cũng có thể khởi tạo một phiên bản GPU và hy vọng điều tốt nhất. Chúng tôi đánh giá các yêu cầu RAM và VRAM thực tế của mô hình của bạn trước khi viết một dòng mã nào, chọn cấp GPU phù hợp (T4, L4 hoặc A100) để cân bằng chi phí và độ trễ, đồng thời xây dựng cơ sở hạ tầng có thể mở rộng theo khối lượng công việc của bạn thay vì sụp đổ dưới nó. Mọi triển khai đều được bảo mật theo thiết kế — không có điểm cuối công khai nào bị bỏ ngỏ, không có thông tin đăng nhập nào được mã hóa cứng.

**Cách thức hoạt động**

Đầu tiên, hãy gửi cho chúng tôi liên kết mô hình và mô tả ngắn gọn về trường hợp sử dụng của bạn. Chúng tôi đánh giá các yêu cầu tài nguyên của mô hình và xác nhận phương pháp triển khai. Sau đó, chúng tôi đóng gói mô hình bằng Docker, triển khai nó lên Vertex AI hoặc Cloud Run, cấu hình cung cấp GPU và bảo mật API, và cuối cùng cung cấp cho bạn một tập lệnh kiểm tra Python đang hoạt động để bạn có thể tự xác minh điểm cuối.

**Những gì được bao gồm**

Tùy thuộc vào cấp độ bạn chọn, bạn sẽ nhận được một số hoặc tất cả các dịch vụ sau: tư vấn chuyên gia và đánh giá kiến trúc, triển khai mô hình đầy đủ đến một điểm cuối GCP an toàn, mã nguồn cho quy trình đóng gói và triển khai, và các bình luận mã chi tiết để nhóm của bạn có thể tự tin duy trì và mở rộng công việc.

**Đối tượng này dành cho ai**

Dịch vụ này phù hợp với các nhà phát triển và nhóm kỹ thuật đã xác định một mô hình Hugging Face mà họ muốn sử dụng trong sản xuất nhưng thiếu kinh nghiệm về cơ sở hạ tầng GCP để triển khai nó một cách an toàn và hiệu quả. Nó cũng rất phù hợp với các nhà sáng lập kỹ thuật cần một backend AI hoạt động mà không cần thuê một nhóm đám mây đầy đủ, và cho các tổ chức đã sử dụng Google Cloud muốn có sự hỗ trợ chuyên nghiệp cho một thách thức triển khai cụ thể.

**Trước khi bạn đặt hàng**

Mỗi dự án là duy nhất. Kích thước mô hình, yêu cầu GPU, kiến trúc GCP hiện có và các ràng buộc bảo mật đều khác nhau. Vui lòng gửi tin nhắn trước khi đặt hàng để chúng tôi có thể xác nhận phương pháp phù hợp với tình huống của bạn và thống nhất phạm vi. Điều này đảm bảo công việc bắt đầu đúng hướng và không có bất ngờ nào.

Đảm bảo chất lượng Zinner

✓
Chuyên gia được kiểm duyệt
Mỗi Zinner đều được xem xét và phê duyệt trước khi tham gia nền tảng.
✓
Đảm bảo chất lượng công việc
Tất cả các dịch vụ đều được đảm bảo bởi cam kết chất lượng của chúng tôi.
✓
Thanh toán an toàn
Khoản thanh toán của bạn được bảo vệ cho đến khi bạn chấp thuận công việc đã giao.

So sánh các gói

Tính năngTư vấnTriển khaiTriển khai + Bình luận
Thời gian giao hàng2 ngày5 ngày10 ngày
Sửa đổi000
Tư vấn chiến lược GCP Vertex AI / Cloud Run 45 phút✓✕✕
Đánh giá mô hình: yêu cầu RAM/VRAM và đề xuất cấp GPU✓✕✕
Hướng dẫn kiến trúc và ước tính chi phí✓✕✕
Phương pháp triển khai được đề xuất được ghi lại bằng văn bản✓✕✕
Lời khuyên về lộ trình tích hợp để kết nối mô hình với ứng dụng hiện có của bạn✓✕✕
Mọi thứ trong cấp Tư vấn✕✓✕
Đóng gói mô hình Dockerised hoàn chỉnh và triển khai lên Vertex AI hoặc Cloud Run✕✓✕
Cung cấp GPU (T4, L4 hoặc A100 tùy theo yêu cầu)✕✓✕
Cấu hình điểm cuối API riêng tư an toàn, gốc VPC✕✓✕
Tập lệnh kiểm tra Python để xác minh điểm cuối trực tiếp✕✓✕
Mã nguồn triển khai đầy đủ được giao cho bạn✕✓✕
Mọi thứ trong cấp độ Triển khai✕✕✓
Bình luận mã nội tuyến chi tiết xuyên suốt tất cả các tập lệnh và tệp cấu hình✕✕✓
Các quyết định kiến trúc được ghi lại giải thích lựa chọn GPU và các lựa chọn bảo mật✕✕✓
Cơ sở mã sẵn sàng bàn giao mà nhóm của bạn có thể tự tin duy trì và mở rộng✕✕✓
Thích hợp cho các LLM lớn hơn hoặc phức tạp hơn (ví dụ: Llama 3, các biến thể lớn của Mistral)✕✕✓
Quản lý đơn hàng ưu tiên và hợp tác chặt chẽ hơn thông qua trò chuyện đơn hàng✕✕✓

Danh mục đầu tư

Ví dụ về công việc của người bán liên quan đến Zinn này.

Triển khai Hugging Face LLM lên GCP Vertex AI hoặc Cloud Run

Triển khai Hugging Face LLM lên GCP Vertex AI hoặc Cloud Run

Thông tin bổ sung

Tại sao chọn tôi

Trụ sở tại:London, England
Chuyên môn:Nền tảng Google Cloud — Triển khai Vertex AI và Cloud Run
Cách tiếp cận của chúng tôi:Chúng tôi không chỉ chạy các tập lệnh. Chúng tôi đánh giá các yêu cầu về RAM/VRAM, chọn cấp GPU phù hợp với mục tiêu chi phí và độ trễ của bạn, đồng thời xây dựng cơ sở hạ tầng VPC-native an toàn, có thể mở rộng theo doanh nghiệp của bạn.

Công cụ tôi sử dụng

Nền tảng đám mây:Google Cloud Platform (GCP)
Mục tiêu triển khai:Vertex AI, Cloud Run
Containerisation:Docker
Nguồn mô hình:Hugging Face (Llama, Mistral, Gemma, BERT và nhiều hơn nữa)
Tùy chọn GPU:NVIDIA T4, L4, A100

Hoàn hảo cho

Ai được hưởng lợi nhiều nhất:Các nhà phát triển tích hợp LLM mã nguồn mở vào ứng dụng sản xuất Các nhà sáng lập kỹ thuật xây dựng sản phẩm hỗ trợ AI trên Google Cloud Các nhóm kỹ thuật cần hỗ trợ chuyên gia cho một triển khai GCP cụ thể Các tổ chức chuyển từ nguyên mẫu sang cơ sở hạ tầng AI có thể mở rộng, an toàn

Câu hỏi thường gặp

Chúng tôi làm việc với nhiều loại mô hình bao gồm Llama 3, Mistral, Gemma, BERT và các mô hình dựa trên transformer khác được lưu trữ trên Hugging Face. Kích thước mô hình và yêu cầu GPU khác nhau, vì vậy vui lòng nhắn tin cho chúng tôi trước khi đặt hàng với liên kết mô hình và trường hợp sử dụng của bạn để chúng tôi có thể xác nhận khả năng tương thích và đề xuất cấp độ phù hợp.

Có. Bạn sẽ cần một tài khoản GCP đang hoạt động với tính năng thanh toán được bật. Chúng tôi làm việc trong môi trường của bạn để bạn giữ toàn quyền sở hữu tất cả cơ sở hạ tầng đã triển khai và chịu trực tiếp chi phí GCP. Nếu bạn không chắc chắn cách thiết lập, cấp độ Tư vấn là một điểm khởi đầu tuyệt vời.

Tối thiểu, chúng tôi cần liên kết mô hình Hugging Face và mô tả ngắn gọn về mục đích bạn định sử dụng nó. Đối với các cấp triển khai, chúng tôi cũng sẽ cần thông tin đăng nhập để truy cập dự án GCP của bạn. Chúng tôi sẽ hướng dẫn bạn chính xác những gì cần chia sẻ một cách an toàn qua trò chuyện đơn hàng.

Các mô hình lớn hơn đòi hỏi đánh giá tài nguyên cẩn thận hơn, thời gian xây dựng container lâu hơn và thử nghiệm kỹ lưỡng hơn điểm cuối trực tiếp. Thời gian bổ sung đảm bảo việc triển khai ổn định, an toàn và được ghi lại đúng cách trước khi bàn giao.

Việc triển khai VPC-native (Virtual Private Cloud) có nghĩa là điểm cuối mô hình của bạn không bị lộ ra internet. Quyền truy cập bị hạn chế ở cấp độ mạng, điều này quan trọng để giữ an toàn cho dữ liệu độc quyền và trọng số mô hình trong môi trường sản xuất.

Cấp triển khai bao gồm mã nguồn đầy đủ để nhóm của bạn có mọi thứ họ cần. Cấp triển khai + Bình luận bổ sung cung cấp các chú thích nội tuyến chi tiết giải thích mọi quyết định quan trọng, giúp các kỹ sư của bạn dễ dàng duy trì và mở rộng cơ sở mã theo thời gian.

Mỗi mô hình và mỗi môi trường GCP đều khác nhau. Một cuộc trò chuyện nhanh chóng đảm bảo chúng tôi hiểu các yêu cầu của bạn, xác nhận cấp độ phù hợp và tránh mọi sự qua lại sau khi đơn hàng bắt đầu. Điều đó cũng có nghĩa là chúng tôi có thể báo trước bất kỳ GPU hoặc chi phí bất thường nào cụ thể cho mô hình bạn đã chọn.

Đánh giá của khách hàng

Xem khách hàng của chúng tôi nói gì về Zinn này

5.0
2 đánh giá
5 ⭐
2
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

Chuyên gia VertexAI rất am hiểu đã trả lời tất cả các câu hỏi của tôi và thậm chí còn cho tôi những hiểu biết hữu ích cho tôi nhưng tôi chưa hỏi cụ thể.

Umair cho đến nay là người giỏi nhất mà chúng tôi từng làm việc cùng tại Zinn Hub. Anh ấy đặc biệt xuất sắc trong việc hiểu các yêu cầu độc đáo của dự án của chúng tôi. Anh ấy đã làm việc vượt xa mong đợi. Tôi sẽ giới thiệu anh ấy cho bất kỳ dự án AI nào.

Chỉ những khách hàng đã đăng nhập và mua sản phẩm này mới có thể để lại đánh giá.

Danh mục

Chính sách Zinner

Triển khai các mô hình Hugging Face

Chỉ những khách hàng đã đăng nhập và mua sản phẩm này mới có thể để lại đánh giá.

Tùy chọn & Đặt hàng

Tải ứng dụng Zinn Hub

Thông báo · Truy cập nhanh hơn · Toàn màn hình

Nhấn Chia sẻ trong trình duyệt của bạn

➜ Sau đó nhấn "Thêm vào Màn hình chính"