0
รถเข็นของคุณ
0
Zinn Hub
0
รถเข็นของคุณ
0

โดยสรุป

รายละเอียดสำคัญเกี่ยวกับบริการนี้เพื่อช่วยคุณตัดสินใจ สร้างโดย Zinn Hub ไม่ใช่ผู้ขาย

เป้าหมายการปรับใช้

Vertex AI หรือ Cloud Run
คุณเลือกบริการ GCP; ผู้ขายจะเลือกสถาปัตยกรรมที่เหมาะสมตามขนาดโมเดลและความต้องการเวลาแฝงของคุณ

ตัวเลือก GPU

T4, L4, หรือ A100
ระดับ GPU จะถูกจับคู่กับความต้องการ VRAM ที่แท้จริงของโมเดลของคุณ - ไม่มีการจัดสรรเกินความจำเป็น ไม่มีการจัดสรรน้อยเกินไป

แนวทางการรักษาความปลอดภัย

VPC-Native Endpoints
ไม่มีจุดสิ้นสุดสาธารณะ น้ำหนักโมเดลและข้อมูลของคุณจะไม่อยู่บนอินเทอร์เน็ตสาธารณะ – ปลอดภัยในระดับเครือข่าย

ดีที่สุดสำหรับ

นักพัฒนาและผู้ก่อตั้งด้านเทคนิค
เหมาะสำหรับทีมที่มีโมเดล Hugging Face พร้อมจัดส่ง แต่ขาดความเชี่ยวชาญด้านโครงสร้างพื้นฐาน GCP ในการปรับใช้โมเดลอย่างปลอดภัยในวงกว้าง

สิ่งที่คุณจะได้รับ

รูปแบบ:
รหัสที่กำหนดเอง
ไฟล์ต้นฉบับ
รายงานเป็นลายลักษณ์อักษร
วิธีการจัดส่ง:
ผู้จัดการคำสั่งซื้อ
หมายเหตุ: สำหรับระดับการให้คำปรึกษา สรุปคำแนะนำที่เป็นลายลักษณ์อักษรจะถูกส่งผ่านผู้จัดการคำสั่งซื้อ สำหรับระดับการปรับใช้ ซอร์สโค้ดทั้งหมด การกำหนดค่า Docker สคริปต์การปรับใช้ และสคริปต์ทดสอบปลายทาง Python จะถูกส่งผ่านผู้จัดการคำสั่งซื้อ ปลายทางสดจะถูกปรับใช้โดยตรงในโครงการ GCP ของคุณ

คำอธิบายฉบับเต็ม

คุณพบโมเดลที่ถูกต้องแล้ว ตอนนี้คุณต้องการให้มันทำงานได้อย่างน่าเชื่อถือในการผลิต — ไม่ใช่แค่ในเครื่อง ไม่ใช่ในสมุดบันทึก แต่เบื้องหลัง API ที่ปลอดภัยและปรับขนาดได้ที่แอปพลิเคชันของคุณสามารถเรียกใช้ได้จริง

นั่นคือสิ่งที่บริการนี้มอบให้

Zinn Digital เป็นผู้เชี่ยวชาญ Google Cloud ที่ตั้งอยู่ในลอนดอน เรานำโมเดล Hugging Face ที่คุณเลือกและปรับใช้กับสภาพแวดล้อมที่พร้อมสำหรับการผลิตบน Vertex AI หรือ Cloud Run — บรรจุในคอนเทนเนอร์อย่างสมบูรณ์ จัดเตรียม GPU และป้องกันอยู่เบื้องหลังปลายทางที่ปลอดภัยและเป็น VPC-native เมื่อทำงานเสร็จ คุณจะได้รับ API สดที่คุณสามารถรวมเข้ากับผลิตภัณฑ์ของคุณได้ทันที

**อะไรที่ทำให้สิ่งนี้แตกต่างจากการ "แค่รันสคริปต์"**

ใคร ๆ ก็สามารถสร้างอินสแตนซ์ GPU และหวังให้ดีที่สุดได้ เราประเมิน RAM และ VRAM ที่แท้จริงที่โมเดลของคุณต้องการก่อนที่จะเขียนโค้ดแม้แต่บรรทัดเดียว เลือก GPU ระดับที่เหมาะสม (T4, L4 หรือ A100) เพื่อสร้างสมดุลระหว่างต้นทุนและความหน่วง และสร้างโครงสร้างพื้นฐานที่ปรับขนาดได้ตามปริมาณงานของคุณ แทนที่จะล่มลงภายใต้ปริมาณงานนั้น การปรับใช้ทุกครั้งได้รับการรักษาความปลอดภัยตั้งแต่การออกแบบ — ไม่มีปลายทางสาธารณะเปิดทิ้งไว้ ไม่มีข้อมูลรับรองที่ฮาร์ดโค้ด

**วิธีการทำงาน**

ขั้นแรก ส่งลิงก์โมเดลและคำอธิบายสั้นๆ เกี่ยวกับกรณีการใช้งานของคุณมาให้เรา เราจะประเมินความต้องการทรัพยากรของโมเดลและยืนยันแนวทางการปรับใช้ จากนั้นเราจะจัดทำคอนเทนเนอร์โมเดลโดยใช้ Docker ปรับใช้กับ Vertex AI หรือ Cloud Run กำหนดค่าการจัดเตรียม GPU และความปลอดภัยของ API และสุดท้ายส่งสคริปต์ทดสอบ Python ที่ใช้งานได้ให้คุณ เพื่อให้คุณสามารถตรวจสอบปลายทางได้ด้วยตัวเอง

**สิ่งที่รวมอยู่**

ขึ้นอยู่กับระดับที่คุณเลือก คุณจะได้รับบางส่วนหรือทั้งหมดดังต่อไปนี้: การให้คำปรึกษาจากผู้เชี่ยวชาญและการประเมินสถาปัตยกรรม, การปรับใช้โมเดลเต็มรูปแบบไปยังปลายทาง GCP ที่ปลอดภัย, ซอร์สโค้ดสำหรับการทำคอนเทนเนอร์และไปป์ไลน์การปรับใช้, และความคิดเห็นโค้ดแบบอินไลน์โดยละเอียด เพื่อให้ทีมของคุณสามารถบำรุงรักษาและขยายงานได้อย่างมั่นใจ

**สำหรับใคร**

บริการนี้เหมาะสำหรับนักพัฒนาและทีมวิศวกรที่ระบุโมเดล Hugging Face ที่ต้องการใช้ในการผลิต แต่ขาดประสบการณ์โครงสร้างพื้นฐาน GCP ในการปรับใช้ได้อย่างปลอดภัยและมีประสิทธิภาพ นอกจากนี้ยังเหมาะสำหรับผู้ก่อตั้งด้านเทคนิคที่ต้องการแบ็กเอนด์ AI ที่ใช้งานได้โดยไม่ต้องจ้างทีมคลาวด์เต็มรูปแบบ และสำหรับองค์กรที่ใช้ Google Cloud อยู่แล้วที่ต้องการผู้เชี่ยวชาญในการแก้ปัญหาการปรับใช้เฉพาะ

**ก่อนที่คุณจะสั่งซื้อ**

ทุกโครงการมีเอกลักษณ์เฉพาะตัว ขนาดโมเดล, ข้อกำหนด GPU, สถาปัตยกรรม GCP ที่มีอยู่ และข้อจำกัดด้านความปลอดภัยล้วนแตกต่างกันไป โปรดส่งข้อความก่อนทำการสั่งซื้อเพื่อให้เรายืนยันว่าแนวทางนี้เหมาะสมกับสถานการณ์ของคุณและตกลงขอบเขตงาน สิ่งนี้ช่วยให้มั่นใจว่างานเริ่มต้นได้อย่างถูกต้องและไม่มีเรื่องเซอร์ไพรส์

การรับประกันคุณภาพ Zinner

✓
ผู้เชี่ยวชาญที่ผ่านการตรวจสอบ
Zinner ทุกคนจะได้รับการตรวจสอบและอนุมัติก่อนเข้าร่วมแพลตฟอร์ม
✓
รับประกันคุณภาพงาน
บริการทั้งหมดได้รับการสนับสนุนจากความมุ่งมั่นในการประกันคุณภาพของเรา
✓
การชำระเงินที่ปลอดภัย
การชำระเงินของคุณจะได้รับการคุ้มครองจนกว่าคุณจะอนุมัติงานที่ส่งมอบ

เปรียบเทียบแพ็คเกจ

คุณสมบัติการให้คำปรึกษาการปรับใช้การปรับใช้ + ความคิดเห็น
เวลาจัดส่ง2 วัน5 วัน10 วัน
การแก้ไข000
การให้คำปรึกษาด้านกลยุทธ์ GCP Vertex AI / Cloud Run 45 นาที✓✕✕
การประเมินโมเดล: ข้อกำหนด RAM/VRAM และคำแนะนำระดับ GPU✓✕✕
คำแนะนำด้านสถาปัตยกรรมและการประมาณราคา✓✕✕
แนวทางการปรับใช้ที่แนะนำที่จัดทำเป็นเอกสาร✓✕✕
คำแนะนำเส้นทางการรวมระบบสำหรับการเชื่อมต่อโมเดลเข้ากับแอปที่มีอยู่ของคุณ✓✕✕
ทุกอย่างในระดับการให้คำปรึกษา✕✓✕
การรวมคอนเทนเนอร์โมเดล Dockerised เต็มรูปแบบและการปรับใช้กับ Vertex AI หรือ Cloud Run✕✓✕
การจัดเตรียม GPU (T4, L4, หรือ A100 ตามความเหมาะสม)✕✓✕
การกำหนดค่าปลายทาง API ส่วนตัวที่ปลอดภัยและเป็น VPC-native✕✓✕
สคริปต์ทดสอบ Python เพื่อตรวจสอบปลายทางที่ใช้งานจริง✕✓✕
ซอร์สโค้ดการปรับใช้ฉบับเต็มส่งถึงคุณ✕✓✕
ทุกอย่างในระดับ Deployment✕✕✓
ความคิดเห็นโค้ดแบบอินไลน์โดยละเอียดตลอดสคริปต์และไฟล์การกำหนดค่าทั้งหมด✕✕✓
การตัดสินใจด้านสถาปัตยกรรมที่จัดทำเป็นเอกสารอธิบายการเลือก GPU และตัวเลือกความปลอดภัย✕✕✓
โค้ดเบสที่พร้อมส่งมอบซึ่งทีมของคุณสามารถบำรุงรักษาและขยายได้อย่างมั่นใจ✕✕✓
เหมาะสำหรับ LLM ที่มีขนาดใหญ่ขึ้นหรือซับซ้อนมากขึ้น (เช่น Llama 3, Mistral รุ่นใหญ่)✕✕✓
การจัดการคำสั่งซื้อตามลำดับความสำคัญและการทำงานร่วมกันอย่างใกล้ชิดผ่านการแชทคำสั่งซื้อ✕✕✓

ผลงาน

ตัวอย่างผลงานของผู้ขายที่เกี่ยวข้องกับ Zinn นี้

ปรับใช้ Hugging Face LLMs กับ GCP Vertex AI หรือ Cloud Run

ปรับใช้ Hugging Face LLMs กับ GCP Vertex AI หรือ Cloud Run

ข้อมูลเพิ่มเติม

ทำไมต้องเลือกฉัน

ตั้งอยู่ใน:ลอนดอน, อังกฤษ
ความเชี่ยวชาญ:Google Cloud Platform — การปรับใช้ Vertex AI และ Cloud Run
แนวทางของเรา:เราไม่ได้แค่รันสคริปต์ เราประเมินความต้องการ RAM/VRAM เลือก GPU ระดับที่เหมาะสมสำหรับเป้าหมายด้านต้นทุนและความหน่วงของคุณ และสร้างโครงสร้างพื้นฐาน VPC-native ที่ปลอดภัยซึ่งปรับขนาดได้ตามธุรกิจของคุณ

เครื่องมือที่ฉันใช้

แพลตฟอร์มคลาวด์:Google Cloud Platform (GCP)
เป้าหมายการปรับใช้:Vertex AI, Cloud Run
การทำคอนเทนเนอร์:Docker
แหล่งที่มาของโมเดล:Hugging Face (Llama, Mistral, Gemma, BERT และอื่นๆ)
ตัวเลือก GPU:NVIDIA T4, L4, A100

เหมาะสำหรับ

ใครได้รับประโยชน์สูงสุด:นักพัฒนาที่รวม LLM แบบโอเพนซอร์สเข้ากับแอปพลิเคชันที่ใช้งานจริง ผู้ก่อตั้งด้านเทคนิคที่สร้างผลิตภัณฑ์ที่ขับเคลื่อนด้วย AI บน Google Cloud ทีมวิศวกรที่ต้องการการสนับสนุนจากผู้เชี่ยวชาญสำหรับการปรับใช้ GCP โดยเฉพาะ องค์กรที่กำลังเปลี่ยนจากต้นแบบไปสู่โครงสร้างพื้นฐาน AI ที่ปรับขนาดได้และปลอดภัย

คำถามที่พบบ่อย

เราทำงานกับโมเดลที่หลากหลาย รวมถึง Llama 3, Mistral, Gemma, BERT และโมเดลที่ใช้ Transformer อื่นๆ ที่โฮสต์บน Hugging Face ขนาดโมเดลและข้อกำหนด GPU แตกต่างกันไป ดังนั้นโปรดส่งข้อความหาเราก่อนสั่งซื้อพร้อมลิงก์โมเดลและกรณีการใช้งานของคุณ เพื่อให้เราสามารถยืนยันความเข้ากันได้และแนะนำระดับที่เหมาะสม

ใช่ คุณจะต้องมีบัญชี GCP ที่ใช้งานอยู่และเปิดใช้งานการเรียกเก็บเงิน เราทำงานในสภาพแวดล้อมของคุณเพื่อให้คุณยังคงเป็นเจ้าของโครงสร้างพื้นฐานที่ปรับใช้ทั้งหมดและรับผิดชอบค่าใช้จ่าย GCP โดยตรง หากคุณไม่แน่ใจว่าจะตั้งค่านี้อย่างไร ระดับการให้คำปรึกษาเป็นจุดเริ่มต้นที่ดี

อย่างน้อยที่สุด เราต้องการลิงก์โมเดล Hugging Face และคำอธิบายสั้นๆ ว่าคุณตั้งใจจะใช้มันเพื่ออะไร สำหรับระดับการปรับใช้ เราจะต้องเข้าถึงข้อมูลประจำตัวของโปรเจกต์ GCP ของคุณด้วย เราจะแนะนำคุณอย่างละเอียดว่าจะแบ่งปันข้อมูลใดอย่างปลอดภัยผ่านการแชทคำสั่งซื้อ

โมเดลขนาดใหญ่ต้องมีการประเมินทรัพยากรที่ระมัดระวังมากขึ้น, ใช้เวลาในการสร้างคอนเทนเนอร์นานขึ้น, และต้องมีการทดสอบปลายทางแบบสดที่ละเอียดถี่ถ้วนมากขึ้น เวลาที่เพิ่มขึ้นนี้ช่วยให้มั่นใจว่าการปรับใช้มีเสถียรภาพ, ปลอดภัย, และมีการจัดทำเอกสารอย่างถูกต้องก่อนส่งมอบ

การปรับใช้แบบ VPC-native (Virtual Private Cloud) หมายความว่าปลายทางของโมเดลของคุณจะไม่ถูกเปิดเผยต่ออินเทอร์เน็ตสาธารณะ การเข้าถึงถูกจำกัดในระดับเครือข่าย ซึ่งเป็นสิ่งสำคัญสำหรับการรักษาข้อมูลที่เป็นกรรมสิทธิ์และน้ำหนักของโมเดลให้ปลอดภัยในสภาพแวดล้อมการผลิต

ระดับการปรับใช้ (Deployment tier) รวมถึงซอร์สโค้ดทั้งหมดเพื่อให้ทีมของคุณมีทุกสิ่งที่ต้องการ ระดับการปรับใช้ + ความคิดเห็น (Deployment + Comments tier) ยังให้คำอธิบายประกอบแบบอินไลน์โดยละเอียดที่อธิบายการตัดสินใจที่สำคัญทุกอย่าง ทำให้โค้ดเบสตรงไปตรงมาสำหรับวิศวกรของคุณในการบำรุงรักษาและขยายในระยะยาว

ทุกโมเดลและทุกสภาพแวดล้อม GCP แตกต่างกัน การสนทนาสั้นๆ ช่วยให้เราเข้าใจความต้องการของคุณ ยืนยันระดับที่ถูกต้อง และหลีกเลี่ยงการโต้ตอบไปมาหลังจากเริ่มคำสั่งซื้อ นอกจากนี้ยังหมายความว่าเราสามารถแจ้งข้อควรพิจารณาเกี่ยวกับ GPU หรือค่าใช้จ่ายที่ผิดปกติซึ่งเฉพาะเจาะจงสำหรับโมเดลที่คุณเลือกได้ล่วงหน้า

รีวิวจากลูกค้า

ดูว่าลูกค้าของเราพูดถึง Zinn นี้ว่าอย่างไร

5.0
2 รีวิว
5 ⭐
2
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

ผู้เชี่ยวชาญ VertexAI ที่มีความรู้มาก ตอบคำถามทั้งหมดของฉันและยังให้ข้อมูลเชิงลึกที่เป็นประโยชน์สำหรับฉันแต่ฉันไม่ได้ถามถึงโดยเฉพาะ

Umair เป็นคนที่ยอดเยี่ยมที่สุดที่เราเคยร่วมงานด้วยใน Zinn Hub เขาเข้าใจความต้องการเฉพาะของโปรเจกต์ของเราได้อย่างยอดเยี่ยม เขาทำงานเกินความคาดหมาย ผมขอแนะนำเขาสำหรับโปรเจกต์ AI ใดๆ

เฉพาะลูกค้าที่เข้าสู่ระบบและซื้อผลิตภัณฑ์นี้เท่านั้นจึงจะสามารถแสดงความคิดเห็นได้

หมวดหมู่

นโยบาย Zinner

ปรับใช้โมเดล Hugging Face

เฉพาะลูกค้าที่เข้าสู่ระบบและซื้อผลิตภัณฑ์นี้เท่านั้นจึงจะสามารถแสดงความคิดเห็นได้

ตัวเลือกและคำสั่งซื้อ

รับแอป Zinn Hub

การแจ้งเตือน · เข้าถึงได้เร็วขึ้น · เต็มหน้าจอ

แตะ แชร์ ในเบราว์เซอร์ของคุณ

➜ จากนั้นแตะ "เพิ่มไปยังหน้าจอหลัก"