ਆਪਣੇ Hugging Face ਮਾਡਲ — Llama, Mistral, Gemma, ਜਾਂ BERT — ਨੂੰ Google Cloud 'ਤੇ ਇੱਕ ਸੁਰੱਖਿਅਤ, ਸਕੇਲੇਬਲ, ਉਤਪਾਦਨ-ਤਿਆਰ ਐਂਡਪੁਆਇੰਟ 'ਤੇ ਤੈਨਾਤ ਕਰੋ, ਪੂਰੀ ਤਰ੍ਹਾਂ ਕੰਟੇਨਰਾਈਜ਼ਡ ਅਤੇ API-ਤਿਆਰ।
ਮੈਂ Hugging Face LLMs ਨੂੰ GCP Vertex AI ਜਾਂ Cloud Run 'ਤੇ ਤੈਨਾਤ ਕਰਾਂਗਾ
ਤੁਹਾਡੇ ਮਾਡਲ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ, ਤੁਹਾਡੀ GCP ਡਿਪਲਾਇਮੈਂਟ ਰਣਨੀਤੀ ਦਾ ਨਕਸ਼ਾ ਬਣਾਉਣ, ਅਤੇ ਤੁਹਾਡੇ ਆਰਕੀਟੈਕਚਰ ਸਵਾਲਾਂ ਦੇ ਜਵਾਬ ਦੇਣ ਲਈ ਇੱਕ ਕੇਂਦਰਿਤ 45-ਮਿੰਟ ਦੀ ਮਾਹਰ ਸਲਾਹ।
- 45-ਮਿੰਟ ਦੀ GCP ਵਰਟੈਕਸ AI / ਕਲਾਉਡ ਰਨ ਰਣਨੀਤੀ ਸਲਾਹ-ਮਸ਼ਵਰਾ
- ਮਾਡਲ ਮੁਲਾਂਕਣ: RAM/VRAM ਲੋੜਾਂ ਅਤੇ GPU ਟੀਅਰ ਸਿਫ਼ਾਰਸ਼
- ਆਰਕੀਟੈਕਚਰ ਅਤੇ ਲਾਗਤ ਅਨੁਮਾਨ ਮਾਰਗਦਰਸ਼ਨ
- ਸਿਫ਼ਾਰਿਸ਼ ਕੀਤੀ ਤੈਨਾਤੀ ਪਹੁੰਚ ਲਿਖਤੀ ਰੂਪ ਵਿੱਚ ਦਸਤਾਵੇਜ਼ੀਬੱਧ ਕੀਤੀ ਗਈ
- ਤੁਹਾਡੀ ਮੌਜੂਦਾ ਐਪ ਨਾਲ ਮਾਡਲ ਨੂੰ ਕਨੈਕਟ ਕਰਨ ਲਈ ਏਕੀਕਰਣ ਮਾਰਗ ਸਲਾਹ
ਤੁਹਾਡੇ Hugging Face ਮਾਡਲ ਦੀ ਇੱਕ ਸੁਰੱਖਿਅਤ GCP ਐਂਡਪੁਆਇੰਟ 'ਤੇ ਪੂਰੀ ਤਰ੍ਹਾਂ ਤੈਨਾਤੀ, ਨਾਲ ਹੀ ਸਰੋਤ ਕੋਡ ਤਾਂ ਜੋ ਤੁਹਾਡੀ ਟੀਮ ਇਸਦੀ ਮਾਲਕੀ ਅਤੇ ਵਿਸਤਾਰ ਕਰ ਸਕੇ।
- ਸਲਾਹ-ਮਸ਼ਵਰੇ ਦੇ ਪੱਧਰ ਵਿੱਚ ਸਭ ਕੁਝ
- ਪੂਰੀ ਤਰ੍ਹਾਂ ਡੌਕਰਾਈਜ਼ਡ ਮਾਡਲ ਕੰਟੇਨਰਾਈਜ਼ੇਸ਼ਨ ਅਤੇ ਵਰਟੈਕਸ AI ਜਾਂ ਕਲਾਉਡ ਰਨ 'ਤੇ ਤੈਨਾਤੀ
- GPU ਪ੍ਰੋਵਿਜ਼ਨਿੰਗ (T4, L4, ਜਾਂ A100 ਜਿਵੇਂ ਉਚਿਤ ਹੋਵੇ)
- ਸੁਰੱਖਿਅਤ, VPC-ਮੂਲ ਨਿੱਜੀ API ਐਂਡਪੁਆਇੰਟ ਸੰਰਚਨਾ
- ਲਾਈਵ ਐਂਡਪੁਆਇੰਟ ਦੀ ਪੁਸ਼ਟੀ ਕਰਨ ਲਈ ਪਾਈਥਨ ਟੈਸਟ ਸਕ੍ਰਿਪਟ
- ਤੁਹਾਨੂੰ ਡਿਲੀਵਰ ਕੀਤਾ ਗਿਆ ਪੂਰਾ ਡਿਪਲਾਇਮੈਂਟ ਸਰੋਤ ਕੋਡ
ਪੂਰਾ ਡਿਪਲਾਇਮੈਂਟ ਪੈਕੇਜ ਜਿਸ ਵਿੱਚ ਪੂਰੇ ਕੋਡਬੇਸ ਵਿੱਚ ਵਿਸਤ੍ਰਿਤ ਇਨਲਾਈਨ ਕੋਡ ਟਿੱਪਣੀਆਂ ਸ਼ਾਮਲ ਹਨ, ਜਿਸ ਨਾਲ ਕੋਡਬੇਸ ਤੁਹਾਡੀ ਇੰਜੀਨੀਅਰਿੰਗ ਟੀਮ ਦੁਆਰਾ ਪੂਰੀ ਤਰ੍ਹਾਂ ਸੰਭਾਲਣ ਯੋਗ ਬਣ ਜਾਂਦਾ ਹੈ।
- ਡਿਪਲਾਇਮੈਂਟ ਟੀਅਰ ਵਿੱਚ ਸਭ ਕੁਝ
- ਸਾਰੀਆਂ ਸਕ੍ਰਿਪਟਾਂ ਅਤੇ ਕੌਨਫਿਗਰੇਸ਼ਨ ਫਾਈਲਾਂ ਵਿੱਚ ਵਿਸਤ੍ਰਿਤ ਇਨਲਾਈਨ ਕੋਡ ਟਿੱਪਣੀਆਂ
- GPU ਚੋਣ ਅਤੇ ਸੁਰੱਖਿਆ ਵਿਕਲਪਾਂ ਦੀ ਵਿਆਖਿਆ ਕਰਨ ਵਾਲੇ ਦਸਤਾਵੇਜ਼ੀ ਆਰਕੀਟੈਕਚਰ ਫੈਸਲੇ
- ਹੈਂਡਓਵਰ-ਤਿਆਰ ਕੋਡਬੇਸ ਜਿਸਨੂੰ ਤੁਹਾਡੀ ਟੀਮ ਭਰੋਸੇ ਨਾਲ ਬਣਾਈ ਰੱਖ ਸਕਦੀ ਹੈ ਅਤੇ ਵਧਾ ਸਕਦੀ ਹੈ
- ਵੱਡੇ ਜਾਂ ਵਧੇਰੇ ਗੁੰਝਲਦਾਰ LLM (ਜਿਵੇਂ ਕਿ ਲਾਮਾ 3, ਮਿਸਟਰਲ ਵੱਡੇ ਵੇਰੀਐਂਟ) ਲਈ ਢੁਕਵਾਂ
- ਆਰਡਰ ਚੈਟ ਰਾਹੀਂ ਤਰਜੀਹੀ ਆਰਡਰ ਪ੍ਰਬੰਧਨ ਅਤੇ ਨਜ਼ਦੀਕੀ ਸਹਿਯੋਗ
ਇੱਕ ਕਸਟਮ ਪੇਸ਼ਕਸ਼ ਦੀ ਬੇਨਤੀ ਕਰੋ
ਕਸਟਮ ਪੇਸ਼ਕਸ਼ ਦੀ ਬੇਨਤੀ ਕਰਨ ਲਈ ਲੌਗ ਇਨ ਕਰੋ
ਇਸ Zinner ਤੋਂ ਇੱਕ ਵਿਅਕਤੀਗਤ ਪੇਸ਼ਕਸ਼ ਦੀ ਬੇਨਤੀ ਕਰਨ ਲਈ ਇੱਕ ਮੁਫਤ ਖਾਤਾ ਬਣਾਓ ਜਾਂ ਲੌਗ ਇਨ ਕਰੋ।
ਲੌਗ ਇਨ / ਰਜਿਸਟਰ ਕਰੋਵਿਕਰੀ ਤੋਂ ਪਹਿਲਾਂ ਦਾ ਸਵਾਲ ਪੁੱਛੋ
ਸਵਾਲ ਪੁੱਛਣ ਲਈ ਲੌਗ ਇਨ ਕਰੋ
ਪਲੇਟਫਾਰਮ ਸਪੈਮ ਨੂੰ ਘਟਾਉਣ ਲਈ, ਪ੍ਰੀ-ਸੇਲ ਸੁਨੇਹੇ ਸਿਰਫ਼ ਲੌਗ-ਇਨ ਕੀਤੇ ਉਪਭੋਗਤਾਵਾਂ ਦੁਆਰਾ ਹੀ ਭੇਜੇ ਜਾ ਸਕਦੇ ਹਨ।
ਇਸ Zinner ਨੂੰ ਸਿੱਧਾ ਸੁਨੇਹਾ ਭੇਜਣ ਲਈ ਇੱਕ ਮੁਫ਼ਤ ਖਾਤਾ ਬਣਾਓ ਜਾਂ ਲੌਗ ਇਨ ਕਰੋ।
ਲੌਗ ਇਨ / ਰਜਿਸਟਰ ਕਰੋਲੌਗ ਇਨ ਕਰਨਾ ਜ਼ਰੂਰੀ ਹੈ
ਇਸ Zinner ਨੂੰ ਸੁਨੇਹਾ ਭੇਜਣ ਲਈ ਇੱਕ ਮੁਫਤ ਖਾਤਾ ਬਣਾਓ ਜਾਂ ਲੌਗ ਇਨ ਕਰੋ।
ਲੌਗ ਇਨ / ਰਜਿਸਟਰ ਕਰੋਲੌਗ ਇਨ ਕਰਨਾ ਜ਼ਰੂਰੀ ਹੈ
ਇੱਕ ਵਿਅਕਤੀਗਤ ਪੇਸ਼ਕਸ਼ ਦੀ ਬੇਨਤੀ ਕਰਨ ਲਈ ਇੱਕ ਮੁਫਤ ਖਾਤਾ ਬਣਾਓ ਜਾਂ ਲੌਗ ਇਨ ਕਰੋ।
ਲੌਗ ਇਨ / ਰਜਿਸਟਰ ਕਰੋਇੱਕ ਨਜ਼ਰ ਵਿੱਚ
ਤੁਹਾਡੇ ਫੈਸਲੇ ਲੈਣ ਵਿੱਚ ਮਦਦ ਕਰਨ ਲਈ ਇਸ ਸੇਵਾ ਬਾਰੇ ਮੁੱਖ ਵੇਰਵੇ। Zinn Hub ਦੁਆਰਾ ਤਿਆਰ ਕੀਤਾ ਗਿਆ, ਵਿਕਰੇਤਾ ਦੁਆਰਾ ਨਹੀਂ।
ਮੁੱਲ ਸਥਿਤੀ
ਤੈਨਾਤੀ ਦਾ ਟੀਚਾ
GPU ਵਿਕਲਪ
ਸੁਰੱਖਿਆ ਪਹੁੰਚ
ਇਸ ਲਈ ਸਭ ਤੋਂ ਵਧੀਆ
ਤੁਹਾਨੂੰ ਕੀ ਮਿਲੇਗਾ
ਪੂਰਾ ਵੇਰਵਾ
ਤੁਹਾਨੂੰ ਸਹੀ ਮਾਡਲ ਮਿਲ ਗਿਆ ਹੈ। ਹੁਣ ਤੁਹਾਨੂੰ ਇਸਨੂੰ ਉਤਪਾਦਨ ਵਿੱਚ ਭਰੋਸੇਯੋਗ ਢੰਗ ਨਾਲ ਚਲਾਉਣ ਦੀ ਲੋੜ ਹੈ — ਸਿਰਫ਼ ਸਥਾਨਕ ਤੌਰ 'ਤੇ ਨਹੀਂ, ਨੋਟਬੁੱਕ ਵਿੱਚ ਨਹੀਂ, ਬਲਕਿ ਇੱਕ ਸੁਰੱਖਿਅਤ, ਸਕੇਲੇਬਲ API ਦੇ ਪਿੱਛੇ ਜਿਸਨੂੰ ਤੁਹਾਡੀ ਐਪਲੀਕੇਸ਼ਨ ਅਸਲ ਵਿੱਚ ਕਾਲ ਕਰ ਸਕਦੀ ਹੈ।
ਇਹ ਬਿਲਕੁਲ ਉਹੀ ਹੈ ਜੋ ਇਹ ਸੇਵਾ ਪ੍ਰਦਾਨ ਕਰਦੀ ਹੈ।
Zinn Digital ਲੰਡਨ ਵਿੱਚ ਸਥਿਤ Google Cloud ਮਾਹਰ ਹਨ। ਅਸੀਂ ਤੁਹਾਡੇ ਚੁਣੇ ਹੋਏ Hugging Face ਮਾਡਲ ਨੂੰ ਲੈਂਦੇ ਹਾਂ ਅਤੇ ਇਸਨੂੰ Vertex AI ਜਾਂ Cloud Run 'ਤੇ ਇੱਕ ਉਤਪਾਦਨ-ਤਿਆਰ ਵਾਤਾਵਰਣ ਵਿੱਚ ਤੈਨਾਤ ਕਰਦੇ ਹਾਂ — ਪੂਰੀ ਤਰ੍ਹਾਂ ਕੰਟੇਨਰਾਈਜ਼ਡ, GPU-ਪ੍ਰੋਵੀਜ਼ਨਡ, ਅਤੇ ਇੱਕ ਸੁਰੱਖਿਅਤ, VPC-ਨੇਟਿਵ ਐਂਡਪੁਆਇੰਟ ਦੇ ਪਿੱਛੇ ਸੁਰੱਖਿਅਤ। ਜਦੋਂ ਕੰਮ ਪੂਰਾ ਹੋ ਜਾਂਦਾ ਹੈ, ਤਾਂ ਤੁਹਾਨੂੰ ਇੱਕ ਲਾਈਵ API ਪ੍ਰਾਪਤ ਹੁੰਦਾ ਹੈ ਜਿਸਨੂੰ ਤੁਸੀਂ ਤੁਰੰਤ ਆਪਣੇ ਉਤਪਾਦ ਵਿੱਚ ਜੋੜ ਸਕਦੇ ਹੋ।
**ਇਹ "ਸਿਰਫ਼ ਇੱਕ ਸਕ੍ਰਿਪਟ ਚਲਾਉਣ" ਤੋਂ ਕਿਵੇਂ ਵੱਖਰਾ ਹੈ**
ਕੋਈ ਵੀ ਇੱਕ GPU ਇੰਸਟੈਂਸ ਸਪਿਨ ਕਰ ਸਕਦਾ ਹੈ ਅਤੇ ਸਭ ਤੋਂ ਵਧੀਆ ਦੀ ਉਮੀਦ ਕਰ ਸਕਦਾ ਹੈ। ਅਸੀਂ ਕੋਡ ਦੀ ਇੱਕ ਵੀ ਲਾਈਨ ਲਿਖਣ ਤੋਂ ਪਹਿਲਾਂ ਤੁਹਾਡੇ ਮਾਡਲ ਦੀ ਅਸਲ RAM ਅਤੇ VRAM ਲੋੜਾਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦੇ ਹਾਂ, ਲਾਗਤ ਅਤੇ ਲੇਟੈਂਸੀ ਨੂੰ ਸੰਤੁਲਿਤ ਕਰਨ ਲਈ ਸਹੀ GPU ਟੀਅਰ (T4, L4, ਜਾਂ A100) ਦੀ ਚੋਣ ਕਰਦੇ ਹਾਂ, ਅਤੇ ਅਜਿਹਾ ਬੁਨਿਆਦੀ ਢਾਂਚਾ ਬਣਾਉਂਦੇ ਹਾਂ ਜੋ ਤੁਹਾਡੇ ਵਰਕਲੋਡ ਦੇ ਨਾਲ ਸਕੇਲ ਕਰਦਾ ਹੈ ਨਾ ਕਿ ਇਸਦੇ ਹੇਠਾਂ ਡਿੱਗਦਾ ਹੈ। ਹਰ ਤੈਨਾਤੀ ਡਿਜ਼ਾਈਨ ਦੁਆਰਾ ਸੁਰੱਖਿਅਤ ਕੀਤੀ ਜਾਂਦੀ ਹੈ — ਕੋਈ ਜਨਤਕ ਐਂਡਪੁਆਇੰਟ ਖੁੱਲ੍ਹੇ ਨਹੀਂ ਛੱਡੇ ਜਾਂਦੇ, ਕੋਈ ਪ੍ਰਮਾਣ ਪੱਤਰ ਹਾਰਡਕੋਡ ਨਹੀਂ ਕੀਤੇ ਜਾਂਦੇ।
**ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ**
ਪਹਿਲਾਂ, ਸਾਨੂੰ ਮਾਡਲ ਲਿੰਕ ਅਤੇ ਤੁਹਾਡੇ ਵਰਤੋਂ ਦੇ ਕੇਸ ਦਾ ਇੱਕ ਸੰਖੇਪ ਵੇਰਵਾ ਭੇਜੋ। ਅਸੀਂ ਮਾਡਲ ਦੀਆਂ ਸਰੋਤ ਲੋੜਾਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦੇ ਹਾਂ ਅਤੇ ਤੈਨਾਤੀ ਪਹੁੰਚ ਦੀ ਪੁਸ਼ਟੀ ਕਰਦੇ ਹਾਂ। ਫਿਰ ਅਸੀਂ ਡੌਕਰ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਮਾਡਲ ਨੂੰ ਕੰਟੇਨਰਾਈਜ਼ ਕਰਦੇ ਹਾਂ, ਇਸਨੂੰ ਵਰਟੈਕਸ AI ਜਾਂ ਕਲਾਉਡ ਰਨ 'ਤੇ ਤੈਨਾਤ ਕਰਦੇ ਹਾਂ, GPU ਪ੍ਰੋਵਿਜ਼ਨਿੰਗ ਅਤੇ API ਸੁਰੱਖਿਆ ਨੂੰ ਕੌਂਫਿਗਰ ਕਰਦੇ ਹਾਂ, ਅਤੇ ਅੰਤ ਵਿੱਚ ਤੁਹਾਨੂੰ ਇੱਕ ਕਾਰਜਸ਼ੀਲ ਪਾਈਥਨ ਟੈਸਟ ਸਕ੍ਰਿਪਟ ਦਿੰਦੇ ਹਾਂ ਤਾਂ ਜੋ ਤੁਸੀਂ ਖੁਦ ਐਂਡਪੁਆਇੰਟ ਦੀ ਪੁਸ਼ਟੀ ਕਰ ਸਕੋ।
**ਕੀ ਸ਼ਾਮਲ ਹੈ**
ਤੁਹਾਡੇ ਦੁਆਰਾ ਚੁਣੀ ਗਈ ਟੀਅਰ ਦੇ ਆਧਾਰ 'ਤੇ, ਤੁਹਾਨੂੰ ਇਹਨਾਂ ਵਿੱਚੋਂ ਕੁਝ ਜਾਂ ਸਾਰੇ ਪ੍ਰਾਪਤ ਹੋਣਗੇ: ਇੱਕ ਮਾਹਰ ਸਲਾਹ-ਮਸ਼ਵਰਾ ਅਤੇ ਆਰਕੀਟੈਕਚਰ ਮੁਲਾਂਕਣ, ਇੱਕ ਸੁਰੱਖਿਅਤ GCP ਐਂਡਪੁਆਇੰਟ 'ਤੇ ਪੂਰਾ ਮਾਡਲ ਤੈਨਾਤੀ, ਕੰਟੇਨਰਾਈਜ਼ੇਸ਼ਨ ਅਤੇ ਤੈਨਾਤੀ ਪਾਈਪਲਾਈਨ ਲਈ ਸਰੋਤ ਕੋਡ, ਅਤੇ ਵਿਸਤ੍ਰਿਤ ਇਨਲਾਈਨ ਕੋਡ ਟਿੱਪਣੀਆਂ ਤਾਂ ਜੋ ਤੁਹਾਡੀ ਟੀਮ ਭਰੋਸੇ ਨਾਲ ਕੰਮ ਨੂੰ ਬਣਾਈ ਰੱਖ ਸਕੇ ਅਤੇ ਵਧਾ ਸਕੇ।
**ਇਹ ਕਿਸ ਲਈ ਹੈ**
ਇਹ ਸੇਵਾ ਉਹਨਾਂ ਡਿਵੈਲਪਰਾਂ ਅਤੇ ਇੰਜੀਨੀਅਰਿੰਗ ਟੀਮਾਂ ਲਈ ਢੁਕਵੀਂ ਹੈ ਜਿਨ੍ਹਾਂ ਨੇ ਇੱਕ Hugging Face ਮਾਡਲ ਦੀ ਪਛਾਣ ਕੀਤੀ ਹੈ ਜਿਸਨੂੰ ਉਹ ਉਤਪਾਦਨ ਵਿੱਚ ਵਰਤਣਾ ਚਾਹੁੰਦੇ ਹਨ ਪਰ ਇਸਨੂੰ ਸੁਰੱਖਿਅਤ ਅਤੇ ਕੁਸ਼ਲਤਾ ਨਾਲ ਤੈਨਾਤ ਕਰਨ ਲਈ GCP ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਦਾ ਅਨੁਭਵ ਨਹੀਂ ਹੈ। ਇਹ ਉਹਨਾਂ ਤਕਨੀਕੀ ਸੰਸਥਾਪਕਾਂ ਲਈ ਵੀ ਬਰਾਬਰ ਢੁਕਵੀਂ ਹੈ ਜਿਨ੍ਹਾਂ ਨੂੰ ਇੱਕ ਪੂਰੀ ਕਲਾਉਡ ਟੀਮ ਨੂੰ ਨਿਯੁਕਤ ਕੀਤੇ ਬਿਨਾਂ ਇੱਕ ਕਾਰਜਸ਼ੀਲ AI ਬੈਕਐਂਡ ਦੀ ਲੋੜ ਹੈ, ਅਤੇ ਉਹਨਾਂ ਸੰਸਥਾਵਾਂ ਲਈ ਜੋ ਪਹਿਲਾਂ ਹੀ Google Cloud ਦੀ ਵਰਤੋਂ ਕਰ ਰਹੀਆਂ ਹਨ ਜੋ ਇੱਕ ਖਾਸ ਤੈਨਾਤੀ ਚੁਣੌਤੀ 'ਤੇ ਮਾਹਰ ਹੱਥ ਚਾਹੁੰਦੇ ਹਨ।
**ਤੁਹਾਡੇ ਆਰਡਰ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ**
ਹਰ ਪ੍ਰੋਜੈਕਟ ਵਿਲੱਖਣ ਹੁੰਦਾ ਹੈ। ਮਾਡਲ ਦਾ ਆਕਾਰ, GPU ਲੋੜਾਂ, ਮੌਜੂਦਾ GCP ਆਰਕੀਟੈਕਚਰ, ਅਤੇ ਸੁਰੱਖਿਆ ਰੁਕਾਵਟਾਂ ਸਭ ਵੱਖੋ-ਵੱਖਰੀਆਂ ਹੁੰਦੀਆਂ ਹਨ। ਕਿਰਪਾ ਕਰਕੇ ਆਪਣਾ ਆਰਡਰ ਦੇਣ ਤੋਂ ਪਹਿਲਾਂ ਇੱਕ ਸੁਨੇਹਾ ਭੇਜੋ ਤਾਂ ਜੋ ਅਸੀਂ ਪੁਸ਼ਟੀ ਕਰ ਸਕੀਏ ਕਿ ਪਹੁੰਚ ਤੁਹਾਡੀ ਸਥਿਤੀ ਲਈ ਸਹੀ ਹੈ ਅਤੇ ਦਾਇਰੇ 'ਤੇ ਸਹਿਮਤ ਹੋ ਸਕੀਏ। ਇਹ ਯਕੀਨੀ ਬਣਾਉਂਦਾ ਹੈ ਕਿ ਕੰਮ ਸਹੀ ਢੰਗ ਨਾਲ ਸ਼ੁਰੂ ਹੋਵੇ ਅਤੇ ਕੋਈ ਹੈਰਾਨੀ ਨਾ ਹੋਵੇ।
Zinner ਗੁਣਵੱਤਾ ਗਾਰੰਟੀ
ਹਰ Zinner ਨੂੰ ਪਲੇਟਫਾਰਮ ਵਿੱਚ ਸ਼ਾਮਲ ਹੋਣ ਤੋਂ ਪਹਿਲਾਂ ਸਮੀਖਿਆ ਅਤੇ ਪ੍ਰਵਾਨਿਤ ਕੀਤਾ ਜਾਂਦਾ ਹੈ।
ਸਾਰੀਆਂ ਸੇਵਾਵਾਂ ਸਾਡੀ ਗੁਣਵੱਤਾ ਭਰੋਸਾ ਪ੍ਰਤੀਬੱਧਤਾ ਦੁਆਰਾ ਸਮਰਥਿਤ ਹਨ।
ਤੁਹਾਡਾ ਭੁਗਤਾਨ ਉਦੋਂ ਤੱਕ ਸੁਰੱਖਿਅਤ ਹੈ ਜਦੋਂ ਤੱਕ ਤੁਸੀਂ ਡਿਲੀਵਰ ਕੀਤੇ ਕੰਮ ਨੂੰ ਮਨਜ਼ੂਰੀ ਨਹੀਂ ਦਿੰਦੇ।
ਪੈਕੇਜਾਂ ਦੀ ਤੁਲਨਾ ਕਰੋ
| ਵਿਸ਼ੇਸ਼ਤਾ | ਸਲਾਹ-ਮਸ਼ਵਰਾ | ਡਿਪਲਾਇਮੈਂਟ | ਤੈਨਾਤੀ + ਟਿੱਪਣੀਆਂ |
|---|---|---|---|
| ਡਿਲੀਵਰੀ ਸਮਾਂ | 2 ਦਿਨ | 5 ਦਿਨ | 10 ਦਿਨ |
| ਸੋਧਾਂ | 0 | 0 | 0 |
| 45-ਮਿੰਟ ਦੀ GCP Vertex AI / Cloud Run ਰਣਨੀਤੀ ਸਲਾਹ | ✓ | ✕ | ✕ |
| ਮਾਡਲ ਮੁਲਾਂਕਣ: RAM/VRAM ਲੋੜਾਂ ਅਤੇ GPU ਟੀਅਰ ਸਿਫ਼ਾਰਸ਼ | ✓ | ✕ | ✕ |
| ਆਰਕੀਟੈਕਚਰ ਅਤੇ ਲਾਗਤ ਅਨੁਮਾਨ ਮਾਰਗਦਰਸ਼ਨ | ✓ | ✕ | ✕ |
| ਲਿਖਤੀ ਰੂਪ ਵਿੱਚ ਦਸਤਾਵੇਜ਼ੀ ਸਿਫ਼ਾਰਿਸ਼ ਕੀਤੀ ਤੈਨਾਤੀ ਪਹੁੰਚ | ✓ | ✕ | ✕ |
| ਮਾਡਲ ਨੂੰ ਤੁਹਾਡੀ ਮੌਜੂਦਾ ਐਪ ਨਾਲ ਕਨੈਕਟ ਕਰਨ ਲਈ ਏਕੀਕਰਣ ਮਾਰਗ ਸਲਾਹ | ✓ | ✕ | ✕ |
| ਸਲਾਹ-ਮਸ਼ਵਰੇ ਦੇ ਪੱਧਰ ਵਿੱਚ ਸਭ ਕੁਝ | ✕ | ✓ | ✕ |
| ਪੂਰਾ ਡੌਕਰਾਈਜ਼ਡ ਮਾਡਲ ਕੰਟੇਨਰਾਈਜ਼ੇਸ਼ਨ ਅਤੇ ਵਰਟੈਕਸ AI ਜਾਂ ਕਲਾਉਡ ਰਨ 'ਤੇ ਤੈਨਾਤੀ | ✕ | ✓ | ✕ |
| GPU ਪ੍ਰੋਵਿਜ਼ਨਿੰਗ (T4, L4, ਜਾਂ A100 ਜਿਵੇਂ ਉਚਿਤ ਹੋਵੇ) | ✕ | ✓ | ✕ |
| ਸੁਰੱਖਿਅਤ, VPC-ਨੇਟਿਵ ਪ੍ਰਾਈਵੇਟ API ਐਂਡਪੁਆਇੰਟ ਕੌਂਫਿਗਰੇਸ਼ਨ | ✕ | ✓ | ✕ |
| ਲਾਈਵ ਐਂਡਪੁਆਇੰਟ ਦੀ ਪੁਸ਼ਟੀ ਕਰਨ ਲਈ ਪਾਈਥਨ ਟੈਸਟ ਸਕ੍ਰਿਪਟ | ✕ | ✓ | ✕ |
| ਪੂਰਾ ਡਿਪਲਾਇਮੈਂਟ ਸਰੋਤ ਕੋਡ ਤੁਹਾਨੂੰ ਡਿਲੀਵਰ ਕੀਤਾ ਗਿਆ | ✕ | ✓ | ✕ |
| ਡਿਪਲਾਇਮੈਂਟ ਟੀਅਰ ਵਿੱਚ ਸਭ ਕੁਝ | ✕ | ✕ | ✓ |
| ਸਾਰੀਆਂ ਸਕ੍ਰਿਪਟਾਂ ਅਤੇ ਕੌਂਫਿਗਰੇਸ਼ਨ ਫਾਈਲਾਂ ਵਿੱਚ ਵਿਸਤ੍ਰਿਤ ਇਨਲਾਈਨ ਕੋਡ ਟਿੱਪਣੀਆਂ | ✕ | ✕ | ✓ |
| GPU ਚੋਣ ਅਤੇ ਸੁਰੱਖਿਆ ਵਿਕਲਪਾਂ ਦੀ ਵਿਆਖਿਆ ਕਰਨ ਵਾਲੇ ਦਸਤਾਵੇਜ਼ੀ ਆਰਕੀਟੈਕਚਰ ਫੈਸਲੇ | ✕ | ✕ | ✓ |
| ਹੈਂਡਓਵਰ-ਤਿਆਰ ਕੋਡਬੇਸ ਜਿਸਨੂੰ ਤੁਹਾਡੀ ਟੀਮ ਭਰੋਸੇ ਨਾਲ ਬਣਾਈ ਰੱਖ ਸਕਦੀ ਹੈ ਅਤੇ ਵਧਾ ਸਕਦੀ ਹੈ | ✕ | ✕ | ✓ |
| ਵੱਡੇ ਜਾਂ ਵਧੇਰੇ ਗੁੰਝਲਦਾਰ LLM (ਜਿਵੇਂ ਕਿ ਲਾਮਾ 3, ਮਿਸਟਰਲ ਵੱਡੇ ਵੇਰੀਐਂਟ) ਲਈ ਢੁਕਵਾਂ | ✕ | ✕ | ✓ |
| ਪ੍ਰਾਥਮਿਕਤਾ ਆਰਡਰ ਪ੍ਰਬੰਧਨ ਅਤੇ ਆਰਡਰ ਚੈਟ ਰਾਹੀਂ ਨਜ਼ਦੀਕੀ ਸਹਿਯੋਗ | ✕ | ✕ | ✓ |
ਪੋਰਟਫੋਲੀਓ
ਇਸ Zinn ਨਾਲ ਸਬੰਧਤ ਵਿਕਰੇਤਾ ਦੇ ਕੰਮ ਦੀਆਂ ਉਦਾਹਰਨਾਂ।

Hugging Face LLM ਨੂੰ GCP Vertex AI ਜਾਂ Cloud Run 'ਤੇ ਡਿਪਲੋਏ ਕਰੋ


Hugging Face LLM ਨੂੰ GCP Vertex AI ਜਾਂ Cloud Run 'ਤੇ ਡਿਪਲੋਏ ਕਰੋ

ਵਾਧੂ ਜਾਣਕਾਰੀ
ਮੈਨੂੰ ਕਿਉਂ ਚੁਣੋ
ਮੈਂ ਵਰਤਦਾ ਹਾਂ ਟੂਲ
ਲਈ ਸੰਪੂਰਨ
ਅਕਸਰ ਪੁੱਛੇ ਜਾਣ ਵਾਲੇ ਸਵਾਲ
ਅਸੀਂ Llama 3, Mistral, Gemma, BERT, ਅਤੇ Hugging Face 'ਤੇ ਹੋਸਟ ਕੀਤੇ ਹੋਰ ਟ੍ਰਾਂਸਫਾਰਮਰ-ਆਧਾਰਿਤ ਮਾਡਲਾਂ ਸਮੇਤ ਮਾਡਲਾਂ ਦੀ ਇੱਕ ਵਿਸ਼ਾਲ ਸ਼੍ਰੇਣੀ ਨਾਲ ਕੰਮ ਕਰਦੇ ਹਾਂ। ਮਾਡਲ ਦਾ ਆਕਾਰ ਅਤੇ GPU ਲੋੜਾਂ ਵੱਖ-ਵੱਖ ਹੁੰਦੀਆਂ ਹਨ, ਇਸ ਲਈ ਕਿਰਪਾ ਕਰਕੇ ਆਰਡਰ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ ਆਪਣੇ ਮਾਡਲ ਲਿੰਕ ਅਤੇ ਵਰਤੋਂ ਦੇ ਕੇਸ ਨਾਲ ਸਾਨੂੰ ਸੁਨੇਹਾ ਭੇਜੋ ਤਾਂ ਜੋ ਅਸੀਂ ਅਨੁਕੂਲਤਾ ਦੀ ਪੁਸ਼ਟੀ ਕਰ ਸਕੀਏ ਅਤੇ ਸਹੀ ਪੱਧਰ ਦੀ ਸਿਫ਼ਾਰਸ਼ ਕਰ ਸਕੀਏ।
ਹਾਂ। ਤੁਹਾਨੂੰ ਬਿਲਿੰਗ ਸਮਰੱਥ ਦੇ ਨਾਲ ਇੱਕ ਕਿਰਿਆਸ਼ੀਲ GCP ਖਾਤੇ ਦੀ ਲੋੜ ਪਵੇਗੀ। ਅਸੀਂ ਤੁਹਾਡੇ ਵਾਤਾਵਰਣ ਵਿੱਚ ਕੰਮ ਕਰਦੇ ਹਾਂ ਤਾਂ ਜੋ ਤੁਸੀਂ ਸਾਰੇ ਤੈਨਾਤ ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਦੀ ਪੂਰੀ ਮਲਕੀਅਤ ਬਰਕਰਾਰ ਰੱਖੋ ਅਤੇ GCP ਲਾਗਤਾਂ ਨੂੰ ਸਿੱਧੇ ਤੌਰ 'ਤੇ ਪ੍ਰਾਪਤ ਕਰੋ। ਜੇਕਰ ਤੁਸੀਂ ਅਨਿਸ਼ਚਿਤ ਹੋ ਕਿ ਇਸਨੂੰ ਕਿਵੇਂ ਸਥਾਪਤ ਕਰਨਾ ਹੈ, ਤਾਂ ਸਲਾਹ-ਮਸ਼ਵਰਾ ਪੱਧਰ ਇੱਕ ਵਧੀਆ ਸ਼ੁਰੂਆਤੀ ਬਿੰਦੂ ਹੈ।
ਘੱਟੋ-ਘੱਟ, ਸਾਨੂੰ Hugging Face ਮਾਡਲ ਲਿੰਕ ਅਤੇ ਇੱਕ ਸੰਖੇਪ ਵਰਣਨ ਦੀ ਲੋੜ ਹੈ ਕਿ ਤੁਸੀਂ ਇਸਨੂੰ ਕਿਸ ਲਈ ਵਰਤਣਾ ਚਾਹੁੰਦੇ ਹੋ। ਡਿਪਲਾਇਮੈਂਟ ਟੀਅਰਾਂ ਲਈ, ਸਾਨੂੰ ਤੁਹਾਡੇ GCP ਪ੍ਰੋਜੈਕਟ ਤੱਕ ਪਹੁੰਚ ਪ੍ਰਮਾਣ ਪੱਤਰਾਂ ਦੀ ਵੀ ਲੋੜ ਹੋਵੇਗੀ। ਅਸੀਂ ਤੁਹਾਨੂੰ ਆਰਡਰ ਚੈਟ ਰਾਹੀਂ ਸੁਰੱਖਿਅਤ ਢੰਗ ਨਾਲ ਕੀ ਸਾਂਝਾ ਕਰਨਾ ਹੈ ਬਾਰੇ ਸਹੀ ਮਾਰਗਦਰਸ਼ਨ ਕਰਾਂਗੇ।
ਵੱਡੇ ਮਾਡਲਾਂ ਲਈ ਵਧੇਰੇ ਸਾਵਧਾਨੀਪੂਰਵਕ ਸਰੋਤ ਮੁਲਾਂਕਣ, ਲੰਬੇ ਕੰਟੇਨਰ ਬਣਾਉਣ ਦੇ ਸਮੇਂ, ਅਤੇ ਲਾਈਵ ਐਂਡਪੁਆਇੰਟ ਦੀ ਵਧੇਰੇ ਚੰਗੀ ਤਰ੍ਹਾਂ ਜਾਂਚ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ। ਵਾਧੂ ਸਮਾਂ ਇਹ ਯਕੀਨੀ ਬਣਾਉਂਦਾ ਹੈ ਕਿ ਤੈਨਾਤੀ ਸਥਿਰ, ਸੁਰੱਖਿਅਤ, ਅਤੇ ਹੈਂਡਓਵਰ ਤੋਂ ਪਹਿਲਾਂ ਸਹੀ ਢੰਗ ਨਾਲ ਦਸਤਾਵੇਜ਼ੀ ਹੈ।
ਇੱਕ VPC-ਨੇਟਿਵ (ਵਰਚੁਅਲ ਪ੍ਰਾਈਵੇਟ ਕਲਾਉਡ) ਡਿਪਲਾਇਮੈਂਟ ਦਾ ਮਤਲਬ ਹੈ ਕਿ ਤੁਹਾਡਾ ਮਾਡਲ ਐਂਡਪੁਆਇੰਟ ਖੁੱਲ੍ਹੇ ਇੰਟਰਨੈਟ 'ਤੇ ਪ੍ਰਗਟ ਨਹੀਂ ਹੁੰਦਾ ਹੈ। ਨੈੱਟਵਰਕ ਪੱਧਰ 'ਤੇ ਪਹੁੰਚ ਪ੍ਰਤਿਬੰਧਿਤ ਹੈ, ਜੋ ਉਤਪਾਦਨ ਵਾਤਾਵਰਣ ਵਿੱਚ ਮਲਕੀਅਤ ਡੇਟਾ ਅਤੇ ਮਾਡਲ ਵਜ਼ਨ ਨੂੰ ਸੁਰੱਖਿਅਤ ਰੱਖਣ ਲਈ ਮਹੱਤਵਪੂਰਨ ਹੈ।
ਡਿਪਲਾਇਮੈਂਟ ਟੀਅਰ ਵਿੱਚ ਪੂਰਾ ਸਰੋਤ ਕੋਡ ਸ਼ਾਮਲ ਹੈ ਤਾਂ ਜੋ ਤੁਹਾਡੀ ਟੀਮ ਕੋਲ ਉਹ ਸਭ ਕੁਝ ਹੋਵੇ ਜਿਸਦੀ ਉਹਨਾਂ ਨੂੰ ਲੋੜ ਹੈ। ਡਿਪਲਾਇਮੈਂਟ + ਟਿੱਪਣੀਆਂ ਟੀਅਰ ਵਿੱਚ ਹਰੇਕ ਮਹੱਤਵਪੂਰਨ ਫੈਸਲੇ ਦੀ ਵਿਆਖਿਆ ਕਰਨ ਵਾਲੀਆਂ ਵਿਸਤ੍ਰਿਤ ਇਨਲਾਈਨ ਐਨੋਟੇਸ਼ਨਾਂ ਵੀ ਪ੍ਰਦਾਨ ਕੀਤੀਆਂ ਜਾਂਦੀਆਂ ਹਨ, ਜਿਸ ਨਾਲ ਕੋਡਬੇਸ ਨੂੰ ਤੁਹਾਡੇ ਇੰਜੀਨੀਅਰਾਂ ਲਈ ਸਮੇਂ ਦੇ ਨਾਲ ਬਣਾਈ ਰੱਖਣਾ ਅਤੇ ਵਧਾਉਣਾ ਸਿੱਧਾ ਹੋ ਜਾਂਦਾ ਹੈ।
ਹਰ ਮਾਡਲ ਅਤੇ ਹਰ GCP ਵਾਤਾਵਰਣ ਵੱਖਰਾ ਹੁੰਦਾ ਹੈ। ਇੱਕ ਤੇਜ਼ ਗੱਲਬਾਤ ਇਹ ਯਕੀਨੀ ਬਣਾਉਂਦੀ ਹੈ ਕਿ ਅਸੀਂ ਤੁਹਾਡੀਆਂ ਲੋੜਾਂ ਨੂੰ ਸਮਝਦੇ ਹਾਂ, ਸਹੀ ਪੱਧਰ ਦੀ ਪੁਸ਼ਟੀ ਕਰਦੇ ਹਾਂ, ਅਤੇ ਆਰਡਰ ਸ਼ੁਰੂ ਹੋਣ ਤੋਂ ਬਾਅਦ ਕਿਸੇ ਵੀ ਅੱਗੇ-ਪਿੱਛੇ ਤੋਂ ਬਚਦੇ ਹਾਂ। ਇਸਦਾ ਮਤਲਬ ਇਹ ਵੀ ਹੈ ਕਿ ਅਸੀਂ ਤੁਹਾਡੇ ਚੁਣੇ ਹੋਏ ਮਾਡਲ ਲਈ ਖਾਸ ਕਿਸੇ ਵੀ ਅਸਾਧਾਰਨ GPU ਜਾਂ ਲਾਗਤ ਸੰਬੰਧੀ ਵਿਚਾਰਾਂ ਨੂੰ ਪਹਿਲਾਂ ਹੀ ਫਲੈਗ ਕਰ ਸਕਦੇ ਹਾਂ।
ਗਾਹਕ ਸਮੀਖਿਆਵਾਂ
ਦੇਖੋ ਸਾਡੇ ਗਾਹਕ ਇਸ Zinn ਬਾਰੇ ਕੀ ਕਹਿੰਦੇ ਹਨ
ਬਹੁਤ ਗਿਆਨਵਾਨ VertexAI ਮਾਹਰ ਜਿਸਨੇ ਮੇਰੇ ਸਾਰੇ ਸਵਾਲਾਂ ਦੇ ਜਵਾਬ ਦਿੱਤੇ ਅਤੇ ਮੈਨੂੰ ਅਜਿਹੀਆਂ ਸੂਝਾਂ ਵੀ ਦਿੱਤੀਆਂ ਜੋ ਮੇਰੇ ਲਈ ਲਾਭਦਾਇਕ ਸਨ ਪਰ ਮੈਂ ਖਾਸ ਤੌਰ 'ਤੇ ਨਹੀਂ ਪੁੱਛਿਆ ਸੀ।
ਉਮੈਰ ਹੁਣ ਤੱਕ ਦਾ ਸਭ ਤੋਂ ਵਧੀਆ ਵਿਅਕਤੀ ਹੈ ਜਿਸ ਨਾਲ ਅਸੀਂ Zinn Hub 'ਤੇ ਕੰਮ ਕੀਤਾ ਹੈ। ਉਹ ਸਾਡੇ ਪ੍ਰੋਜੈਕਟ ਦੀਆਂ ਵਿਲੱਖਣ ਲੋੜਾਂ ਨੂੰ ਸਮਝਣ ਵਿੱਚ ਬੇਮਿਸਾਲ ਸੀ। ਉਸਨੇ ਉਮੀਦਾਂ ਤੋਂ ਵੱਧ ਕੇ ਕੰਮ ਕੀਤਾ। ਮੈਂ ਉਸਨੂੰ ਕਿਸੇ ਵੀ AI ਪ੍ਰੋਜੈਕਟ ਲਈ ਸਿਫਾਰਸ਼ ਕਰਾਂਗਾ।
ਸਿਰਫ਼ ਉਹ ਲੌਗ ਇਨ ਗਾਹਕ ਜਿਨ੍ਹਾਂ ਨੇ ਇਹ ਉਤਪਾਦ ਖਰੀਦਿਆ ਹੈ, ਸਮੀਖਿਆ ਛੱਡ ਸਕਦੇ ਹਨ।
ਸ਼੍ਰੇਣੀਆਂ
Zinner ਨੀਤੀਆਂ
ਸਬੰਧਤ Zinns








