0
រទេះរបស់អ្នក
0
Zinn Hub
0
រទេះរបស់អ្នក
0

នៅ glance

ព័ត៌មានលម្អិតសំខាន់ៗអំពីសេវាកម្មនេះ ដើម្បីជួយអ្នកសម្រេចចិត្ត។ បង្កើតដោយ Zinn Hub មិនមែនអ្នកលក់ទេ។

គោលដៅនៃការដាក់ពង្រាយ

Vertex AI ឬ Cloud Run
អ្នកជ្រើសរើសសេវាកម្ម GCP; អ្នកលក់ជ្រើសរើសស្ថាបត្យកម្មត្រឹមត្រូវដោយផ្អែកលើទំហំគំរូ និងតម្រូវការ latency របស់អ្នក។

ជម្រើស GPU

T4, L4, ឬ A100
កម្រិត GPU ត្រូវបានផ្គូផ្គងទៅនឹងតម្រូវការ VRAM ពិតប្រាកដរបស់ម៉ូដែលរបស់អ្នក - គ្មានការផ្តល់លើស គ្មានការផ្តល់ក្រោម។

វិធីសាស្រ្តសុវត្ថិភាព

VPC-Native Endpoints
គ្មាន Public Endpoint ទេ។ ទម្ងន់ម៉ូដែល និងទិន្នន័យរបស់អ្នកនឹងមិនមាននៅលើអ៊ីនធឺណិតជាសាធារណៈទេ - វាត្រូវបានការពារនៅកម្រិតបណ្តាញ។

ល្អបំផុតសម្រាប់

អ្នកអភិវឌ្ឍន៍ និងស្ថាបនិកបច្ចេកទេស
ល្អឥតខ្ចោះសម្រាប់ក្រុមដែលមានម៉ូដែល Hugging Face រួចរាល់ក្នុងការដឹកជញ្ជូន ប៉ុន្តែខ្វះជំនាញហេដ្ឋារចនាសម្ព័ន្ធ GCP ដើម្បីដាក់ពង្រាយវាដោយសុវត្ថិភាពក្នុងកម្រិតធំ។

អ្វីដែលអ្នកនឹងទទួលបាន

ទម្រង់៖
កូដផ្ទាល់ខ្លួន
ឯកសារប្រភព
របាយការណ៍ជាលាយលក្ខណ៍អក្សរ
វិធីសាស្រ្តដឹកជញ្ជូន:
អ្នកគ្រប់គ្រងការបញ្ជាទិញ
ចំណាំ៖ សម្រាប់កម្រិតប្រឹក្សាយោបល់ សេចក្តីសង្ខេបជាលាយលក្ខណ៍អក្សរនៃអនុសាសន៍ត្រូវបានផ្តល់ជូនតាមរយៈអ្នកគ្រប់គ្រងការបញ្ជាទិញ។ សម្រាប់កម្រិតដាក់ពង្រាយ រាល់កូដប្រភព ការកំណត់រចនាសម្ព័ន្ធ Docker ស្គ្រីបដាក់ពង្រាយ និងស្គ្រីបសាកល្បងចំណុចបញ្ចប់ Python ត្រូវបានផ្តល់ជូនតាមរយៈអ្នកគ្រប់គ្រងការបញ្ជាទិញ។ ចំណុចបញ្ចប់ផ្ទាល់ត្រូវបានដាក់ពង្រាយដោយផ្ទាល់ទៅក្នុងគម្រោង GCP របស់អ្នក។

ការពិពណ៌នាពេញលេញ

អ្នកបានរកឃើញគំរូត្រឹមត្រូវហើយ។ ឥឡូវនេះអ្នកត្រូវការវាដំណើរការដោយភាពជឿជាក់ក្នុងការផលិត — មិនមែនគ្រាន់តែក្នុងស្រុកទេ មិនមែននៅក្នុងសៀវភៅកត់ត្រាទេ ប៉ុន្តែនៅពីក្រោយ API ដែលមានសុវត្ថិភាព និងអាចពង្រីកបានដែលកម្មវិធីរបស់អ្នកអាចហៅបាន។

នោះជាអ្វីដែលសេវាកម្មនេះផ្តល់ជូន។

Zinn Digital គឺជាអ្នកជំនាញ Google Cloud ដែលមានមូលដ្ឋាននៅទីក្រុង London។ យើងយកគំរូ Hugging Face ដែលអ្នកបានជ្រើសរើស ហើយដាក់ពង្រាយវាទៅបរិយាកាសដែលត្រៀមរួចជាស្រេចសម្រាប់ការផលិតនៅលើ Vertex AI ឬ Cloud Run — ត្រូវបានដាក់ក្នុងកុងតឺន័រពេញលេញ ផ្តល់ GPU និងការពារនៅពីក្រោយចំណុចបញ្ចប់ VPC-native ដែលមានសុវត្ថិភាព។ នៅពេលដែលការងារត្រូវបានបញ្ចប់ អ្នកនឹងទទួលបាន API ផ្ទាល់ដែលអ្នកអាចបញ្ចូលទៅក្នុងផលិតផលរបស់អ្នកភ្លាមៗ។

**តើអ្វីដែលធ្វើឱ្យនេះខុសពី "គ្រាន់តែដំណើរការស្គ្រីប"**

នរណាម្នាក់អាចបង្កើត GPU instance ហើយសង្ឃឹមថានឹងល្អបំផុត។ យើងវាយតម្លៃតម្រូវការ RAM និង VRAM ពិតប្រាកដរបស់ម៉ូដែលរបស់អ្នក មុនពេលសរសេរបន្ទាត់កូដតែមួយ ជ្រើសរើសកម្រិត GPU ត្រឹមត្រូវ (T4, L4, ឬ A100) ដើម្បីរក្សាតុល្យភាពរវាងតម្លៃ និងភាពយឺតយ៉ាវ ហើយបង្កើតហេដ្ឋារចនាសម្ព័ន្ធដែលរីកចម្រើនទៅតាមបន្ទុកការងាររបស់អ្នក ជំនួសឱ្យការដួលរលំក្រោមវា។ ការដាក់ពង្រាយនីមួយៗត្រូវបានធានាសុវត្ថិភាពដោយការរចនា — គ្មាន public endpoints ត្រូវបានទុកចោល គ្មាន credentials ត្រូវបាន hardcoded ។

**របៀបដែលវាដំណើរការ**

ដំបូង សូមផ្ញើមកយើងនូវតំណភ្ជាប់គំរូ និងការពិពណ៌នាសង្ខេបអំពីករណីប្រើប្រាស់របស់អ្នក។ យើងវាយតម្លៃតម្រូវការធនធានរបស់គំរូ និងបញ្ជាក់វិធីសាស្រ្តដាក់ពង្រាយ។ បន្ទាប់មកយើងដាក់គំរូទៅក្នុងកុងតឺន័រដោយប្រើ Docker ដាក់ពង្រាយវាទៅ Vertex AI ឬ Cloud Run កំណត់រចនាសម្ព័ន្ធការផ្តល់ GPU និងសុវត្ថិភាព API ហើយចុងក្រោយប្រគល់ស្គ្រីបសាកល្បង Python ដែលដំណើរការឱ្យអ្នកដើម្បីឱ្យអ្នកអាចផ្ទៀងផ្ទាត់ចំណុចបញ្ចប់ដោយខ្លួនឯង។

**អ្វីដែលរួមបញ្ចូល**

អាស្រ័យលើកម្រិតដែលអ្នកជ្រើសរើស អ្នកនឹងទទួលបានមួយចំនួន ឬទាំងអស់នៃ៖ ការប្រឹក្សាអ្នកជំនាញ និងការវាយតម្លៃស្ថាបត្យកម្ម ការដាក់ពង្រាយគំរូពេញលេញទៅកាន់ចំណុចបញ្ចប់ GCP ដែលមានសុវត្ថិភាព កូដប្រភពសម្រាប់ការដាក់បញ្ចូលក្នុងកុងតឺន័រ និងបំពង់បង្ហូរដាក់ពង្រាយ និងមតិយោបល់កូដលម្អិត ដើម្បីឱ្យក្រុមរបស់អ្នកអាចថែរក្សា និងពង្រីកការងារដោយទំនុកចិត្ត។

**សម្រាប់អ្នកណា**

សេវាកម្មនេះស័ក្តិសមសម្រាប់អ្នកអភិវឌ្ឍន៍ និងក្រុមវិស្វកម្មដែលបានកំណត់អត្តសញ្ញាណគំរូ Hugging Face ដែលពួកគេចង់ប្រើក្នុងការផលិត ប៉ុន្តែខ្វះបទពិសោធន៍ហេដ្ឋារចនាសម្ព័ន្ធ GCP ដើម្បីដាក់ពង្រាយវាដោយសុវត្ថិភាព និងប្រសិទ្ធភាព។ វាក៏ស័ក្តិសមសម្រាប់ស្ថាបនិកបច្ចេកទេសដែលត្រូវការ AI backend ដែលដំណើរការដោយមិនចាំបាច់ជួលក្រុម cloud ពេញលេញ និងសម្រាប់អង្គការដែលកំពុងប្រើប្រាស់ Google Cloud ដែលចង់បានអ្នកជំនាញលើបញ្ហាដាក់ពង្រាយជាក់លាក់មួយ។

**មុនពេលអ្នកបញ្ជាទិញ**

គ្រប់គម្រោងទាំងអស់គឺមានលក្ខណៈពិសេស។ ទំហំម៉ូដែល តម្រូវការ GPU ស្ថាបត្យកម្ម GCP ដែលមានស្រាប់ និងដែនកំណត់សុវត្ថិភាពទាំងអស់ប្រែប្រួល។ សូមផ្ញើសារមុនពេលដាក់ការបញ្ជាទិញរបស់អ្នក ដូច្នេះយើងអាចបញ្ជាក់ថាវិធីសាស្រ្តនេះត្រឹមត្រូវសម្រាប់ស្ថានភាពរបស់អ្នក និងយល់ព្រមលើវិសាលភាព។ នេះធានាថាការងារចាប់ផ្តើមបានត្រឹមត្រូវ ហើយគ្មានការភ្ញាក់ផ្អើលអ្វីឡើយ។

ការធានាគុណភាព Zinner

✓
អ្នកជំនាញដែលបានត្រួតពិនិត្យ
Zinner គ្រប់រូបត្រូវបានត្រួតពិនិត្យ និងអនុម័តមុនពេលចូលរួមវេទិកា។
✓
ធានាការងារដែលមានគុណភាព
សេវាកម្មទាំងអស់ត្រូវបានគាំទ្រដោយការប្តេជ្ញាចិត្តធានាគុណភាពរបស់យើង។
✓
ការទូទាត់មានសុវត្ថិភាព
ការទូទាត់របស់អ្នកត្រូវបានការពាររហូតដល់អ្នកអនុម័តការងារដែលបានប្រគល់។

ប្រៀបធៀបកញ្ចប់

លក្ខណៈពិសេសការប្រឹក្សាការដាក់ពង្រាយការដាក់ពង្រាយ + មតិយោបល់
ពេលវេលាដឹកជញ្ជូន2 ថ្ងៃ5 ថ្ងៃ10 ថ្ងៃ
ការកែប្រែ000
ការប្រឹក្សាយោបល់យុទ្ធសាស្ត្រ GCP Vertex AI / Cloud Run រយៈពេល 45 នាទី✓✕✕
ការវាយតម្លៃម៉ូដែល៖ តម្រូវការ RAM/VRAM និងអនុសាសន៍កម្រិត GPU✓✕✕
ការណែនាំអំពីស្ថាបត្យកម្ម និងការប៉ាន់ស្មានតម្លៃ✓✕✕
វិធីសាស្រ្តដាក់ពង្រាយដែលបានណែនាំត្រូវបានកត់ត្រាជាលាយលក្ខណ៍អក្សរ✓✕✕
ដំបូន្មានផ្លូវរួមបញ្ចូលគ្នាសម្រាប់ការភ្ជាប់គំរូទៅកម្មវិធីដែលមានស្រាប់របស់អ្នក✓✕✕
អ្វីគ្រប់យ៉ាងនៅក្នុងកម្រិតប្រឹក្សាយោបល់✕✓✕
ការដាក់បញ្ចូលម៉ូដែល Dockerised ពេញលេញ និងការដាក់ពង្រាយទៅ Vertex AI ឬ Cloud Run✕✓✕
ការផ្តល់ GPU (T4, L4, ឬ A100 តាមការសមស្រប)✕✓✕
ការកំណត់រចនាសម្ព័ន្ធចំណុចបញ្ចប់ API ឯកជនដែលមានសុវត្ថិភាព, VPC-native✕✓✕
ស្គ្រីបសាកល្បង Python ដើម្បីផ្ទៀងផ្ទាត់ចំណុចបញ្ចប់ផ្ទាល់✕✓✕
កូដប្រភពដាក់ពង្រាយពេញលេញត្រូវបានផ្តល់ជូនអ្នក✕✓✕
អ្វីគ្រប់យ៉ាងនៅក្នុងកម្រិត Deployment✕✕✓
មតិយោបល់កូដលម្អិតនៅក្នុងស្គ្រីប និងឯកសារកំណត់រចនាសម្ព័ន្ធទាំងអស់✕✕✓
ការសម្រេចចិត្តស្ថាបត្យកម្មដែលបានចងក្រងជាឯកសារពន្យល់ពីការជ្រើសរើស GPU និងជម្រើសសុវត្ថិភាព✕✕✓
មូលដ្ឋានកូដដែលត្រៀមរួចជាស្រេចសម្រាប់ការប្រគល់ ដែលក្រុមរបស់អ្នកអាចថែរក្សា និងពង្រីកដោយទំនុកចិត្ត✕✕✓
ស័ក្តិសមសម្រាប់ LLM ធំជាង ឬស្មុគស្មាញជាង (ឧទាហរណ៍ Llama 3, Mistral large variants)✕✕✓
ការគ្រប់គ្រងការបញ្ជាទិញអាទិភាព និងកិច្ចសហការកាន់តែជិតស្និទ្ធតាមរយៈការជជែកបញ្ជាទិញ✕✕✓

ផលប័ត្រ

ឧទាហរណ៍នៃការងាររបស់អ្នកលក់ដែលទាក់ទងនឹង Zinn នេះ។

ដាក់ពង្រាយ Hugging Face LLMs ទៅ GCP Vertex AI ឬ Cloud Run

ដាក់ពង្រាយ Hugging Face LLMs ទៅ GCP Vertex AI ឬ Cloud Run

ព័ត៌មានបន្ថែម

ហេតុអ្វីបានជាជ្រើសរើសខ្ញុំ

មានមូលដ្ឋាននៅ:London, England
ឯកទេស៖Google Cloud Platform — ការដាក់ពង្រាយ Vertex AI និង Cloud Run
វិធីសាស្រ្តរបស់យើង៖យើងមិនគ្រាន់តែដំណើរការស្គ្រីបទេ។ យើងវាយតម្លៃតម្រូវការ RAM/VRAM ជ្រើសរើសកម្រិត GPU ត្រឹមត្រូវសម្រាប់គោលដៅតម្លៃ និងភាពយឺតយ៉ាវរបស់អ្នក ហើយបង្កើតហេដ្ឋារចនាសម្ព័ន្ធ VPC-native ដែលមានសុវត្ថិភាពដែលរីកចម្រើនជាមួយអាជីវកម្មរបស់អ្នក។

ឧបករណ៍ដែលខ្ញុំប្រើ

វេទិកា Cloud:Google Cloud Platform (GCP)
គោលដៅដាក់ពង្រាយ៖Vertex AI, Cloud Run
ការដាក់ក្នុងកុងតឺន័រ:Docker
ប្រភពគំរូ៖Hugging Face (Llama, Mistral, Gemma, BERT និងច្រើនទៀត)
ជម្រើស GPU៖NVIDIA T4, L4, A100

ល្អឥតខ្ចោះសម្រាប់

អ្នកណាទទួលបានអត្ថប្រយោជន៍ច្រើនបំផុត៖អ្នកអភិវឌ្ឍន៍ដែលបញ្ចូល LLM ប្រភពបើកចំហទៅក្នុងកម្មវិធីផលិតកម្ម ស្ថាបនិកបច្ចេកទេសដែលបង្កើតផលិតផលដែលដំណើរការដោយ AI នៅលើ Google Cloud ក្រុមវិស្វកម្មដែលត្រូវការការគាំទ្រពីអ្នកជំនាញសម្រាប់ការដាក់ពង្រាយ GCP ជាក់លាក់ អង្គការដែលផ្លាស់ប្តូរពីគំរូដើមទៅហេដ្ឋារចនាសម្ព័ន្ធ AI ដែលអាចធ្វើមាត្រដ្ឋានបាន និងមានសុវត្ថិភាព

សំណួរដែលសួរញឹកញាប់

យើងធ្វើការជាមួយម៉ូដែលជាច្រើនប្រភេទ រួមមាន Llama 3, Mistral, Gemma, BERT និងម៉ូដែលផ្អែកលើ Transformer ផ្សេងទៀតដែលបង្ហោះនៅលើ Hugging Face។ ទំហំម៉ូដែល និងតម្រូវការ GPU ប្រែប្រួល ដូច្នេះសូមផ្ញើសារមកយើងមុនពេលបញ្ជាទិញជាមួយនឹងតំណម៉ូដែល និងករណីប្រើប្រាស់របស់អ្នក ដើម្បីយើងអាចបញ្ជាក់ពីភាពឆបគ្នា និងណែនាំកម្រិតត្រឹមត្រូវ។

បាទ/ចាស។ អ្នកនឹងត្រូវការគណនី GCP សកម្មដែលបានបើកការចេញវិក្កយបត្រ។ យើងធ្វើការនៅក្នុងបរិស្ថានរបស់អ្នក ដូច្នេះអ្នករក្សាបាននូវកម្មសិទ្ធិពេញលេញនៃហេដ្ឋារចនាសម្ព័ន្ធដែលបានដាក់ពង្រាយទាំងអស់ និងទទួលរងការចំណាយ GCP ដោយផ្ទាល់។ ប្រសិនបើអ្នកមិនប្រាកដពីរបៀបរៀបចំនេះទេ កម្រិតប្រឹក្សាយោបល់គឺជាចំណុចចាប់ផ្តើមដ៏ល្អ។

យ៉ាងហោចណាស់ យើងត្រូវការតំណភ្ជាប់គំរូ Hugging Face និងការពិពណ៌នាសង្ខេបអំពីអ្វីដែលអ្នកមានបំណងប្រើវាសម្រាប់។ សម្រាប់កម្រិតនៃការដាក់ពង្រាយ យើងក៏នឹងត្រូវការសិទ្ធិចូលប្រើគម្រោង GCP របស់អ្នកផងដែរ។ យើងនឹងណែនាំអ្នកអំពីអ្វីដែលត្រូវចែករំលែកដោយសុវត្ថិភាពតាមរយៈការជជែកបញ្ជាទិញ។

ម៉ូដែលធំៗទាមទារការវាយតម្លៃធនធានដោយប្រុងប្រយ័ត្នបន្ថែមទៀត រយៈពេលបង្កើតកុងតឺន័រយូរជាងមុន និងការធ្វើតេស្តកាន់តែហ្មត់ចត់នៃចំណុចបញ្ចប់ផ្ទាល់។ ពេលវេលាបន្ថែមធានាថាការដាក់ពង្រាយមានស្ថិរភាព សុវត្ថិភាព និងឯកសារត្រឹមត្រូវមុនពេលប្រគល់។

ការដាក់ពង្រាយ VPC-native (Virtual Private Cloud) មានន័យថា ចំណុចបញ្ចប់គំរូរបស់អ្នកមិនត្រូវបានលាតត្រដាងទៅកាន់អ៊ីនធឺណិតបើកចំហនោះទេ។ ការចូលប្រើត្រូវបានរឹតបន្តឹងនៅកម្រិតបណ្តាញ ដែលសំខាន់សម្រាប់ការរក្សាទុកទិន្នន័យកម្មសិទ្ធិ និងទម្ងន់គំរូឱ្យមានសុវត្ថិភាពនៅក្នុងបរិយាកាសផលិតកម្ម។

កម្រិត Deployment រួមបញ្ចូលកូដប្រភពពេញលេញ ដូច្នេះក្រុមរបស់អ្នកមានអ្វីគ្រប់យ៉ាងដែលពួកគេត្រូវការ។ កម្រិត Deployment + Comments បន្ថែមទៀតផ្តល់នូវចំណារពន្យល់លម្អិតក្នុងបន្ទាត់ដែលពន្យល់រាល់ការសម្រេចចិត្តសំខាន់ៗ ដែលធ្វើឱ្យមូលដ្ឋានកូដមានភាពងាយស្រួលសម្រាប់វិស្វកររបស់អ្នកក្នុងការថែរក្សា និងពង្រីកតាមពេលវេលា។

ម៉ូដែលនីមួយៗ និងបរិស្ថាន GCP នីមួយៗមានភាពខុសគ្នា។ ការសន្ទនាខ្លីមួយធានាថាយើងយល់ពីតម្រូវការរបស់អ្នក បញ្ជាក់កម្រិតត្រឹមត្រូវ និងជៀសវាងការទៅមកបន្ទាប់ពីការបញ្ជាទិញចាប់ផ្តើម។ វាក៏មានន័យថា យើងអាចសម្គាល់ GPU មិនធម្មតា ឬការពិចារណាថ្លៃដើមជាក់លាក់ចំពោះម៉ូដែលដែលអ្នកបានជ្រើសរើសជាមុន។

ការវាយតម្លៃរបស់អតិថិជន

មើលអ្វីដែលអតិថិជនរបស់យើងនិយាយអំពី Zinn នេះ

5.0
2 ការវាយតម្លៃ
5 ⭐
2
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

អ្នកជំនាញ VertexAI ដែលមានចំណេះដឹងខ្ពស់ ដែលបានឆ្លើយសំណួរទាំងអស់របស់ខ្ញុំ ហើយថែមទាំងបានផ្តល់នូវការយល់ដឹងដែលមានប្រយោជន៍សម្រាប់ខ្ញុំ ប៉ុន្តែខ្ញុំមិនបានសួរជាក់លាក់នោះទេ។

Umair គឺជាមនុស្សល្អបំផុតដែលយើងធ្លាប់ធ្វើការជាមួយនៅលើ Zinn Hub។ គាត់ពូកែយល់ពីតម្រូវការពិសេសនៃគម្រោងរបស់យើង។ គាត់បានធ្វើលើសពីការរំពឹងទុក។ ខ្ញុំសូមណែនាំគាត់សម្រាប់គម្រោង AI ណាមួយ។

មានតែអតិថិជនដែលបានចូលគណនី ហើយបានទិញផលិតផលនេះប៉ុណ្ណោះ ទើបអាចទុកការវាយតម្លៃបាន។

ប្រភេទ

គោលការណ៍ Zinner

ដាក់ឱ្យប្រើប្រាស់ម៉ូដែល Hugging Face

មានតែអតិថិជនដែលបានចូលគណនី ហើយបានទិញផលិតផលនេះប៉ុណ្ណោះ ទើបអាចទុកការវាយតម្លៃបាន។

ជម្រើស & ការបញ្ជាទិញ

ទាញយកកម្មវិធី Zinn Hub

ការជូនដំណឹង · ការចូលប្រើលឿនជាងមុន · អេក្រង់ពេញ

ប៉ះចែករំលែកនៅក្នុងកម្មវិធីរុករករបស់អ្នក

➜ បន្ទាប់មកចុច "បន្ថែមទៅអេក្រង់ដើម"