डिजिओ पायाभूत सुविधा

AI मॉडेल आणि GPU

व्यवस्थापित फ्रंटियर मॉडेल्सवर आज एजंट चालवा—किंवा GPU क्षमता भाड्याने घ्या, तुमचे स्वतःचे वजन तैनात करा आणि त्याच कार्यक्षेत्रातील खाजगी एंडपॉइंट्सवर डिजिओ कार्ये मार्गी लावा.

क्लॉड, जीपीटी, मिथुन प्रति-एजंट मॉडेल निवड GPU भाड्याने आणि BYOM
व्यवस्थापित मॉडेल

डिजिओमध्ये आज मॉडेल उपलब्ध आहेत

प्रति एजंट एक डीफॉल्ट मॉडेल नियुक्त करा किंवा प्रति कार्य ओव्हरराइड करा. तुमच्या प्लॅन बॅलन्समधून डिजिओ टोकनमध्ये वापर मोजला जातो—एजंट सॉनेट, GPT-4o किंवा जेमिनी फ्लॅशला कॉल करत असले तरीही तेच वॉलेट.

मानववंशीय क्लॉड

  • Claude Opus 4.7 प्रमुख तर्क, दीर्घ संदर्भ, आर्किटेक्चर आणि धोरण कार्य.
  • Claude Opus 4.6 स्थिर, उच्च-गुणवत्तेच्या विश्लेषणासाठी मागील पिढीचे ओपस.
  • Claude Sonnet 4.6 दैनिक ड्रायव्हर—कोडिंग, लेखन आणि मल्टी-स्टेप एजंट लूप.
  • Claude Sonnet 4.5 / 4 समर्थित वर्कलोड्सवर प्रॉम्प्ट कॅशिंगसह जलद सॉनेट स्तर.
  • Claude Haiku 4.5 कमी-विलंब मसुदे, वर्गीकरण आणि उच्च-खंड उपकार्य.

B2B SaaS वेबसाइट UI लेबल. नैसर्गिक श्री मध्ये भाषांतर करा: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 सामान्य आणि एजंटिक वर्कलोडसाठी नवीनतम GPT-5 कुटुंब.
  • GPT-4.1 & GPT-4o उत्पादन एजंट्ससाठी विश्वसनीय मल्टीमोडल चॅट आणि साधन वापर.
  • GPT-4o mini सारांश आणि लाइटवेट पायऱ्यांसाठी किफायतशीर राउटिंग.
  • o3 / o3-pro / o3-mini / o4-mini गणित, नियोजन आणि पडताळणीसाठी तर्क-केंद्रित मॉडेल.
  • GPT-5.3 Codex & Codex mini कोड जनरेशन, रिफॅक्टर्स आणि रेपो-अवेअर एजंट कौशल्ये.

Google मिथुन

  • Gemini 2.5 Pro दीर्घ संदर्भ संशोधन आणि संरचित निष्कर्षण.
  • Gemini 2.5 Flash स्पर्धात्मक टोकन दरांसह उच्च-थ्रूपुट एजंट पायऱ्या.
  • Gemini 2.0 Flash पार्सिंग, टॅगिंग आणि बॅच जॉबसाठी अल्ट्रा-फास्ट पास.

उघडा आणि विशेषज्ञ API

  • DeepSeek Chat & Reasoner चॅट आणि साखळी-ऑफ-थॉट शैली कार्यांसाठी मजबूत मूल्य.
  • Mistral Large बहुभाषिक एजंट संघांसाठी युरोपियन-होस्टेड पर्याय.
  • Llama 3.3 70B API द्वारे ओपन-वेट क्लास मॉडेल—खाजगी GPU सह चांगले जोडते.
  • Grok 3 बातम्या आणि सोशल मॉनिटरिंग एजंटसाठी रिअल-टाइम ओरिएंटेड मॉडेल.
  • Sonar Pro संशोधन एजंट्ससाठी आधारीत उत्तरे शोधा.
  • Command R+ RAG-अनुकूल एंटरप्राइझ चॅट आणि पुनर्प्राप्ती कार्यप्रवाह.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

वापर

एजंट मॉडेल कसे निवडतात

समन्वयक कार्य प्रकारावर आधारित सॉनेट वि ओपस विरुद्ध स्वस्त फ्लॅश मॉडेलची शिफारस करू शकतो. पॉवर वापरकर्ते प्रति एजंट रोल डीफॉल्ट सेट करतात - सॉनेटवर संशोधन, ओपसवर अंतिम पुनरावलोकन, हायकू किंवा जेमिनी फ्लॅशवर मोठ्या प्रमाणात टॅगिंग.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU भाड्याने

GPU भाड्याने घ्या आणि तुमचे स्वतःचे मॉडेल चालवा

फाइन-ट्यून, एअर-गॅप्ड चेकपॉईंट किंवा अंदाज लावता येण्याजोग्या किंमतीची आवश्यकता आहे? तुमच्या डिजिओ वर्कस्पेसमध्ये समर्पित GPU क्षमता जोडा, तुम्हाला आवडणारा सर्व्हिंग स्टॅक स्थापित करा आणि तुमच्या खाजगी एंडपॉइंटवर पॉइंट एजंट्स.

समर्पित उदाहरणे

दर तासाला किंवा मासिक GPU नोड्स (A100, H100, L40S वर्ग) तुमच्या भाडेकरूशी संलग्न आहेत—इतर ग्राहकांपासून वेगळे.

तुमचे वजन

सेफटेन्सर, GGUF अपलोड करा किंवा तुमच्या रेजिस्ट्रीमधून पुल करा; लामा, मिस्ट्रल, क्वेन आणि सानुकूल फाइन-ट्यून चालवा.

मानक सेवा

vLLM, TGI, Ollama, किंवा कंटेनर इमेज तुम्ही राखता-Digio एजंट OpenAI-सुसंगत बेस URL ला कॉल करतात.

त्याच ऑर्केस्ट्रेशन

करण्यासाठी, टीम चॅट, कौशल्ये आणि सहयोग अपरिवर्तित—केवळ अनुमान बॅकएंड तुमचा आहे.

हायब्रिड राउटिंग

खाजगी GPU ला संवेदनशील पायऱ्या पाठवा आणि एका वर्कफ्लोमध्ये सार्वजनिक संशोधनासाठी क्लॉड किंवा GPT वापरा.

एंटरप्राइझ नियंत्रणे

VPC पीअरिंग, स्टॅटिक एग्रेस, ऑडिट लॉग आणि नियमन केलेल्या संघांसाठी मॉडेल अनुमत सूची.

आपले स्वतःचे मॉडेल आणा

सानुकूल मॉडेल स्थापित करा आणि कनेक्ट करा

तुमच्या एंडपॉइंटवर कॉल करणाऱ्या एजंट्सपर्यंत शून्य ते ठराविक सेटअप:

  1. GPU आरक्षित करा

    VRAM, प्रदेश आणि अपटाइम निवडा (बर्स्ट वि नेहमी चालू). उदाहरणासह किंवा तुमची बादली आरोहित वजनासाठी साठवण.

  2. स्टॅक तैनात करा

    मध्ये सेवा देणारी प्रतिमा किंवा SSH सुरू करा, CUDA ड्राइव्हर्स स्थापित करा आणि चेकपॉइंट लोड करा. आरोग्य तपासणी मॉडेल तयार असल्याची पुष्टी करतात.

  3. एंडपॉइंट नोंदणी करा

    वर्कस्पेस सेटिंग्जमध्ये बेस URL, API की आणि मॉडेल आयडी जोडा. Digio लाइव्ह जाण्यापूर्वी लेटन्सी आणि टोकन फॉरमॅट प्रमाणित करते.

  4. एजंटांना नियुक्त करा

    निवडलेल्या एजंटसाठी डीफॉल्ट म्हणून तुमचे खाजगी मॉडेल निवडा; व्यवस्थापित क्लॉड/GPT मॉडेल शेजारीच उपलब्ध आहेत.

GPU भाड्याचे बिल Digio प्लॅन सबस्क्रिप्शनमधून वेगळे केले जाते. विद्यमान अनुमान क्लस्टरमधून क्षमता नियोजन, SLA आणि स्थलांतरासाठी आमच्याशी संपर्क साधा.

वारंवार विचारले जाणारे प्रश्न

मॉडेल आणि GPU प्रश्न

Digio वर व्यवस्थापित API वि स्व-होस्ट केलेले अनुमान निवडणे.

मी दोनदा पैसे भरतो का—प्लॅन प्लस API?

तुमच्या डिजिओ सबस्क्रिप्शनमध्ये पायाभूत सुविधा, एजंट आणि डिजिओ टोकन समाविष्ट आहेत. व्यवस्थापित मॉडेल वापर डेबिट जे वास्तविक इनपुट/आउटपुट टोकन्सद्वारे टोकन शिल्लक. GPU भाडे हे तुम्ही नियंत्रित करत असलेल्या मशीनसाठी ॲड-ऑन आहे.

भिन्न एजंट भिन्न मॉडेल वापरू शकतात?

होय—प्रत्येक एजंटचे स्वतःचे डीफॉल्ट असू शकतात. टास्क आणि चॅट्स ग्लोबल डीफॉल्ट न बदलता एकाच रनसाठी ओव्हरराइड करू शकतात.

सॉनेट आणि ओपसमध्ये काय फरक आहे?

ओपस कठोर तर्क आणि दीर्घ सुसंगत योजनांसाठी ट्यून केले जाते; रोजच्या एजंट लूपसाठी सॉनेट वेगवान आणि स्वस्त आहे. व्हॉल्यूम सबटास्कसाठी हायकू आणि फ्लॅश-क्लास मॉडेल सर्वोत्तम आहेत.

मी फक्त माझे स्वतःचे मॉडेल चालवू शकतो आणि क्लाउड एपीआय ब्लॉक करू शकतो?

एंटरप्राइझ वर्कस्पेसेस आउटबाउंड मॉडेल प्रदात्यांना प्रतिबंधित करू शकतात आणि सर्व एजंट ट्रॅफिक तुमच्या GPU एंडपॉईंटवर रूट करू शकतात. हायब्रिड मोड बहुतेक संघांसाठी डीफॉल्ट आहे.

कोणते GPU आकार उपलब्ध आहेत?

ऑफरिंग क्षेत्र आणि मागणीवर अवलंबून असतात—सामान्यत: 7B–70B वर्ग मॉडेल्ससाठी 24-80 GB VRAM टियर आणि मोठ्या स्टॅकसाठी मल्टी-GPU नोड्स. आम्ही तुमच्या पॅरामीटर गणना आणि परिमाणीकरणातून आकारमान VRAM ला मदत करतो.

खाजगी GPU वापर अजूनही Digio टोकन वापरतो का?

ऑर्केस्ट्रेशन (एजंट, टास्क, स्टोरेज) तुमच्या प्लॅनवर राहते. तुमच्या GPU वरील अनुमान GPU वेळ म्हणून बिल केले जाते; अंतर्गत चार्जबॅकसाठी तुम्ही पर्यायाने टोकन-आकाराचा वापर मीटर करू शकता.

व्यवस्थापित मॉडेल निवडा किंवा तुमचे GPU आणा

आजच क्लॉड आणि GPT वर प्रारंभ करा, नंतर जेव्हा तुम्ही सानुकूल वजन - समान एजंट, समान कार्ये, तुमचे अनुमान होस्ट करण्यास तयार असाल तेव्हा समर्पित GPU जोडा.