డిజియో మౌలిక సదుపాయాలు

AI మోడల్స్ & GPU

ఈరోజు నిర్వహించబడే సరిహద్దు మోడల్‌లలో ఏజెంట్‌లను అమలు చేయండి-లేదా GPU సామర్థ్యాన్ని అద్దెకు తీసుకోండి, మీ స్వంత బరువులను అమర్చండి మరియు అదే వర్క్‌స్పేస్‌లోని ప్రైవేట్ ఎండ్ పాయింట్‌లకు డిజియో టాస్క్‌లను రూట్ చేయండి.

క్లాడ్, GPT, జెమిని ప్రతి ఏజెంట్ మోడల్ ఎంపిక GPU అద్దె & BYOM
నిర్వహించబడే నమూనాలు

ఈరోజు డిజియోలో మోడల్‌లు అందుబాటులో ఉన్నాయి

ప్రతి ఏజెంట్‌కు డిఫాల్ట్ మోడల్‌ను కేటాయించండి లేదా ప్రతి టాస్క్‌ను భర్తీ చేయండి. మీ ప్లాన్ బ్యాలెన్స్ నుండి డిజియో టోకెన్‌లలో వినియోగం గణించబడుతుంది—ఏజెంట్ Sonnet, GPT-4o లేదా Gemini Flashకి కాల్ చేసినా అదే వాలెట్.

ఆంత్రోపిక్ క్లాడ్

  • Claude Opus 4.7 ఫ్లాగ్‌షిప్ రీజనింగ్, లాంగ్ కాంటెక్స్ట్, ఆర్కిటెక్చర్ మరియు స్ట్రాటజీ వర్క్.
  • Claude Opus 4.6 స్థిరమైన, అధిక-నాణ్యత విశ్లేషణ కోసం మునుపటి తరం ఓపస్.
  • Claude Sonnet 4.6 రోజువారీ డ్రైవర్-కోడింగ్, రైటింగ్ మరియు బహుళ-దశల ఏజెంట్ లూప్‌లు.
  • Claude Sonnet 4.5 / 4 మద్దతు ఉన్న పనిభారంపై ప్రాంప్ట్ కాషింగ్‌తో ఫాస్ట్ సోనెట్ టైర్లు.
  • Claude Haiku 4.5 తక్కువ-లేటెన్సీ డ్రాఫ్ట్‌లు, వర్గీకరణ మరియు అధిక-వాల్యూమ్ సబ్‌టాస్క్‌లు.

అక్షరాలా అనువదించండి: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 సాధారణ మరియు ఏజెంట్ పనిభారం కోసం తాజా GPT-5 కుటుంబం.
  • GPT-4.1 & GPT-4o ఉత్పత్తి ఏజెంట్ల కోసం నమ్మదగిన మల్టీమోడల్ చాట్ మరియు సాధన వినియోగం.
  • GPT-4o mini సారాంశాలు మరియు తేలికపాటి దశల కోసం ఖర్చుతో కూడుకున్న రూటింగ్.
  • o3 / o3-pro / o3-mini / o4-mini గణితం, ప్రణాళిక మరియు ధృవీకరణ కోసం రీజనింగ్-ఫోకస్డ్ మోడల్స్.
  • GPT-5.3 Codex & Codex mini కోడ్ ఉత్పత్తి, రీఫ్యాక్టర్‌లు మరియు రెపో-అవేర్ ఏజెంట్ నైపుణ్యాలు.

గూగుల్ జెమిని

  • Gemini 2.5 Pro దీర్ఘ-సందర్భ పరిశోధన మరియు నిర్మాణాత్మక వెలికితీత.
  • Gemini 2.5 Flash పోటీ టోకెన్ రేట్లతో హై-త్రూపుట్ ఏజెంట్ అడుగులు.
  • Gemini 2.0 Flash పార్సింగ్, ట్యాగింగ్ మరియు బ్యాచ్ జాబ్‌ల కోసం అల్ట్రా-ఫాస్ట్ పాస్‌లు.

ఓపెన్ & స్పెషలిస్ట్ APIలు

  • DeepSeek Chat & Reasoner చాట్ మరియు చైన్-ఆఫ్-థాట్ స్టైల్ టాస్క్‌లకు బలమైన విలువ.
  • Mistral Large బహుభాషా ఏజెంట్ బృందాల కోసం యూరోపియన్-హోస్ట్ ఎంపిక.
  • Llama 3.3 70B API ద్వారా ఓపెన్-వెయిట్స్ క్లాస్ మోడల్—ప్రైవేట్ GPUతో బాగా జత చేస్తుంది.
  • Grok 3 వార్తలు మరియు సామాజిక పర్యవేక్షణ ఏజెంట్ల కోసం రియల్ టైమ్ ఓరియెంటెడ్ మోడల్.
  • Sonar Pro రీసెర్చ్ ఏజెంట్ల కోసం సెర్చ్-గ్రౌండెడ్ సమాధానాలు.
  • Command R+ RAG-స్నేహపూర్వక ఎంటర్‌ప్రైజ్ చాట్ మరియు రిట్రీవల్ వర్క్‌ఫ్లోలు.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

వాడుక

ఏజెంట్లు మోడల్‌ను ఎలా ఎంచుకుంటారు

కోఆర్డినేటర్ టాస్క్ రకం ఆధారంగా సొనెట్ vs ఓపస్ vs చౌకైన ఫ్లాష్ మోడల్‌ని సిఫార్సు చేయవచ్చు. పవర్ యూజర్లు ప్రతి ఏజెంట్ పాత్రకు డిఫాల్ట్‌లను సెట్ చేస్తారు-సోనెట్‌లో పరిశోధన, ఓపస్‌లో తుది సమీక్ష, హైకు లేదా జెమినీ ఫ్లాష్‌లో బల్క్ ట్యాగింగ్.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU అద్దె

GPUని అద్దెకు తీసుకోండి మరియు మీ స్వంత నమూనాలను అమలు చేయండి

ఫైన్-ట్యూన్, ఎయిర్-గ్యాప్డ్ చెక్‌పాయింట్ లేదా ఊహించదగిన అనుమితి ధర కావాలా? మీ డిజియో వర్క్‌స్పేస్‌కు అంకితమైన GPU సామర్థ్యాన్ని జోడించండి, మీరు ఇష్టపడే సర్వింగ్ స్టాక్‌ను ఇన్‌స్టాల్ చేయండి మరియు మీ ప్రైవేట్ ఎండ్‌పాయింట్‌లో పాయింట్ ఏజెంట్‌లను జోడించండి.

అంకితమైన సందర్భాలు

మీ అద్దెదారుకు గంట లేదా నెలవారీ GPU నోడ్‌లు (A100, H100, L40S క్లాస్) జోడించబడ్డాయి—ఇతర కస్టమర్‌ల నుండి వేరుచేయబడి ఉంటాయి.

మీ బరువులు

సేఫ్టెన్సర్లు, GGUF అప్‌లోడ్ చేయండి లేదా మీ రిజిస్ట్రీ నుండి లాగండి; లామా, మిస్ట్రాల్, క్వెన్ మరియు కస్టమ్ ఫైన్-ట్యూన్‌లను అమలు చేయండి.

స్టాండర్డ్ సర్వింగ్

vLLM, TGI, Ollama లేదా మీరు నిర్వహించే కంటైనర్ చిత్రాలు—Digio ఏజెంట్లు OpenAI-అనుకూల బేస్ URLని కాల్ చేస్తారు.

అదే ఆర్కెస్ట్రేషన్

చేయడానికి, టీమ్ చాట్, నైపుణ్యాలు మరియు సహకారం మారదు-అనుమితి బ్యాకెండ్ మాత్రమే మీదే.

హైబ్రిడ్ రూటింగ్

ప్రైవేట్ GPUకి సున్నితమైన దశలను పంపండి మరియు ఒక వర్క్‌ఫ్లో పబ్లిక్ పరిశోధన కోసం క్లాడ్ లేదా GPTని ఉపయోగించండి.

సంస్థ నియంత్రణలు

VPC పీరింగ్, స్టాటిక్ ఎగ్రెస్, ఆడిట్ లాగ్‌లు మరియు నియంత్రిత బృందాల కోసం మోడల్ అనుమతి జాబితాలు.

మీ స్వంత నమూనాను తీసుకురండి

కస్టమ్ మోడల్‌ను ఇన్‌స్టాల్ చేసి కనెక్ట్ చేయండి

మీ ఎండ్‌పాయింట్‌కి కాల్ చేసే సున్నా నుండి ఏజెంట్‌ల వరకు సాధారణ సెటప్:

  1. రిజర్వ్ GPU

    VRAM, ప్రాంతం మరియు సమయ సమయాన్ని ఎంచుకోండి (బర్స్ట్ vs ఎల్లప్పుడూ ఆన్‌లో ఉంటుంది). మీ బకెట్‌ను ఇన్‌స్టాన్స్‌తో లేదా మౌంట్‌తో బరువుల కోసం నిల్వ చేయండి.

  2. స్టాక్‌ను అమలు చేయండి

    లో సర్వింగ్ ఇమేజ్ లేదా SSH ప్రారంభించండి, CUDA డ్రైవర్‌లను ఇన్‌స్టాల్ చేయండి మరియు చెక్‌పాయింట్‌లను లోడ్ చేయండి. మోడల్ సిద్ధంగా ఉందని ఆరోగ్య తనిఖీలు నిర్ధారిస్తాయి.

  3. రిజిస్టర్ ఎండ్ పాయింట్

    వర్క్‌స్పేస్ సెట్టింగ్‌లలో బేస్ URL, API కీ మరియు మోడల్ ఐడిని జోడించండి. ప్రత్యక్ష ప్రసారం చేయడానికి ముందు డిజియో జాప్యం మరియు టోకెన్ ఆకృతిని ధృవీకరిస్తుంది.

  4. ఏజెంట్లకు అప్పగించండి

    ఎంచుకున్న ఏజెంట్ల కోసం మీ ప్రైవేట్ మోడల్‌ని డిఫాల్ట్‌గా ఎంచుకోండి; నిర్వహించబడే క్లాడ్/GPT మోడల్‌లు పక్కపక్కనే అందుబాటులో ఉంటాయి.

GPU అద్దె డిజియో ప్లాన్ సబ్‌స్క్రిప్షన్‌ల నుండి విడిగా బిల్ చేయబడుతుంది. ఇప్పటికే ఉన్న అనుమితి క్లస్టర్ నుండి కెపాసిటీ ప్లానింగ్, SLAలు మరియు మైగ్రేషన్ కోసం మమ్మల్ని సంప్రదించండి.

తరచుగా అడిగే ప్రశ్నలు

మోడల్స్ & GPU ప్రశ్నలు

డిజియోలో నిర్వహించబడే APIలు vs స్వీయ-హోస్ట్ చేసిన అనుమితిని ఎంచుకోవడం.

నేను రెండుసార్లు చెల్లించాలా-ప్లాన్ ప్లస్ API?

మీ డిజియో సబ్‌స్క్రిప్షన్ ఇన్‌ఫ్రాస్ట్రక్చర్, ఏజెంట్‌లు మరియు డిజియో టోకెన్‌లను కవర్ చేస్తుంది. వాస్తవ ఇన్‌పుట్/అవుట్‌పుట్ టోకెన్‌ల ద్వారా టోకెన్ బ్యాలెన్స్‌ని నిర్వహించే మోడల్ యూసేజ్ డెబిట్‌లు. GPU రెంటల్ అనేది మీరు నియంత్రించే మెషీన్‌ల కోసం ఒక యాడ్-ఆన్.

వేర్వేరు ఏజెంట్లు వేర్వేరు నమూనాలను ఉపయోగించవచ్చా?

అవును-ప్రతి ఏజెంట్ దాని స్వంత డిఫాల్ట్‌ని కలిగి ఉండవచ్చు. గ్లోబల్ డిఫాల్ట్‌ని మార్చకుండా టాస్క్‌లు మరియు చాట్‌లు ఒక్క పరుగు కోసం ఓవర్‌రైడ్ చేయగలవు.

సోనెట్ మరియు ఓపస్ మధ్య తేడా ఏమిటి?

ఓపస్ కఠినమైన తార్కికం మరియు పొడవైన పొందికైన ప్రణాళికల కోసం ట్యూన్ చేయబడింది; రోజువారీ ఏజెంట్ లూప్‌ల కోసం సొనెట్ వేగంగా మరియు చౌకగా ఉంటుంది. హైకూ మరియు ఫ్లాష్-క్లాస్ మోడల్‌లు వాల్యూమ్ సబ్‌టాస్క్‌లకు ఉత్తమమైనవి.

నేను నా స్వంత మోడల్‌ను మాత్రమే అమలు చేయగలనా మరియు క్లౌడ్ APIలను నిరోధించవచ్చా?

ఎంటర్‌ప్రైజ్ వర్క్‌స్పేస్‌లు అవుట్‌బౌండ్ మోడల్ ప్రొవైడర్‌లను నియంత్రిస్తాయి మరియు మీ GPU ఎండ్‌పాయింట్‌కు ఏజెంట్ ట్రాఫిక్‌ను మొత్తం రూట్ చేయగలవు. చాలా జట్లకు హైబ్రిడ్ మోడ్ డిఫాల్ట్.

ఏ GPU పరిమాణాలు అందుబాటులో ఉన్నాయి?

ఆఫర్‌లు ప్రాంతం మరియు డిమాండ్‌పై ఆధారపడి ఉంటాయి-సాధారణంగా 7B–70B క్లాస్ మోడల్‌లకు 24–80 GB VRAM టైర్లు మరియు పెద్ద స్టాక్‌ల కోసం బహుళ-GPU నోడ్‌లు. మేము మీ పారామీటర్ కౌంట్ మరియు పరిమాణీకరణ నుండి పరిమాణం VRAMకి సహాయం చేస్తాము.

ప్రైవేట్ GPU వినియోగం ఇప్పటికీ డిజియో టోకెన్‌లను వినియోగిస్తుందా?

ఆర్కెస్ట్రేషన్ (ఏజెంట్‌లు, టాస్క్‌లు, నిల్వ) మీ ప్లాన్‌లో ఉంటుంది. మీ GPUపై అనుమానం GPU సమయంగా బిల్ చేయబడుతుంది; అంతర్గత ఛార్జ్‌బ్యాక్ కోసం మీరు ఐచ్ఛికంగా టోకెన్ ఆకారపు వినియోగాన్ని మీటర్ చేయవచ్చు.

నిర్వహించబడే మోడల్‌లను ఎంచుకోండి లేదా మీ GPUని తీసుకురండి

ఈరోజే క్లాడ్ మరియు GPTలో ప్రారంభించండి, ఆపై మీరు అనుకూల బరువులను హోస్ట్ చేయడానికి సిద్ధంగా ఉన్నప్పుడు అంకితమైన GPUని జోడించండి-అదే ఏజెంట్లు, అదే పనులు, మీ అనుమితి.