டிஜியோ உள்கட்டமைப்பு

AI மாதிரிகள் & GPU

இன்று நிர்வகிக்கப்படும் எல்லை மாடல்களில் முகவர்களை இயக்கவும் - அல்லது GPU திறனை வாடகைக்கு எடுக்கவும், உங்கள் சொந்த எடைகளை வரிசைப்படுத்தவும் மற்றும் அதே பணியிடத்தில் உள்ள தனிப்பட்ட முனைப்புள்ளிகளுக்கு டிஜியோ பணிகளைச் செய்யவும்.

கிளாட், ஜிபிடி, ஜெமினி ஒரு முகவர் மாதிரி தேர்வு GPU வாடகை & BYOM
நிர்வகிக்கப்பட்ட மாதிரிகள்

மாடல்கள் இன்று டிஜியோவில் கிடைக்கும்

ஒரு முகவருக்கு இயல்புநிலை மாதிரியை ஒதுக்கவும் அல்லது பணிக்கு மேலெழுதவும். உங்கள் திட்ட இருப்புநிலையிலிருந்து டிஜியோ டோக்கன்களில் பயன்பாடு கணக்கிடப்படுகிறது—ஏஜென்ட் Sonnet, GPT-4o அல்லது Gemini Flashஐ அழைத்தாலும் அதே வாலட்.

ஆந்த்ரோபிக் கிளாட்

  • Claude Opus 4.7 முதன்மையான பகுத்தறிவு, நீண்ட சூழல், கட்டிடக்கலை மற்றும் உத்தி வேலை.
  • Claude Opus 4.6 நிலையான, உயர்தர பகுப்பாய்விற்கான முந்தைய தலைமுறை ஓபஸ்.
  • Claude Sonnet 4.6 தினசரி இயக்கி-குறியீடு, எழுதுதல் மற்றும் பல-படி முகவர் சுழல்கள்.
  • Claude Sonnet 4.5 / 4 ஆதரிக்கப்படும் பணிச்சுமைகளில் உடனடி தேக்ககத்துடன் கூடிய வேகமான சொனட் அடுக்குகள்.
  • Claude Haiku 4.5 குறைந்த தாமத வரைவுகள், வகைப்பாடு மற்றும் அதிக அளவு துணைப் பணிகள்.

மொழியில் மொழிபெயர்க்கவும்: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 பொது மற்றும் முகவர் பணிச்சுமைக்கான சமீபத்திய GPT-5 குடும்பம்.
  • GPT-4.1 & GPT-4o உற்பத்தி முகவர்களுக்கான நம்பகமான மல்டிமாடல் அரட்டை மற்றும் கருவி பயன்பாடு.
  • GPT-4o mini சுருக்கங்கள் மற்றும் இலகுரக படிகளுக்கான செலவு குறைந்த ரூட்டிங்.
  • o3 / o3-pro / o3-mini / o4-mini கணிதம், திட்டமிடல் மற்றும் சரிபார்ப்புக்கான பகுத்தறிவு-மையப்படுத்தப்பட்ட மாதிரிகள்.
  • GPT-5.3 Codex & Codex mini குறியீடு உருவாக்கம், மறுபயன்பாடுகள் மற்றும் ரெப்போ-விழிப்புணர்வு முகவர் திறன்கள்.

கூகுள் ஜெமினி

  • Gemini 2.5 Pro நீண்ட சூழல் ஆராய்ச்சி மற்றும் கட்டமைக்கப்பட்ட பிரித்தெடுத்தல்.
  • Gemini 2.5 Flash போட்டி டோக்கன் விகிதங்களுடன் உயர்-செயல்திறன் முகவர் படிகள்.
  • Gemini 2.0 Flash பாகுபடுத்துதல், குறியிடுதல் மற்றும் தொகுதி வேலைகளுக்கான அதிவேக பாஸ்கள்.

திறந்த மற்றும் சிறப்பு APIகள்

  • DeepSeek Chat & Reasoner அரட்டை மற்றும் சிந்தனை பாணி பணிகளுக்கு வலுவான மதிப்பு.
  • Mistral Large பன்மொழி முகவர் குழுக்களுக்கான ஐரோப்பிய ஹோஸ்ட் விருப்பம்.
  • Llama 3.3 70B API வழியாக திறந்த எடை வகுப்பு மாதிரி—தனியார் GPU உடன் நன்றாக இணைகிறது.
  • Grok 3 செய்தி மற்றும் சமூக கண்காணிப்பு முகவர்களுக்கான நிகழ்நேரம் சார்ந்த மாதிரி.
  • Sonar Pro ஆராய்ச்சி முகவர்களுக்கான தேடல் அடிப்படையிலான பதில்கள்.
  • Command R+ RAG-க்கு ஏற்ற நிறுவன அரட்டை மற்றும் மீட்பு பணிப்பாய்வுகள்.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

பயன்பாடு

முகவர்கள் ஒரு மாதிரியை எவ்வாறு தேர்வு செய்கிறார்கள்

பணி வகையின் அடிப்படையில் சோனட் vs ஓபஸ் vs மலிவான ஃபிளாஷ் மாடலை ஒருங்கிணைப்பாளர் பரிந்துரைக்கலாம். பவர் பயனர்கள் ஒரு ஏஜென்ட் பங்கிற்கு இயல்புநிலைகளை அமைக்கிறார்கள்-சோனட்டில் ஆராய்ச்சி, ஓபஸில் இறுதி மதிப்பாய்வு, ஹைக்கூ அல்லது ஜெமினி ஃப்ளாஷ் மீது மொத்தமாக குறியிடுதல்.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU வாடகை

GPU ஐ வாடகைக்கு எடுத்து உங்கள் சொந்த மாடல்களை இயக்கவும்

நேர்த்தியான ட்யூன், காற்று இடைவெளி கொண்ட சோதனைச் சாவடி அல்லது யூகிக்கக்கூடிய அனுமான விலை நிர்ணயம் வேண்டுமா? உங்கள் டிஜியோ பணியிடத்தில் பிரத்யேக GPU திறனைச் சேர்க்கவும், நீங்கள் விரும்பும் சர்விங் ஸ்டேக்கை நிறுவவும் மற்றும் உங்கள் தனிப்பட்ட முடிவுப் புள்ளியில் முகவர்களைக் குறிப்பிடவும்.

அர்ப்பணிக்கப்பட்ட நிகழ்வுகள்

மற்ற வாடிக்கையாளர்களிடமிருந்து தனிமைப்படுத்தப்பட்ட உங்கள் குத்தகைதாரருடன் மணிநேர அல்லது மாதாந்திர GPU முனைகள் (A100, H100, L40S வகுப்பு) இணைக்கப்பட்டுள்ளன.

உங்கள் எடைகள்

சேஃப்டென்சர்களைப் பதிவேற்றவும், GGUF அல்லது உங்கள் பதிவேட்டில் இருந்து இழுக்கவும்; லாமா, மிஸ்ட்ரல், குவென் மற்றும் தனிப்பயன் ஃபைன்-டியூன்களை இயக்கவும்.

நிலையான சேவை

நீங்கள் பராமரிக்கும் vLLM, TGI, Ollama அல்லது கொள்கலன் படங்கள்—Digio முகவர்கள் OpenAI-இணக்கமான அடிப்படை URL ஐ அழைக்கிறார்கள்.

அதே ஆர்கெஸ்ட்ரேஷன்

செய்ய, குழு அரட்டை, திறன்கள் மற்றும் ஒத்துழைப்பு மாறாமல் - அனுமானத்தின் பின்தளம் மட்டுமே உங்களுடையது.

ஹைப்ரிட் ரூட்டிங்

தனிப்பட்ட GPU க்கு முக்கியமான படிகளை அனுப்பவும் மற்றும் ஒரு பணிப்பாய்வு பொது ஆராய்ச்சிக்காக Claude அல்லது GPT ஐப் பயன்படுத்தவும்.

நிறுவன கட்டுப்பாடுகள்

VPC பியரிங், ஸ்டேடிக் எக்ரஸ், தணிக்கை பதிவுகள் மற்றும் ஒழுங்குபடுத்தப்பட்ட குழுக்களுக்கான மாதிரி அனுமதி பட்டியல்கள்.

உங்கள் சொந்த மாதிரியை கொண்டு வாருங்கள்

தனிப்பயன் மாதிரியை நிறுவி இணைக்கவும்

பூஜ்ஜியத்திலிருந்து முகவர்கள் வரை உங்கள் இறுதிப் புள்ளியை அழைக்கும் வழக்கமான அமைப்பு:

  1. ரிசர்வ் ஜி.பீ

    VRAM, பகுதி மற்றும் இயக்க நேரத்தைத் தேர்வு செய்யவும் (பர்ஸ்ட் vs எப்போதும்-ஆன்). வெயிட்ஸ் ஷிப்களுக்கான சேமிப்பு உதாரணத்துடன் அல்லது உங்கள் வாளியை ஏற்றுகிறது.

  2. அடுக்கை வரிசைப்படுத்தவும்

    ஒரு சேவை படத்தை அல்லது SSH ஐத் தொடங்கவும், CUDA இயக்கிகளை நிறுவவும் மற்றும் சோதனைச் சாவடிகளை ஏற்றவும். மாதிரி தயாராக இருப்பதை சுகாதார சோதனைகள் உறுதிப்படுத்துகின்றன.

  3. இறுதிப்புள்ளியை பதிவு செய்யவும்

    பணியிட அமைப்புகளில் அடிப்படை URL, API விசை மற்றும் மாதிரி ஐடியைச் சேர்க்கவும். நேரலைக்குச் செல்வதற்கு முன் டிஜியோ தாமதம் மற்றும் டோக்கன் வடிவமைப்பை சரிபார்க்கிறது.

  4. முகவர்களிடம் ஒப்படைக்கவும்

    தேர்ந்தெடுக்கப்பட்ட முகவர்களுக்கான இயல்புநிலையாக உங்கள் தனிப்பட்ட மாதிரியைத் தேர்ந்தெடுக்கவும்; நிர்வகிக்கப்பட்ட கிளாட்/ஜிபிடி மாதிரிகள் அருகருகே கிடைக்கின்றன.

ஜிபியு வாடகைக்கு டிஜியோ திட்ட சந்தாக்களிலிருந்து தனியாகக் கட்டணம் வசூலிக்கப்படுகிறது. திறன் திட்டமிடல், SLAகள் மற்றும் ஏற்கனவே உள்ள அனுமானக் கிளஸ்டரிலிருந்து இடம்பெயர்வு ஆகியவற்றிற்கு எங்களைத் தொடர்பு கொள்ளவும்.

அடிக்கடி கேட்கப்படும் கேள்விகள்

மாதிரிகள் & GPU கேள்விகள்

டிஜியோவில் நிர்வகிக்கப்பட்ட ஏபிஐகளுக்கு எதிராக சுய-ஹோஸ்ட் செய்யப்பட்ட அனுமானத்தைத் தேர்ந்தெடுப்பது.

நான் இரண்டு முறை-திட்டம் மற்றும் API செலுத்த வேண்டுமா?

உங்கள் டிஜியோ சந்தா உள்கட்டமைப்பு, முகவர்கள் மற்றும் டிஜியோ டோக்கன்களை உள்ளடக்கியது. உண்மையான உள்ளீடு/வெளியீட்டு டோக்கன்கள் மூலம் டோக்கன் சமநிலையை நிர்வகிக்கும் மாதிரி பயன்பாடு பற்று. GPU வாடகை என்பது நீங்கள் கட்டுப்படுத்தும் இயந்திரங்களுக்கான துணை நிரலாகும்.

வெவ்வேறு முகவர்கள் வெவ்வேறு மாதிரிகளைப் பயன்படுத்த முடியுமா?

ஆம்-ஒவ்வொரு முகவருக்கும் அதன் சொந்த இயல்புநிலை இருக்கலாம். பணிகளும் அரட்டைகளும் உலகளாவிய இயல்புநிலையை மாற்றாமல் ஒரே ஓட்டத்திற்கு மேலெழுதலாம்.

சோனட்டிற்கும் ஓபஸுக்கும் என்ன வித்தியாசம்?

ஓபஸ் கடினமான பகுத்தறிவு மற்றும் நீண்ட ஒத்திசைவான திட்டங்களுக்காக வடிவமைக்கப்பட்டுள்ளது; தினசரி ஏஜென்ட் லூப்களுக்கு சொனட் வேகமானது மற்றும் மலிவானது. ஹைக்கூ மற்றும் ஃபிளாஷ்-வகுப்பு மாதிரிகள் தொகுதி துணைப் பணிகளுக்குச் சிறந்தவை.

எனது சொந்த மாதிரியை மட்டும் இயக்கி கிளவுட் APIகளைத் தடுக்க முடியுமா?

எண்டர்பிரைஸ் பணியிடங்கள் வெளிச்செல்லும் மாடல் வழங்குநர்களைக் கட்டுப்படுத்தலாம் மற்றும் உங்கள் GPU எண்ட்பாயிண்டிற்கு அனைத்து முகவர் போக்குவரத்தையும் அனுப்பலாம். பெரும்பாலான அணிகளுக்கு ஹைப்ரிட் பயன்முறையே இயல்புநிலை.

எந்த GPU அளவுகள் உள்ளன?

சலுகைகள் பிராந்தியம் மற்றும் தேவையைப் பொறுத்தது—பொதுவாக 7B–70B வகுப்பு மாடல்களுக்கு 24–80 GB VRAM அடுக்குகள் மற்றும் பெரிய அடுக்குகளுக்கு பல GPU முனைகள். உங்கள் அளவுரு எண்ணிக்கை மற்றும் அளவீடு மூலம் VRAM அளவுக்கு உதவுகிறோம்.

தனிப்பட்ட GPU பயன்பாடு இன்னும் டிஜியோ டோக்கன்களைப் பயன்படுத்துகிறதா?

ஆர்கெஸ்ட்ரேஷன் (முகவர்கள், பணிகள், சேமிப்பு) உங்கள் திட்டத்தில் இருக்கும். உங்கள் GPU பற்றிய அனுமானம் GPU நேரமாகக் கணக்கிடப்படுகிறது; உள் சார்ஜ்பேக்கிற்கு டோக்கன் வடிவ உபயோகத்தை நீங்கள் விருப்பமாக அளவிடலாம்.

நிர்வகிக்கப்பட்ட மாடல்களைத் தேர்வு செய்யவும் அல்லது உங்கள் GPU கொண்டு வரவும்

இன்றே க்ளாட் மற்றும் ஜிபிடியில் தொடங்கவும், பிறகு தனிப்பயன் எடைகளை ஹோஸ்ட் செய்யத் தயாராக இருக்கும் போது பிரத்யேக GPU-ஐச் சேர்க்கவும்—அதே முகவர்கள், அதே பணிகள், உங்கள் அனுமானம்.