Digio infrastruktūra

AI modeļi un GPU

Palaidiet aģentus pārvaldītajos modeļos jau šodien vai nomājiet GPU jaudu, izvietojiet savus svarus un maršrutējiet Digio uzdevumus uz privātiem galapunktiem tajā pašā darbvietā.

Klods, GPT, Dvīņi Modeļa izvēle katram aģentam GPU noma un BYOM
Pārvaldīti modeļi

Modeļi pieejami Digio jau šodien

Piešķiriet noklusējuma modeli katram aģentam vai ignorējiet katram uzdevumam. Lietojums tiek aprēķināts Digio Tokens no jūsu plāna bilances — tajā pašā makā neatkarīgi no tā, vai aģents zvana Sonnet, GPT-4o vai Gemini Flash.

Antropiskais Klods

  • Claude Opus 4.7 Pamatdomošana, garš konteksts, arhitektūra un stratēģijas darbs.
  • Claude Opus 4.6 Iepriekšējās paaudzes Opus stabilai, augstas kvalitātes analīzei.
  • Claude Sonnet 4.6 Ikdienas draiveris — kodēšana, rakstīšana un daudzpakāpju aģenta cilpas.
  • Claude Sonnet 4.5 / 4 Ātri Sonneta līmeņi ar ātru kešatmiņu atbalstītās darba slodzēs.
  • Claude Haiku 4.5 Zema latentuma uzmetumi, klasifikācija un liela apjoma apakšuzdevumi.

Tulkot burtiski: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 Jaunākā GPT-5 saime vispārējai un aģentu darba slodzei.
  • GPT-4.1 & GPT-4o Uzticama multimodāla tērzēšana un rīku izmantošana ražošanas aģentiem.
  • GPT-4o mini Rentabla maršrutēšana kopsavilkumiem un vieglām darbībām.
  • o3 / o3-pro / o3-mini / o4-mini Uz argumentāciju vērsti modeļi matemātikai, plānošanai un pārbaudei.
  • GPT-5.3 Codex & Codex mini Kodu ģenerēšana, pārstrukturēšana un repo-apzinoša aģenta prasmes.

Tulkot burtiski: Google Gemini

  • Gemini 2.5 Pro Ilgstoša konteksta izpēte un strukturēta ieguve.
  • Gemini 2.5 Flash Augstas caurlaidības aģenta darbības ar konkurētspējīgām marķieru likmēm.
  • Gemini 2.0 Flash Īpaši ātras caurlaides parsēšanai, marķēšanai un pakešu darbiem.

Atvērtās un specializētās API

  • DeepSeek Chat & Reasoner Liela vērtība tērzēšanas un domu ķēdes stila uzdevumiem.
  • Mistral Large Eiropā izvietota iespēja daudzvalodu aģentu komandām.
  • Llama 3.3 70B Atvērtā svara klases modelis, izmantojot API — labi savienojas ar privāto GPU.
  • Grok 3 Reāllaika orientēts modelis ziņu un sociālās uzraudzības aģentiem.
  • Sonar Pro Uz meklēšanu balstītas atbildes pētniecības aģentiem.
  • Command R+ RAG draudzīgas uzņēmuma tērzēšanas un izguves darbplūsmas.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

Lietošana

Kā aģenti izvēlas modeli

Koordinators var ieteikt Sonnet vs Opus salīdzinājumā ar lētāku zibspuldzes modeli, pamatojoties uz uzdevuma veidu. Jaudīgi lietotāji iestata noklusējuma iestatījumus katrai aģenta lomai — pētījumi Sonnetā, gala pārskatīšana pakalpojumā Opus, lielapjoma marķēšana Haiku vai Gemini Flash.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU noma

Nomājiet GPU un palaidiet savus modeļus

Nepieciešama precīza noregulēšana, gaisa spraugas kontrolpunkts vai paredzama izsecināmu cenu noteikšana? Pievienojiet savai Digio darbvietai īpašu GPU jaudu, instalējiet vēlamo apkalpošanas steku un norādiet aģentus uz savu privāto galapunktu.

Īpaši gadījumi

Stundas vai mēneša GPU mezgli (A100, H100, L40S klase), kas pievienoti jūsu nomniekam — izolēti no citiem klientiem.

Tavi svari

Augšupielādējiet seifus, GGUF vai izvelciet no sava reģistra; palaist Llama, Mistral, Qwen un pielāgotas smalkas melodijas.

Standarta pasniegšana

VLLM, TGI, Ollama vai konteinera attēli, ko uzturat — Digio aģenti izsauc ar OpenAI saderīgu bāzes URL.

Tāda pati orķestrācija

Lai to paveiktu, komandas tērzēšana, prasmes un sadarbība nemainās — jums pieder tikai secinājumu aizmugursistēma.

Hibrīda maršrutēšana

Nosūtiet sensitīvas darbības uz privātu GPU un izmantojiet Claude vai GPT publiskai izpētei vienā darbplūsmā.

Uzņēmuma kontrole

VPC peering, statiskā izeja, audita žurnāli un modeļu atļaušanas saraksti regulētām komandām.

Ņemiet līdzi savu modeli

Instalējiet un pievienojiet pielāgotu modeli

Tipiska iestatīšana no nulles līdz aģentiem, kas izsauc jūsu galapunktu:

  1. Rezerves GPU

    Izvēlieties VRAM, reģionu un darbības laiku (sērijveida vai vienmēr ieslēgtu). Svaru krātuve tiek piegādāta kopā ar instanci vai stiprinājumiem.

  2. Izvietojiet kaudzi

    Sāciet apkalpot attēlu vai SSH, instalējiet CUDA draiverus un ielādējiet kontrolpunktus. Veselības pārbaudes apstiprina, ka modelis ir gatavs.

  3. Reģistrēt beigu punktu

    Pievienojiet bāzes URL, API atslēgu un modeļa ID darbvietas iestatījumos. Digio pirms tiešraides pārbauda latentuma un marķiera formātu.

  4. Piešķirt aģentiem

    Izvēlieties savu privāto modeli kā noklusējuma modeli atlasītajiem aģentiem; pārvaldītie Claude/GPT modeļi paliek pieejami blakus.

GPU noma tiek iekasēta atsevišķi no Digio plāna abonementiem. Sazinieties ar mums par jaudas plānošanu, SLA un migrāciju no esoša secinājumu kopas.

B2B SaaS vietnes lietotāja interfeisa etiķete. Tulkot uz natural lv: FAQ

Jautājumi par modeļiem un GPU

Pārvaldīto API izvēle salīdzinājumā ar pašmitinātiem secinājumiem pakalpojumā Digio.

Vai man ir jāmaksā divreiz — plāns un API?

Jūsu Digio abonements attiecas uz infrastruktūru, aģentiem un iekļautajiem Digio marķieriem. Pārvaldīta modeļa izmantošanas debeti, kas marķieri sabalansē pēc faktiskajiem ievades/izvades marķieriem. GPU noma ir jūsu kontrolēto iekārtu papildinājums.

Vai dažādi aģenti var izmantot dažādus modeļus?

Jā — katram aģentam var būt savs noklusējums. Uzdevumus un tērzēšanu var ignorēt vienu reizi, nemainot globālo noklusējuma iestatījumu.

Kāda ir atšķirība starp Sonnet un Opus?

Opus ir pielāgots stingrākai spriešanai un garākiem saskaņotiem plāniem; Sonets ir ātrāks un lētāks ikdienas aģentu cilpām. Haiku un flash klases modeļi ir vislabākie apjoma apakšuzdevumiem.

Vai es varu palaist tikai savu modeli un bloķēt mākoņa API?

Uzņēmuma darbvietas var ierobežot izejošo modeļu nodrošinātājus un novirzīt visu aģentu trafiku uz jūsu GPU galapunktu. Hibrīda režīms ir noklusējuma režīms lielākajai daļai komandu.

Kādi GPU izmēri ir pieejami?

Piedāvājumi ir atkarīgi no reģiona un pieprasījuma — parasti 24–80 GB VRAM līmeņi 7B–70B klases modeļiem un vairāku GPU mezgli lielākiem skursteņiem. Mēs palīdzam noteikt VRAM lielumu no jūsu parametru skaita un kvantēšanas.

Vai privāta GPU izmantošana joprojām patērē Digio marķierus?

Orķestrācija (aģenti, uzdevumi, krātuve) paliek jūsu plānā. Secinājumi par jūsu GPU tiek iekasēti kā GPU laiks; pēc izvēles varat izmērīt marķiera formas lietojumu iekšējai atmaksai.

Izvēlieties pārvaldītos modeļus vai ņemiet līdzi savu GPU

Sāciet ar Claude un GPT jau šodien, pēc tam pievienojiet īpašu GPU, kad esat gatavs mitināt pielāgotus svarus — tos pašus aģentus, tos pašus uzdevumus, jūsu secinājumus.