Modele gestionate
Modele disponibile în Digio astăzi
Atribuiți un model implicit pentru fiecare agent sau înlocuiți pentru fiecare sarcină. Utilizarea este măsurată în jetoane Digio din soldul planului dvs. - același portofel, indiferent dacă agentul sună Sonnet, GPT-4o sau Gemini Flash.
Claude antropic
-
Claude Opus 4.7
Raționament emblematic, context lung, arhitectură și activitate strategică.
-
Claude Opus 4.6
Opus de generație anterioară pentru analiză stabilă, de înaltă calitate.
-
Claude Sonnet 4.6
Driver zilnic: codare, scriere și bucle de agent în mai mulți pași.
-
Claude Sonnet 4.5 / 4
Niveluri Sonnet rapide cu memorare rapidă în cache pe sarcinile de lucru acceptate.
-
Claude Haiku 4.5
Schițe cu latență redusă, clasificare și sarcini secundare cu volum mare.
Eticheta interfață de utilizare a site-ului web B2B SaaS. Traduceți în ro natural: OpenAI
-
GPT-5.5 / GPT-5.4 / GPT-5.2
Cea mai recentă familie GPT-5 pentru sarcini de lucru generale și agentice.
-
GPT-4.1 & GPT-4o
Chat multimodal de încredere și utilizarea instrumentelor pentru agenții de producție.
-
GPT-4o mini
Rutare rentabilă pentru rezumate și pași simpli.
-
o3 / o3-pro / o3-mini / o4-mini
Modele axate pe raționament pentru matematică, planificare și verificare.
-
GPT-5.3 Codex & Codex mini
Generarea codului, refactorarea și abilitățile de agenți repo-aware.
Google Gemeni
-
Gemini 2.5 Pro
Cercetare în context lung și extracție structurată.
-
Gemini 2.5 Flash
Pași de agent de mare debit cu rate competitive de token.
-
Gemini 2.0 Flash
Treceri ultra-rapide pentru lucrări de analizare, etichetare și lot.
API-uri deschise și specializate
-
DeepSeek Chat & Reasoner
Valoare puternică pentru sarcinile de stil de chat și lanț de gândire.
-
Mistral Large
Opțiune găzduită în Europa pentru echipele de agenți multilingvi.
-
Llama 3.3 70B
Model de clasă cu greutăți deschise prin API - se împerechează bine cu GPU-ul privat.
-
Grok 3
Model orientat în timp real pentru știri și agenții de monitorizare socială.
-
Sonar Pro
Răspunsuri bazate pe căutare pentru agenții de cercetare.
-
Command R+
Fluxuri de lucru pentru chat și recuperare pentru întreprinderi prietenoase cu RAG.
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in
pricing.
-
1
Rezervați GPU
Alegeți VRAM, regiunea și timpul de funcționare (burst vs always-on). Depozitul pentru greutăți este livrat cu instanța sau vă montează găleata.
-
2
Implementați stiva
Porniți o imagine de difuzare sau SSH, instalați drivere CUDA și încărcați punctele de control. Controalele de sănătate confirmă că modelul este gata.
-
3
Înregistrați punctul final
Adăugați adresa URL de bază, cheia API și id-ul modelului în setările spațiului de lucru. Digio validează latența și formatul jetonului înainte de a fi difuzat.
-
4
Atribuiți agenților
Alegeți modelul dvs. privat ca implicit pentru agenții selectați; modelele Claude/GPT gestionate rămân disponibile unul lângă altul.
Închirierea GPU-ului este facturată separat de abonamentele la planul Digio. Contactați-ne pentru planificarea capacității, SLA și migrarea de la un cluster de inferență existent.