Дигито инфраструктура

AI модели и GPU

Пуснете агенти на управлявани гранични модели днес или наемете GPU капацитет, разположете свои собствени тегла и насочете Digio задачи към частни крайни точки в същото работно пространство.

Клод, GPT, Близнаци Избор на модел за всеки агент GPU под наем и BYOM
Управлявани модели

Модели, налични в Digio днес

Задайте модел по подразбиране за агент или заменете за задача. Използването се измерва в Digio Tokens от баланса на плана ви — един и същ портфейл, независимо дали агентът се обажда на Sonnet, GPT-4o или Gemini Flash.

Антропичен Клод

  • Claude Opus 4.7 Водещи разсъждения, дълъг контекст, архитектура и стратегическа работа.
  • Claude Opus 4.6 Opus от предишно поколение за стабилен, висококачествен анализ.
  • Claude Sonnet 4.6 Ежедневен драйвер - кодиране, писане и многоетапни агентски цикли.
  • Claude Sonnet 4.5 / 4 Бързи нива на Sonnet с бързо кеширане при поддържани работни натоварвания.
  • Claude Haiku 4.5 Чернови с ниска латентност, класификация и подзадачи с голям обем.

Преведете буквално: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 Най-новото семейство GPT-5 за общи и агентски натоварвания.
  • GPT-4.1 & GPT-4o Надежден мултимодален чат и използване на инструменти за производствени агенти.
  • GPT-4o mini Рентабилно маршрутизиране за обобщения и леки стъпки.
  • o3 / o3-pro / o3-mini / o4-mini Фокусирани върху разсъждението модели за математика, планиране и проверка.
  • GPT-5.3 Codex & Codex mini Умения за генериране на код, рефактори и репо-съзнателни агенти.

Преведете буквално: Google Gemini

  • Gemini 2.5 Pro Изследване в дълъг контекст и структурирано извличане.
  • Gemini 2.5 Flash Стъпки на високопроизводителни агенти с конкурентни цени на токени.
  • Gemini 2.0 Flash Изключително бързи пропуски за анализиране, маркиране и пакетни задания.

Отворени и специализирани API

  • DeepSeek Chat & Reasoner Силна стойност за задачи в стил чат и последователни мисли.
  • Mistral Large Хоствана в Европа опция за многоезични агентски екипи.
  • Llama 3.3 70B Модел на клас с отворени тегла чрез API—съчетава се добре с частен GPU.
  • Grok 3 Ориентиран в реално време модел за агенти за новини и социален мониторинг.
  • Sonar Pro Основани на търсенето отговори за изследователски агенти.
  • Command R+ Удобен за RAG корпоративен чат и работни процеси за извличане.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

Използване

Как агентите избират модел

Координаторът може да препоръча Sonnet срещу Opus срещу по-евтин флаш модел въз основа на типа задача. Опитните потребители задават настройки по подразбиране за роля на агент – проучване на Sonnet, финален преглед на Opus, групово маркиране на Haiku или Gemini Flash.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU под наем

Наемете GPU и управлявайте свои собствени модели

Нуждаете се от фина настройка, контролна точка с въздушна междина или предсказуемо ценообразуване? Добавете специален GPU капацитет към вашето работно пространство Digio, инсталирайте обслужващия стек, който предпочитате, и насочете агенти към вашата частна крайна точка.

Специализирани инстанции

Почасови или месечни GPU възли (клас A100, H100, L40S), прикрепени към вашия клиент—изолирани от други клиенти.

Вашите килограми

Качете safetensors, GGUF или изтеглете от вашия регистър; стартирайте Llama, Mistral, Qwen и персонализирани фини настройки.

Стандартна порция

vLLM, TGI, Ollama или изображения на контейнери, които поддържате – агентите на Digio извикват базов URL адрес, съвместим с OpenAI.

Същата оркестрация

Задачи, екипен чат, умения и сътрудничество непроменени – само бекендът за изводи е ваш.

Хибридно маршрутизиране

Изпратете чувствителни стъпки към частен GPU и използвайте Claude или GPT за публични изследвания в един работен процес.

Корпоративни контроли

VPC peering, статичен изход, регистрационни файлове за одит и списъци с разрешени модели за регулирани екипи.

Донесете свой собствен модел

Инсталирайте и свържете персонализиран модел

Типична настройка от нула до агенти, които се обаждат на вашата крайна точка:

  1. Резервен GPU

    Изберете VRAM, регион и време на работа (burst срещу винаги включен). Съхранение за тежести се доставя с екземпляра или монтира вашата кофа.

  2. Разположете стека

    Стартирайте обслужващо изображение или SSH, инсталирайте CUDA драйвери и заредете контролни точки. Здравните проверки потвърждават, че моделът е готов.

  3. Регистрирайте крайната точка

    Добавете основен URL адрес, API ключ и идентификатор на модел в настройките на работното пространство. Digio проверява латентността и формата на токена, преди да се активира.

  4. Задайте на агенти

    Изберете своя частен модел като стандартен за избрани агенти; управляваните Claude/GPT модели остават налични един до друг.

Наемът на GPU се таксува отделно от абонаментите за Digio план. Свържете се с нас за планиране на капацитет, SLA и миграция от съществуващ клъстер за изводи.

ЧЗВ

Въпроси за модели и GPU

Избор на управлявани API срещу самостоятелно хоствано заключение на Digio.

Плащам ли два пъти — план плюс API?

Вашият абонамент за Digio покрива инфраструктура, агенти и включени Digio Tokens. Използването на управляван модел дебитира баланса на токените чрез действителни токени за вход/изход. GPU под наем е добавка за машините, които контролирате.

Могат ли различните агенти да използват различни модели?

Да — всеки агент може да има своя собствена подразбиране. Задачите и чатовете могат да се заменят за едно изпълнение, без да се променя глобалната настройка по подразбиране.

Каква е разликата между Сонет и Опус?

Opus е настроен за по-трудно разсъждение и по-дълги съгласувани планове; Sonnet е по-бърз и по-евтин за ежедневни агентски цикли. Haiku и моделите от флаш клас са най-добри за обемни подзадачи.

Мога ли да стартирам само моя собствен модел и да блокирам облачни API?

Корпоративните работни пространства могат да ограничат доставчиците на изходящи модели и да насочат целия трафик на агент към вашата крайна точка на GPU. Хибридният режим е стандартният за повечето екипи.

Кои размери на GPU са налични?

Предложенията зависят от региона и търсенето – обикновено 24–80 GB VRAM нива за модели от клас 7B–70B и мулти-GPU възли за по-големи стекове. Ние помагаме да оразмерим VRAM от вашия брой параметри и квантуване.

Все още ли частното използване на GPU консумира Digio Tokens?

Оркестрацията (агенти, задачи, съхранение) остава във вашия план. Изводът за вашия GPU се таксува като GPU време; можете по желание да измервате използването във формата на токен за вътрешно връщане на плащане.

Изберете управлявани модели или донесете своя GPU

Започнете с Claude и GPT днес, след това добавете специален GPU, когато сте готови да хоствате персонализирани тегла – същите агенти, същите задачи, вашето заключение.