Цифровая инфраструктура

Модели ИИ и графический процессор

Запускайте агентов на готовых моделях уже сегодня, арендуйте мощности GPU, загружайте свои настройки и направляйте задачи Digio на частные серверы — всё в одном рабочем пространстве.

Claude, GPT, Gemini Выбор модели для каждого агента Аренда GPU и свои модели
Управляемые модели

Модели, доступные в Digio сегодня

Назначьте модель по умолчанию каждому агенту или выберите другую для конкретной задачи. Расход считается в токенах Digio с баланса вашего тарифа — один и тот же счёт, вызывает ли агент Sonnet, GPT-4o или Gemini Flash.

Anthropic Claude

  • Claude Opus 4.7 Главная модель для сложных рассуждений, длинного контекста, архитектуры и стратегии.
  • Claude Opus 4.6 Opus предыдущего поколения для стабильного и качественного анализа.
  • Claude Sonnet 4.6 Ежедневные задачи — программирование, написание текстов и многошаговая работа с агентом.
  • Claude Sonnet 4.5 / 4 Уровни Fast Sonnet с быстрым кэшированием для поддерживаемых рабочих нагрузок.
  • Claude Haiku 4.5 Черновики с малой задержкой, классификация и объемные подзадачи.

OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 Новейшее семейство GPT-5 для общих задач и работы агентов.
  • GPT-4.1 & GPT-4o Надежный мультимодальный чат и использование инструментов для производственных агентов.
  • GPT-4o mini Экономичная маршрутизация для сводок и облегченных шагов.
  • o3 / o3-pro / o3-mini / o4-mini Модели, ориентированные на рассуждения, для математики, планирования и проверки.
  • GPT-5.3 Codex & Codex mini Генерация кода, рефакторинг и навыки агентов, поддерживающего репо.

Google Gemini

  • Gemini 2.5 Pro Долгосрочные исследования и структурированный анализ.
  • Gemini 2.5 Flash Быстрые действия агента с выгодным расходом токенов.
  • Gemini 2.0 Flash Сверхбыстрые проходы для синтаксического анализа, тегирования и пакетных заданий.

Открытые и специализированные API

  • DeepSeek Chat & Reasoner Высокая ценность для чата и задач в стиле цепочки мыслей.
  • Mistral Large Вариант размещения в Европе для многоязычных агентских команд.
  • Llama 3.3 70B Модель с открытым весом через API — хорошо работает вместе с частным GPU.
  • Grok 3 Модель, ориентированная на режим реального времени, для агентов новостей и социального мониторинга.
  • Sonar Pro Поисковые ответы для исследовательских агентов.
  • Command R+ Корпоративный чат и рабочие процессы поиска, совместимые с RAG.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

Использование

Как агенты выбирают модель

Координатор может предложить Sonnet, Opus или более дешёвую Flash-модель в зависимости от задачи. Опытные пользователи настраивают модель по умолчанию для каждой роли: исследования на Sonnet, финальная проверка на Opus, массовая обработка на Haiku или Gemini Flash.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

Аренда GPU

Арендуйте графический процессор и запускайте свои собственные модели

Нужна точная настройка, собственные контрольные точки или предсказуемые цены? Добавьте выделенную мощность GPU в своё рабочее пространство Digio, настройте нужное окружение и направляйте агентов на ваш частный сервер.

Выделенные экземпляры

Узлы графического процессора (класс A100, H100, L40S) с почасовой или ежемесячной оплатой, подключенные к вашему арендатору и изолированные от других клиентов.

Свои настройки

Загружайте файлы моделей (Safetensors, GGUF) или берите из реестра. Запускайте Llama, Mistral, Qwen и настраивайте под себя.

Стандартное обслуживание

vLLM, TGI, Ollama или ваши собственные контейнеры. Агенты Digio обращаются к URL-адресу, совместимому с OpenAI.

Та же оркестровка

При этом командный чат, навыки и сотрудничество остаются без изменений — вам принадлежит только серверная часть вывода.

Гибридная маршрутизация

Отправляйте важные задачи на частный GPU, а Claude или GPT используйте для публичных исследований — в одном рабочем процессе.

Корпоративный контроль

VPC, статический выход, журналы аудита и списки разрешенных моделей для команд с высокими требованиями.

Принесите свою модель

Подключение своей модели

Обычный путь от начала до вызова агентов на ваш сервер:

  1. Аренда GPU

    Выберите объём памяти, регион и тип работы (по запросу или постоянно). Хранилище идёт с сервером или подключается к вашему облачному хранилищу.

  2. Развертывание стека

    Запустите обслуживающий образ или SSH, установите драйверы CUDA и загрузите контрольные точки. Проверка работоспособности подтверждает, что модель готова.

  3. Добавьте свой сервер

    Укажите URL-адрес, ключ API и идентификатор модели в настройках рабочего пространства. Digio проверит скорость и формат перед запуском.

  4. Назначьте агентам

    Выберите свою модель как основную для нужных агентов. Готовые модели Claude/GPT останутся доступны параллельно.

Аренда GPU оплачивается отдельно от подписки на тариф Digio. Свяжитесь с нами для планирования мощности, обсуждения уровня обслуживания и миграции с вашего существующего кластера.

Часто задаваемые вопросы

Вопросы о моделях и графических процессорах

Выбор управляемых API или самостоятельного вывода на Digio.

Плачу ли я дважды — план плюс API?

Ваша подписка Digio распространяется на инфраструктуру, агентов и включенные токены Digio. Использование управляемой модели дебетует баланс токенов фактическими токенами ввода/вывода. Аренда графического процессора — это надстройка для машин, которыми вы управляете.

Могут ли разные агенты использовать разные модели?

Да, у каждого агента может быть свой собственный параметр по умолчанию. Задачи и чаты можно переопределить за один запуск без изменения глобального значения по умолчанию.

В чем разница между Сонетом и Опусом?

Opus настроен на более сложные рассуждения и более длинные и последовательные планы; Sonnet быстрее и дешевле для повседневных циклов агентов. Модели Haiku и флэш-класса лучше всего подходят для объемных подзадач.

Могу ли я запустить только свою собственную модель и заблокировать облачные API?

Корпоративные рабочие области могут ограничивать поставщиков исходящих моделей и направлять весь трафик агентов на конечную точку вашего графического процессора. Гибридный режим используется по умолчанию для большинства команд.

Какие размеры графического процессора доступны?

Предложения зависят от региона и спроса — обычно уровни видеопамяти объемом 24–80 ГБ для моделей классов 7B–70B и узлы с несколькими графическими процессорами для более крупных стеков. Мы помогаем определить размер VRAM на основе количества параметров и квантования.

При использовании частного графического процессора по-прежнему используются токены Digio?

Оркестрация (агенты, задачи, хранилище) остается в вашем плане. Вывод на вашем графическом процессоре оплачивается как время графического процессора; при желании вы можете отслеживать использование токенов для внутреннего возврата платежей.

Выбирайте управляемые модели или привозите свой графический процессор

Начните с Claude и GPT сегодня, а затем добавьте выделенный графический процессор, когда будете готовы размещать пользовательские веса — те же агенты, те же задачи, ваши выводы.