12/Цены

GPU и инференс
как устроена цена.

Цены и лимиты приведены для примера, а не как действующее предложение. Доступность моделей, цена, ресурсы, хранение и SLA определяются договором.

01

Managed Inference

Доступ к моделям с оплатой по использованию.

Общий Pod · Производительный Pod
Подходит для
  • API
  • Переменный спрос
  • Эксперименты
Биллинг
$0.12 – $2.50
за 1M токенов · по контексту
Планировать запуск →
02

GPU Pod

Выделенные или зарезервированные вычисления.

Производительный Pod · Выделенный Pod
Подходит для
  • Предсказуемые нагрузки
  • Свои модели
  • Высокая пропускная способность
Биллинг
$0.79 – $2.50
за GPU-час · Blackwell или Ampere
Запросить ёмкость →
03

Корпоративный

Приватная инфраструктура.

Корпоративный Pod
Подходит для
  • Безопасность
  • Региональные требования
  • Крупная ёмкость
  • Индивидуальный SLA
Биллинг
Годовой контракт
SLA по договору
Для предприятий →
В Турции, где применимо Биллинг в TRYe-Fatura / e-ArşivМестные коммерческие отношенияПланы, тарифы и сценарии →

От чего зависит счёт за инференс?

Оплата токенов

Отдельно считайте вход и выход, включая историю и найденные документы. При разных тарифах рассчитывайте части отдельно. Умножьте на число запросов и добавьте эмбеддинги, реранкинг или аудио с отдельной оплатой.

Зарезервированный или выделенный GPU

Считайте число GPU × оплачиваемые часы × тариф. Учитывайте простой, реплики, хранение и сеть. Сравнивайте загрузку и обязанности с управляемой оплатой токенов.

До согласования предложения

Уточните модель, версию, контекст, параллельность, валюту, налоги, минимум и превышения. Определите поддержку, хранение, измерение SLA и исключения. Пример не является обязательством по ресурсам или сервису.

Сравнение

Сравните модель эксплуатации.

Разные инструменты решают разные задачи. Сравните управление, размещение данных и эксплуатацию до сравнения цены.

Сравните модель эксплуатации.
ВозможностьLLMPodsOpenAI APIRunpodСобственный сервер
Доступ к моделямКаталог открытых весов; свои модели по договоруКаталог моделей OpenAI APIСвои нагрузки GPU и публичные конечные точки моделейВы выбираете веса и стек инференса
Размещение данныхТурция сейчас; Франкфурт и Канада планируютсяРазмещение на уровне проекта; с условиями доступа и охватаЗависит от выбранного развёртывания и продуктаВаша инфраструктура и подключённые сервисы
Ответственность за эксплуатациюУправляемый инференс; изоляция по договоруAPI эксплуатирует провайдерУправляемые конечные точки или ваши контейнеры GPUВы управляете мощностью, обновлениями и доступностью
Коммерческая модельИспользование или резервирование; счета в TRY по договоруТарифы API по использованиюОплата из баланса; вычисления и хранениеОборудование или облако плюс эксплуатация

Прокрутите по горизонтали для сравнения →

Обзор функций, а не тест производительности. Возможности зависят от плана и конфигурации. Источники проверены 5 октября 2026.

Валютный риск в каждом счёте.

При тарифах в иностранной валюте та же нагрузка может дорожать в TRY при изменении курса. Уточните валюту счёта и правило пересчёта до покупки.

Счета в TRY доступны по условиям договора; тарифы с привязкой к USD сохраняют валютный риск.

То же использование. Разные расходы в местной валюте.
USD/TRY 30
3 000 TRY
USD/TRY 40
4 000 TRY
USD/TRY 50
5 000 TRY

Иллюстрация: использование на $100 при условных курсах USD/TRY 30, 40 и 50. Без налогов и банковских сборов; это не текущие курсы.

14/Корпоративный

Когда одного Pod
недостаточно.

Зарезервируйте инфраструктуру под ваши AI-нагрузки.

01 · Один Pod

Одна модель, одна аллокация GPU.

02 · Несколько Pod

Реплики с общей маршрутизацией.

03 · Стойка

Pod в одном шасси.

04 · Кластер

Стойки за приватной границей.

  • Выделенные GPU-кластеры
  • Приватная сеть
  • Резервная ёмкость
  • Региональная архитектура
  • Serving своих моделей
  • Техническая поддержка аккаунта
  • Enterprise SLA
  • Индивидуальные соглашения
15/Терминал

Управляйте Pod
как инфраструктурой.

Командная строка для той же системы. Концепт интерфейса: показанные команды иллюстративны, пока CLI не выпущен.

16/Документация

Вы уже знаете
этот API.

POST https://api.llmpods.com/v1/chat/completions
ЗапросJSON
{
  "model": "llama-70b-instruct",
  "stream": true,
  "messages": [
    { "role": "user", "content": "Hello, Pod." }
  ]
}
Ответ200 · JSON
{
  "id": "chatcmpl-7f39a21",
  "object": "chat.completion",
  "model": "llama-70b-instruct",
  "choices": [
    { "index": 0,
      "message": { "role": "assistant", "content": "Hello." },
      "finish_reason": "stop" }
  ],
  "usage": { "total_tokens": 15 }
}
Поток токеновSSE
data: {"delta": {"content": "Hel"}}
data: {"delta": {"content": "lo"}}
data: {"delta": {"content": ","}}
data: {"delta": {"content": " Pod"}}
data: [DONE]
Читать документацию → Справочник API →

Дайте вашему AI
место получше для работы.

Планировать запуск → Для предприятий
  • Совместимо с OpenAI
  • Региональные вычисления
  • Выделенный GPU
  • Управляемая инфраструктура