Вычислительная сеть LLMPods TR-IST-01 онлайн

Запустите
интеллект.

Железо — наша забота.

MetaLlama
QwenQwen
DeepSeekDeepSeek
MistralMistral

Запускайте боевые AI-нагрузки на производительной GPU-инфраструктуре: привычные API, масштабируемая ёмкость, региональный контроль.

  • Совместимо с OpenAI
  • Региональные вычисления
  • Выделенный GPU
  • Автомасштабирование
  • Без настройки инфраструктуры
API-шлюз
Маршрутизатор · авто
Открыть Pod
ИДЕНТИФИКАТОР PODPOD-018
МОДЕЛЬLLAMA 70B
GPUPRO 6000
РЕГИОНTR-IST
НАГРУЗКА67%
СОСТОЯНИЕАКТИВНЫЙ
Открыть Pod
ИДЕНТИФИКАТОР PODPOD-024
МОДЕЛЬQWEN CODER
GPUPRO 6000
РЕГИОНTR-IST
НАГРУЗКА22%
СОСТОЯНИЕПРОГРЕТЫЙ
Открыть Pod
ИДЕНТИФИКАТОР PODPOD-031
МОДЕЛЬПОЛЬЗОВАТЕЛЬСКИЙ
GPUPRO 6000
РЕГИОНTR-IST
НАГРУЗКА41%
СОСТОЯНИЕВЫДЕЛЕННЫЙ
Открыть Pod
ИДЕНТИФИКАТОР PODPOD-041
МОДЕЛЬЭМБЕДДИНГ
GPUPRO 6000
РЕГИОНTR-IST
НАГРУЗКА4%
СОСТОЯНИЕРЕЗЕРВ
Открыть Pod
ИДЕНТИФИКАТОР PODPOD-007
МОДЕЛЬDEEPSEEK
GPUPRO 6000
РЕГИОНTR-IST
НАГРУЗКА0%
СОСТОЯНИЕРЕЗЕРВ
Открыть Pod
ИДЕНТИФИКАТОР PODPOD-012
МОДЕЛЬWHISPER
GPUPRO 6000
РЕГИОНTR-IST
НАГРУЗКА0%
СОСТОЯНИЕРЕЗЕРВ
Трассировка запросаДемо-данные
ЗапросPOST /v1/chat/completions
РегионTR-IST-01
МаршрутизаторАВТОМАТИЧЕСКИ
PodPOD-018
МодельLLAMA-70B
Первый токенДЕМО 24 ms
ПотокАКТИВНЫЙ

Кратко о LLMPods

LLMPods предоставляет региональную GPU-инфраструктуру для инференса открытых моделей. Выбирайте ресурсы с учётом модели, нагрузки и требований к данным.

Оператор
Disket Teknoloji Limited Sirketi · Стамбул/Турция
Текущее размещение вычислений
Стамбул / Турция
Семейства моделей
Llama · Qwen · DeepSeek · Mistral
Планируемые регионы; пока недоступны
Франкфурт / Германия · Канада

Модели, варианты развёртывания и цены

Создано для вашего рынка

Ваш ИИ работает ближе.

Задержка, размещение данных и валюта счёта — решения об инфраструктуре. Определите их до развёртывания.

01

Задержка, которую вы ощущаете.

Короткий сетевой путь может ускорить начало ответа. Вычисления в Турции приближают местные нагрузки; размер модели, очередь и длина запроса также влияют на первый токен.

Измеряйте первый токен, P50 и P95 из своего приложения.

02

Понимайте риски по KVKK.

Отслеживайте передачу запросов, ответов, журналов и данных поддержки. Обработка моделей в Турции может ограничить трансграничную передачу; законность обработки, сроки хранения и доступ остаются важными.

Местное размещение само по себе не обеспечивает соответствие KVKK.

03

Валютный риск в каждом счёте.

При тарифах в иностранной валюте та же нагрузка может дорожать в TRY при изменении курса. Уточните валюту счёта и правило пересчёта до покупки.

Счета в TRY доступны по условиям договора; тарифы с привязкой к USD сохраняют валютный риск.

Компания, конфиденциальность и условия →

Сегодня — Турция. Новые регионы планируются.

Вычисления сегодня размещены в Турции. Франкфурт и Канада — планируемые площадки, пока недоступные для развёртывания.

  1. Live

    Стамбул / Турция

    Текущая площадка · TR-IST-01

  2. Planned

    Франкфурт / Германия

    Планируется · дата запуска не объявлена

  3. Planned

    Канада

    Планируется · дата запуска не объявлена

Вопросы перед первым развёртыванием.

Где работает моя модель?

Текущие вычисления находятся в Турции. Франкфурт и Канада планируются; другие рынки могут обслуживаться из Турции без перемещения GPU.

Местные вычисления всегда быстрее?

Короткий маршрут может снизить сетевую задержку, но первый токен зависит и от модели, очереди и входных данных. Сравнивайте одинаковые запросы из местоположения пользователей.

Размещение в Турции автоматически обеспечивает KVKK?

Нет. Необходимо оценить основания обработки, уведомления, хранение, доступ и передачи через интеграции или поддержку. Региональные вычисления — часть этой оценки.

Счёт в TRY устраняет весь валютный риск?

Нет, если цена привязана к USD или другой валюте. Уточните фиксацию цены в TRY, дату пересчёта и включение налогов.

Компания, конфиденциальность и условия →
01/Система

На входе API.
На выходе токены.

Каждый запрос проходит одни и те же семь слоёв. Каждый слой отчитывается о своей работе, поэтому путь никогда не остаётся чёрным ящиком.

01
Приложение
ЗАПРОС7F39A21
МЕТОДPOST
02
API LLMPods
АУТЕНТИФИКАЦИЯOK
СХЕМАOPENAI
03
Региональный маршрутизатор
РЕГИОНTR-IST
МАРШРУТИЗАЦИЯАВТОМАТИЧЕСКИ
04
Планировщик моделей
МОДЕЛЬQWEN
ОЧЕРЕДЬ0
05
Вычислительный Pod
POD018
СОСТОЯНИЕАКТИВНЫЙ
06
GPU
КЛАССPRO 6000
ВЫДЕЛЕНИЕЗАРЕЗЕРВИРОВАНО
07
Поток токенов
СТАТУСПОТОК
ПЕРВЫЙ ТОКЕНДЕМО 24 ms
УРОВЕНЬ 03 Управление разработчика
УРОВЕНЬ 02 Системный интеллект
УРОВЕНЬ 01 Физические вычисления
УРОВЕНЬ 03 Разработчик

Пример телеметрии · демонстрационные данные

02/Опыт разработчика

Смените эндпоинт.
Оставьте стек.

LLMPods понимает схему OpenAI. Направьте существующий SDK на новый base URL, остальной код не меняется.

api.llmpods.com/v1
1from openai import OpenAI
2import os
3
4client = OpenAI(
5 base_url="https://api.llmpods.com/v1",ПЕРЕХОД ОДНОЙ СТРОКОЙ →
6 api_key=os.environ["LLMPODS_API_KEY"],
7)
8
9stream = client.chat.completions.create(
10 model="llama-70b-instruct",
11 messages=[{"role": "user", "content": "Hello, Pod."}],
12 stream=True,
13)
14
15for chunk in stream:
16 print(chunk.choices[0].delta.content or "", end="")
  • 01Схема, совместимая с OpenAI
  • 02Потоковые ответы
  • 03Вызов инструментов
  • 04Эмбеддинги
  • 05Привычные SDK
  • 06Миграция без боли
03/Pods

Pod для
каждой нагрузки.

Четыре топологии развёртывания на одном runtime. Они различаются тем, какая доля машины принадлежит вам.

Топология 01
ОБЩИЙ ПУЛ GPU

Общий Pod

Для эластичного инференса.

  • Оплата по использованию
  • Автомасштабирование
  • Управляемая инфраструктура
  • Общий пул GPU
Топология 02
ЗАРЕЗЕРВИРОВАННЫЙ РАЗДЕЛ

Производительный Pod

Для предсказуемых боевых нагрузок.

  • Резервная ёмкость
  • Приоритетное планирование
  • Стабильная производительность
  • Предсказуемая доступность
Топология 03
ИЗОЛИРОВАННЫЙ

Выделенный Pod

Для изолированных нагрузок.

  • Выделенный GPU
  • Свои модели
  • Приватный эндпоинт
  • Изолированные ресурсы
Топология 04

Корпоративный Pod

Для стратегических требований к инфраструктуре.

  • Multi-GPU
  • Выделенный кластер
  • Приватная сеть
  • Региональный контроль
  • SLA
  • Индивидуальная архитектура
04/Масштаб

Ёмкость следует за трафиком.

Масштабируйте ёмкость под спрос, а не закладывайте инфраструктуру под пиковый трафик.

Входящий трафик
Запросов / с
120
Активные Pod
1
Загрузка GPU
58%
Очередь
0
Токенов / с
9.6K
Маршрутизатор · TR-IST-01 Базовый уровень · 1 Pod
001 АКТИВНЫЙ
002 РЕЗЕРВ
003 РЕЗЕРВ
004 РЕЗЕРВ
005 РЕЗЕРВ
006 РЕЗЕРВ
007 РЕЗЕРВ
008 РЕЗЕРВ
009 РЕЗЕРВ
010 РЕЗЕРВ
011 РЕЗЕРВ
012 РЕЗЕРВ
013 РЕЗЕРВ
014 РЕЗЕРВ
015 РЕЗЕРВ
016 РЕЗЕРВ
Активен Прогрет Ожидание
Иллюстративная симуляция
Конец Home 1 · Hero и система Далее — 05 / Модели →