05/Modelos

Modelos abiertos
para inferencia LLM.

Modelos open-weight, de embeddings, reranking y voz tras una sola API. Trae tus propios pesos cuando el catálogo no baste.

MetaLlama
QwenQwen
DeepSeekDeepSeek
MistralMistral

Las marcas identifican a sus propietarios. La disponibilidad depende del despliegue; no implican asociación ni respaldo.

ModeloFamiliaTareaContextoDespliegueRegiónDisponibilidad
Llama
Chat
128K
Compartido · Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
Llama
Chat
128K
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
Llama
Seguridad · Moderación
128K
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
Qwen
Chat · Turco
128K
Compartido · Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
Qwen
Programación
128K
Compartido · Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
Qwen
Chat
128K
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
DeepSeek
Razonamiento
128K
Compartido · Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
DeepSeek
Razonamiento
128K
Compartido · Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
Mistral
Chat
128K
Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
Mistral
Chat
32K
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
Mistral
Chat
32K
Compartido
TR-IST
BAJO SOLICITUD
Desplegar → API →
Turco
Chat · Turco
Por modelo
Compartido · Rendimiento · Dedicado
TR-IST
BAJO SOLICITUD
Desplegar → API →
Utilidad
Embedding · Turco
Por modelo
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
Utilidad
Reranking
Por modelo
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
Utilidad
Voz · Turco
Audio
Compartido · Rendimiento
TR-IST
BAJO SOLICITUD
Desplegar → API →
Personalizado
Personalizado
Por modelo
Dedicado · Empresas
A tu elección
BAJO SOLICITUD
Desplegar → API →
16 de 16 modelos Catálogo ilustrativo. Confirma versión, identificador API, contexto y disponibilidad antes del lanzamiento.

Cómo elegir un modelo abierto

Empieza por la tarea y tus datos de evaluación. Parámetros, contexto y ubicación describen restricciones distintas; ninguno mide por sí solo la calidad.

Calidad por tarea e idioma

Prueba prompts turcos e ingleses, terminología, citas y salidas estructuradas. Compara respuestas, código o precisión de extracción con un conjunto fijo. El nombre de la familia no determina la idoneidad.

Contexto y memoria GPU

El contexto incluye tokens de entrada y salida. Prompts largos y concurrencia aumentan la memoria KV-cache además de los pesos. Confirma límites, precisión y concurrencia del despliegue; el máximo de la ficha no garantiza capacidad.

Licencia y despliegue

Los pesos abiertos no implican derechos comerciales idénticos. Revisa licencia, uso aceptable y permisos de ajuste. Confirma identificadores API, herramientas y disponibilidad antes de conectar producción.

06/Hardware

Bajo cada Pod:
cómputo real.

LLMPods no revende la API de otro. Cada Pod es un stack físico, del runtime al chasis, y cada capa es inspeccionable.

Pod de cómputo · vista despiezada
Stack de Pod Runtime
RTX PRO 6000 Blackwell
Acelerador · Ficha técnica 01
ArquitecturaBlackwell
VRAM96 GB GDDR7
DespliegueCompartido · Rendimiento · Dedicado
RegiónTR-IST-01
ReservaCapacidad reservada
DisponibilidadEn vivo · 1.3 TB+ de memoria GPU en pool
Blackwell · dedicada
Acelerador · Ficha técnica 02
ArquitecturaBlackwell
VRAMPor clase
DespliegueAlquiler de GPU · fine-tuning · serving personalizado
RegiónTR-IST-01
Reserva$0.79 – $2.50 / hora de GPU
DisponibilidadBajo solicitud
Ampere · dedicada
Acelerador · Ficha técnica 03
ArquitecturaAmpere
VRAMPor clase
DespliegueAlquiler de GPU · fine-tuning · serving personalizado
RegiónTR-IST-01
Reserva$0.79 – $2.50 / hora de GPU
DisponibilidadBajo solicitud
Clúster empresarial
Acelerador · Ficha técnica 04
ArquitecturaA medida
VRAMA medida
DespliegueClúster dedicado · red privada
RegiónA tu elección
ReservaSLA según contrato
DisponibilidadAcuerdo personalizado
Las tarifas y límites son ejemplos, no una oferta vigente. El contrato define disponibilidad de modelos, precio, capacidad, retención y SLA. Solicitar capacidad →
07/Regiones

La distancia es
infraestructura.

Türkiye es infraestructura física. Las demás regiones se sirven por red y se etiquetan así: en vivo, servida o planificada.

RegiónEstadoResidencia de datosFacturaciónRed

Estructura regional ilustrativa · confirmar estados, residencia y facturación antes del lanzamiento

Red regionalTR-IST-01 · activo
TR-IST-01 EUROPA MENA [PLANIFICADO]
En vivo · alojada Servida · enrutada Planificada

Infraestructura física en Turquía: clústeres RTX PRO 6000 Blackwell con más de 1,3 TB de memoria GPU. Residencia de datos orientada a KVKK, facturación en TRY y soporte e-Fatura.

Turquía hoy. Más regiones previstas.

El cómputo se aloja hoy en Turquía. Fráncfort y Canadá están previstos, no disponibles actualmente como regiones de despliegue.

  1. En vivo

    Estambul / Turquía

    Ubicación actual de cómputo · TR-IST-01

  2. Planificada

    Fráncfort / Alemania

    Previsto · sin fecha de lanzamiento anunciada

  3. Planificada

    Canadá

    Previsto · sin fecha de lanzamiento anunciada

08/Control

Tu carga de trabajo.
Tu perímetro.

Un Dedicated Pod puede aislarse de toda ruta salvo la que tú controlas.

  • Procesamiento regionalElige dónde se procesan las solicitudes.
  • Opciones de retención ceroAjustes de retención por despliegue.
  • Infraestructura dedicadaCapacidad de GPU no compartida con otros clientes.
  • Endpoints privadosAccede a tu Pod sin pasar por la vía pública.
Internet pública
Pool compartido
Otros clientes
Tu red · endpoint privado

Límite activo · rutas externas cerradas

  • Control de los datos del clienteTú decides qué se registra y se conserva.
  • Define el uso permitido de datos en el contratoTus prompts y resultados siguen siendo tuyos.
  • Acuerdos empresariales a medidaCondiciones redactadas según tus requisitos.
  • Infraestructura orientada a KVKKOpciones de despliegue alineadas con las obligaciones de KVKK.

El alojamiento local por sí solo no garantiza el cumplimiento de KVKK.

●/Traza de solicitud · demo en vivo

¿Adónde va mi solicitud?

Envía una solicitud y obsérvala cruzar el stack. Cada etapa informa de una marca de tiempo, una duración y un estado.

SOLICITUD7F39A21
PRIMER TOKENDEMO 24ms
TOTALDEMO 932ms

Datos de demostración

EtapaDetalleMarca de tiempoDuraciónEstado
Puerta de enlace api.llmpods.com · autenticación correcta T+000ms 6ms COMPLETADO
Región TR-IST-01 seleccionado T+006ms 5ms COMPLETADO
Enrutador ruta asignada · automático T+011ms 3ms COMPLETADO
Modelo qwen-coder · cargado T+014ms 4ms COMPLETADO
Pod POD-018 listo T+018ms 3ms COMPLETADO
GPU PRO 6000 · asignación reservada T+021ms 3ms COMPLETADO
Generación primer token · transmisión T+024ms 908ms COMPLETADO
Respuesta transmisión cerrada · 200 OK T+932ms 1ms COMPLETADO