Empieza con una API
Para prototipos, asistentes y tráfico variable: empieza con inferencia gestionada y mide el uso antes de reservar capacidad.
Inferencia gestionada mediante una API compatible con OpenAI, alquiler de GPU dedicada y capacidad empresarial. Una plataforma, tres formas de ejecutar.
Las marcas identifican a sus propietarios. La disponibilidad depende del despliegue; no implican asociación ni respaldo.
Paga por token modelos open-weight tras una sola API.
Pod compartido · Pod de rendimientoGPU dedicadas para fine-tuning y serving personalizado.
Pod de rendimiento · Pod dedicadoCapacidad reservada bajo contrato anual a medida.
Pod empresarialElige entre familias open-weight, modelos ajustados al turco y modelos de utilidad para recuperación y voz. Trae tu propio fine-tune cuando lo necesites.
Las tarifas y límites son ejemplos, no una oferta vigente. El contrato define disponibilidad de modelos, precio, capacidad, retención y SLA.
Las tarifas y límites son ejemplos, no una oferta vigente. El contrato define disponibilidad de modelos, precio, capacidad, retención y SLA.
Para prototipos, asistentes y tráfico variable: empieza con inferencia gestionada y mide el uso antes de reservar capacidad.
Para tráfico de producción con una base conocida: evalúa capacidad reservada y planificación según tus objetivos de latencia.
Para pesos propios o límites más estrictos: define recursos dedicados, endpoints privados y tratamiento de datos en el acuerdo.
Prueba el mismo modelo, longitud de entrada y límite de salida desde la región de tus usuarios. Registra el primer token, la respuesta total y p95 con la concurrencia prevista. La cercanía de red no determina el rendimiento del modelo.
Documenta prompts, resultados, registros, copias y acceso de soporte. Pregunta quién los procesa, dónde se guardan y cuánto tiempo. Alojar en Turquía es parte de una evaluación KVKK, no una garantía de cumplimiento.
Compara tokens y horas GPU considerando tráfico, capacidad ociosa, almacenamiento y operaciones. Confirma moneda, impuestos e indexación cambiaria antes de comprometerte.
Prepara prompts, región, solicitudes por minuto, concurrencia máxima y límites. Identifica datos sensibles y retención. Usa el explorador y la guía de precios para definir alcance antes de acordar capacidad y condiciones.
Latencia y velocidad dependen del modelo, entrada y carga. Pruébalas; el contrato define disponibilidad y compensaciones.
Hoy todas las GPU funcionan en Türkiye. Otros territorios se sirven por red y se planifican nuevos sitios.
Clústeres RTX PRO 6000 Blackwell con 1.3 TB+ de memoria GPU. Residencia de datos orientada a KVKK y facturación en TRY.
Servidas por red desde Türkiye. Todas las GPU permanecen en Türkiye.
El cómputo se aloja hoy en Turquía. Fráncfort y Canadá están previstos, no disponibles actualmente como regiones de despliegue.
El cómputo actual está en Turquía. Fráncfort y Canadá están previstos; otros mercados pueden atenderse desde Turquía sin trasladar las GPU.
Una ruta corta puede reducir la demora de red, pero el primer token depende del modelo, la cola y la entrada. Compara el mismo modelo y prompt desde la ubicación de tus usuarios.
No. Debes evaluar la base legal, los avisos, la retención, el acceso y las transferencias mediante integraciones o soporte. El cómputo regional es parte de esa evaluación.
No si el precio está indexado al USD u otra moneda. Confirma si la tarifa es fija en TRY, la fecha de conversión y si incluye impuestos.
Prepara prompts, región, solicitudes por minuto, concurrencia máxima y límites. Identifica datos sensibles y retención. Usa el explorador y la guía de precios para definir alcance antes de acordar capacidad y condiciones.
Estambul, Türkiye · Compatible con OpenAI · Orientado a KVKK