AI
Muy prontoInfraestructura de IA sin la complejidad
Endpoints, inferencia y recuperación para desarrolladores. Modelos privados y conocimiento corporativo para organizaciones. Una clave, una API, una factura.
Tokens (30 d)
1422 M
Costo (30 d)
USD 527.22
Uso de tokens por carga de trabajo
- Chat812 M · 57%
- Embeddings486 M · 34%
- Visión124 M · 9%
Endpoints
- En ejecución64.2K · 780 ms
chat-production
Llama 3.3 70B
- En ejecución1.1M · 42 ms
search-embed
Embed Large
Distribución de latencia
Desarrolladores
Infraestructura de IA para desarrolladores
Endpoints alojados, recuperación y APIs de modelos detrás de una sola credencial, para que cambiar de modelo sea un cambio de configuración y no una reescritura.
AI Endpoints
Muy prontoUna URL estable y compatible con OpenAI por proyecto. Cambia el modelo detrás de ella sin tocar tu código.
Inference
Muy prontoServing serverless para modelos de pesos abiertos, diseñado para facturación por token y sin costo en reposo.
Embeddings
Muy prontoGeneración de embeddings de alto rendimiento para búsqueda, clustering y pipelines de recomendación.
Vector Databases
Muy prontoColecciones vectoriales administradas en la misma red privada que tus endpoints, para que la recuperación nunca salga de Hostacker.
AI APIs
Muy prontoTranscripción, reranking, visión y moderación detrás de la misma clave y la misma factura.
Los productos de IA todavía no están abiertos para uso. Los precios se publican una vez que se contrate la capacidad de inferencia.
Empresas
IA privada para empresas
Para organizaciones que quieren la capacidad sin enviar datos internos a un servicio compartido y multiinquilino.
Private LLM
PreviewInfraestructura de modelos de lenguaje aislada, pensada para datos de empresa y aplicaciones internas.
Enterprise RAG
PreviewConecta documentos, procedimientos y conocimiento de tu empresa a una experiencia de IA privada con control de acceso.
Dedicated Inference
PreviewInfraestructura de GPU reservada o dedicada para cargas de IA que necesitan un throughput predecible.
También parte de Enterprise AI
Indexación del conocimiento corporativo, acceso MCP para agentes aprobados, y los controles de seguridad y gobernanza que hacen razonables a ambos dentro de una empresa.
- Conocimiento empresarial
- Infraestructura vectorial
- MCP
- SSO
- Registros de auditoría
- Políticas de despliegue
Plataforma
Lo que la capa de IA está diseñada para darte
No es telemetría: Hostacker todavía no atiende tráfico. Estas son las propiedades sobre las que se está diseñando la plataforma.
Una sola clave para todos los modelos
Los endpoints, embeddings y APIs de modelos están diseñados para autenticarse igual, así cambiar de modelo es un cambio de configuración.
Uso visible por proyecto
El consumo de tokens, el volumen de solicitudes y el costo se atribuyen por endpoint y por proyecto, en lugar de llegar como una factura opaca.
Recuperación en una red privada
Las colecciones vectoriales están planeadas para vivir junto a tus endpoints, así los documentos y embeddings nunca pasan por internet pública.
Costo estimado antes de comprometerte
Cada acción de aprovisionamiento está diseñada para devolver primero una estimación, incluidas las que inicia un agente de IA a través de MCP.
Modelos
Cambia de modelo sin reescribir tu integración
Los endpoints están diseñados como URLs estables. Apunta uno a otro modelo y tu aplicación sigue funcionando.
| Modelo | Estado |
|---|---|
Llama 3.3 70B Instructhk-llama-3-70b | Preview |
Llama 3.1 8B Instructhk-llama-3-8b | Preview |
Mistral Smallhk-mistral-small | Muy pronto |
Qwen Coder 32Bhk-qwen-coder-32b | Muy pronto |
Hostacker Embed Largehk-embed-large | Muy pronto |
Lanza funciones de IA, no plomería de IA
Cuéntanos qué estás construyendo y lo mapearemos a la infraestructura de IA que necesita.