Self-hosted · BYOK · Escrito en Rustv1.0.0-rc.3

IA para tu empresa.
En tu servidor.
Con techo de gasto real.

Arandu es el gateway de IA que corre entero en tu infraestructura. Usás los modelos que quieras con tus propias claves — con un límite de gasto que se aplica antes de gastar, un firewall que redacta datos sensibles antes de que salgan, y una auditoría que nadie puede borrar.

Nosotros nunca vemos tus datos. Ni podríamos aunque quisiéramos: Arandu corre en tu servidor, no en el nuestro.

Tu equipo ya usa IA. El problema no es ese.

El problema es que nadie sabe cuánto se está gastando, qué datos se están yendo, ni cómo probárselo a un auditor. Arandu cierra las tres.

Costo

«Me despierto con una factura de US$ 4.000.»

Un loop, un prompt gigante, un script de un tercero. Todos los wrappers te avisan cuando ya gastaste.

Arandu rechaza la request antes de llamar al proveedor.

Estima el costo antes de gastarlo y corta si excede el techo. Presupuestos por tier, API key, usuario, modelo y proveedor. Contabilidad idempotente: un reintento no te cobra dos veces. Y los modelos locales están exentos — correr en tu hardware no consume presupuesto.

Privacidad

«Un empleado pegó el DNI de un cliente en un prompt.»

Acá está el agujero real de BYOK, y casi nadie lo dice: si usás un modelo cloud, el dato sí sale hacia tu proveedor.

Arandu lo redacta antes, incluso mientras el modelo escribe.

Escanea entrada, salida y streaming. En modo redacción el dato literal nunca pasa; en modo bloqueo corta antes del proveedor. Mantiene una ventana de 4.096 caracteres para que un dato partido entre dos chunks no se escape por la grieta. Queda el evento auditable, nunca el contenido.

Auditoría

«No sé quién hizo qué, y no puedo probárselo a mi auditor.»

Sin trazabilidad no hay respuesta para el comité de riesgo. Y guardar los prompts para tenerla es cambiar un problema por otro peor.

Auditoría inmutable a nivel de base de datos.

No es «prometemos no borrarla»: un trigger de Postgres la vuelve inalterable. Ni un DBA con acceso directo puede tocarla. Registra quién, qué modelo, cuánto costó y por qué se enrutó ahí — sin guardar un solo prompt.

Corre en tu infra. Vos decidís si un dato sale, y adónde.

Esta es la parte que otros esconden. Preferimos que la audites vos.

Modo local

Apuntás Arandu a tu propio Ollama, vLLM o LM Studio. El prompt no sale de tu red. Ni al proveedor, ni a nosotros. Y no consume presupuesto: es tu hardware.

Modo cloud (BYOK)

Traés tu clave de OpenAI o de cualquier proveedor OpenAI-compatible. El prompt viaja de tu servidor al proveedor que elegiste, con tu contrato y tu precio — después de pasar por el firewall. Nosotros no estamos en el camino y no revendemos tokens.

Qué recibimos nosotros

Solo el heartbeat de licencia: id de licencia, id de instancia, versión y timestamp. Ni un prompt, ni un documento, ni una credencial. La conexión saliente es esa y solo esa.

Construido, probado y funcionando hoy

Nada de esto es roadmap. Todo lo de abajo está en el código y tiene tests que lo ejercitan.

Licencia por usuarios concurrentes

Pagás por gente trabajando a la vez, no por cuentas creadas. Dás de alta 50, pagás por 10. Cuentas ilimitadas en todos los planes.

BYOK real: tus claves, tu contrato

Arandu nunca revende tokens. El costo de IA queda entre vos y tu proveedor, con tu descuento por volumen. Las credenciales se cifran con AES-256-GCM y una clave maestra que vive fuera de la base.

Cloud y local en el mismo panel

El mismo adapter atiende a OpenAI y a tu Ollama on-prem, con paridad total: mismo routing, mismo presupuesto, misma auditoría, mismo firewall.

SSO OIDC incluido en todos los planes

Okta, Entra o Google Workspace. Sin «SSO-tax»: no cobramos aparte por la puerta de entrada segura. Probado contra un servidor de identidad real que firma tokens de verdad, no un mock.

Se protege solo cuando el proveedor cae

Circuit breaker por modelo: si tu proveedor se cae a las 3 de la mañana, Arandu deja de mandarle tráfico y prueba de a poco hasta que vuelve. Sin que nadie se levante.

Reintentos que no cobran dos veces

Idempotency-Key al nivel de una pasarela de pagos, incluso en streaming. Un reintento devuelve la misma respuesta, no una segunda factura.

Knowledge Spaces sobre tu propio corpus

Indexación vectorial con Qdrant. Los embeddings también pueden correr contra tu runtime local: la promesa de que el documento no sale de tu red se sostiene también al indexar, no solo al chatear.

Nunca quedás afuera de tu instancia

Recuperación por varias vías, incluida una por línea de comandos para el dueño. Nada de cirugía a mano en la base de datos.

Vas a correr esto en tu infraestructura. Mirá con qué está hecho.

Si vas a confiarle tus claves de IA a un proceso, tenés derecho a saber cómo está construido. Cada punto es verificable.

Rust, sin una línea de código inseguro

Unas 100.000 líneas con cero unsafe. El proceso que tiene cargadas tus claves de OpenAI no puede sufrir un desbordamiento de buffer. Lo garantiza el compilador, no una revisión de código.

No puede caerse por un error no manejado

unwrap, panic y expect están prohibidos por lint en runtime. Corre en tu infra: no hay una guardia nuestra que lo levante a las 3am. Tiene que no caerse.

Podman rootless, sin daemon

Preferimos Podman: sin daemon y sin root significa menos superficie de ataque, no solo menos peso. Si tu empresa ya usa Docker, funciona igual — el instalador detecta cuál tenés.

Artefactos firmados que podés verificar vos

Cada imagen OCI se firma con cosign y publicamos la clave pública. No hace falta que nos creas: verificá la firma antes de correr nada. Cada release trae su SBOM en formato CycloneDX, listo para el cuestionario de seguridad de tu cliente.

Arquitectura hexagonal: cambiar no es reescribir

El dominio no conoce infraestructura. Cambiar de proveedor, de base vectorial o de cache es implementar una interfaz, no rehacer el producto. Anti lock-in demostrable, no prometido.

La capa de gobierno es invisible en latencia

Medido: 16 ms al primer token y unos 30 ms de overhead. Auditar, presupuestar y filtrar no te cuesta velocidad.

Cuándo NO comprar Arandu

Decirlo nos ahorra tiempo a los dos. Si necesitás algo de esta lista, todavía no somos para vos.

  • Agentes autónomos, tool-use o MCP. No existe y no está en v1.
  • Kubernetes o Helm oficial. El camino soportado es OCI + compose.
  • Varias organizaciones en una instancia. v1 es de una sola, por diseño.
  • Una interfaz de chat lista para usar. Arandu es API + consola de administración; el chat lo integrás vos.
  • PDF en la base de conocimiento. Hoy: texto plano, Markdown y JSON.
  • ISO 27001, SOC 2 o pentest certificado. Fuera de alcance en v1.
  • SLA de uptime. Corre en tu infra: la operás vos.
  • Anthropic o Google como proveedores nativos. Hoy solo OpenAI-compatible (que cubre OpenAI, Azure, vLLM, Ollama, LM Studio y TGI).

Todavía no está abierto al público

Estamos terminando de auditar el release antes de abrir las descargas. Si sos una empresa que quiere evaluarlo, o querés ver el producto por dentro, escribinos: respondemos nosotros, los que lo construimos.