Kobi Autopilot · remediación autónoma para Kubernetes

Tu clúster se cae a las 3am. Tú sigues durmiendo.

Kobi Autopilot encuentra la causa, aplica un fix de un catálogo cerrado de acciones verificadas y lo revierte si la comprobación falla. Tú decides hasta dónde llega: empieza en modo «solo sugerir» y sube de nivel cuando confíes.

En producción propia: incidentes reales resueltos sin intervención humana.

Un pod entra en CrashLoopBackOff a las 03:14; Kobi diagnostica la sonda de liveness, aplica un fix del catálogo y lo verifica en 87 segundos. El pager pasa de crítico a resuelto. Una de cada tres veces es otro incidente, un OOMKilled en checkout-worker: Kobi sube el límite de memoria, la verificación no pasa porque es una fuga, revierte el cambio y te avisa.

Agente de IA · 24/7

01 · El problema

La alerta dice qué se rompió.
No dice qué lo rompió.

De la alerta al commit que la causó, saltando entre cinco herramientas. El mismo incidente, en paralelo, con Kobi.

El mismo incidente, en paralelo. Tú: de las 03:14 a las 03:34, cinco herramientas, hasta encontrar el commit que lo causó. Kobi: 87 segundos para diagnosticarlo, arreglarlo con una acción del catálogo, verificarlo y escribir el postmortem.

Tú · 5 herramientas · 10 pestañas 20 min para saber qué cambió. Y todavía no está arreglado.
Kobi · catálogo cerrado · 0 pestañas 87 s para arreglarlo, verificarlo y dejar el postmortem escrito.

A las 03:34 sabes qué lo rompió. Kobi lo había arreglado a las 03:15.

Reconstrucción de un incidente típico · datos ilustrativos · escala real: 20 min frente a 87 s

Tiempo

Veinte minutos para saber qué cambió. La alerta no lo dice; cinco herramientas lo saben a medias.

Acceso

El acceso, disperso. Kubeconfig al día, VPN o un bastion por clúster, y otra vez con cada persona nueva.

Contexto

Diez pestañas, cero contexto. Ninguna une el evento con el despliegue y con el permiso que lo explica.

02 · Cómo resuelve

El modelo no decide
qué puede tocar producción.

Reglas deterministas identifican los casos cubiertos y cuándo hace falta investigar. Cuando Kobi propone una acción, el ejecutor solo acepta operaciones de un catálogo cerrado y respeta el RBAC del clúster. Lo único que cambia es quién aprueba.

▶ Compruébalo: elige el nivel, rompe algo y mira hasta dónde llega Kobi.

1Elige el nivel de control

2Rompe algo

tres se resuelven · uno revierte · uno se queda fuera

Kobi Copilot · aprobar y ejecutar

Kobi diagnostica, te enseña el comando exacto y lo ejecuta con tu clic. Lo destructivo, siempre con tu firma.

Quién actúaKobi + tú
Quién apruebaTú pulsas Ejecutar
VelocidadSegundos hasta el fix

Mismo motor: detectar, diagnosticar, remediar. Solo cambia el modelo de control.

Kobi payments-api · CrashLoopBackOff Aprobar y ejecutar
03:14:07 Alerta CRITICAL · payments-api · CrashLoopBackOff · 7 reinicios
03:14:19 Diagnóstico el commit #4127 subió el arranque de 8 a 41 s y la liveness mata el pod antes de que termine · confianza 0.91
03:14:48 Propuesta patch_probe payments-api · startupProbe de 90 s
patch_probe payments-api · startupProbe de 90 s
$kubectl patch deployment payments-api -n payments -p '{"spec":{"template":{"spec":{"containers":[{"name":"api","startupProbe":{"httpGet":{"path":"/healthz","port":8080},"periodSeconds":10,"failureThreshold":9}}]}}}}'
catálogo cerradoreversibleno destructivo
Aprobar y ejecutar
Kobi te enseña el comando exacto y lo ejecuta con tu clic, con tu RBAC y registro de auditoría.
firmado · esperaste 00:04
03:15:06 Ejecución startupProbe aplicada · 3/3 pods Ready en 34 s · ejecutado con tu clic
03:15:38 Verificación pods Ready · sin reinicios en 60 s · p99 de vuelta a 180 ms
03:15:40 Postmortem postmortem escrito · enlaza el commit #4127 y a quién lo mergeó
Resuelto y verificado en 91 s. Con tu firma donde hizo falta. 1 clic tuyo · espera 00:04

Guion ilustrativo con acciones del catálogo real · los tiempos siguen los del incidente de las 03:14.

Catálogo cerrado · RBAC del clúster · umbral de confianza por regla · rollback automático · todo queda registrado

03 · Qué conecta

Sale, nunca entra.
Lo que instalas y lo que no.

Las cinco respuestas que un equipo de plataforma pide antes de instalar nada en producción.

Un agente que sale, nunca entra

Canal gRPC saliente desde dentro del clúster. Tu API server no se expone: sin VPN, sin bastion, sin puertos abiertos.

ServiceAccount y tres niveles de RBAC

Sin kubeconfig en el equipo del operador. Empieza en métricas o lectura y sube a operador cuando quieras.

Solo sugerir, por defecto

Ninguna acción se ejecuta sin tu política. Catálogo cerrado; lo destructivo pide aprobación humana por política de plataforma.

¿Ya tienes Prometheus? Quédatelo

Si lo tienes, lo une a recursos, eventos y cambios. Si no, usa las métricas del kubelet.

Qué datos salen y dónde se procesan

Solo lo necesario para investigar sale del clúster. Qué se envía, cuánto se guarda y dónde, en el modelo de confianza.

04 · Kobi, un agente, dos modos

Kobi resuelve.
Contigo en Copilot. Solo en Autopilot.

El mismo agente, el mismo catálogo cerrado, el mismo registro de cada acción. Lo único que cambia es quién aprueba.

Kobi Copilot contigo · disponible hoy
¿Por qué payments-api reinicia desde las 03:03?
consultando tu clúster get_workload_pods payments-api get_pod_logs payments-api get_workload_history payments-api

CrashLoopBackOff desde el rollout de las 03:02. El ConfigMap payments-config cambió DB_URL y el pod no conecta. 7 reinicios, sin impacto en otros servicios.

causa raíz el ConfigMap payments-config, en el rollout de las 03:02 · confianza 0.94

Acción propuesta · catálogo
rollback_deployment payments-api → rev 41
Ejecutar →

Copilot: tú preguntas, Kobi responde. Gestionado en Cloud, con tu clave si lo autoalojas, y servidor MCP.

Kobi Autopilot Beta abierta
Orquestador dedup · semáforo por org · circuit breaker
  1. 03:14:07 L1 Detector patrón conocido: CrashLoopBackOff · 7 reinicios lo ve una regla y ya trae recomendación
  2. 03:14:09 L2 Router es señal, no ruido · escala a investigación
  3. 03:14:19 L3 Investigador la liveness mata el pod antes de que arranque · confianza 0.91
  4. 03:14:48 L4 Planner patch_probe del catálogo · reversible
  5. 03:15:02 L5 Executor aplicado con guardarraíles · no destructivo, sin aprobación
  6. 03:15:34 L6 Postmortem pods Ready · informe escrito

determinística IA + determinista modelo

Autopilot solo gestiona incidentes catalogados.

Autopilot: Kobi actúa solo, tú apruebas lo destructivo. Ver el incidente · 1:40
Tú eliges el nivel. Solo sugerir · Aprobar y ejecutar · Autónomo. Lo destructivo siempre pide tu firma.
Catálogo cerrado + RBAC. Acciones verificadas y reversibles. Nada de kubectl arbitrario.
Todo queda registrado. Qué hizo, su resultado y quién lo aprobó. Si la verificación falla, deshace su propio cambio.

En producción propia: incidentes reales resueltos sin intervención humana.

05 · La plataforma

Salud, seguridad y gasto.
Sin instalar nada más.

El mismo agente que ya conecta el clúster abre cuatro vistas. Hoy, en Free.

Clúster: Overview · Capacity · Cost · Reliability

Capturas reales de la app; su interfaz está en inglés por ahora.

Home. Lo que pasó mientras no estabas, lo que requiere tu atención hoy y el gasto, en todos los clústeres.

Panel Home de KubeBolt: resumen de lo ocurrido, atención requerida y gasto en todos los clústeres

06 · Open Source y Cloud

El Open Source es gratis para siempre.
El Cloud cobra infraestructura, no personas.

KubeBolt se distribuye en dos ediciones. Open Source va bajo Apache 2.0, sin límite y con tu infra; KubeBolt Cloud añade Kobi Autopilot gestionado y acceso de equipo con OAuth, con un tier gratis disponible ya.

Open Source · Apache 2.0

Sin coste · tú pones la infra

El mismo agente, bajo Apache 2.0 y sin límite, corriendo en tu infraestructura. Incluye Kobi Copilot con tu propia clave (BYOK).

Ver en GitHub

SaaS · Cloud

$0 $49€45 /mes + uso

El mismo agente, con Kobi Autopilot gestionado y acceso de equipo con OAuth. Enterprise Self-Hosted es este mismo SaaS en tu infraestructura.

Empieza gratis →

Incluido en el plan

Free Team
Clústeres 2 ilimitados
Nodos / pods 10 / 150 por uso
Usuarios 3 (tope fijo) 15 (flexible)
Retención 15 días 30 días
Créditos IA / mes 100 1.500

Lo que se cobra hoy

Nodo de producción $8,64€7,92 /mes
Series extra / 1K $4,00€3,70 /mes
Nodo no productivo $2,16€2,02 /mes
Por persona $0€0 /mes

Business, Enterprise y la calculadora Durante el lanzamiento, el exceso de nodos, pods y series se mide pero no se factura; los créditos de IA se pausan al agotarse.

Conecta tu clúster
en minutos.

Crea la cuenta, instala el agente y en la primera alerta verás a Kobi trabajar contigo. Empieza en solo sugerir.

Free · 2 clústeres · sin límite de tiempo

O instala el agente open source

bash
$ helm install kubebolt-agent \
  oci://ghcr.io/clm-cloud-solutions/kubebolt/helm/kubebolt-agent \
  --namespace kubebolt-system --create-namespace \
  --set backendUrl=agent.kubebolt.io:443 --set tls.enabled=true \
  --set auth.mode=ingest-token \
  --set auth.ingestToken.existingSecret=<secret-with-your-token> \
  --set cluster.name=<cluster-name>

El asistente de la app genera este comando con tu token y el nombre del clúster. docs/connect-clusters

Apache 2.0 · ★ en GitHub · el agente sale, nunca entra.

Novedades

Una nota por release, sin ruido.