Oferta de lanzamiento +1000 créditos de IA/mes para los primeros 10 registros. Empieza gratis
Agentes de IA para Kubernetes

Incidentes de Kubernetes, resueltos.

Conoce a Kobi, tu SRE de IA. Un agente, dos modos: Kobi Copilot lo arregla con tu clic, Kobi Autopilot lo arregla solo.

87s tiempo medio de resolución
24/7 agente de IA de guardia
0-touch en Autopilot
cluster / prod-eu-west Monitoreando

La columna: cómo resuelve

Un solo motor.
Tú eliges el control.

El mismo motor de resolución en todo. Lo único que cambia es quién aprieta el botón: tú, o el propio clúster.

Kobi Copilot
Quién actúa Kobi + tú
Quién aprueba Tú pulsas Ejecutar
Velocidad Segundos hasta el fix

Mismo motor detectar → diagnosticar → remediar. Solo cambia el modelo de control.

01

Kobi Copilot · Disponible hoy

Kobi resuelve.
Enseña. Y nunca te deja atascado.

Pulsa ⌘ J y describe qué falla. Kobi consulta tu cluster en vivo con 17+ herramientas, halla la causa raíz y propone el fix exacto, tú pulsas Ejecutar. Explica cada paso, y cuando un fix queda fuera de lo que puede ejecutar, te entrega los comandos precisos para la consola.

01 · Resuelve

De la alerta al fix, con tu clic

Kobi halla la causa raíz y propone el comando exacto: rollback, escalar, ajustar limits. Tú apruebas; ejecuta con RBAC completo y registro de auditoría. El humano sigue en el loop.

02 · Enseña

Muestra su razonamiento, siempre

Cada diagnóstico viene con el razonamiento y los comandos detrás. Tu equipo aprende Kubernetes, no solo KubeBolt. Onboarding y respuesta a incidentes en uno.

03 · Guía a consola

Nunca un callejón sin salida

Cuando un fix queda fuera de lo que Kobi puede ejecutar, no se encoge de hombros: te da el paso a paso exacto para hacerlo a mano, así nunca te bloqueas.

04 · Anywhere

UI, IDE, CLI vía MCP

Kobi expone un servidor Model Context Protocol. Conéctalo a Cursor o Claude Code y tu asistente obtiene contexto del cluster en vivo sin salir del editor.

Multi-modelo

Trae tu propio modelo

Para el trabajo interactivo aprobado por humano, Kobi te deja elegir proveedor: Anthropic Claude, OpenAI GPT, xAI Grok, o cualquier endpoint compatible con OpenAI (Llama / Qwen / Mistral self-hosted vía vLLM, Ollama, LM Studio). Pon uno como fallback ante 429 / 5xx. El prompt caching mantiene la factura predecible. (Autopilot, actuando sin supervisión, usa Claude exclusivamente.)

  • → Anthropic · Claude Sonnet / Opus / Haiku
  • → OpenAI · GPT-5 / serie o
  • → xAI · familia Grok 4
  • → Compatible OpenAI · self-hosted, gateways custom

Donde sea, vía MCP

Cursor. Claude Code. Tu terminal.

Kobi expone un servidor de Model Context Protocol. Conéctalo a tu IDE y tu asistente de IA tendrá acceso de lectura a tu cluster, sin salir del editor.

# claude code
/mcp add kubebolt
02

Kobi Autopilot

Beta abierta · Plan Free

Autopilot.
El mismo Kobi. Sin manos. Auditable.

Autopilot es Kobi actuando solo: despierta cuando algo importa: un crash loop se propaga, el budget de un SLO se quema, un nodo se degrada. Abre una sesión, reúne contexto, decide y actúa. En la beta abierta ya resuelve incidentes reales de extremo a extremo en menos de 90 segundos, a menos de $1 cada uno, y lo hemos demostrado en vivo. Construido sobre el Claude Agent SDK con failover multi-región, disponible hoy en KubeBolt Cloud.

< 90s para resolver
<$1 por incidente
100% auditable
01

Análisis de causa raíz

Cuando se dispara un incidente, Autopilot lanza una sesión larga de investigación. Correlaciona eventos, logs, despliegues e incidentes previos, y escribe un veredicto que puedes auditar.

02

Remediación guiada

Propone un parche, lo pasa por un ejecutor determinista con guardrails de política, y hace rollback si rompe el SLO. Apruebas una vez; lo recuerda.

03

Postmortems en piloto automático

Genera un borrador de postmortem desde la línea de tiempo del incidente. Action items enlazados a PRs. Five-whys incluidos. Editas, no escribes desde cero.

04

Operación del lifecycle del cluster

Programa power-on / power-off en EKS, AKS, GKE, OpenShift y node pools. Se paga a sí mismo en la mayoría de los entornos.

Tú tienes el mando

Tú decides cuánta autonomía: Solo sugerir, Aprobar y ejecutar, o Autónomo (lo destructivo siempre pide tu firma). Ventana desatendida con días, horario y zona horaria, opt-in por organización, y techo de autonomía a nivel plataforma. Todo esto, hoy, en la beta abierta.

Por qué Claude exclusivamente, para Autopilot

Para la acción no supervisada usamos Claude exclusivamente, con failover multi-región entre Anthropic API, AWS Bedrock y Google Vertex AI. La remediación autónoma exige el modelo más fiable: sin router, sin zoo de modelos, sin ambigüedad en un postmortem. Kobi, contigo en el loop, es donde vive el multi-modelo.

03

Módulo: Cluster Lifecycle

Roadmap · 2026 · Business / Enterprise

El módulo
que se paga solo.

La mayoría de clusters corren 24/7 aunque las personas no. El módulo de lifecycle de KubeBolt programará power-on / power-off en toda tu flota (entornos preview, clusters de dev, downtime de fin de semana) y rastreará los ahorros. Llega con el tier KubeBolt Business en 2026.

Ahorro típico

~65%

en gasto de clusters non-prod, programando noches y fines de semana con calentamiento inteligente antes de horas laborales.

El ahorro de infraestructura suele superar la propia suscripción a KubeBolt.

Plataformas soportadas

  • EKS
  • AKS
  • GKE
  • OpenShift
  • Generic node pools

Schedules por cluster, reglas semana / fin de semana, override manual, audit log de cada transición de power. Diseñado para no interrumpir CI runs en vuelo.

04

Arquitectura: Determinismo primero

Las 6 capas, listas · Autopilot en beta abierta

Skills.
La llamada al LLM más barata
es la que no haces.

Una Skill es una rutina diagnóstica declarativa y determinista: una receta para un patrón de fallo conocido. Las seis capas ya están listas y trabajan juntas dentro de Kobi Autopilot, ahora en beta abierta: L1 Detectores marca el patrón, L2 Router decide la profundidad, L3 Investigador halla la causa raíz, L4 Planificador propone el fix, L5 Ejecutor lo aplica con guardrails y L6 Postmortem lo documenta. L1 y L5 además ya viven fuera de Autopilot: el Insights Engine de 24 reglas de abajo y el surface de write-ops determinista de arriba (Set image, Secret reveal con audit, Apply manifest).

L1

LISTO

Detectores

Determinista. Sin IA.

L2

LISTO

Router

Tipo Haiku. Triage.

L3

LISTO

Investigador

Tipo Sonnet. RCA.

L4

LISTO

Planificador

Sonnet / Opus.

L5

LISTO

Ejecutor

Determinista. Guardrails.

L6

LISTO

Postmortem

Sonnet / Opus.

05

Insights Engine

24 reglas. Cero configuración.

Evaluación continua contra heurísticas probadas. Recomendaciones accionables, no PromQL crudo. Cada regla es una Skill, así que el motor funciona incluso antes de configurar un modelo.

Crash loop detectado Crítico
OOM killed Crítico
Image pull backoff Crítico
Nodo no listo Crítico
Cero réplicas Crítico
Release de Helm fallida Crítico
Riesgo de CPU throttle Advertencia
Memory pressure Advertencia
HPA al máximo Advertencia
Certificado por expirar Advertencia
App de ArgoCD no sana Advertencia
+13 reglas más Catálogo completo →
06

Módulo: Operaciones del cluster

Disponible hoy

Opera.
No solo observes.

Cada verbo equivalente de kubectl es un click. Set image, scale, drain de un nodo, editar env, revelar un secret, aplicar un manifest nuevo: todo desde el dashboard con RBAC enforcement en cada endpoint, una entrada de audit log en cada mutación y un switch de governance para acotar o desactivar las acciones de escritura. Sin terminal.

01

Edición de workloads

Set image, ajustar CPU/memoria (requests y limits), set env (literal, ref de ConfigMap, ref de Secret), editar labels y anotaciones. Strategic-merge patches con soporte de init-containers y validación de limit ≥ request.

02

Reveal de Secret con audit

Razón del operador obligatoria (≥10 chars) antes de cualquier reveal. Gate de namespace prod que escala a Admin. Auto-hide por key a los 60s. Audit log registra quién/qué/cuándo/por qué, nunca los valores.

03

Mantenimiento de nodos

Cordon, uncordon y drain con progreso SSE en vivo de los pods siendo evictados. Cancelable mid-flight. Misma paridad de toolbar desde Node detail y el listado de Nodes.

04

Aplicar manifest nuevo

Pega YAML o elige entre 18 starter templates por kind. Editor CodeMirror con validación pre-flight: consistencia de kind / apiVersion / namespace, guard de documento único, status / managedFields se eliminan automáticamente.

05

Diff de revisiones y rollback

La pestaña History de cada rollout muestra un diff YAML lado a lado (qué cambió, línea por línea), venga de kubectl, GitOps o KubeBolt. Vuelve a cualquier revisión con un click.

06

Releases de Helm, de extremo a extremo

Ve cada release de Helm del cluster: chart, values, manifest renderizado, historial de revisiones y dependencias. Decodificado directo de los Secrets de Helm, sin SDK y sin terminal.

07

Surface: UI del operador

Mira tu cluster.
En movimiento.

Un mapa en tiempo real de cada pod, servicio y ruta de petición. Mini-dashboards en cada recurso. Flujo de tráfico que puedes observar de verdad. Pensado para ingenieros que prefieren ver la topología antes que escribir otro kubectl get.

01

30+ vistas de recursos

Pods, Deployments, Services, Ingresses, ConfigMaps, Secrets, Jobs, Nodes. Cada tipo tiene una vista diseñada con las columnas, las acciones y los paneles de detalle correctos.

02

Live, sin polling

Cada lista, gráfico y arista se mueve por Watch streams contra la K8s API. Los cambios de estado aparecen en milisegundos: sin F5, sin filas viejas, sin sorpresas.

03

⌘K para todo

Escribe para saltar a cualquier recurso en cualquier namespace. Búsqueda fuzzy entre tipos. Contexto reciente fijado. Funciona como tu editor, porque así es como ya piensas.

04

Tres lentes en el dashboard

Overview para salud de un vistazo, Capacity para recomendaciones de right-sizing y top consumers, Reliability con error rates L7, hot-spots y Network Drops vía Hubble.

08

Stack

Liviano por diseño.

Origen

Kubernetes

  • API Server
  • Metrics Server
  • OTel Collector (forked)

Core

Motor KubeBolt

  • Go · Auth · RBAC
  • BoltDB embedded
  • Insights Engine · 24 rules
  • MCP servers

Superficies

Donde trabajas

  • Web UI · 30+ views
  • Slack · Discord · Email
  • Cursor · Claude Code (MCP)
Go 1.25+ · client-go · BoltDB · Anthropic API · OpenAI API · OpenTelemetry · Hubble flows · Model Context Protocol · React 18 · TypeScript · Go 1.25+ · client-go · BoltDB · Anthropic API · OpenAI API · OpenTelemetry · Hubble flows · Model Context Protocol · React 18 · TypeScript ·

Por qué KubeBolt

La mayoría observa.
KubeBolt opera.

Dashboards, métricas y alertas son lo mínimo, todos los tienen. La diferencia es lo que pasa después de que salta la alerta.

Lo mínimo: todos lo tienen

Lo que hace un dashboard

  • Dashboards y visualización de recursos
  • Agregación de métricas y logs
  • Alertas cuando algo se rompe
  • Un chat pegado al clúster
Solo KubeBolt

Lo que ningún dashboard tiene

  • Remediación autónoma con guardarraíles No solo te avisa: resuelve el incidente, con política de grado operador y auditoría completa.
  • Una flota de agentes especializados Red, almacenamiento, workloads, seguridad: cada capa vigilada y diagnosticada de extremo a extremo, no un bot genérico.
  • Todo el ciclo del incidente Detectar → diagnosticar → remediar → verificar → postmortem. Un solo bucle, cerrado automáticamente.
  • Tu API server sigue privado El agente marca hacia afuera; nada entra. Funciona en GKE/EKS privados, tras bastiones, air-gapped: sin VPN, sin clúster expuesto.
09

Instalar

Un comando.
Cualquier cluster.

Chart OCI en GHCR. RBAC, Ingress, auth y recursos configurables.

helm install kubebolt \
  oci://ghcr.io/clm-cloud-solutions/kubebolt/helm/kubebolt

kubectl port-forward svc/kubebolt 3000:80

¿Necesitas la referencia completa? Lee la documentación →

Roadmap · Por etapas

De la visibilidad a la autonomía.

KubeBolt avanza por etapas: primero ves, luego actúas con tu aprobación, al final la plataforma actúa sola bajo tu política. Ventanas orientativas para 2026: la etapa marca cuándo llega cada capacidad, no el plan que la incluye.

Free

Disponible hoy Hoy

Ver y resolver

  • Kobi Copilot: resolución asistida de incidentes con acciones auditadas Kobi
  • Operaciones kubectl y visibilidad de Helm vía agente Kobi
  • Insights Engine: 24 reglas de fiabilidad y configuración, cero config Security
  • Autopilot en beta abierta: opt-in por organización, ventana horaria y guardrails Autopilot · beta
  • Costos cloud con OpenCost: gasto por cluster, idle y rightsizing valorado en dinero Lifecycle · beta

Team

En construcción Q3 2026

Visibilidad total

  • Panel Security & Compliance: Trivy, Falco, CIS y Kyverno en una sola vista Security
  • Costos accionables: detección de volúmenes y recursos huérfanos que siguen facturando Lifecycle
  • Vista de flota multi-clúster y búsqueda global cross-cluster Fleet
  • Topología GitOps: tus apps de ArgoCD y Flux mapeadas a sus repos Fleet

Business

Diseñado Q4 2026

Actuar con tu aprobación

  • Resolución en la raíz: el fix corrige el manifiesto y llega como pull request a tu repo Git; el merge es la aprobación Kobi
  • Del cálculo a la acción: rightsizing aplicado con aprobación, apagado programado de nonprod y dashboard de ROI Lifecycle
  • Skills determinísticas y conectores MCP: respuestas más rápidas, menos créditos Kobi
  • Kobi sobre tus hallazgos: score CIS, amenazas activas, violaciones de política Security

Enterprise

Diseñado Q4 2026

Autonomía bajo política

  • Autopilot completo: cross-cluster, cola de aprobaciones y postmortems automáticos Autopilot
  • Skills autónomas de seguridad y FinOps autónomo bajo política Security
  • PRs de remediación abiertos de forma autónoma, con la evidencia del incidente incluida Kobi
  • Cockpit multi-cloud: AWS, GCP y Azure con costo reconciliado en un solo lugar Fleet

Planes: un solo lugar para elegir tu camino

Gratis para siempre,
o totalmente hosteado.

El agente open-source es gratis para siempre bajo Apache 2.0. KubeBolt Cloud añade Kobi Autopilot hosteado, Lifecycle Management y SSO de equipo, con un tier hosted gratis disponible ya.

OSS · Self-Hosted Disponible hoy

Gratis para siempre. Sin topes.

Apache 2.0. Tú operas la infra. KubeBolt no opera nada.

  • Clusters ilimitados
  • Nodos / pods ilimitados
  • Usuarios ilimitados
  • Retención tu disco
  • Kobi Copilot BYOK · ilimitado
  • Soporte GitHub · Comunidad
Instala en 60 segundos →

Novedades

No te pierdas
lo que viene.

KubeBolt Cloud ya está aquí y lo liberamos por etapas: nuevas capacidades, pricing y más, cada pocas semanas. Déjanos tu email y te avisamos en cada release. Sin ruido.

10+ reciben las novedades 17 estrellas en GitHub

Sin spam. Te das de baja con un click. Solo enviamos novedades de producto.