Workstation Logo
Produtos
Labs de IAAgentes OpenAIAgentes ClaudeGrok BotWorkstation CRM (WSL CRM)MarketingTodos os Produtos
Soluções IA
Estações de Trabalho IAAI SME PackagesIA PrivadaClusters GPUIA EdgeLaboratório IA EmpresarialIA por Indústria
Serviços
Modernização de plataformaEngenharia digitalFundações de dados e IAOperações autónomasConsultoria de IAAutomação DevOpsCibersegurançaDesenvolvimento de softwareConstrução de agentesConfiguração MLOps
Sobre Nós
ParceirosHistórias de Clientes
Artigos
Documentação
WSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7
Blog
Contacte-nosLogin
Workstation

Estações de trabalho de IA, software multiagente de IA, infraestrutura de GPU e soluções de agentes inteligentes para empresas modernas.

Contacte-nos

Soluções de IA

Estações de Trabalho IAAI SME PackagesIA PrivadaClusters GPUIA EdgeLaboratório IA EmpresarialIA por Indústria

Produtos

Todos os ProdutosWSL CRM e ERPMarketingAgentes OpenAIWSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7

Empresa

Sobre NósPor que WorkstationParceirosHistórias de ClientesPreçosContato

Recursos

ArtigosDocumentaçãoBlogPesquisarMapa do Site
Escritório Reino Unido
77-79 Marlowes, Hemel Hempstead HP1 1LFComo chegar: pegue a saída 20 da M25, Outer LondonN.º da empresa: 11641870Seg - Sex: 9:00 - 18:00 GMT
+44 7515 356 146
Escritório Bélgica
Workstation SRL, Rue Vanderkindere 34, 1180 Uccle, BrusselsBE 0751.518.683Seg - Sex: 9:00 - 18:00 CET
+32 492 45 67 46
Escritório Índia
#159 Sector 9, Pocket 1, DDA Flats, 110077 Dwarka, New Delhi
+91 98881 98841

© 2026 Workstation AI. Todos os direitos reservados.

PrivacidadeCookiesTermos de ServiçoMapa do site
Home / Articles / Technology
KubernetesDevOpsAIOpsOpen Source

KubePilot: CoPilot, Pilot e AutoPilot para incidentes mais rápidos do Kubernetes

Resumo técnico: loop de incidente de três modos, instalação (fonte/Helm/Docker/iOS), grades de segurança do AutoPilot, MCP, runbooks e lista de verificação de produção

August 12, 2026Technology6 min read

KubePilot é um cockpit de solução de problemas do Kubernetes de código aberto criado pelo Workstation equipe de engenharia. Ele combina diagnóstico assistido por IA (Co-piloto), navegação em cluster estilo SRE (Piloto) e remediação controlada por políticas (Piloto automático) para que as equipes de plataforma, SRE e DevOps passem de sinais barulhentos para uma solução segura, sem fazer malabarismos com as guias kubectl no meio do incidente. Local do produto: kubepilot.org. Fonte: github.com/bwalia/kubepilot.

Capa do KubePilot – CoPilot Pilot AutoPilot

Navegação. Blog complementar: resumo do negócio. Relacionado: GitOps com Argo CD e Flux, CD Kubeflow + Argo, LLMs no Kubernetes, OAuth e cofre do MCP.
Resumo do agente.
  • O que: Cockpit K8s de código aberto - CoPilot (AI RCA) + Pilot (navegador SRE) + AutoPilot (fixador fechado).
  • Quem: Equipes de SRE, DevOps, plataforma/AIOps que precisam de MTTR mais rápido com automação auditável.
  • Correr: binário serve em: 8383, gráfico Helm, Docker (ghcr.io/kubepilot/kubepilot), companheiro do iOS.
  • IA: LLMs locais via Ollama; Solicitação de cópia; Servidor MCP em:9090.
  • Segurança: padrões do Pilot somente leitura; Piloto automático desligado/funcionamento em teste/ativo; pisos de confiança; listas de bloqueio; interruptor de matar; livro de decisões.

1. Assista ao passo a passo

youtu.be/CsiJWpfncqA - Balinder Walia, Workstation.

2. O problema que o KubePilot resolve

Clusters modernos emitem mais sinais do que os humanos conseguem fazer triagem em uma única página: CrashLoops, ImagePullBackOff, OOMKills, pressão de nó, testes escamosos e desvio de YAML. A resposta típica se espalha por:

  • kubectl histórico e scripts de shell,
  • uma IU do navegador (Lens/Rancher/painel),
  • registra em uma terceira ferramenta,
  • um bate-papo LLM com YAML colado (e sem autenticação de cluster).

Essa fragmentação queima minutos quando os minutos são o SLA. O KubePilot recolhe o loop em um cockpit: localizar → perguntar → verificar → corrigir.

Loop de incidente de três modos

3. Modo A — CoPilot (solução de problemas assistida por IA)

CoPilot é a superfície RCA automatizada e de linguagem natural:

  • Faça perguntas operacionais em inglês simples (“por que o checkout CrashLooping está em produção?”).
  • Um clique Análise de IA em pods e eventos de problemas.
  • Análise de causa raiz com cadeias de evidências, confiança, risco, comandos sugeridos, correções YAML e próximas etapas.
  • Detecção de anomalias para padrões CrashLoop, OOM, ImagePull e pressão de nó.
  • Copiar prompt para reutilizar o prompt de diagnóstico exato com seu modelo preferido.
  • Projetado para Ollama/modelos locais para que o contexto do cluster possa permanecer na sua rede.

Eventos de cluster e solução de problemas de IA

4. Modo B – Piloto (navegador de solução de problemas de SRE)

Pilot é o ambiente de trabalho somente leitura estilo Lens/Rancher para verificação antes da mutação:

  • Navegue por implantações, StatefulSets, DaemonSets, Jobs, Services, Ingresses, ConfigMaps, Secrets, PVCs.
  • Ambiente de trabalho de pod: visão geral, contêineres, eventos, logs, YAML higienizado, contagens de reinicialização, tempo de atividade.
  • Medidores de recursos de cluster em tempo real (CPU, memória, disco) — compatíveis com Longhorn quando aplicável.
  • Tela de topologia de serviço: Entrada → Serviço → Carga de trabalho → Pod com cores e portas de status.
  • Classificação IP de LAN, WAN e túnel (por exemplo, WireGuard / flanela) - não apenas o endereço de sobreposição.
  • Túneis de encaminhamento de porta da UI; upload de kubeconfig de vários clusters e alternância de contexto sem reinicialização.

Visão geral do painel piloto com medidores e IPs de nós

5. Modo C – Piloto Automático (fixador AI com grades de segurança)

O AutoPilot fecha o ciclo com autocorreção auditável – nunca “YOLO apply” como padrão:

Controlar Propósito
Modos: desligado/funcionamento a seco/ativoPré-visualizar antes de aplicar; mantenha a automação estacionada quando necessário
Pisos de confiançaIgnore RCAs de baixa confiança em vez de adivinhar
Listas de bloqueio de namespace e listas de permissões de açãoProteja os namespaces kube-system/prod; limitar tipos de mutação
Recargas e limites horáriosEvite tempestades de remediação
Interruptor de matarPausa de um clique para operadores
Livro razão de decisãoExecutado, ignorado, escalonado, com falha — trilha de auditoria
Escalação de código CRAprovação humana para ações arriscadas

Anomalia do AutoPilot para fluxo de trabalho de correção auditado

6. Mapa completo de recursos (de kubepilot.org)

  • Runbooks pré-construídos: sete fluxos de trabalho de diagnóstico opinativos; runbooks YAML personalizados com fsnotify hot-reload (IDs de usuário substituem os integrados).
  • História RCA durável: SQLite integrado opcional (WAL, sem CGO) com retenção para relatórios e anomalias durante reinicializações.
  • Alertas e cronograma: avisos, eventos, anomalias, RCA como um cronograma de operações pesquisável; cartões de incidentes opcionais do Slack.
  • Chip de saúde de IA: saber que o Ollama está pronto antes que um incidente dependa disso.
  • Padrões de segurança em primeiro lugar: autenticação opcional, navegação somente leitura, portas de mutação, políticas CORS.
  • Protocolo do agente MCP: servidor MCP integrado para orquestração de agentes multicluster e acesso programático.
  • Companheiro iOS nativo: Aplicativo SwiftUI – cartões de saúde, pods, registros, RCA, Face ID, widgets, Siri/App Intents.

7. Opções de instalação

Pré-requisitos para compilações de origem: Go 1.22+, Node.js 18+, um cluster acessível + kubeconfig; Ollama recomendado para IA local.

7.1 Construir a partir da fonte

git clone https://github.com/bwalia/kubepilot.git
cd kubepilot
make dashboard-install
make dashboard
make build
KUBEPILOT_KUBECONFIG="$HOME/.kube/config" ./dist/kubepilot serve --dashboard-port=8383
# Dashboard/API: http://localhost:8383
# MCP server: :9090

7.2 Helm (instalação de cluster)

helm repo add kubepilot https://bwalia.github.io/kubepilot
helm repo update
helm upgrade --install kubepilot kubepilot/kubepilot \
  -n kubepilot --create-namespace
kubectl port-forward svc/kubepilot -n kubepilot 8080:8080
# Open http://localhost:8080

Também suportado: NodePort, Ingress (+ TLS do gerenciador de certificados), LoadBalancer e substituições de valores - consulte o gráfico README no GitHub.

7.3 Janela de encaixe

docker run --rm -p 8383:8383 -p 9090:9090 \
  -v "$HOME/.kube:/root/.kube:ro" \
  ghcr.io/kubepilot/kubepilot:latest \
  serve --dashboard-port=8383

7.4 companheiro iOS

cd ios
brew install xcodegen
./generate.sh
open KubePilot.xcodeproj
# Point the app at http://<server-ip>:8383

8. Modelo operacional recomendado

  1. Dia 0: execute o Pilot como somente leitura em um cluster que não seja de produção; fio Ollama; confirme o chip de saúde da IA.
  2. Dia 1: use o CoPilot AI Analyze em pods defeituosos conhecidos; compare o RCA com seus runbooks; ajuste o prompt de cópia em sua equipe LLM.
  3. Dia 2: ativar o piloto automático em ensaio apenas; revisar o livro de decisões por uma semana.
  4. Dia 3+: promova namespaces selecionados para ativos com listas de permissões restritas, níveis de confiança e alertas do Slack; mantenha o sistema kube bloqueado.
  5. Sempre: kill switch ensaiado; Caminho do código CR para mutações de risco; Ferramentas MCP por trás da autenticação (veja nosso resumo de segurança do agente).

9. Lista de verificação de produção

  • ☐ Autenticação habilitada para qualquer painel acessível pela rede.
  • ☐ O AutoPilot inicia em teste; ativo somente após revisão do razão.
  • ☐ A lista de bloqueio de namespace inclui namespaces de sistema/compartilhados.
  • ☐ Limites horários e tempos de espera definidos abaixo dos limites de tempestade.
  • ☐ Ollama (ou caminho LLM aprovado) monitorado por meio de integridade de IA.
  • ☐ Integração com Slack ou pager para anomalias de alta gravidade.
  • ☐ GitOps ainda possui o estado desejado – o AutoPilot é um fixador tático, não um substituto para o Argo CD/Flux.
  • ☐ Lançamentos de estrelas e faixas: github.com/bwalia/kubepilot.

10. Por que o Workstation oferece este código aberto

A Workstation cria plataformas de automação para equipes de operações reais. KubePilot é nossa aposta que AIOps só funciona quando o diagnóstico e a remediação compartilham uma trilha de evidências – e quando a automação é controlada como um SRE humano bloquearia uma mudança. Nós o publicamos em código aberto para que as equipes da plataforma possam executá-lo em suas próprias redes, estender runbooks e conectar agentes MCP sem dependência de fornecedor.

Começar em kubepilot.org, clonar o repositórioe assista ao passo a passo em YouTube. Resumo do complemento: postagem no blog.

Share this article

More in Technology

Jobshout SEO Analyst AI Agent — Analyse Any Website & Fix SEO Issues Automatically

Jobshout SEO Analyst AI Agent — Analyse Any Website & Fix SEO Issues Automatically

Technical brief: SEO Analyst modes, real workstation.co.uk run (score 44), findings with fix prompts, Improve/Publish paths, and Jobshout supervised agents

Read more
WSLVault: Steal the Server. Not the Secrets.

WSLVault: Steal the Server. Not the Secrets.

Technical brief: AES-256-GCM envelope hierarchy, cryptographic tenant isolation, engines, identity/MFA, active/active regions, Kubernetes deploy, and video chapters

Read more
Workstation WSL Proxy — Docker Image Optimisation, Build Cache, Full Deploy Workflow, and Shipping It with AI Assistance

Workstation WSL Proxy — Docker Image Optimisation, Build Cache, Full Deploy Workflow, and Shipping It with AI Assistance

Technical brief: prebuilt OpenResty Dockerfile, Buildx/GHA cache, Ansible extract, delivery pipeline DEPLOY_MODE, and an operator+agent loop for finishing pipeline work

Read more