Ir para o conteúdo
Callaba
Guia do produto

Saúde e diagnóstico da instância

Interprete sinais de erro CPU, memória, disco, processo e SRT, teste a capacidade e preserve evidências antes de limpar os logs de incidentes.

Onde encontrar no CallabaCabeçalho do painel → Integridade da instância
O que este módulo faz

Os sinais de saúde explicam se o host pode sustentar o fluxo de trabalho de mídia. Use-os com estatísticas de módulo: um host íntegro não prova que uma fonte está ativa e uma fonte ativa não prova que o host tem espaço livre.

Continue este fluxo no Callaba

Callaba self-hosted

O operador pode distinguir uma falha de mídia upstream da saturação do host e aplicar a capacidade correta ou alteração de perfil.

Ver como o produto funciona

Antes de começar

  • Uma linha de base normal conhecida para esta instância e carga de trabalho.

  • Permissão para inspecionar ou limpar logs de erros operacionais.

  • Um registro de incidente externo antes da limpeza destrutiva.

Configurações explicadas

Explicamos apenas os controles úteis ao operador. Nomes internos e eventos de implementação são omitidos de propósito.

Capacidade

Leia o espaço atual do host.

Uso de CPU

Carga de processamento atual em mídia e trabalho de aplicativo.

Uso de memória

Pressão RAM atual.

Uso de disco

Espaço disponível para logs, uploads, transcodificação temporária e gravações.

Teste de velocidade de rede

Capacidade de rede medida da instância.

Execute fora dos picos críticos de produção.

Evidência operacional

Identifique falhas antes de alterar a configuração.

Erros de processo

Falhas no processo de aplicativo/mídia que exigem investigação em nível de módulo.

Erros SRT

Eventos de transporte e erros SRT associados a fluxos de trabalho de contribuição.

Notificação de versão

Versão do aplicativo instalado e contexto de atualização.

Limpar logs de erros

Remova entradas de erros acumuladas.

Exporte ou registre primeiro as evidências do incidente.
Localização IP

Resolva o contexto regional para um endereço de conexão quando compatível.

Primeiro fluxo seguro

  1. 01

    Compare CPU, memória e disco com a linha de base íntegra conhecida.

  2. 02

    Processo aberto ou erros SRT e identifique o módulo proprietário e a janela de tempo.

  3. 03

    Inspecione as estatísticas ao vivo e a entrada/saída real desse módulo.

  4. 04

    Execute um teste de velocidade somente quando ele não distorcer o tráfego de produção.

  5. 05

    Registre ou exporte evidências de incidentes antes de limpar os registros.

Exemplos de fluxo

Use quando

Diagnosticar transcodificação ao vivo instável

Os quadros de saída começam a ser perdidos após o início de um novo trabalho de transcodificação.

Fonte ao vivoTaxa de bits de entrada
TranscodificaçãoCarga de trabalho do codec
Saúde do hostCPU + memória
SaídaFPS + taxa de bits
Diagrama animado do fluxo: Diagnosticar transcodificação ao vivo instável

Como construir

  1. 1

    Confirme se a taxa de bits de origem está estável.

  2. 2

    Compare o host CPU/memory antes e depois do início da tarefa.

  3. 3

    Inspecione a taxa de bits de saída e a taxa de quadros.

  4. 4

    Remova trabalhos desnecessários de redimensionamento/taxa de quadros/codec ou mude para a capacidade medida do host.

Use quando

Preserve as evidências antes de eliminar erros

Erros antigos obscurecem uma investigação ativa de incidentes.

Lista de errosTempo + módulo
Registro de incidentePreservar evidências
Limpar registrosAção controlada
ReproduzirSinal fresco
Diagrama animado do fluxo: Preserve as evidências antes de eliminar erros

Como construir

  1. 1

    Registre o erro relevante, carimbo de data/hora, módulo e versão de lançamento atual.

  2. 2

    Salve a configuração do módulo associado e as estatísticas em tempo real.

  3. 3

    Elimine os erros somente depois que a evidência for externalizada.

  4. 4

    Reproduza um teste controlado e investigue apenas as novas entradas.

Validar o resultado

  • Os valores de capacidade correspondem à carga de trabalho esperada e deixam espaço planejado.
  • Cada erro ativo pode estar vinculado a um módulo de tempo e propriedade.
  • A limpeza dos logs ocorre somente depois que as evidências são armazenadas em outro lugar.

Solução de problemas

A integridade do host está normal, mas a reprodução falha

Verifique
  • Inspecione os módulos de origem e saída.
  • Verifique o acesso, o protocolo e a reprodução real do cliente.
Depois faça isto

Trate a saúde do hospedeiro como uma camada; reparar o primeiro limite de mídia com falha.