---
sourceDocument: Xanadu IT Operations Management
sourceDocumentLink: https://servicenow-prod.fluidtopics.net/r/pt-BR/xanadu/it-operations-management

 Release :

    - xanadu

ft:locale :

    - pt-BR

ft:publication_title :

    - Xanadu IT Operations Management

ft:clusterId :

    - itom

bundleId :

    - itom

workflow :

    - Technology


---

# Exploração do Gestão de confiabilidade de serviços

# Exploração do Gestão de confiabilidade de serviços {#ariaid-title1}

* Versão de lançamento: Xanadu
* 
* Atualizado 1 de ago. de 2024
* 
* ![](https://www.servicenow.com/docs/portal-asset/ico-clock) 4 min. de leitura

Gestão de confiabilidade de serviços (SRM) fornece uma experiência guiada de autoatendimento para que as equipes gerenciem de forma autônoma a integridade de seus serviços técnicos. A experiência é criada usando a aplicação Espaço de operações de serviços e combina recursos de ITOM e ITSM em um único fluxo de trabalho de operações de serviços.

## Visão geral SRM {#exploring-service-reliability-management__cf-exploring-parent-overview}

Otimize a integridade de serviço com Gestão de confiabilidade de serviços (SRM) para equipes de TI que adotam práticas de engenharia de confiabilidade do site (SRE). SRM é um espaço de operações único que capacita as equipes a melhorar a confiabilidade dos serviços digitais com SRE.

* Use escalações de plantão para responder a problemas identificados pelo monitoramento e alertas de ITOM em tempo hábil.
* Reduza o atrito de configuração com o autoatendimento guiado para integrar equipes distribuídas com dados separados, acesso capacitado e governança mínima da TI central.
{#exploring-service-reliability-management__ul_ahx_ypj_4bc}

Quando SRM está ativado, vários plug-ins e aplicações também são instalados. Para obter mais informações, consulte [Plug-ins ou aplicações instaladas com Integridade do ITOM](https://servicenow-prod.fluidtopics.net/jrAs6v2aoDjqbh7FfGuuDw "Tabelas que listam os plug-ins ou aplicações instaladas com Integridade do ITOM aplicações. Quando você atualiza sua aplicação, todas as dependências de aplicações recém-necessárias são instaladas.").

## SRM usuários {#exploring-service-reliability-management__cf-exploring-parent-users}

{#exploring-service-reliability-management__table_ayk_qqd_pwq__entry__3}

| Usuários | Descrição | Contém as funções |
|-|-|-|
| administrador | Um administrador de ServiceNow é responsável pela administração, o desenvolvimento, a operação, a formação e a manutenção da plataforma da ServiceNow. Responsável pela instalação e pode executar a configuração da Central de administração da Espaço de operações de serviços de SRM. | Todos |
| Administrador \[srm_admin\] Nota: Não a função de administrador da ServiceNow | Os administradores de SRM podem gerenciar configurações e definições de conta e usuários. Os administradores podem executar as funções a seguir: * Acesse, crie, edite ou exclua todas as configurações de SRM. * Adicione ou gerencie integrações. * Criar integrações com ferramentas de Monitoramento de desempenho de aplicativos (APM) * Configurar e manter Indicadores de confiabilidade. * Configurar e manter políticas de orçamento de erro. {#exploring-service-reliability-management__ul_byk_qqd_pwb} | * Gerente * Respondente {#exploring-service-reliability-management__ul_cyk_qqd_pwb} |
| Gerente \[srm_manager\] | Os gerentes supervisionam uma equipe de SREs. Os gerentes atribuem SREs à programação da equipe de plantão, monitoram seu desempenho, criam procedimentos para lidar com incidentes e desenvolvem soluções. Os gerentes garantem a resiliência em todos os sistemas e fluxos de trabalho de DevOps. Os gerentes podem executar as seguintes ações dentro do contexto de suas respectivas equipes: * Defina e configure equipes e, cronogramas de plantão e serviços. * Adicione e exclua usuários, como respondentes e gerentes das equipes das quais fazem parte. * Adicione ou gerencie integrações. * Criar integrações com ferramentas de Monitoramento de desempenho de aplicativos (APM) * Configurar e manter Indicadores de confiabilidade. * Configurar e manter políticas de orçamento de erro. {#exploring-service-reliability-management__ul_dyk_qqd_pwb} | Respondente |
| Respondente \[srm_responder\] | Um Engenheiro de Confiabilidade de Serviço (SRE) que usa SRM para executar tarefas diárias. Os respondentes são os indivíduos que estão de plantão e diagnosticam e corrigem incidentes. Os respondentes só podem acessar as configurações das quais fazem parte. Eles só podem acessar os alertas ou incidentes para os quais têm permissão. Os SREs podem executar as seguintes ações no contexto de suas equipes: * Configurar serviços, equipes e integrações * Confirmar seus cronogramas de plantão * Gerenciar registros de incidentes e alertas * Atualizar as equipes que eles criaram * Adicionar outros respondentes * Criar integrações com ferramentas de Monitoramento de desempenho de aplicativos (APM) * Configurar e manter métricas de confiabilidade * Configurar e manter ações de limite de erros {#exploring-service-reliability-management__ul_eyk_qqd_pwb} | Herda 17 funções, incluindo as seguintes: * cmdb_read * sn_sow.sow_user * sn_sow_srm.srm_responder * workspace_user * operador_slo {#exploring-service-reliability-management__ul_fyk_qqd_pwb} |
[Tabela 1. Usuários]

{#exploring-service-reliability-management__table_ayk_qqd_pwq}

Para obter mais informações, consulte [SRM funções e responsabilidades](https://servicenow-prod.fluidtopics.net/rridNYY5DW73W_hg7ddNbw "As funções concedem aos usuários acesso a diferentes partes do console da SRM. As funções determinam as ações que os usuários podem ou não executar em Gestão de confiabilidade de serviços.").

## Fluxo de trabalho do SRM {#exploring-service-reliability-management__cf-exploring-parent-workflow}

1. As equipes de produto em TI ou linhas de negócios fornecem continuamente novos serviços técnicos e de aplicações. Exemplo: novo portal de faturamento do cliente.
2. Junto com Gestão de SLO, as equipes têm acesso para se implementarem no SRM para registrar esses serviços e definir objetivos de nível de serviço (SLO) para garantir resultados de negócios. Exemplo: disponibilidade mensal de 95% para o portal de faturamento.
3. As integrações de monitoramento são configuradas pelas equipes para coletar a integridade em tempo real desses serviços. Exemplo: observabilidade de nuvem.
4. O monitoramento cria alertas de impacto do indicador de nível de serviço (SLI) quando os serviços estão com desempenho insuficiente. A automação agrupa e aprimora. Exemplo: a latência do portal de faturamento excede 7 s.
5. Quando os alertas indicam uma indisponibilidade ou uma degradação que afeta o cliente, os incidentes são criados e as notificações de plantão notificam os recursos da equipe apropriados. Exemplo: uma equipe de SRE de faturamento é notificada por telefone sobre um problema de latência no portal de faturamento.
6. Depois que os incidentes são diagnosticados e corrigidos de forma colaborativa, os itens de ação para melhorar a resiliência são capturados. Exemplo: a equipe de faturamento decide adicionar mais capacidade ao servidor web.
7. A gestão revisa continuamente o desempenho do SLO, ajuda a evitar mudanças quando o limite de erros está esgotado e prioriza iniciativas de melhoria para serviços com desempenho insuficiente.
{#exploring-service-reliability-management__cf-exploring-parent-workflow-ol}

## Benefícios das SRM {#exploring-service-reliability-management__cf-exploring-parent-benefits}

{#exploring-service-reliability-management__table_mlp_szc_4bc__entry__3}

| Benefício | Recurso | Usuários |
|-|-|-|
| Experiência baseada em equipe | [Trabalhando com equipes da SRM](https://servicenow-prod.fluidtopics.net/m_MWEQz7IVGPhGgmsJhqYQ "Gerencie cronogramas e defina políticas de escalação para sua equipe. Dessa forma, sua equipe vê quem está de plantão e responsável e pode ter a confiança de que alertas ou incidentes críticos são confirmados em tempo hábil.") | Respondente, gerente e administrador de confiabilidade de serviço |
| Registro de serviço | [Como trabalhar com serviços da SRM](https://servicenow-prod.fluidtopics.net/j_~gGN92Dz~H_k9GfuBf6g "Um serviço representa um resultado funcional, como rede, pagamentos ou serviços de RH, que pertence a uma equipe. Para entregar esse resultado, o serviço pode conter um ou mais componentes técnicos, como um serviço de autenticação de usuário, ou uma infraestrutura compartilhada, como um banco de dados.") | Respondente, gerente e administrador de confiabilidade de serviço |
| Integrações pré-criadas | [Trabalhando com integrações da SRM](https://servicenow-prod.fluidtopics.net/RUMj~sj6HaBtCrsJy2F50A "As integrações dentro da SRM fornecem a capacidade de usar ferramentas de monitoramento e colaboração a fim de gerenciar alertas e incidentes de maneira eficiente pelos usuários. As integrações de SRM são adicionadas ou criadas apenas nos Serviços.") | Respondente, gerente e administrador de confiabilidade de serviço |
| Medir a integridade do serviço | [Trabalhando com o Métricas de confiabilidade](https://servicenow-prod.fluidtopics.net/yTCP9WaH5dCBuvxDMGVLKA "Use as métricas de confiabilidade SRM para definir indicadores de nível de serviço (SLI), objetivos de nível de serviço (SLO) e políticas de orçamento de erro para rastrear a integridade do serviço e tomar as medidas necessárias.") | Respondente, gerente e administrador de confiabilidade de serviço |
| Cobertura de plantão | [Criar programação de plantão da SRM](https://servicenow-prod.fluidtopics.net/bOdkt0CB5B3ZMyjSMEDW_w "Configure uma programação de plantão para sua equipe para que um membro da equipe esteja disponível para responder rapidamente a incidentes e alertas críticos. Os cronogramas de plantão determinam quem está de plantão ou disponível em um determinado horário.") | Respondente, gerente e administrador de confiabilidade de serviço |
| Corrigir incidentes e alertas de gravidade alta | [Trabalhando com tarefas de confiabilidade SRM](https://servicenow-prod.fluidtopics.net/VV3Fi8ZroE1dnrUBlQlSMw "Alertas, incidentes e solicitações de mudança são tarefas de confiabilidade. Da criação à resolução, a SRM permite que você gerencie seus alertas durante todo o ciclo de vida de resposta.") | Respondente, gerente e administrador de confiabilidade de serviço |
[Tabela 2. Benefícios da SRM]

{#exploring-service-reliability-management__table_mlp_szc_4bc}

## O que explorar a seguir {#exploring-service-reliability-management__cf-exploring-parent-links}

Para saber mais sobre como configurar e usar a SRM, consulte:

* [Configuração do Gestão de confiabilidade de serviços](https://servicenow-prod.fluidtopics.net/50UuQFfkfGvCQNcSDIUwfw "Configurar Gestão de confiabilidade de serviços envolve instalá-lo a partir do ServiceNow Store ou da Central de administração, atribuir administradores de SRM e importar serviços e equipes.")
* [Como usar o Gestão de confiabilidade de serviços](https://servicenow-prod.fluidtopics.net/IU6vcIBePAQfmdBCi1Kw3A "SRM O permite que você registre serviços, monitore a integridade do serviço, responda a degradações de serviço com turnos de plantão e políticas e gatilhos de escalação e integre equipes distribuídas com governança mínima da TI central.")
* [Referência Gestão de confiabilidade de serviços](https://servicenow-prod.fluidtopics.net/LU3rOlQHGKoqW47kMJ5VMA "Os tópicos de referência apresentam informações adicionais sobre a administração do Gestão de confiabilidade de serviços.")
{#exploring-service-reliability-management__ul_nlp_szc_4bc}
* **[Comece a usar a Gestão de confiabilidade de serviços](https://servicenow-prod.fluidtopics.net/yrfnFN_KM_3G07mkiR7f_w)**   
  SRM acelera seu caminho para visualizar a integridade do serviço no contexto dos objetivos de nível de serviço e da resolução de incidentes. Ajuda as equipes de operações de TI e DevOps a cumprir a promessa de agilidade, desempenho e tempo de atividade.
* **[Espaço do alerta do SRM](https://servicenow-prod.fluidtopics.net/JoojGGEOd_qR0nS1zxBcZA)**   
  O espaço do alerta contém várias áreas com dados do alerta e ações possíveis.
* **[Espaço do incidente da SRM](https://servicenow-prod.fluidtopics.net/NTPujSOcseZ~ufYE3qAOfw)**   
  O espaço do incidente contém vários painéis com detalhes do incidente e ações possíveis.

