Home›Perspectivas›Artigos›Gestão delegada de infraestrutura de TI: como operar 24/7 sem engenheiros no local

Blog · Serviços gerenciados · Infraestrutura

Gestão delegada de infraestrutura de TI: como operar 24/7 sem engenheiros no local

Centenas de máquinas virtuais, mais de 300 bancos de dados e dois centros de dados, operados de forma 100 % remota. O que aprendemos ao administrar a infraestrutura de uma firma de serviços profissionais Big Four na América Latina.

O tamanho do desafio

O escopo do serviço dá uma ideia da complexidade que envolve operar uma infraestrutura corporativa moderna:

  • 484 máquinas virtuais VMware , das quais 369 estão em produção.
  • 9 servidores físicos x86 distribuídos entre o site principal e o de recuperação de desastres (DRP).
  • 5 sistemas de armazenamento IBM FlashSystem .
  • Mais de 300 bancos de dados SQL Server e MongoDB administrados.

A isso se soma um ambiente multiplataforma — VMware, Windows, Linux, IBM Power e IBM FlashSystem — que exige especialistas distintos para cada camada. Cobrir tudo isso com pessoal próprio, em turnos de 24 horas, nos 365 dias do ano, requer uma equipe considerável e difícil de reter.

O que significa realmente "gestão delegada"

Delegar a infraestrutura não é o mesmo que terceirizar o suporte técnico. Num modelo de gestão delegada, o fornecedor assume a responsabilidade pela operação diária: monitora, detecta, atende, escala, documenta e reporta. O cliente mantém o controle estratégico e a visibilidade, mas deixa de carregar o trabalho operacional.

Para que funcione, o modelo precisa de quatro peças:

  • Um centro de operação permanente que vigie a infraestrutura 24 horas por dia.
  • Processos padronizados , idealmente baseados em marcos reconhecidos como o ITIL.
  • SLA definidos por criticidade , para que cada incidente receba a atenção que o seu impacto exige.
  • Rastreabilidade : o cliente deve poder ver o que aconteceu, quando e o que foi feito.
A gestão delegada funciona quando o cliente sabe exatamente o que está acontecendo na sua infraestrutura, sem ter de operá-la.
Equipe de Serviços Gerenciados, Redsis

Como operamos: o modelo por trás do serviço

Neste cliente, a Redsis presta o serviço por meio do seu Centro de Atendimento ao Cliente (CAC), que opera sob as práticas do ITIL com monitoramento 24/7/365. Os incidentes são classificados por criticidade e os de nível 1 têm um tempo de resposta de 15 minutos.

A classificação por criticidade é uma prática central do ITIL: a prioridade de um incidente é determinada combinando o seu impacto — quantos usuários ou serviços afeta — com a sua urgência — com que rapidez o dano cresce. Um servidor de testes fora do ar não pesa o mesmo que um banco de dados de produção inacessível, e o SLA deve refletir isso.

Todo o serviço é 100 % remoto, sem engenheiros no local. O cliente tem acesso a um portal de autoatendimento e recebe relatórios mensais de gestão, o que lhe dá rastreabilidade completa sobre a operação.

Cinco lições para delegar a infraestrutura sem perder o controle

1. Inventariar antes de assinar

Um bom serviço gerenciado começa com um inventário preciso: quantas máquinas virtuais, quantas em produção, quais servidores, qual armazenamento, quantos bancos de dados e em quais motores. Sem esse ponto de partida, os SLA são negociados às cegas.

2. Definir a criticidade com o negócio

A matriz de prioridades não é decidida pela TI sozinha. É preciso acordar com as áreas de negócio quais serviços são críticos e qual impacto cada um tem. Esse acordo é o que permite comprometer, por exemplo, uma resposta de 15 minutos para os incidentes de nível 1.

3. Tratar a contingência como parte da operação

O site de recuperação de desastres não é um seguro que se revisa uma vez por ano. Neste cliente, a cobertura inclui tanto o site principal quanto o DRP, de modo que a continuidade do negócio faz parte do serviço diário e não de um plano guardado numa gaveta.

4. Aproveitar as capacidades da plataforma

O armazenamento moderno faz parte do trabalho. O IBM FlashSystem, por exemplo, inclui detecção de ransomware baseada em IA, cópias imutáveis ( Safeguarded Copy ), replicação de dados e administração centralizada de múltiplos sistemas por meio do IBM Storage Virtualize. Um operador que conhece a fundo essas capacidades pode usá-las para fortalecer a proteção e a continuidade.

5. Medir e mostrar

Um SLA que não é reportado não existe. O portal de autoatendimento e os relatórios mensais de gestão transformam a operação em algo auditável: o cliente pode verificar o cumprimento, identificar tendências e tomar decisões informadas sobre a sua infraestrutura.

O resultado: infraestrutura de missão crítica com menos custo operacional

Hoje a firma conta com uma operação de infraestrutura 24/7/365 sob o ITIL, com SLA por criticidade e resposta em 15 minutos para incidentes de nível 1, cobertura dos seus sites principal e DRP e um ambiente multiplataforma administrado de ponta a ponta. Tudo sem engenheiros no local, com menor custo operacional do que uma equipe interna dedicada e com rastreabilidade total por meio do portal de autoatendimento e dos relatórios mensais.

Para a Redsis, este serviço demonstra algo importante: um modelo de gestão delegada escalável e replicável para grandes contas empresariais, capaz de operar infraestrutura de missão crítica com SLA auditáveis.

Por onde começar?

Se a sua equipe de TI dedica a maior parte do seu tempo a manter a infraestrutura funcionando, se cobrir as noites e os fins de semana é um problema recorrente ou se você não tem uma visão clara do cumprimento dos seus próprios níveis de serviço, vale a pena avaliar um modelo de gestão delegada. Na Redsis combinamos mais de 25 anos de experiência em infraestrutura para a região, parcerias com IBM (Platinum) e Cisco (Premier), e um Centro de Atendimento ao Cliente que opera sob o ITIL 24 horas por dia.

Leia o caso completo

Conheça como a Redsis opera a infraestrutura de TI de uma firma de serviços profissionais Big Four.

Ver caso de sucessoFalar com um especialista