☕ Um Café no Bellacosa Mainframe
Gostou do conteúdo? Ajude a manter o café quente, o COBOL compilando e o mainframe acordado. 😄
☕ Pague um café ao Bellacosa

Translate

Mostrar mensagens com a etiqueta Fatores Humanos. Mostrar todas as mensagens
Mostrar mensagens com a etiqueta Fatores Humanos. Mostrar todas as mensagens

segunda-feira, 15 de fevereiro de 2016

Out-of-the-Loop Performance Problem: Doctor Who, COBOL e o Dia em que a Automação Devolveu o Volante — Mas o Humano Já Não Sabia em que Estrada Estava

 

Bellacosa Mainframe e out-of-the-loop

☕ Um Café no Bellacosa Mainframe

Out-of-the-Loop Performance Problem: Doctor Who, COBOL e o Dia em que a Automação Devolveu o Volante — Mas o Humano Já Não Sabia em que Estrada Estava

Uma viagem pela TARDIS dos incidentes para entender por que operadores que passam tempo demais fora do controle ativo podem perder consciência situacional, habilidade manual e velocidade de reação — justamente até o momento raro em que a automação falha e exige que eles assumam tudo de volta

Domingo.

03:47.

Produção.

O turno estava:

tranquilo demais.

Daqueles turnos em que:

o dashboard parecia:

meditar.

PAYMENTS-X

STATUS:
GREEN

AUTOMATION:
ACTIVE

SELF-HEALING:
ENABLED

INCIDENTS LAST 24H:
0

Nosso jovem programador COBOL toma café.

Ao lado:

um operador.

Mais ao lado:

um analista.

Ninguém está:

preocupado.

Por quê?

Porque:

a automação cuida.

Ela:

detecta.

Classifica.

Prioriza.

Executa.

Escala.

Registra.

Fecha.

Há meses.

Talvez anos.

03:49.

Uma janela aparece:

AUTOMATION DEGRADED

MANUAL CONTROL REQUIRED

Silêncio.

Operador:

— Manual?

Nosso jovem:

— Sim.

— Agora?

— Parece que sim.

— O que exatamente precisamos assumir?

Silêncio.

O analista abre:

o runbook.

MANUAL RECOVERY PROCEDURE
LAST UPDATED:
2023-11-14

Nosso jovem:

— Estamos em 2026.

Operador:

— Eu sei.

— Você já executou isso?

— Não.

— Nunca?

— Quando entrei, já era automático.

Ah.

Lá está.

Uma das frases mais deliciosamente assustadoras da modernidade:

“Quando eu entrei, já era automático.”

VWORP.

VWORP.

VWORP.

A TARDIS aparece no canto da War Room.

A porta abre.

O Doctor sai.

Olha:

para a mensagem.

Depois:

para o runbook.

Depois:

para o operador.

— Você sabe o estado atual do sistema?

— Mais ou menos.

— Quais ações a automação executou nos últimos dez minutos?

— Não sei.

— Qual fila está mais pressionada?

— O dashboard resumido não mostra.

— Qual componente está em failover?

— Acho que o AOR 3.

— Acha?

— O sistema normalmente decide isso.

Doctor:

— Então você está autorizado a assumir o controle...

Pausa.

...mas cognitivamente já não está dentro do sistema.

Ele pega um marcador.

Escreve:



OUT-OF-THE-LOOP PERFORMANCE PROBLEM

E embaixo:

“Quando a automação mantém o humano fora do controle ativo por tempo suficiente para degradar sua consciência situacional e sua capacidade de reassumir rapidamente quando algo dá errado.”

Nosso jovem:

— Então é consequência da Automation Complacency?

Doctor:

— Frequentemente.

— Deskilling?

— Também.

— Situation Awareness Loss?

— Com certeza.

— Mode Confusion?

— Agora você está começando a montar o monstro.


🧠 O que é o Out-of-the-Loop Performance Problem?

O Out-of-the-Loop Performance Problem descreve uma dificuldade típica de sistemas altamente automatizados:

o humano deixa de:

executar diretamente;

acompanhar detalhes;

tomar decisões frequentes;

manipular controles;

formar continuamente um modelo mental atualizado.

Enquanto tudo funciona:

ótimo.

Mas quando a automação:

falha;

degrada;

entra em estado inesperado;

pede intervenção;

entrega o controle,

o humano precisa:

entender rapidamente:

o que aconteceu,

o que está acontecendo,

o que a automação já fez,

o que ainda pode acontecer

e:

qual ação deve tomar.

Só que ele:

estava fora do loop.


☕ Definição Bellacosa

Out-of-the-Loop Performance Problem é quando o sistema devolve o teclado para o humano e descobre que o humano já não tem contexto suficiente para saber onde apertar Enter.


💻 COBOL cognitivo

Imagine:

       IF AUTOMATION-STATUS = 'OK'
           MOVE 'PASSIVE'
             TO HUMAN-ROLE
       END-IF.

Durante meses.

Então:

       IF AUTOMATION-STATUS = 'FAILED'
           MOVE 'FULL-CONTROL'
             TO HUMAN-ROLE
       END-IF.

Problema:

a variável mudou.

A competência não.


🧠 Controle formal não é controle cognitivo

Isso é central.

Você pode ter:

permissão;

acesso;

botão;

runbook;

console.

E ainda:

não ter:

consciência situacional.


🎯 Pergunta Bellacosa nº 1

“A pessoa tem controle técnico ou entende suficientemente o estado atual para usá-lo?”


🧠 Situation Awareness

Aqui entra um conceito fundamental:

consciência situacional.

Para operar bem:

você precisa saber:

  1. O que está acontecendo.

  2. O que significa.

  3. O que provavelmente acontecerá em seguida.

Se automação:

oculta muita coisa,

o humano pode perder:

essas três camadas.


☕ Dashboard resumido

pode:

mostrar:

“GREEN”.

Mas não:

ensinar:

como chegamos:

até ali.


🎯 Pergunta Bellacosa nº 2

“A interface mostra apenas o estado final ou também o caminho que levou até ele?”


🧠 Automação como compressão

Automação:

resume complexidade.

Isso é bom.

Ela transforma:

200 eventos

em:

1 status.

Mas:

quanto maior a compressão,

mais difícil:

reconstruir o contexto

quando algo foge:

do esperado.


☕ O resumo é ótimo...

...até você precisar:

do detalhe que o resumo jogou fora.


👻 Easter Egg nº 1 — TARDIS Autopilot

TARDIS:

— AUTOPILOT ACTIVE.

Doctor:

— Excelente.

Horas depois:

AUTOPILOT FAILURE.
MANUAL FLIGHT REQUIRED.

Companion:

— Você sabe pilotar manualmente?

Doctor:

— Claro.

— Quando foi a última vez?

Doctor:

— Defina “última vez”.

— Ano?

— Década?

— Século?

Companion:

— Isso não me tranquilizou.


🧠 Out-of-the-Loop e Automation Complacency

Automation Complacency:

reduz vigilância.

Out-of-the-Loop:

reduz capacidade de assumir.

A sequência:

AUTOMATION WORKS WELL
↓
HUMAN MONITORS LESS
↓
HUMAN ACTS LESS
↓
CONTEXT FADES
↓
SKILL FADES
↓
AUTOMATION FAILS
↓
HUMAN MUST TAKE OVER
↓
PERFORMANCE DROPS

🎯 Pergunta Bellacosa nº 3

“Quanto tempo a equipe consegue ficar fora do controle ativo antes de perder fluência operacional?”


🧠 Deskilling

Quanto mais:

automação executa,

menos:

humano pratica.

Esse ponto:

merece café duplo.

Porque:

conhecimento não usado:

atrofia.


☕ Você pode:

saber teoricamente.

Mas:

não ter:

velocidade.


🧠 Em produção

velocidade importa.

Saber:

“acho que lembro”

não é igual:

a:

“faço isso toda semana.”


🎯 Pergunta Bellacosa nº 4

“A equipe sabe fazer ou apenas lembra que um dia soube?”


🧠 Manual fallback ilusório

Muitas arquiteturas desenham:

“manual fallback.”

Maravilhoso no documento.

Mas:

manual fallback não existe de verdade

se:

ninguém pratica.


☕ Um procedimento de emergência não testado

é:

fan fiction operacional.


🎯 Pergunta Bellacosa nº 5

“O fallback manual foi usado recentemente em condições realistas?”


🧠 Runbook envelhecido

Nosso exemplo:

runbook de 2023.

Sistema:

Arquitetura:

mudou.

Nomes:

mudaram.

Thresholds:

mudaram.

Permissões:

mudaram.


☕ O runbook não envelheceu.

O mundo:

passou por ele.


🎯 Pergunta Bellacosa nº 6

“O procedimento manual foi validado depois das últimas mudanças relevantes?”


🧠 Out-of-the-Loop e Mode Confusion

Agora:

fica interessante.

Automação pode operar:

em modos diferentes.

AUTO.

MANUAL.

PARTIAL.

DEGRADED.

FAILSAFE.

SHADOW.

O operador:

acha:

AUTO.

Sistema:

está:

PARTIAL.

Ou:

acha:

MANUAL.

Mas:

um subsistema ainda:

auto age.


☕ Isso é Mode Confusion.

E é:

veneno.


🎯 Pergunta Bellacosa nº 7

“O operador sabe exatamente em qual modo cada parte do sistema está?”


🧠 Automation Surprise

Outra conexão.

O humano vê:

ação inesperada.

“Por que o sistema fez isso?”

Resposta:

porque:

um modo,

uma regra,

um threshold

ou:

uma dependência

mudou.


☕ Automação surpreendente

quase sempre:

é pior

quando:

o humano já estava:

fora do loop.


🎯 Pergunta Bellacosa nº 8

“Quando a automação age inesperadamente, conseguimos explicar rapidamente por quê?”


🧠 Passive Monitoring Problem

Transformar:

especialista

em:

espectador.

Parece:

eficiente.

Mas:

é cognitivamente estranho.

O profissional:

não participa.

Só:

vigia.


☕ Você contratou:

um piloto

e:

mandou ele assistir:

o avião voar sozinho.

Depois:

quer desempenho perfeito

na emergência.


🎯 Pergunta Bellacosa nº 9

“O papel humano é ativo o suficiente para manter compreensão do sistema?”


🧠 Out-of-the-Loop e Vigilance Decrement

Se humano:

só observa,

eventos raros:

ficam difíceis:

de detectar.

Além disso:

quando finalmente acontecem,

a pessoa:

não está pronta:

para assumir.

Duplo risco.


🧠 Primeiro:

não percebe.

Depois:

percebe tarde.

Depois:

age devagar.


☕ Bela sequência.

Para postmortem:

péssima.


🎯 Pergunta Bellacosa nº 10

“A automação está pedindo ao humano para ser excelente exatamente no momento em que menos pratica?”


🧠 Human-in-the-Loop Paradox

Adorável conceito.

Dizemos:

“há humano no loop.”

Mas:

na prática,

a automação resolve:

99,9%.

Humano:

só entra:

nos 0,1%.

Só que:

esse 0,1%

é:

o caso:

mais raro;

mais complexo;

mais ambíguo;

mais perigoso.


☕ O humano não:

fica com:

o fácil.

Fica:

com o pedaço que:

a máquina desistiu.

Excelente divisão de trabalho.


🎯 Pergunta Bellacosa nº 11

“Estamos entregando ao humano apenas os casos que são difíceis demais para a automação?”


🧠 Ironies of Automation

Essa ideia é clássica em fatores humanos:

quanto melhor:

a automação,

menos:

o humano participa.

Quanto menos participa,

pior:

fica para assumir.

E quanto mais:

precisamos dele

quando a automação falha,

mais:

exigimos exatamente a habilidade

que deixamos:

atrofiar.


☕ Isso é quase poesia cruel.


🎯 Pergunta Bellacosa nº 12

“A automação está reduzindo justamente a habilidade humana que usamos como última camada de segurança?”


🧠 Out-of-the-Loop e Algorithmic Deference

Se humano:

acostuma a:

ceder,

ele também:

para de formar:

hipóteses independentes.

Quando:

sistema falha,

ele não tem:

modelo alternativo.


☕ Primeiro:

“a máquina deve saber.”

Depois:

“a máquina não sabe.”

E então:

“agora quem sabe?”

Silêncio.


🎯 Pergunta Bellacosa nº 13

“A equipe ainda forma modelos mentais próprios ou apenas acompanha o modelo automatizado?”


🧠 Out-of-the-Loop e Algorithmic Authority

Se sistema:

tem autoridade,

humano pode:

desengajar mais.

Porque:

“não sou eu quem decide.”

Depois:

em emergência,

autoridade volta:

para humano.

Mas:

responsabilidade volta mais rápido:

que contexto.


☕ O crachá chega:

antes do conhecimento.


🎯 Pergunta Bellacosa nº 14

“Quando a autoridade retorna ao humano, o contexto retorna junto?”


🧠 Não automaticamente.

Esse é o problema.


🧠 Out-of-the-Loop e Automation Bias

Humano:

acostuma:

“se a máquina não alertou, tudo bem.”

Quando:

ela degrada,

ele ainda interpreta:

silêncio:

como normalidade.


🎯 Pergunta Bellacosa nº 15

“A equipe continua confiando na saída mesmo depois de a própria automação informar degradação?”


🧠 Isso acontece

Porque:

confiança:

tem inércia.


☕ Status operacional muda em segundos.

Confiança humana:

às vezes:

demora minutos.

Ou:

meses.


🧠 Out-of-the-Loop e Normalcy Bias

Automação:

falhou.

Humano:

“provavelmente algo pequeno.”

Porque:

não tem:

contexto.

Normalcy:

preenche:

o vazio.


🎯 Pergunta Bellacosa nº 16

“A falta de contexto está sendo substituída pela suposição de que nada mudou muito?”


🧠 Action Bias depois

Agora:

panic.

Sem modelo mental.

Humano:

quer fazer:

alguma coisa.

Restart.

Failover.

Rollback.

Big actions.


☕ Out-of-the-loop

pode terminar em:

Action Bias.


🧠 Sequência Bellacosa

OUT OF LOOP
↓
LOW CONTEXT
↓
LATE RECOGNITION
↓
PANIC
↓
ACTION BIAS
↓
OVERREACTION

🎯 Pergunta Bellacosa nº 17

“Estamos fazendo uma ação grande porque entendemos o sistema ou porque precisamos recuperar sensação de controle?”


🧠 Mainframe agora

Vamos trazer:

para o nosso quintal.

Imagine:

CICSplex.

Automation:

balanceia regions.

Reinicia AOR.

Move workload.

Abre ticket.

Resolve:

storage pressure.

Tudo:

automático.

Junior:

nunca:

fez isso manualmente.

Um dia:

automation manager:

cai.

Agora:

quem sabe:

qual AOR está:

em condição ruim?

Qual:

é safe to recycle?

Qual transaction class:

está saturada?

Qual:

impacto de tirar região?


☕ O sistema ficou:

mais fácil de operar...

...até:

não estar.


🎯 Pergunta Bellacosa nº 18

“A equipe entende a topologia por trás da automação?”


🧠 WLM

WLM:

faz:

muita coisa.

Operador:

não precisa:

tunar manualmente:

a cada segundo.

Ótimo.

Mas:

deve:

entender:

service classes,

goals,

importance,

velocity,

response time,

periods.

Senão:

quando comportamento:

parece estranho,

não sabe:

interpretar.


☕ Automação madura

não elimina:

modelo mental.

Ela:

muda:

onde o modelo mental:

é usado.


🎯 Pergunta Bellacosa nº 19

“Quem opera a automação entende os princípios que ela automatizou?”


🧠 JES2 e scheduler

Scheduler:

dependency.

Restart.

Calendar.

Predecessor.

Automatic rerun.

Great.

Mas:

job falha:

de modo raro.

Scheduler:

degraded.

Operator:

precisa:

entender JCL.


🧠 COBOL beginner alert

Você precisa saber:

DISP;

restartability;

COND;

IF/THEN/ELSE;

step dependencies;

GDG;

dataset states.

Porque:

um dia:

o scheduler:

não será:

seu professor.


🎯 Pergunta Bellacosa nº 20

“A automação está fazendo algo que o operador nunca precisou aprender por baixo?”


🧠 MQ

Automation:

restarts consumers.

Handles:

queue depth.

One day:

poison message.

Retry loop.

System:

cannot recover.

Human:

needs:

understand:

backout,

DLQ,

message semantics,

idempotency.


☕ A automação conhece:

o padrão.

O operador precisa:

entender:

a exceção.


🎯 Pergunta Bellacosa nº 21

“Temos competência humana para os modos de falha que a automação não cobre?”


🧠 Db2

Auto tuning.

Monitoring.

Advisors.

Great.

But:

rare lock scenario.

Need:

understand:

transactions,

locks,

isolation,

commit,

deadlock.


🎯 Pergunta Bellacosa nº 22

“O time sabe interpretar o mecanismo, não apenas o score?”


🧠 Out-of-the-Loop e abstração

Toda automação:

cria:

abstração.

Abstração:

é:

boa.

Mas:

cada camada:

distancia:

operador

do mecanismo.


☕ Quanto mais alta:

a abstração,

mais importante:

saber:

quando descer:

um nível.


🎯 Pergunta Bellacosa nº 23

“Conseguimos fazer drill-down rápido até o nível onde a falha realmente existe?”


🧠 Dashboard problem

Dashboard:

summary.

Need:

raw.

Logs.

Metrics.

Trace.

SDSF.

SMF.


☕ Se o humano está:

out of loop,

o drill-down:

não pode:

ser arqueologia.


🧠 Out-of-the-Loop e documentação

Automação:

faz:

processo.

Docs:

pararam.

Agora:

script:

é:

a única documentação.


🎯 Pergunta Bellacosa nº 24

“Existe documentação do porquê, ou apenas código do que?”


🧠 Porque:

quando script falha,

você precisa:

intenção.


🧠 Out-of-the-Loop e Knowledge Debt

Muito.

Especialista:

codifica:

automation.

Sai.

Time:

usa.

Anos.

Ninguém:

sabe:

lógica.

A automação:

vira:

um bloco de conhecimento opaco.


☕ O runbook:

virou:

algoritmo.

E:

ninguém mais sabe:

ler a história.


🎯 Pergunta Bellacosa nº 25

“O conhecimento operacional existe fora da automação?”


🧠 Out-of-the-Loop e Cognitive Offloading

Humano:

terceiriza:

memória.

Decisão.

Sequência.

Calendário.

Checks.

Tudo:

para sistema.

Bom.

Mas:

se externalizamos:

tudo,

o cérebro:

não mantém:

representação.


☕ Externalizar memória:

é produtividade.

Externalizar compreensão:

é risco.


🎯 Pergunta Bellacosa nº 26

“O que estamos terceirizando: execução ou entendimento?”


🧠 Um excelente filtro

Automatize:

o repetitivo.

Preserve:

o raciocínio crítico.


🧠 Out-of-the-Loop e treinamento

Júnior:

entra.

Tudo automático.

Nunca:

vê:

modo manual.

Então:

experiência:

não acumula.


☕ O veterano aprendeu:

apagando incêndio.

O júnior moderno pode:

aprender:

vendo dashboard verde.

Não é:

a mesma escola.


🎯 Pergunta Bellacosa nº 27

“Como o iniciante aprende os modos de falha se a automação impede que ele os veja?”


🧠 Shadowing

Uma solução:

training mode.

Simulação.

Replay de incidentes.

Chaos.

Game days.


☕ Se produção não:

ensina mais,

o laboratório precisa:

ensinar.


🧠 Out-of-the-Loop e simulation

Simulações:

excelentes.

Reproduza:

automation failure.

Manual takeover.

Context reconstruction.


🎯 Pergunta Bellacosa nº 28

“Treinamos a transição do modo automático para o manual?”


🧠 Isso é diferente de:

treinar:

manual isolado.

Porque:

o difícil:

é:

a transição.


☕ Não basta saber:

pilotar.

Precisa saber:

assumir:

quando o avião já está:

em condição ruim.


🧠 Handoff automático → humano

Deve:

fornecer:

context packet.

Exemplo:

AUTOMATION HANDOFF

CURRENT MODE:
DEGRADED

LAST 10 ACTIONS:
1. RETRY CONSUMER
2. SHIFT TRAFFIC 10%
3. RESTART AOR-2

CURRENT RISKS:
MQ DEPTH RISING

UNRESOLVED:
ACK LATENCY

RECOMMENDED HUMAN CHECKS:
- NETWORK
- RETRY LOOP
- DOWNSTREAM ACK

Isso:

é muito melhor.


🎯 Pergunta Bellacosa nº 29

“A automação entrega contexto quando entrega controle?”


🧠 Regra de ouro

Não transfira apenas autoridade. Transfira estado, histórico e intenção.


🧠 Out-of-the-Loop e audit trail

Se automação:

executou:

ações,

humano:

precisa saber:

quais.

Sem isso:

pode:

duplicar.

Undo.

Conflict.


☕ Human takeover sem history

é:

entrar:

numa partida de xadrez

no lance 37

sem ver:

as peças.


🎯 Pergunta Bellacosa nº 30

“O humano consegue reconstruir rapidamente o que a automação já fez?”


🧠 Out-of-the-Loop e observability

Automated action log:

deve:

ser visível.

Não:

em:

15 arquivos.


🎯 Pergunta Bellacosa nº 31

“As ações automáticas são observáveis como primeira classe?”


🧠 Muito importante

Não só:

system state.

Também:

automation behavior.


🧠 Out-of-the-Loop e explainability operacional

Não:

“AI decided.”

Precisa:

“why.”


🎯 Pergunta Bellacosa nº 32

“O sistema mostra o motivo da última ação automatizada?”


🧠 Context restoration

Quando humano assume:

precisa:

recuperar:

mental model.

Interface deve:

ajudar.


🧠 Situation snapshot

Component status.

Recent changes.

Actions.

Risks.

Pending.


☕ Handoff bom:

é:

uma compressão útil.

Não:

uma frase:

MANUAL CONTROL REQUIRED.


🧠 Out-of-the-Loop e time pressure

Se takeover:

precisa:

ser imediato,

design:

deve:

reduzir:

tempo de reentrada.


🎯 Pergunta Bellacosa nº 33

“Quanto tempo o humano precisa para ficar operacionalmente orientado?”


🧠 Time-to-Orient

Ótima métrica.

Talvez:

mais útil

que:

“human available.”


☕ Disponível não:

é:

pronto.


🧠 Out-of-the-Loop e failover

Auto failover:

great.

Manual takeover:

needs:

know:

who primary,

who secondary,

replication state,

data lag.


🎯 Pergunta Bellacosa nº 34

“O estado de redundância está claro no momento da transferência?”


🧠 Split-brain risk

Human:

may:

act:

wrong.


🧠 Out-of-the-Loop e backups

Automated.

When:

recovery:

human must:

know:

last good backup,

consistency,

restore sequence.


🎯 Pergunta Bellacosa nº 35

“A automação guarda um contexto de recuperação utilizável por humanos?”


🧠 Out-of-the-Loop e security

SOAR:

auto-containment.

Analyst:

rarely manual.

One day:

SOAR:

fails.

Attack:

ongoing.

Analyst:

needs:

contain.

But:

permissions?

Commands?

Routes?


☕ O atacante:

não espera:

o humano reaprender.


🎯 Pergunta Bellacosa nº 36

“O tempo para reaprender é menor que o tempo para o adversário causar dano?”


🧠 Excellent.


🧠 Out-of-the-Loop e AI agents

Agora:

moderno.

Agent:

handles:

tickets.

Diagnostics.

Fixes.

Humans:

review summaries.

One day:

agent:

stops.

Now:

human sees:

huge backlog.

No situational awareness.


☕ Um agente eficiente:

pode:

reduzir:

visibilidade humana

do trabalho real.


🎯 Pergunta Bellacosa nº 37

“O time consegue acompanhar o estado agregado mesmo quando o agente resolve tudo sozinho?”


🧠 Need:

exposure.


🧠 Out-of-the-Loop e permission boundaries

Agent:

has:

permissions.

Human:

maybe:

not.

When:

agent fails,

human can't:

do same.


☕ Excelente fallback:

“o robô fazia.”

Humano:

sem access.


🎯 Pergunta Bellacosa nº 38

“O humano possui acesso equivalente ao necessário para assumir?”


🧠 Huge governance issue.


🧠 Out-of-the-Loop e access rot

Accounts:

inactive.

Privileges:

revoked.

MFA:

not tested.

Manual account:

locked.


🎯 Pergunta Bellacosa nº 39

“O caminho manual funciona tecnicamente, inclusive permissões?”


🧠 Break-glass

Must:

test.


☕ Conta de emergência que:

nunca foi usada

pode:

ser:

decoração securitária.


🧠 Out-of-the-Loop e handoff design

A boa automação deveria:

prepare takeover.

Antes de:

falhar totalmente,

degraded mode:

involve human.


🎯 Pergunta Bellacosa nº 40

“O humano é chamado apenas depois da falha total ou já durante a degradação?”


🧠 Progressive engagement

Beautiful idea.


🧠 Example

Automation:

confidence falling.

Human:

notified.

Then:

observer mode.

Then:

approve.

Then:

manual.

Gradual.


☕ Melhor:

trazer o humano de volta:

aos poucos

do que:

jogar o volante:

no colo.


🧠 Out-of-the-Loop e authority ladder

Could:

decrease automation level:

progressively.


🎯 Pergunta Bellacosa nº 41

“A transição de autoridade é gradual ou abrupta?”


🧠 Abrupt:

worse.


🧠 Out-of-the-Loop e automation surprise together

Sudden:

“manual now.”

Bad.

Better:

“automation degraded; human prepare.”


🧠 Human readiness state

Maybe:

need:

on-call.


☕ O humano também:

precisa:

de:

warm standby.


🎯 Pergunta Bellacosa nº 42

“Temos um humano em warm standby ou apenas alguém teoricamente disponível?”


🧠 Delicious mainframe analogy

Hot standby human.

😂


🧠 Out-of-the-Loop e monitoring

Dashboard should:

show:

automation confidence,

mode,

coverage,

data freshness,

actions,

limitations.


🎯 Pergunta Bellacosa nº 43

“O operador consegue perceber que está ficando fora do loop?”


🧠 Meta-awareness

Important.


🧠 If operator:

doesn't know:

what automation handles,

he cannot:

know:

where skill decays.


🧠 Out-of-the-Loop e training metrics

Don't only:

measure:

automation uptime.

Measure:

manual takeover performance.


🎯 Pergunta Bellacosa nº 44

“Quanto tempo a equipe leva para assumir o controle durante um drill?”


🧠 Time-to-Takeover

Great KPI.


🧠 Another metric:

manual success rate.


🧠 Out-of-the-Loop e postmortem

After incident:

don't ask:

“why was operator slow?”

Ask:

  • How long out of loop?

  • What context unavailable?

  • Was manual flow practiced?

  • Was interface adequate?

  • Did permissions work?

  • Did automation explain previous actions?


🎯 Pergunta Bellacosa nº 45

“O problema foi falha humana ou falha de reentrada humana?”


🧠 This distinction:

very important.


☕ Um humano lento

pode:

ser:

efeito do design.


🧠 Out-of-the-Loop e blame

Hindsight:

“deveria ter assumido mais rápido.”

Mas:

system:

gave:

no context.

No practice.

No access.

Blame:

unfair.


🎯 Pergunta Bellacosa nº 46

“A organização criou condições reais para um takeover competente?”


🧠 Great.


🧠 Out-of-the-Loop e checklists

Takeover checklist:

valuable.

But:

must:

be:

short.

Contextual.

Current.


🧠 Bellacosa Manual Takeover Card

AUTOMATION MODE:
____________________

CURRENT SYSTEM STATE:
____________________

LAST 10 AUTOMATED ACTIONS:
____________________

UNRESOLVED RISKS:
____________________

PENDING ACTIONS:
____________________

MANUAL OWNER:
____________________

FIRST SAFE ACTION:
____________________

ROLLBACK POINT:
____________________

☕ Muito mais útil

que:

um PDF de 96 páginas.


🧠 Out-of-the-Loop e Alarm Fatigue

If:

takeover alert

sounds like:

normal alert,

human:

may:

not realize severity.

Need:

distinct signal.


🎯 Pergunta Bellacosa nº 47

“O pedido de takeover é claramente diferente de um alerta comum?”


🧠 Mode annunciation

Important.


🧠 Out-of-the-Loop e UI

Huge.

Mode:

must be:

obvious.


☕ Se o operador precisa:

clicar em três abas

para descobrir:

quem está controlando,

já perdeu.


🎯 Pergunta Bellacosa nº 48

“A interface deixa explícito quem está no controle agora?”


🧠 This should always:

visible.


🧠 Out-of-the-Loop e dual control confusion

Human assumes:

manual.

Automation still:

acts.

Conflict.


🎯 Pergunta Bellacosa nº 49

“Após takeover, a automação ainda pode executar ações independentes?”


🧠 Important.

Need:

clear.


🧠 Out-of-the-Loop e race conditions

Human:

undo.

Automation:

redo.

Chaos.


☕ Dois operadores:

um humano,

um software,

brigando:

pela mesma variável.

Excelente.


🎯 Pergunta Bellacosa nº 50

“Existe coordenação entre ação humana e automática durante transição?”


🧠 Out-of-the-Loop e control authority

Use:

token.

Lease.

Lock.

Single owner.


🧠 Mainframe people love:

serialization.


☕ War Room também:

precisa:

de ENQ.


🧠 Out-of-the-Loop e cognitive overload

When takeover:

human suddenly:

receives:

everything.

20 dashboards.

80 alerts.

Logs.

Tickets.

Too much.


🎯 Pergunta Bellacosa nº 51

“O sistema entrega contexto suficiente ou despeja toda a complexidade de uma vez?”


🧠 Good takeover design:

prioritized.


🧠 Out-of-the-Loop e information overload

Irony:

human had:

too little info.

Then:

too much.


☕ Primeiro:

cego.

Depois:

afogado.


🎯 Pergunta Bellacosa nº 52

“A transição oferece informação na ordem certa?”


🧠 Need:

What changed.

What risk.

What to do.


🧠 Out-of-the-Loop e Timeline

Timeline:

extremely useful.

Because:

reconstructs:

context.


🎯 Pergunta Bellacosa nº 53

“Temos uma timeline automática legível por humanos?”


🧠 Yes.


🧠 Out-of-the-Loop e RCA

After:

capture:

takeover delay.

Why.


🧠 Out-of-the-Loop e near misses

If automation:

almost fails,

use:

training.


🎯 Pergunta Bellacosa nº 54

“Eventos de degradação estão sendo usados para manter humanos no loop?”


🧠 Could:

review.


🧠 Out-of-the-Loop e staffing

Automation:

allows:

fewer people.

Fine.

But:

need:

enough:

to:

take over.


🎯 Pergunta Bellacosa nº 55

“A equipe remanescente possui largura de banda para assumir múltiplos sistemas simultaneamente?”


🧠 Critical.

One automation platform:

fails.

Now:

20 systems:

need humans.

Staff:

Oops.


☕ Automation concentration risk.


🧠 Common mode failure in staffing

A single platform:

handles:

many.

If:

platform fails,

manual workload:

explodes.


🎯 Pergunta Bellacosa nº 56

“Qual volume manual aparece se uma camada comum de automação cair?”


🧠 Excellent capacity planning.


🧠 Out-of-the-Loop e disaster recovery

Need:

human capacity.


🧠 Out-of-the-Loop e cloud

Autoscaling.

Healing.

Managed services.

Engineers:

rarely touch.

Incident:

underlying.

Need:

skills.


☕ Cloud não:

remove:

Out-of-the-Loop.

Só:

troca:

o console.


🎯 Pergunta Bellacosa nº 57

“A abstração terceirizada reduziu também nossa capacidade de diagnóstico?”


🧠 Out-of-the-Loop e SaaS

Vendor:

operates.

Customer:

gets:

status page.

When:

outage:

little control.

Different:

but similar:

loss of situational awareness.


🧠 Out-of-the-Loop e AI coding

Copilot:

writes:

most code.

Dev:

less:

understands.

Bug:

complex.

Need:

take over.


☕ O código continua:

seu.

Mesmo:

se você nunca:

pensou:

cada linha.


🎯 Pergunta Bellacosa nº 58

“Se a ferramenta parar agora, consigo continuar o raciocínio técnico?”


🧠 This is central for juniors.


🧠 Out-of-the-Loop e learning

Good practice:

occasionally:

code without AI.

Debug:

manually.

Explain:

generated code.


🎯 Pergunta Bellacosa nº 59

“A equipe preserva exercícios sem automação para manter competência?”


🧠 Good.


🧠 Out-of-the-Loop e trust calibration

The goal:

not:

always manual.

Not:

always auto.

Need:

appropriate reliance.


☕ Automation should:

reduce toil,

not:

erase readiness.


🧠 Out-of-the-Loop e adaptive automation

Interesting solution:

vary:

automation level

to keep human:

engaged.

Not always:

fully auto.


🎯 Pergunta Bellacosa nº 60

“O nível de automação pode se adaptar para preservar consciência situacional?”


🧠 Adaptive automation

Examples:

human confirmation sometimes.

Random manual tasks.

Training.


🧠 But:

don't create:

toil artificially.

Need:

smart.


☕ Não queremos:

torturar operador

para:

“mantê-lo ocupado.”

Queremos:

mantê-lo:

capaz.


🧠 Out-of-the-Loop e active monitoring

Instead of:

watching green,

ask:

meaningful periodic questions.


🎯 Pergunta Bellacosa nº 61

“A supervisão humana exige decisões reais ou apenas presença?”


🧠 Important.


🧠 Out-of-the-Loop e game days

Schedule:

automation-off drills.

Test:

manual.


🎯 Pergunta Bellacosa nº 62

“Quando foi o último game day de perda de automação?”


🧠 If never:

now.


🧠 Out-of-the-Loop e simulation replay

Replay:

past incident.

Ask:

team:

take over.


🧠 Great training.


🎯 Pergunta Bellacosa nº 63

“Usamos incidentes passados como simuladores de reentrada?”


🧠 Excellent.


🧠 Out-of-the-Loop e documentation as executable

Runbook:

test.


🎯 Pergunta Bellacosa nº 64

“O runbook manual é testado como código ou apenas lido?”


🧠 Nice DevOps.


🧠 Out-of-the-Loop e rotation

Rotate:

manual ownership.

Not only:

one expert.


🎯 Pergunta Bellacosa nº 65

“Quantas pessoas conseguem executar o fallback?”


🧠 Bus factor.


🧠 Out-of-the-Loop e shadow manual mode

One interesting practice:

automation acts.

Human:

predicts:

what it will do.

Then:

compare.

Great for:

training.


🎯 Pergunta Bellacosa nº 66

“O operador consegue antecipar a próxima ação automática?”


🧠 If no:

mental model weak.


☕ Se a máquina sempre:

surpreende,

o humano:

não está:

no loop.


🧠 Out-of-the-Loop e explainability again

Need:

prediction.


🎯 Pergunta Bellacosa nº 67

“A automação é previsível para quem precisa supervisioná-la?”


🧠 Out-of-the-Loop e silent autonomy creep

Automation:

started:

simple.

Years:

more.

Humans:

didn't notice.

Now:

system:

does:

90%.


🎯 Pergunta Bellacosa nº 68

“Quanto do processo foi automatizado desde o último redesign do papel humano?”


🧠 Great organizational question.


🧠 Role drift

Human job:

changed

without:

training.


☕ O algoritmo recebeu:

novas tarefas.

O humano:

não recebeu:

novo manual.


🎯 Pergunta Bellacosa nº 69

“O papel humano foi redesenhado junto com a automação?”


🧠 Human factors crucial.


🧠 Out-of-the-Loop e accountability

If human:

cannot realistically:

supervise,

don't pretend:

he owns every decision.


🎯 Pergunta Bellacosa nº 70

“A responsabilidade formal corresponde à capacidade real de supervisão?”


🧠 Very important.


🧠 Out-of-the-Loop e Human-on-the-Loop

Sometimes:

not in loop.

On loop:

supervisory.

Need:

different design.


☕ Supervisor de automação

é:

profissão própria.

Não:

operador menos ocupado.


🎯 Pergunta Bellacosa nº 71

“Estamos treinando supervisores de automação ou apenas antigos operadores com menos tarefas?”


🧠 Great.


🧠 Out-of-the-Loop e meta-monitoring

Supervisor:

needs:

health of automation.


🎯 Pergunta Bellacosa nº 72

“O operador vê a saúde do sistema e a saúde do controlador?”


🧠 Two layers.


🧠 Out-of-the-Loop e active learning

Human overrides:

system learns.

Human:

also learns.

Need:

feedback.


🎯 Pergunta Bellacosa nº 73

“O humano recebe feedback sobre quando sua intervenção foi correta?”


🧠 If not:

skill calibration:

hard.


🧠 Out-of-the-Loop e confidence decay

Maybe:

manual certification expires.

Need:

drill.


☕ Se você não:

pilota há:

18 meses,

seu “sei fazer”

merece:

asterisco.


🎯 Pergunta Bellacosa nº 74

“Competência manual tem validade operacional ou é presumida para sempre?”


🧠 Great.


🧠 Out-of-the-Loop e certification

Could:

require:

periodic.


🧠 Out-of-the-Loop e takeover ergonomics

Interface:

manual controls:

hidden.

Why?

Auto first.

When fail:

humans:

struggle.


🎯 Pergunta Bellacosa nº 75

“O modo manual é usável sob pressão?”


🧠 This matters.


☕ Botão de emergência

não:

pode:

estar:

na página 7.


🧠 Out-of-the-Loop e permission escalation

Manual mode:

may require:

approval.

Time.

Need:

predefined.


🎯 Pergunta Bellacosa nº 76

“A burocracia do takeover é compatível com a urgência?”


🧠 Great.


🧠 Out-of-the-Loop e two-person rule

For:

dangerous actions,

yes.

But:

don't:

make impossible.


🧠 Out-of-the-Loop e workload transfer

Automation fails:

not one task.

Many.

Need:

prioritization.


🎯 Pergunta Bellacosa nº 77

“Qual é a ordem de prioridade quando o trabalho automatizado retorna de uma vez aos humanos?”


🧠 Great disaster planning.


🧠 Out-of-the-Loop e capacity reserve

Need:

human headroom.


☕ Assim como:

CPU,

humanos também:

precisam:

headroom.


🎯 Pergunta Bellacosa nº 78

“Existe capacidade humana reservada para contingência?”


🧠 Excellent analogy.


🧠 Out-of-the-Loop e over-automation

Some tasks:

should:

not:

fully automate

if:

human skill:

critical.

Maybe:

keep:

periodic manual.


🎯 Pergunta Bellacosa nº 79

“Há tarefas em que manter alguma participação humana vale mais que eliminar todo toil?”


🧠 Sometimes yes.


🧠 Out-of-the-Loop e trust

If:

manual fallback bad,

people:

may:

overtrust automation

because:

alternative weak.

This creates:

lock-in.


☕ Quanto pior:

o humano fica,

mais:

a máquina parece:

indispensável.

Loop.


🧠 Dependency cycle

MORE AUTOMATION
↓
LESS HUMAN PRACTICE
↓
WEAKER MANUAL PERFORMANCE
↓
MORE RELIANCE ON AUTOMATION
↓
MORE AUTOMATION

🎯 Pergunta Bellacosa nº 80

“Estamos melhorando a automação ou tornando a alternativa humana impossível?”


🧠 Deep.


🧠 Out-of-the-Loop e resilience

Resilience:

not:

never fail.

It's:

recover.

Human capability:

part of recovery.


☕ Automação é:

resiliência.

Humano preparado também.


🎯 Pergunta Bellacosa nº 81

“A arquitetura de resiliência inclui competência humana como componente explícito?”


🧠 Good.


🧠 Out-of-the-Loop e organizational memory

Store:

past manual operations.

Videos.

Docs.

Simulations.


🎯 Pergunta Bellacosa nº 82

“A memória operacional dos procedimentos raros está preservada?”


🧠 Great for mainframe.


🧠 Out-of-the-Loop e retired expertise

Senior retires.

Automation:

keeps.

Manual path:

dies.


☕ Sistema:

continua:

operando.

Capacidade de:

entender:

vai embora.


🎯 Pergunta Bellacosa nº 83

“A automação está mascarando perda de conhecimento crítico?”


🧠 Huge.


🧠 Out-of-the-Loop e modernization

Modernization often:

automation.

Good.

But:

legacy knowledge:

may vanish.

Need:

capture.


🎯 Pergunta Bellacosa nº 84

“Modernizamos operação sem preservar conhecimento causal do legado?”


🧠 Strong.


🧠 Out-of-the-Loop e AI ops

AI may:

explain:

incident.

If:

always,

humans:

stop:

learning diagnosis.

Need:

ask human first.


🎯 Pergunta Bellacosa nº 85

“A IA entra antes ou depois da primeira hipótese humana?”


🧠 Great training practice.


🧠 Out-of-the-Loop e replay

After incident:

hide AI.

Ask team:

reconstruct.

Then:

compare.


🧠 Out-of-the-Loop e supervision skill

New skill:

knowing:

when automation is:

wrong.

Need:

patterns.


🎯 Pergunta Bellacosa nº 86

“A equipe é treinada para reconhecer sinais de falha da própria automação?”


🧠 Key.


🧠 Out-of-the-Loop e error injection

Inject:

wrong recommendation

in drill.

See:

challenge.


🎯 Pergunta Bellacosa nº 87

“Já treinamos uma automação deliberadamente errada?”


🧠 Excellent.


🧠 Out-of-the-Loop e confidence in takeover

Human confidence:

low.

May:

hesitate.

Omission.


🎯 Pergunta Bellacosa nº 88

“A falta de prática está aumentando hesitação exatamente quando decisão rápida é necessária?”


🧠 Yes.


🧠 Out-of-the-Loop e Authority Gradient

Junior:

takes over.

System:

was automated by experts.

Feels:

intimidated.

Algorithmic Deference.


☕ O operador não:

discorda:

nem da automação quebrada.


🎯 Pergunta Bellacosa nº 89

“O humano se sente autorizado a contrariar um sistema que já está falhando?”


🧠 Amazing.


🧠 Out-of-the-Loop e recovery confidence

Need:

clear:

manual authority.


🧠 Out-of-the-Loop e control handback

After:

human stabilizes,

automation:

retakes.

Danger.

Need:

criteria.


🎯 Pergunta Bellacosa nº 90

“Quem decide quando a automação está pronta para reassumir?”


🧠 Important.


🧠 Handback can:

create:

oscillation.


☕ Tomada de controle

também:

precisa:

de rollback.


🧠 Out-of-the-Loop e oscillation

AUTO→MANUAL→AUTO→MANUAL.

Bad.

Need:

stability.


🎯 Pergunta Bellacosa nº 91

“Existe critério de estabilidade antes de devolver o controle?”


🧠 Great.


🧠 Out-of-the-Loop e incident commander

IC:

should:

know:

mode transitions.


🧠 Out-of-the-Loop e documentation of authority

Action log:

who controls.


🎯 Pergunta Bellacosa nº 92

“A timeline registra mudanças de autoridade entre humano e automação?”


🧠 Very useful.


🧠 Out-of-the-Loop e postmortem metrics

Could track:

  • Time-to-detect automation degradation

  • Time-to-orient

  • Time-to-takeover

  • Manual error rate

  • Time-to-stabilize

  • Time-to-handback


☕ Isso transforma:

“humano demorou”

em:

engenharia mensurável.


🎯 Pergunta Bellacosa nº 93

“Medimos o processo de reentrada ou apenas o tempo total do incidente?”


🧠 Great.


🧠 Out-of-the-Loop e Goodhart

Careful:

if optimize:

takeover speed,

humans may:

act too fast.

Need:

quality.


🎯 Pergunta Bellacosa nº 94

“Estamos medindo rapidez de takeover sem medir qualidade da decisão?”


🧠 Good connection.


🧠 Out-of-the-Loop e Action Bias again

Fast takeover KPI:

could:

cause:

rash action.


🧠 Balanced.


🧠 Out-of-the-Loop e Omission Bias

Too hesitant:

bad.

Need:

criteria.


🧠 Out-of-the-Loop e Trust Calibration

Humans should know:

when:

to trust automation.

When:

to prepare.

When:

to take.


🎯 Pergunta Bellacosa nº 95

“Existem thresholds claros para aumentar participação humana?”


🧠 Excellent.


🧠 Out-of-the-Loop e degraded mode

Most systems:

need:

degraded.

Not:

binary.


☕ Entre:

AUTO

e:

MANUAL

existe:

um universo:

chamado:

“estamos começando a desconfiar.”


🎯 Pergunta Bellacosa nº 96

“Temos um modo intermediário que traga o humano de volta antes da emergência?”


🧠 This may be one of best antidotes.


🧠 Out-of-the-Loop e progressive disclosure

Show more details:

as automation:

degrades.


🎯 Pergunta Bellacosa nº 97

“A interface aumenta a riqueza de contexto à medida que a automação perde confiança?”


🧠 Great design.


🧠 Out-of-the-Loop e human state

Could:

automation ask:

operator:

ack understanding?

Maybe.


🧠 But avoid:

checkbox theater.

Need:

active.


🎯 Pergunta Bellacosa nº 98

“O takeover exige uma confirmação cognitiva ou apenas um clique?”


🧠 Active confirmation:

“What is current primary?”

Could:

help.


🧠 Out-of-the-Loop e training simulator

Test.


🎯 Pergunta Bellacosa nº 99

“O operador consegue demonstrar compreensão do estado antes de assumir ações críticas?”


🧠 Great.


🎯 Pergunta Bellacosa nº 100

“Se a automação desaparecesse agora, quanto tempo levaríamos não apenas para agir, mas para entender suficientemente o sistema para agir sem piorá-lo?”

Essa:

é:

a pergunta definitiva.

Porque:

se a resposta for:

“não sabemos,”

então:

o problema não é apenas:

automação.

É:

dependência sem prontidão.


🧠 De volta à War Room

03:49.

AUTOMATION DEGRADED
MANUAL CONTROL REQUIRED

Agora:

não temos:

pânico.

Porque:

a equipe tinha:

novo procedimento.

Tela muda:

TAKEOVER SUMMARY

AUTOMATION MODE:
PARTIAL

LAST ACTIONS:
- SHIFTED 15% TRAFFIC
- RESTARTED AOR-2
- DISABLED RETRY POLICY X

CURRENT RISK:
MQ DEPTH +38%

UNOBSERVED:
ACK SERVICE

MANUAL OWNER:
APP-LEAD

NEXT SAFE CHECK:
VERIFY ACK SERVICE

Nosso jovem:

— Muito melhor.

Doctor:

— Por quê?

— Porque não me deram apenas o controle.

— O que deram?

— Contexto.


☕ Exatamente.


🧠 O operador verifica:

ACK service.

Problema:

downstream.

Traffic:

reroute.

Queue:

cai.

Service:

stabilizes.

Automation:

fica:

em:

manual-assist.

Depois:

health:

normal.

Critérios:

atendidos.

Automation:

reassume.


🧠 Ninguém:

precisou:

adivinhar.


☕ Gerente pergunta:

— Então o segredo é deixar humanos no loop o tempo todo?

Doctor:

— Não.

— Não?

— Se fizer isso, você destrói o benefício da automação.

— Então?

Nosso jovem:

“É manter o humano capaz de voltar ao loop.”

Doctor sorri.


🧠 Essa é a frase

Não precisamos que o humano faça tudo. Precisamos que ele consiga entender e assumir quando for necessário.


🧠 Bellacosa Rule

Automação madura reduz toil, mas preserva consciência, acesso, contexto e habilidade de recuperação.


🧠 Anti-Out-of-the-Loop Protocol

Passo 1 — Mapeie o que foi automatizado

O humano ainda sabe:

o que acontece?

Passo 2 — Defina modos explícitos

AUTO.

ASSISTED.

DEGRADED.

MANUAL.

Passo 3 — Mostre transições

Quem está:

no controle?

Passo 4 — Preserve action history

O que a automação:

já fez?

Passo 5 — Crie takeover summary

Estado.

Risco.

Últimas ações.

Passo 6 — Teste manual fallback

Regularmente.

Passo 7 — Treine reentrada

Não só:

modo manual.

Passo 8 — Faça game days

Automation unavailable.

Passo 9 — Meça time-to-orient

Não apenas:

MTTR.

Passo 10 — Planeje handback

Quando:

automação reassume?


📋 Checklist Bellacosa anti-Out-of-the-Loop

  • O modo atual do sistema está explícito?

  • Sabemos quem está no controle?

  • A automação registra suas ações?

  • O humano consegue reconstruir a timeline?

  • Existe resumo de takeover?

  • O manual fallback foi testado recentemente?

  • As permissões manuais funcionam?

  • O runbook está atualizado?

  • A equipe pratica procedimentos raros?

  • Existe modo degradado intermediário?

  • O humano recebe aviso antes da falha total?

  • Existe capacidade humana suficiente para takeover?

  • O time sabe operar sem o agente/copiloto?

  • Medimos time-to-orient e time-to-takeover?

  • Há critérios claros para devolver controle à automação?


🧠 Bellacosa Takeover Card

AUTOMATION:
____________________________

CURRENT MODE:
____________________________

HUMAN OWNER:
____________________________

LAST AUTOMATED ACTIONS:
____________________________

CURRENT SYSTEM STATE:
____________________________

KNOWN RISKS:
____________________________

UNKNOWN / BLIND SPOTS:
____________________________

FIRST MANUAL ACTION:
____________________________

ROLLBACK POINT:
____________________________

HAND-BACK CRITERIA:
____________________________

👻 Easter Egg nº 2 — BELLACOSA.BIAS(OUT-OF-LOOP)

       IF AUTOMATION-MODE = 'AUTO'
           PERFORM MAINTAIN-HUMAN-AWARENESS
       END-IF.

       IF AUTOMATION-MODE = 'DEGRADED'
           PERFORM PREPARE-HUMAN-TAKEOVER
       END-IF.

       IF AUTOMATION-MODE = 'MANUAL'
           PERFORM SHOW-LAST-AUTOMATED-ACTIONS
           PERFORM SHOW-CURRENT-RISKS
       END-IF.

       IF HUMAN-SKILL-LAST-TESTED > 180-DAYS
           DISPLAY
           'WARNING: MANUAL FALLBACK MAY BE FICTION'
       END-IF.

Comentários:

* CONTROL
* WITHOUT CONTEXT
* IS NOT CONTROL.

Outro:

* MANUAL MODE
* DOES NOT CREATE
* MANUAL SKILL.

Outro:

* IF AUTOMATION HANDS OVER
* THE WHEEL,
* HAND OVER THE MAP TOO.

Outro:

* HUMAN AVAILABLE
* DOES NOT MEAN
* HUMAN READY.

E naturalmente:

* DALEK AUTOPILOT:
* MANUAL CONTROL REQUIRED.
*
* HUMAN:
* WHERE IS THE MANUAL?
*
* DALEK:
* ARCHIVED IN 2021.
*
* DOCTOR:
* "EXCELLENT RESILIENCE."

🧠 O que um programador COBOL iniciante deve aprender com isso?

Muito mais:

do que parece.

Você está entrando:

num mundo

onde:

cada vez mais:

IDE,

copiloto,

monitor,

scheduler,

AIOps,

observability,

agents,

runbooks automáticos

vão:

fazer coisas:

por você.

Ótimo.

Use.

Mas:

continue entendendo:

o mecanismo.


☕ Se a IA gera:

COBOL,

entenda:

PIC.

USAGE.

COMP-3.

REDEFINES.

OCCURS.

File status.

SQLCODE.

CICS.


🧠 Se o scheduler resolve:

job,

entenda:

restart.

Dependencies.

Datasets.

GDG.

DISP.


🧠 Se monitor detecta:

abend,

saiba:

ler dump.


🧠 Se AIOps sugere:

Db2,

saiba:

o que é lock.


🎯 Pergunta Bellacosa nº 101

“Se a automação desaparecer, eu ainda entendo a tecnologia que estou operando?”


🧠 Esse é o teste

do profissional:

não:

anti-automação.

Mas:

automation-resilient.


☕ Um profissional moderno

não é:

quem faz tudo manual.

É:

quem sabe:

o suficiente

para:

perceber quando:

o automático saiu:

da estrada.


🧬 Regeneração organizacional

Uma organização madura não tenta:

manter humanos:

clicando inutilmente.

Isso seria:

desperdício.

Ela automatiza:

agressivamente

onde faz sentido.

Mas:

redesenha:

o papel humano.

Ela cria:

interfaces de takeover.

Mantém:

mode awareness.

Registra:

ações automáticas.

Treina:

manual recovery.

Faz:

game days.

Preserva:

access.

Testa:

break-glass.

Mede:

time-to-orient.

Evita:

transferência abrupta.

Cria:

modes intermediários.

E entende:

que:

o humano não deveria ser a última esperança apenas no organograma; deveria ser uma última esperança operacionalmente preparada.


📓 Diário do Doctor

Se guardar algumas ideias desta viagem, guarde estas:

Out-of-the-Loop Performance Problem é a degradação de desempenho humano que pode ocorrer quando a automação mantém operadores afastados do controle ativo e depois exige que assumam rapidamente em situações anormais.

Ter acesso ao controle não significa possuir consciência situacional suficiente para usá-lo bem.

Automation Complacency reduz vigilância; Out-of-the-Loop reduz capacidade de reentrada.

Deskilling ocorre quando procedimentos deixam de ser praticados e a fluência operacional se deteriora.

Situation Awareness Loss é central: o humano pode não saber o que aconteceu, o que está acontecendo e o que virá em seguida.

Mode Confusion torna transições perigosas quando operadores não sabem exatamente qual parte do sistema está automática, manual ou degradada.

Automation Surprise aparece quando o sistema executa ações que o humano não consegue prever ou explicar.

Passive Monitoring transforma especialistas em espectadores e reduz sua participação cognitiva.

O Human-in-the-Loop Paradox aparece quando humanos são chamados apenas para os casos raros que são difíceis demais para a automação.

A Irony of Automation é que quanto mais eficiente a automação, menos o humano pratica — e mais excepcional é o momento em que precisará agir.

Manual fallback não existe de verdade se runbooks, acessos e habilidades não forem testados.

A transição AUTO→MANUAL é uma competência própria e deve ser treinada.

O sistema deve entregar contexto junto com autoridade: estado atual, ações recentes, riscos, incertezas e próximos passos seguros.

Action logs automáticos são fundamentais para que humanos não repitam, contradigam ou desfaçam ações sem saber.

Time-to-Orient e Time-to-Takeover podem ser métricas mais úteis do que simplesmente registrar que havia um humano disponível.

A presença de modos intermediários pode trazer o humano de volta ao loop antes da falha total.

A automação deveria degradar de forma visível, e não desaparecer silenciosamente deixando o humano descobrir tarde demais.

Humanos precisam de headroom operacional assim como sistemas precisam de headroom de CPU.

Concentração de automação pode criar risco de capacidade humana quando uma plataforma comum falha e devolve muitas tarefas simultaneamente.

Equipes novas precisam aprender os mecanismos que a automação esconde, especialmente em ambientes críticos como mainframe.

Treinamento deve incluir falhas da automação, e não apenas operação normal.

Simulações, game days, replay de incidentes e exercícios manuais preservam competência sem exigir que trabalho repetitivo volte a ser manual.

O papel humano precisa ser redesenhado quando o nível de automação cresce; não basta automatizar tarefas e manter responsabilidades antigas.

Algoritmos podem receber autoridade mais rápido do que humanos recebem conhecimento para supervisioná-los.

A responsabilidade formal deve corresponder à capacidade real de supervisão.

Quando a automação reassume o controle, também deve existir critério explícito de handback.

O objetivo não é manter o humano permanentemente dentro de cada detalhe, mas mantê-lo capaz de voltar ao loop com contexto, competência e velocidade adequados.

E principalmente:

o maior erro não é permitir que a automação dirija durante horas. É imaginar que, quando ela soltar o volante no pior momento possível, o humano que ficou apenas olhando pela janela estará instantaneamente pronto para assumir a curva.


🥚 Easter Egg final

Antes de entrar na TARDIS, o Doctor olha:

para o console.

AUTOMATION:
ACTIVE

HUMAN:
STANDBY

Nosso jovem:

— Isso parece bom.

Doctor:

— Talvez.

— O que está errado?

— Quando foi o último manual drill?

Nosso jovem:

verifica.

LAST MANUAL DRILL:
398 DAYS AGO

Silêncio.

Doctor:

— E quando a automação falhar?

— O humano assume.

— Em quanto tempo?

— Não sei.

— Com qual contexto?

— Não sei.

— Com quais permissões?

— Também não sei.

Doctor:

— Então isso não é standby.

Ele altera:

a tela.

HUMAN STATUS:
UNVERIFIED

Nosso jovem:

— Dói mais.

Doctor:

— Verdade costuma ter esse efeito.

Depois:

nova simulação.

Manual drill.

Takeover.

Context packet.

Access tested.

Novo status:

HUMAN STATUS:
READY

Nosso jovem sorri.

— Agora posso tomar café?

Doctor:

— Agora você pode tomar café sabendo onde fica o volante.

VWORP.

VWORP.

VWORP.

A TARDIS desaparece.

No quadro sobra:

AUTOMATION ≠ READINESS

Abaixo:

ACCESS ≠ SITUATIONAL AWARENESS

Depois:

MANUAL MODE ≠ MANUAL SKILL

E finalmente:

“SE A AUTOMAÇÃO VAI DEVOLVER O CONTROLE UM DIA, TREINE O HUMANO ANTES DESSE DIA.”

Talvez essa seja toda a essência do Out-of-the-Loop Performance Problem no Bellacosa Mainframe:

automatizar é retirar trabalho desnecessário das mãos humanas; sair do loop é retirar também contexto, habilidade e prontidão — e descobrir a diferença apenas quando a máquina falha é uma maneira extremamente cara de aprender fatores humanos.

☕🌀

Próxima parada: Skill Degradation / Deskilling — o dia em que o procedimento manual continuava oficialmente disponível, mas ninguém mais na equipe conseguia executá-lo sem primeiro perguntar à própria automação como ele funcionava.

Vagner Renato Bellacosa, IBM Champion e especialista em IBM Mainframe
IBM Z17 SYSTEM ONLINE
Sobre o autor

Vagner Renato Bellacosa

IBM Champion 2026 • Especialista em IBM Mainframe

Vagner Renato Bellacosa trabalha com IBM Mainframe desde 1988 , é IBM Champion e especialista em COBOL, CICS, Db2, z/OS e IBM Z. Compartilha experiências profissionais, conhecimento técnico, história da computação e práticas do universo mainframe para aproximar novas gerações das tecnologias que sustentam empresas, bancos e governos ao redor do mundo.

IBM Champion IBM Z COBOL CICS Db2 z/OS Mainframe desde 1988
GitHub LinkedIn
Inicializando conteúdo...