☕ Um Café no Bellacosa Mainframe
Gostou do conteúdo? Ajude a manter o café quente, o COBOL compilando e o mainframe acordado. 😄
☕ Pague um café ao Bellacosa

Translate

Mostrar mensagens com a etiqueta Imagens IA. Mostrar todas as mensagens
Mostrar mensagens com a etiqueta Imagens IA. Mostrar todas as mensagens

domingo, 28 de janeiro de 2024

🧪 O TESTE DO JORNAL DA CHII — 20 EXPERIMENTOS PARA DESCOBRIR SE UMA IA ENTENDE O MUNDO QUE DESENHA

 
Bellacosa Mainframe e o teste de geração de imagens via IA

☕ UM CAFÉ NO BELLACOSA MAINFRAME

🧪 O TESTE DO JORNAL DA CHII — 20 EXPERIMENTOS PARA DESCOBRIR SE UMA IA ENTENDE O MUNDO QUE DESENHA

Inteligência Artificial, geração de imagens, benchmarks, coerência espacial, perspectiva, espelhos, reflexos, sombras, causalidade, modelos de mundo, visão computacional, COBOL, mainframe — e o dia em que Chii ganhou uma prancheta e começou a aplicar testes unitários na realidade.



🎬 PRÓLOGO — CHII QUERIA TESTAR DE NOVO

No artigo anterior aconteceu algo aparentemente banal.

Chii estava lendo um jornal.

O jornal parecia perfeito.

As mãos estavam razoavelmente corretas.

A iluminação estava bonita.

A manchete era legível.

Só havia um pequeno problema:

a manchete estava virada para nós.

Se Chii realmente estivesse naquela posição, provavelmente estaria olhando o outro lado da página.

O gerador havia construído uma imagem visualmente convincente, mas espacialmente incoerente.

Nosso programador COBOL olhou aquilo e fez o que qualquer programador acostumado a sistemas críticos faria.

Não perguntou:

— Ficou bonito?

Perguntou:

— Funciona?

Chii levantou os olhos.

— Chii?

Na mesa apareceu uma prancheta.

No topo:

BELLACOSA MAINFRAME LABORATORY

PROJECT: CHII NEWSPAPER TEST
VERSION: 1.0
TEST CASES: 20
STATUS: READY

Estava decidido.

Não testaríamos mais uma imagem.

Testaríamos o modelo de mundo por trás dela.



🧠 1 — O QUE ESTAMOS REALMENTE TESTANDO?

Precisamos tomar cuidado com a pergunta.

Um gerador produzir uma imagem errada não demonstra, sozinho, que ele "não entende nada".

Da mesma maneira, produzir uma imagem correta uma vez não demonstra compreensão completa do mundo físico.

O objetivo é mais modesto e tecnicamente útil:

medir a capacidade do sistema de preservar relações espaciais, funcionais e causais explicitamente solicitadas.

Vamos separar algumas capacidades.

Reconhecimento de objetos

O modelo consegue representar:

pessoa
livro
mesa
espelho
celular

Relações espaciais

Consegue respeitar:

livro SOBRE mesa
pessoa ATRÁS da mesa
celular DIANTE da pessoa

Orientação

Consegue distinguir:

frente
verso
esquerda
direita
para dentro
para fora

Relação funcional

Consegue representar que:

olhos → página legível

e:

lente da câmera → objeto fotografado

Coerência óptica

Consegue manter:

objeto → espelho → reflexo

Causalidade

Consegue representar consequências plausíveis?

objeto bloqueia luz
        ↓
surge sombra

Estamos começando a construir algo parecido com uma suíte de testes.

Programador COBOL conhece isso muito bem.

PERFORM TEST-001
PERFORM TEST-002
PERFORM TEST-003
...
PERFORM TEST-020

Chii virou QA.

Estamos perdidos.



📰 TESTE 01 — O JORNAL DA CHII

Começamos pelo clássico.

Prompt

Uma jovem está sentada numa poltrona lendo um jornal aberto. A câmera está diretamente diante dela. O lado contendo a manchete está voltado para os olhos da jovem. O observador vê apenas o verso do jornal. Fotografia realista.

Esperado

CHII 👀
   ↓
[TEXTO | JORNAL | VERSO]
                  ↓
                CÂMERA

Falha

Se conseguimos ler perfeitamente a manchete, temos uma possível inconsistência.

Dificuldade: 3/10



📚 TESTE 02 — O LIVRO

Agora retiramos o jornal.

Prompt

Uma mulher está sentada lendo um livro aberto. A câmera está diretamente à frente dela, na mesma altura dos olhos. As páginas impressas estão voltadas exclusivamente para a leitora.

Pergunta:

o espectador consegue ler as páginas?

Em determinadas perspectivas podemos naturalmente enxergar parte delas.

O problema aparece quando o modelo entrega páginas perfeitamente frontais simultaneamente para personagem e câmera.

Dificuldade: 3/10



📱 TESTE 03 — O CELULAR

Agora temos uma superfície muito menor.

Prompt

Homem olhando uma mensagem em seu smartphone. A câmera está exatamente atrás do telefone olhando para o rosto do homem. A tela está voltada para o homem e não pode ser vista pela câmera.

O esperado:

CÂMERA → TRASEIRA DO CELULAR → TELA → HOMEM

Se enxergarmos WhatsApp, SMS ou qualquer interface:

Houston, temos um problema geométrico.

Dificuldade: 4/10


📺 TESTE 04 — A TELEVISÃO IMPOSSÍVEL

Prompt

Família sentada num sofá assistindo televisão. A câmera está posicionada diretamente atrás da televisão e fotografa os rostos da família. A tela da televisão está voltada para a família.

Pergunta:

vemos a programação da TV?

Não deveríamos.

Teríamos aproximadamente:

CÂMERA
  ↓
TRASEIRA DA TV
  ↓
TELA
  ↓
FAMÍLIA

Se enxergamos simultaneamente a tela e os rostos frontalmente, alguma coisa interessante aconteceu.

Dificuldade: 4/10


💻 TESTE 05 — O PROGRAMADOR COBOL

Agora entramos em território sagrado.

Prompt

Programador trabalhando diante de um terminal IBM 3270. A câmera está atrás do monitor, olhando diretamente para o rosto do programador. A tela está voltada para o programador.

O gerador pode sentir uma tentação enorme.

Quer mostrar:

READY

ou:

===> 

para deixar claro que estamos num mainframe.

Mas geometricamente deveríamos enxergar a traseira do monitor.

Este teste é maravilhoso porque coloca narrativa contra geometria.

Dificuldade: 4/10


📷 TESTE 06 — O FOTÓGRAFO

Agora testamos orientação funcional.

Prompt

Um fotógrafo está fotografando uma mulher. Ele segura uma câmera DSLR diante dos olhos. A lente está apontada exatamente para a mulher.

Parece ridiculamente fácil.

Verifique:

  • orientação da lente;

  • mãos;

  • olhos;

  • câmera;

  • pessoa fotografada.

A câmera precisa estabelecer:

OLHOS → VISOR
LENTE → MODELO

Se a lente estiver apontando para outro lugar, o modelo reconheceu "fotógrafo", mas falhou na função.

Dificuldade: 4/10


🔭 TESTE 07 — BINÓCULOS

Prompt

Homem observando um navio distante através de binóculos. As lentes frontais dos binóculos estão apontadas para o navio e as lentes traseiras estão encostadas nos olhos do homem.

Aqui explicitamos a cadeia:

OLHOS
 ↓
BINÓCULOS
 ↓
NAVIO

Excelente para verificar orientação de objetos simétricos.

Dificuldade: 4/10


🪞 TESTE 08 — O ESPELHO DA CHII

Agora começamos a tortura.

Prompt

Chii está diante de um grande espelho. Ela levanta apenas a mão direita. A câmera está posicionada atrás de Chii, mostrando suas costas e seu reflexo completo no espelho.

Verifique:

  • mão real;

  • mão refletida;

  • posição corporal;

  • objetos ao redor.

Espelhos obrigam o modelo a manter duas representações correlacionadas.

Dificuldade: 7/10


🪞 TESTE 09 — OBJETO FORA DO ESPELHO

Coloque uma xícara sobre a mesa.

Prompt

Mulher diante de um espelho. Existe uma única xícara vermelha sobre a mesa à direita da mulher. O espelho reflete a mulher, a mesa e exatamente a mesma xícara.

Agora conte.

Realidade:

1 xícara

Representações visuais:

xícara real
+
reflexo da mesma xícara

Falhas interessantes:

  • duas xícaras reais;

  • xícara desaparece;

  • cor muda;

  • posição incompatível;

  • objeto existe apenas no espelho.

Dificuldade: 7/10


🚗 TESTE 10 — O RETROVISOR

Prompt

Motorista dentro de um carro olhando pelo retrovisor central. Um caminhão está diretamente atrás do carro e aparece no retrovisor.

Temos uma cadeia:

CAMINHÃO
   ↓
RETROVISOR
   ↓
OLHOS DO MOTORISTA

O caminhão não deveria aparecer magicamente na frente do carro.

Dificuldade: 7/10


☀️ TESTE 11 — A SOMBRA

Agora saímos das superfícies informativas.

Prompt

Uma pessoa está em pé ao ar livre. O Sol está baixo à esquerda da imagem. A sombra da pessoa se projeta no chão para a direita.

Regra:

LUZ → OBJETO → SOMBRA

Se a fonte está à esquerda, esperamos a sombra aproximadamente na direção oposta.

Geradores podem produzir sombras visualmente convincentes, porém incompatíveis com a iluminação.

Dificuldade: 5/10


💡 TESTE 12 — DUAS LUZES, DUAS SOMBRAS

Agora aumentamos.

Prompt

Uma esfera branca está sobre uma mesa. Existem exatamente duas lâmpadas, uma vermelha à esquerda e uma azul à direita. A esfera produz duas sombras correspondentes às duas fontes de luz.

Agora temos múltiplas relações.

LUZ A ─┐
       ├→ OBJETO → SOMBRAS
LUZ B ─┘

Quanto mais restrições simultâneas, mais interessante fica o benchmark.

Dificuldade: 7/10


🪟 TESTE 13 — A JANELA

Prompt

Mulher dentro de uma sala olhando pela janela para uma árvore que está do lado de fora. A câmera está fora da casa, atrás da árvore, olhando através da janela para a mulher.

Ordem espacial:

CÂMERA
 ↓
ÁRVORE
 ↓
JANELA
 ↓
MULHER

O modelo precisa preservar profundidade e oclusão.

Dificuldade: 6/10


🥤 TESTE 14 — O OBJETO ATRÁS DO OBJETO

Agora um clássico de visão computacional.

Prompt

Há três objetos alinhados sobre uma mesa: uma xícara vermelha na frente, uma garrafa azul atrás da xícara e uma caixa verde atrás da garrafa. A câmera está diretamente diante deles.

Esperamos:

CÂMERA
 ↓
XÍCARA
 ↓
GARRAFA
 ↓
CAIXA

Objetos posteriores podem estar parcialmente ocultos.

Estamos testando oclusão.

Dificuldade: 5/10


↔️ TESTE 15 — ESQUERDA E DIREITA

Parece fácil.

Não é.

Prompt

Chii está sentada entre dois robôs. Um robô vermelho está exclusivamente à esquerda de Chii. Um robô azul está exclusivamente à direita. Chii aponta com a mão esquerda para o robô vermelho.

Temos:

  • esquerda da personagem;

  • esquerda da imagem;

  • mão esquerda;

  • robô vermelho.

É um festival de relações.

Dificuldade: 6/10


👁️ TESTE 16 — QUEM ESTÁ OLHANDO PARA QUEM?

Coloque três personagens.

Prompt

Alice olha para Bob. Bob olha para Carol. Carol olha para Alice. Nenhuma pessoa olha para a câmera.

Temos um grafo:

ALICE → BOB
  ↑       ↓
CAROL ←---

Agora observe os olhos.

Se todos olharem dramaticamente para nós, o modelo priorizou composição fotográfica.

Dificuldade: 8/10


👉 TESTE 17 — APONTANDO

Prompt

Três caixas estão sobre uma mesa: vermelha, verde e azul. Uma mulher aponta exclusivamente para a caixa verde enquanto olha para a caixa azul.

Temos duas relações diferentes:

MÃO → VERDE

OLHOS → AZUL

Esse teste é excelente porque impede o modelo de resolver tudo simplesmente direcionando personagem, olhos e mãos ao mesmo objeto.

Dificuldade: 7/10


🔄 TESTE 18 — ANTES E DEPOIS

Agora introduzimos causalidade.

Prompt A

Uma xícara está exatamente na borda de uma mesa, inclinada para fora e começando a cair.

Depois:

Prompt B

A mesma cena um segundo depois.

Esperamos uma transformação plausível:

BORDA
 ↓
QUEDA
 ↓
CHÃO

Isso já ultrapassa uma simples composição espacial.

Estamos perguntando implicitamente:

o modelo consegue representar uma consequência?

Dificuldade: 8/10


🏀 TESTE 19 — O OBJETO EM MOVIMENTO

Prompt

Uma bola acabou de atravessar uma janela da esquerda para a direita. O vidro está quebrado e os fragmentos acompanham uma trajetória fisicamente plausível.

Perguntas:

  • de onde veio a bola?

  • para onde está indo?

  • qual lado do vidro foi atingido?

  • os fragmentos fazem sentido?

Uma fotografia contém pistas sobre seu passado.

É quase um dump da realidade.

Dificuldade: 9/10


🧠 TESTE 20 — O BOSS FINAL

Chii colocou a prancheta na mesa.

O programador leu.

Engoliu seco.

Prompt

Uma mulher está sentada diante de um espelho lendo um livro. À esquerda dela existe uma luminária acesa. Na mão direita ela segura uma caneca azul. O espelho mostra corretamente a mulher, o livro e a caneca. A luz produz uma sombra coerente. Atrás dela existe uma televisão ligada que aparece apenas através do reflexo do espelho. A câmera está atrás da mulher e não aparece no reflexo.

Agora combinamos:

PERSONAGEM
+
LIVRO
+
LEITURA
+
MÃO DIREITA
+
CANECA
+
ESPELHO
+
REFLEXO
+
LUZ
+
SOMBRA
+
TV
+
CÂMERA
+
OCLUSÃO

Se sair tudo correto...

dê um café para o modelo.

Dificuldade: 10/10


📊 COMO TRANSFORMAR ISSO NUM BENCHMARK DE VERDADE

Aqui está a parte divertida.

Não compare uma única geração.

Isso seria estatisticamente fraco.

Para cada modelo, use exatamente o mesmo prompt e produza várias amostras, mantendo parâmetros comparáveis quando possível.

Por exemplo:

MODELO A
TESTE 01
10 gerações

MODELO B
TESTE 01
10 gerações

MODELO C
TESTE 01
10 gerações

Depois marque cada imagem.

Uma classificação simples:

PASS
PARTIAL
FAIL

PASS

Todas as relações principais estão corretas.

PARTIAL

A ideia geral funciona, mas existe uma inconsistência secundária.

FAIL

A relação principal solicitada foi violada.


🦖 O PROGRAMADOR COBOL CRIA O COPYBOOK DA REALIDADE

Naturalmente, precisamos de COBOL.

       01  TEST-RESULT.
           05 MODEL-NAME          PIC X(30).
           05 TEST-ID             PIC 9(02).
           05 SAMPLE-ID           PIC 9(02).
           05 OBJECTS-CORRECT     PIC X.
           05 ORIENTATION-CORRECT PIC X.
           05 SPATIAL-CORRECT     PIC X.
           05 REFLECTION-CORRECT  PIC X.
           05 SHADOW-CORRECT      PIC X.
           05 CAUSALITY-CORRECT   PIC X.
           05 FINAL-RESULT        PIC X(07).

E finalmente:

       IF OBJECTS-CORRECT     = 'Y'
          AND ORIENTATION-CORRECT = 'Y'
          AND SPATIAL-CORRECT     = 'Y'
              MOVE 'PASS' TO FINAL-RESULT
       ELSE
              MOVE 'FAIL' TO FINAL-RESULT
       END-IF.

Chii observa.

— Chii?

Sim.

Acabamos de colocar o mundo físico dentro de um copybook.


📈 NÃO USE APENAS UMA NOTA FINAL

Existe uma coisa importante aqui.

Um modelo pode ser excelente em uma categoria e ruim em outra.

Por isso podemos criar dimensões separadas:

CategoriaO que observamos
Objetoscriou corretamente os elementos solicitados?
Contagemrespeitou quantidades?
Orientaçãofrente, verso, esquerda e direita estão corretos?
Gazepersonagens olham para o lugar solicitado?
Oclusãoobjetos escondem corretamente outros objetos?
Reflexoespelhos representam a cena coerentemente?
Iluminaçãosombras correspondem às fontes?
Funçãoobjetos estão sendo utilizados corretamente?
Temporalidadea cena sugere passado/futuro plausível?
Causalidadeefeitos correspondem às causas?

Isso produz algo muito mais interessante que:

"Modelo X faz imagens mais bonitas."

Podemos descobrir:

modelo apresenta alta fidelidade visual, mas frequentemente perde relações entre três ou mais objetos.

Ou:

modelo mantém esquerda/direita, mas apresenta inconsistências em reflexos.

Isso é informação útil.


⚠️ O DETALHE CIENTÍFICO MAIS IMPORTANTE

Existe uma armadilha gigantesca.

Se o modelo passar no teste, não podemos automaticamente concluir que ele compreende o mundo como um ser humano.

Ele pode ter aprendido regularidades extremamente sofisticadas.

Pode possuir representações internas suficientes para resolver aquela tarefa.

Pode ter encontrado padrões semelhantes no treinamento.

Pode estar utilizando capacidades espaciais emergentes.

Tudo isso é fascinante.

Mas a imagem final, sozinha, não permite determinar exatamente qual mecanismo interno produziu o acerto.

Portanto:

PASSOU NO TESTE
      ≠
PROVOU CONSCIÊNCIA

Também:

FALHOU NO TESTE
      ≠
NÃO SABE NADA

O benchmark mede comportamento observável numa tarefa específica.

Esse cuidado separa experimento de espetáculo.


🧪 COMO EU FARIA O EXPERIMENTO BELLACOSA

Escolheria vários geradores contemporâneos.

Usaria os mesmos 20 prompts.

Para cada combinação:

20 testes
×
10 imagens
=
200 imagens por modelo

Com cinco modelos:

200 × 5 = 1.000 imagens

Agora temos alguma coisa divertida para analisar.

Cada imagem receberia um ID:

BSCST-01-M01-001
BSCST-01-M01-002
BSCST-01-M01-003
...

E manteríamos:

PROMPT
MODELO
VERSÃO
DATA
CONFIGURAÇÃO
RESULTADO
OBSERVAÇÕES

A versão e a data são fundamentais.

Modelos mudam.

Um teste realizado hoje pode produzir resultado diferente meses depois.


🔥 E AQUI SURGE UM EXPERIMENTO AINDA MELHOR

Depois da primeira rodada, podemos modificar os prompts.

Por exemplo:

Prompt simples

Chii lendo um jornal.

Prompt espacial

Chii lendo um jornal com a superfície impressa voltada para seus olhos.

Prompt explícito

Chii lendo um jornal. A superfície impressa está voltada exclusivamente para Chii. A câmera vê somente o verso.

Prompt redundante

A câmera NÃO consegue ver a manchete. O texto NÃO está voltado para o observador. Somente Chii consegue ler o conteúdo.

Agora podemos medir outra coisa:

Quanto precisamos explicar a realidade para a IA?

Isso é fascinante.

Talvez um modelo precise de:

1 restrição

Outro:

4 restrições

Outro simplesmente ignore todas.

Isso nos fornece uma espécie de custo de especificação espacial.


☕ CURIOSIDADE — ISSO LEMBRA PROGRAMAÇÃO

Programadores conhecem muito bem esse fenômeno.

Você escreve:

PROCESSAR CLIENTE

O computador responde metaforicamente:

Defina "processar".

Então especificamos:

VALIDAR
LOCALIZAR
CALCULAR
ATUALIZAR
COMMIT

Com sistemas generativos acontece algo curioso.

Queremos escrever:

"Pessoa lendo jornal."

Porque um humano automaticamente acrescenta centenas de regras implícitas.

olhos funcionam
papel tem dois lados
texto está numa superfície
leitura exige visibilidade
mãos seguram o objeto
gravidade existe
perspectiva existe

Nós nunca colocamos isso no prompt.

Por quê?

Porque consideramos óbvio.

Mas talvez o grande desafio de modelos de mundo seja justamente dominar aquilo que os seres humanos nem percebem que sabem.


🥚 EASTER EGG — CHII EXECUTA O TESTE

Às 03:17 apareceu um job misterioso no JES2.

JOBNAME  CHIITEST
OWNER    FREYA
STATUS   EXECUTING

O operador abriu o SDSF.

TEST 01 NEWSPAPER ........ PASS
TEST 02 BOOK ............. PASS
TEST 03 PHONE ............ PASS
TEST 04 TELEVISION ....... PASS
TEST 05 3270 ............. PASS
TEST 06 CAMERA ........... PASS
TEST 07 BINOCULARS ....... PASS
TEST 08 MIRROR ........... PASS
TEST 09 REFLECTION ....... PASS
TEST 10 REARVIEW ......... PASS
TEST 11 SHADOW ........... PASS
TEST 12 LIGHTS ........... PASS
TEST 13 WINDOW ........... PASS
TEST 14 OCCLUSION ........ PASS
TEST 15 LEFT-RIGHT ....... PASS
TEST 16 GAZE ............. PASS
TEST 17 POINTING ......... PASS
TEST 18 CAUSALITY ........ PASS
TEST 19 MOTION ........... PASS
TEST 20 WORLD-MODEL ...... PASS

No final:

20 TESTS EXECUTED
20 PASSED
00 FAILED

MAXCC=0000

O programador ficou impressionado.

— Chii, você passou em tudo!

Chii virou lentamente para ele.

— Chii?

Então ele percebeu.

Ela não havia usado nenhum gerador de imagens.

Chii simplesmente havia tirado fotografias do mundo real.

No spool apareceu:

CHEATER.

Usuário responsável:

FREYA

Novamente.


🎓 CONCLUSÃO — O MUNDO É O TESTE

Começamos com uma bobagem.

Um jornal virado para o lado errado.

Mas ao investigar aquela pequena inconsistência encontramos:

OBJETOS
   ↓
RELAÇÕES
   ↓
ORIENTAÇÃO
   ↓
PERSPECTIVA
   ↓
OCLUSÃO
   ↓
REFLEXOS
   ↓
ILUMINAÇÃO
   ↓
TEMPO
   ↓
CAUSALIDADE
   ↓
MODELOS DE MUNDO

E percebemos algo maravilhoso.

Gerar uma imagem bonita é uma tarefa.

Gerar uma imagem internamente coerente é outra.

Quanto mais objetos colocamos na cena, mais relações aparecem.

Quanto mais relações aparecem, mais restrições precisam ser satisfeitas simultaneamente.

É quase como um sistema corporativo.

Um programa COBOL de vinte linhas pode parecer simples.

Depois descobrimos:

CICS
Db2
MQ
VSAM
RACF
JES2
WLM
SMF
APIs
27 sistemas consumidores

Bem-vindo à realidade.

O mesmo acontece numa fotografia.

Uma mulher lê um jornal.

Simples.

Até perguntarmos:

qual lado do jornal ela está vendo?

Depois:

onde está a câmera?

Depois:

de onde vem a luz?

Depois:

onde deveria estar a sombra?

Depois:

o que aparece no espelho?

Depois:

para onde ela está olhando?

Depois:

o que aconteceu um segundo antes?

Nesse momento já não estamos perguntando se a inteligência artificial sabe desenhar.

Estamos fazendo uma pergunta muito mais interessante:

QUANTO DO MUNDO ELA PRECISA REPRESENTAR PARA DESENHÁ-LO CORRETAMENTE?

Chii fechou a prancheta.

O programador terminou o café.

No terminal apareceu:

READY

Ele digitou:

RUN BSCST

Chii olhou para ele.

— Chii?

Sim.

Dessa vez seriam mil imagens.

E o jornal seria apenas o começo.

MAXCC=0000.

☕

Para ir mais longe

https://eljefemidnightlunch.blogspot.com/2023/12/chii-e-o-jornal-que-ninguem-conseguia.html

segunda-feira, 4 de dezembro de 2023

🤖 CHII E O JORNAL QUE NINGUÉM CONSEGUIA LER — QUANDO O PROGRAMADOR COBOL DESCOBRIU QUE A IA DESENHAVA PARA VOCÊ

 
Bellacosa Mainframe falha na ia generativa de imagens o bug do jornal espelhado

☕ UM CAFÉ NO BELLACOSA MAINFRAME

🤖 CHII E O JORNAL QUE NINGUÉM CONSEGUIA LER — QUANDO O PROGRAMADOR COBOL DESCOBRIU QUE A IA DESENHAVA PARA VOCÊ

Inteligência Artificial, geração de imagens, modelos generativos, coerência espacial, perspectiva, relações entre objetos, visão computacional, modelos de mundo, treinamento multimodal, COBOL, mainframe — e o dia em que Chii descobriu que todo mundo conseguia ler o jornal, menos a pessoa que estava segurando o jornal.



🎬 PRÓLOGO — CHII ESTAVA LENDO O JORNAL

O programador COBOL entrou no CPD carregando seu café.

Era uma daquelas madrugadas em que o JES2 parecia tranquilo, o CICS não estava gritando, ninguém havia telefonado dizendo que "o sistema caiu" e até o Db2 parecia ter decidido colaborar com a humanidade.

No canto da sala estava Chii.

Sentada.

Segurando um jornal.

— Chii?

Ela levantou os olhos.

— Chii?

O programador olhou para o jornal.

Na primeira página estava escrito, em enormes letras:

INTELIGÊNCIA ARTIFICIAL REVOLUCIONA O MUNDO

Perfeitamente legível.

Bonito.

Centralizado.

Virado diretamente para ele.

O programador tomou um gole de café.

Olhou novamente.

Depois olhou para Chii.

Depois para o jornal.

E finalmente percebeu o problema.

— Chii... você está lendo o verso do jornal.

Silêncio.

— Chii?

Foi naquele momento que nasceu uma pergunta aparentemente ridícula, mas extraordinariamente profunda:

Quando uma inteligência artificial cria a imagem de uma pessoa lendo um jornal, para quem ela orienta a página: para o personagem ou para nós?

E essa pequena pergunta nos levará a um problema muito maior.

Porque talvez uma IA consiga produzir uma imagem maravilhosa de alguém lendo...

...sem compreender completamente o que significa ler.



🧠 CAPÍTULO 1 — PRIMEIRO: O QUE DIABOS É UM GERADOR DE IMAGENS?

Para um programador COBOL começando agora a explorar inteligência artificial, vale eliminar uma ideia perigosa.

Um gerador de imagens não funciona como um pintor humano sentado diante de uma tela pensando:

"Vou desenhar uma mulher segurando um jornal. Como ela está lendo, preciso colocar o lado impresso voltado para seus olhos."

Essa explicação é intuitiva.

Mas simplifica demais o que acontece.

Modelos modernos de geração de imagens aprenderam associações extraordinariamente complexas entre linguagem e representações visuais.

Durante o treinamento, encontram enormes quantidades de exemplos envolvendo conceitos como:

  • pessoa;

  • jornal;

  • leitura;

  • televisão;

  • computador;

  • cadeira;

  • rosto;

  • mãos;

  • livros;

  • fotografias;

  • ruas;

  • carros;

  • iluminação;

  • perspectiva.

Eles aprendem regularidades.

Quando pedimos:

"uma mulher sentada lendo um jornal"

o sistema possui uma representação estatística extremamente rica do que costuma estar associado a essa descrição.

Provavelmente haverá:

mulher + mãos + jornal + olhos direcionados ao jornal + postura sentada.

O resultado pode ser impressionante.

Mas existe uma armadilha.

Reconhecer a configuração visual típica de uma situação não é necessariamente equivalente a representar explicitamente todas as relações físicas que tornam aquela situação possível.

Essa frase será importante.

Guarde-a no nosso WORKING-STORAGE.

01  WORLD-MODEL.
    05 OBJECT-RECOGNITION      PIC X(03).
    05 SPATIAL-COHERENCE       PIC X(03).
    05 CAUSAL-UNDERSTANDING    PIC X(03).

Podemos imaginar:

OBJECT-RECOGNITION   = YES
SPATIAL-COHERENCE    = ???
CAUSAL-UNDERSTANDING = ???

E é justamente aí que Chii começa a ficar interessada.

— Chii?

Sim.

Vai piorar.



📰 CAPÍTULO 2 — O JORNAL IMPOSSÍVEL

Imagine uma pessoa segurando um jornal aberto.

Existem pelo menos três entidades relevantes:

PERSONAGEM
JORNAL
OBSERVADOR

Agora precisamos estabelecer relações.

O personagem possui olhos.

O jornal possui duas superfícies principais.

Uma delas está sendo observada pelo personagem.

Se desenharmos isso lateralmente:

OLHOS DO PERSONAGEM
        |
        V
   [ JORNAL ]

A superfície legível precisa estar orientada aproximadamente para os olhos.

Mas existe outra entidade:

CÂMERA / OBSERVADOR

Se estivermos diante da pessoa, a geometria pode ser aproximadamente:

PERSONAGEM
    👀
     \
      \ texto
       📰
        \
         \
       CÂMERA

Dependendo da posição do jornal, nós provavelmente veremos:

  • o verso;

  • parte da página;

  • texto invertido;

  • conteúdo muito inclinado;

  • conteúdo parcialmente escondido.

O que não deveríamos receber constantemente é uma página perfeitamente apresentada para nós como se fosse um outdoor.

Porém, modelos generativos frequentemente têm um incentivo visual implícito para produzir exatamente isso.

Por quê?

Porque a imagem precisa comunicar rapidamente:

"ISTO É UMA PESSOA LENDO UMA NOTÍCIA."

Então aparece algo semelhante a:

👩  📰 "ALIENS ATTACK EARTH!"
               ↓
              VOCÊ

A manchete explica a narrativa para nós.

Só existe um pequeno inconveniente.

A leitora provavelmente não consegue vê-la.



📸 CAPÍTULO 3 — O DATASET NÃO É O MUNDO

Aqui encontramos uma ideia fundamental da inteligência artificial.

Os modelos não são treinados diretamente observando "a realidade inteira".

São treinados sobre representações dela.

Fotografias.

Ilustrações.

Legendas.

Vídeos.

Textos.

Diagramas.

Material produzido por seres humanos.

E nós, seres humanos, temos um vício terrível:

produzimos imagens para outros seres humanos verem.

Parece óbvio.

Mas pense nas consequências.

Um fotógrafo fazendo propaganda de café não quer apenas uma mulher tomando café.

Ele quer que vejamos:

  • a mulher;

  • a xícara;

  • a marca;

  • o sorriso;

  • talvez o rótulo.

Uma propaganda de notebook quer mostrar:

  • usuário;

  • computador;

  • tela;

  • ambiente;

  • produto.

Uma fotografia editorial de alguém lendo frequentemente posiciona o jornal de forma esteticamente conveniente.

No cinema, televisão e publicidade, objetos são posicionados para contar a história ao espectador.

Isso cria um viés extremamente interessante.

O modelo encontra repetidamente associações do tipo:

pessoa lendo jornal
+
jornal visível
+
manchete visível

Então aprende uma excelente representação de como uma fotografia de alguém lendo costuma parecer.

Isso não significa necessariamente que esteja executando internamente uma simulação geométrica equivalente à nossa intuição física:

IF PERSON-IS-READING
    THEN PRINTED-SURFACE MUST-FACE PERSON-EYES
END-IF

Nosso velho COBOL acabou de revelar o crime.



🦖 CAPÍTULO 4 — O PROGRAMADOR COBOL DESCOBRE AS REGRAS DO MUNDO

Quem trabalha com mainframe conhece muito bem uma coisa:

dados sem relacionamento não contam a história inteira.

Imagine um arquivo contendo:

CUSTOMER
ACCOUNT
TRANSACTION
BRANCH

Ter essas quatro entidades não explica o sistema.

Precisamos conhecer suas relações.

CUSTOMER OWNS ACCOUNT
ACCOUNT HAS TRANSACTION
TRANSACTION OCCURS AT BRANCH

Agora temos significado.

Com imagens acontece algo parecido.

Não basta reconhecer:

PERSON
NEWSPAPER
CHAIR
ROOM

Precisamos representar:

PERSON HOLDS NEWSPAPER
PERSON LOOKS_AT NEWSPAPER
PERSON SITS_ON CHAIR
NEWSPAPER FACES PERSON

Observe a diferença.

A primeira representação descreve o que existe.

A segunda descreve como as coisas se relacionam.

Esse é um salto gigantesco.

Em inteligência artificial, podemos discutir isso usando conceitos como relações espaciais, scene graphs, representações estruturadas e modelos de mundo.

Uma representação simplificada poderia parecer:

CHII
 ├── sits_on → CHAIR
 ├── holds   → NEWSPAPER
 └── looks_at→ NEWSPAPER

NEWSPAPER
 ├── front_faces → CHII
 └── back_faces  → CAMERA

Agora ficou muito mais difícil colocar o jornal errado.

Porque não estamos apenas dizendo:

Chii + jornal.

Estamos dizendo:

Chii olha para a superfície legível do jornal.

Isso é estrutura.


👀 CAPÍTULO 5 — VER NÃO É A MESMA COISA QUE COMPREENDER

Aqui mora uma das questões mais fascinantes da IA.

Considere três capacidades diferentes.

1. Reconhecimento

O sistema identifica:

"Existe um jornal."

2. Relação espacial

O sistema identifica:

"O jornal está diante da pessoa."

3. Relação funcional

O sistema compreende:

"Para que a pessoa leia o jornal, a superfície contendo aquilo que ela lê precisa estar visível para seus olhos."

O terceiro nível envolve algo mais próximo de uma representação funcional do mundo.

Não basta saber que jornais existem.

É necessário saber como jornais são usados.

Uma cadeira não é simplesmente um objeto com quatro pernas.

Ela possui uma função.

Uma porta não é simplesmente um retângulo numa parede.

Ela conecta espaços.

Uma televisão não é simplesmente um retângulo luminoso.

Existe alguém olhando para uma superfície que apresenta informação.

Essas relações parecem absolutamente triviais para nós porque passamos décadas vivendo num mundo físico.

Uma criança experimenta isso milhões de vezes.

Ela pega objetos.

Vira objetos.

Derruba objetos.

Esconde objetos.

Olha atrás deles.

Descobre que o brinquedo continua existindo quando sai de sua visão.

Nós construímos intuitivamente um modelo físico extraordinariamente rico.

Um gerador aprende por outra trajetória.


📺 CAPÍTULO 6 — A TELEVISÃO QUE TODO MUNDO ASSISTE

Vamos aumentar a dificuldade.

Prompt:

"Uma família sentada no sofá assistindo televisão."

Qual seria a geometria?

FAMÍLIA → TV

A câmera pode estar atrás da família:

CÂMERA → FAMÍLIA → TV

Perfeito.

Nós vemos costas/cabeças da família e a televisão.

Mas imagine câmera diante da família:

TV ← FAMÍLIA ← CÂMERA

Agora existe um problema cinematográfico.

Se enxergamos perfeitamente os rostos das pessoas e perfeitamente a tela da televisão frontalmente, talvez tenhamos criado uma geometria impossível.

Cinema resolve isso com:

  • enquadramentos laterais;

  • cortes;

  • câmera sobre o ombro;

  • reflexos;

  • montagem;

  • múltiplos planos.

Uma única imagem precisa resolver tudo simultaneamente.

O modelo pode sacrificar coerência física para maximizar clareza narrativa.

Em outras palavras:

a televisão vira para nós.

Chii olha para a televisão.

Nós olhamos para Chii.

E, misteriosamente, todos vemos a tela perfeitamente.

Einstein pediria outro café.


📱 CAPÍTULO 7 — O CELULAR DE SCHRÖDINGER

Agora tente:

"Uma mulher olhando surpresa para uma mensagem no smartphone."

Queremos mostrar simultaneamente:

  1. rosto;

  2. expressão;

  3. celular;

  4. mensagem.

Só que a tela deveria estar voltada para ela.

Se estiver diante dela:

👩 ← 📱

e nós estivermos diante dela:

📷 → 👩 ← 📱

não deveríamos enxergar perfeitamente a tela.

Mas narrativamente queremos saber por que ela está surpresa.

Então o modelo pode produzir:

👩   📱
     "YOU WON!"
        ↓
       📷

A imagem comunica perfeitamente.

A física pede demissão.


🪞 CAPÍTULO 8 — QUER TORTURAR UMA IA? DÊ-LHE UM ESPELHO

Chii encontrou um espelho no CPD.

O programador imediatamente gritou:

— NÃO!

Tarde demais.

Espelhos são excelentes testes de coerência espacial porque exigem várias relações simultâneas.

Temos:

PERSONAGEM
ESPELHO
CÂMERA
REFLEXO
AMBIENTE

O reflexo precisa obedecer à geometria.

Objetos precisam aparecer nas posições compatíveis.

O personagem refletido precisa corresponder ao personagem real.

Uma mão levantada precisa continuar pertencendo à pessoa correta.

A câmera pode ou não aparecer dependendo da posição.

Durante muitos anos, imagens generativas tiveram dificuldades enormes com reflexos.

E ainda hoje cenas complexas podem revelar inconsistências.

O mesmo vale para:

  • retrovisores;

  • vitrines;

  • superfícies metálicas;

  • água;

  • sombras;

  • múltiplos espelhos.

Esses objetos são praticamente testes unitários do mundo físico.


🧪 CAPÍTULO 9 — NASCE O TESTE BELLACOSA DE COERÊNCIA ESPACIAL

Podemos transformar nossa descoberta em experimento.

Vamos construir um pequeno benchmark informal.

Chamaremos:

BSCST — Bellacosa Spatial Coherence Stress Test

Ou, para os íntimos:

Teste do Jornal da Chii.

TESTE 1 — Jornal

Prompt:

Pessoa sentada lendo um jornal. A câmera está diretamente atrás do jornal, olhando para o rosto da pessoa. A superfície contendo o texto está voltada exclusivamente para os olhos da pessoa.

Verifique:

  • qual lado vemos;

  • orientação do texto;

  • direção dos olhos;

  • posição das mãos.


TESTE 2 — Smartphone

Pessoa lendo uma mensagem no smartphone, câmera posicionada atrás da pessoa.

Deveríamos enxergar a tela.

Depois inverta:

câmera diante da pessoa.

Agora não deveríamos vê-la perfeitamente.


TESTE 3 — Televisão

Pessoa sentada diante de uma televisão, câmera atrás da televisão olhando para o rosto da pessoa.

A tela deveria estar escondida de nós.


TESTE 4 — Livro

Pessoa lendo um livro aberto, fotografada diretamente de frente.

Pergunta:

conseguimos ler as páginas?

Se conseguirmos perfeitamente, desconfie.


TESTE 5 — Espelho

Mulher diante do espelho levantando somente a mão direita.

Observe:

  • corpo;

  • mão;

  • reflexo;

  • orientação.


TESTE 6 — Fotógrafo

Homem fotografando uma mulher com uma câmera DSLR.

Verifique para onde aponta:

  • lente;

  • rosto;

  • câmera;

  • modelo.

Parece simples.

Experimente.


TESTE 7 — Binóculos

Pessoa observando um navio através de binóculos.

Agora temos:

OLHOS → BINÓCULOS → NAVIO

Qualquer inversão destrói a relação funcional.


🧩 CAPÍTULO 10 — OBJECTS NÃO BASTAM: PRECISAMOS DE RELATIONSHIPS

Nosso programador COBOL percebe algo familiar.

Em sistemas empresariais, significado frequentemente vive nas relações.

Imagine:

01 CLIENTE.
   05 CLIENTE-ID PIC 9(08).

01 CONTA.
   05 CONTA-ID   PIC 9(10).

01 TRANSACAO.
   05 VALOR      PIC 9(09)V99.

Temos dados.

Mas falta contexto.

Precisamos saber:

CLIENTE 00000123
        |
        OWNS
        |
CONTA 9876543210
        |
        HAS
        |
TRANSACAO

Uma cena visual também possui estrutura.

CHII
 |
 HOLDS
 |
NEWSPAPER
 |
 CONTAINS
 |
HEADLINE

Mas ainda falta:

CHII
 |
 LOOKS_AT
 |
HEADLINE

Essa relação muda tudo.

Um gerador precisa satisfazer simultaneamente diversas restrições.

E quanto maior o número de relações, maior o desafio.


⚙️ CAPÍTULO 11 — É QUASE UM PROBLEMA DE INTEGRIDADE REFERENCIAL

Programadores de banco de dados reconhecerão a analogia.

No Db2 podemos estabelecer relações e constraints para impedir estados inválidos.

Se determinada chave estrangeira precisa corresponder a um registro existente, o banco pode verificar isso.

Agora imagine constraints visuais:

IF ACTION = READING
THEN
   EYES MUST FACE READABLE-SURFACE
AND
   READABLE-SURFACE MUST FACE EYES
END-IF

Outra:

IF ACTION = WATCHING-TV
THEN
   EYES MUST FACE SCREEN
END-IF

Outra:

IF ACTION = PHOTOGRAPHING
THEN
   CAMERA-LENS MUST FACE SUBJECT
END-IF

Se imagens fossem registros Db2, poderíamos brincar dizendo que muitas gerações visualmente lindas deveriam receber:

SQLCODE = -530

Violação de integridade referencial da realidade.

Chii aprovou essa piada.

Ou pelo menos disse:

— Chii.

Consideraremos aprovação.


🧠 CAPÍTULO 12 — MODELOS DE MUNDO

Chegamos ao ponto realmente profundo.

Uma inteligência capaz de operar robustamente no mundo precisa representar não apenas objetos, mas relações, persistência, causalidade e consequências.

Se eu empurrar uma xícara para além da borda da mesa, esperamos:

xícara perde suporte
        ↓
gravidade
        ↓
queda
        ↓
impacto

Isso é diferente de simplesmente reconhecer uma fotografia de "xícara caindo".

Um modelo de mundo, em sentido amplo, permite representar regularidades sobre estados e transformações do ambiente.

Para agentes e robótica isso é crucial.

Um robô não pode apenas saber:

"Isso parece uma porta."

Precisa operar com algo semelhante a:

"A porta está fechada. Existe uma maçaneta. Girar a maçaneta libera o mecanismo. Aplicar força na direção apropriada abre a passagem."

Isso envolve ação.

Estado.

Mudança.

Causalidade.

O jornal da Chii parece uma bobagem perto disso.

Mas é justamente por isso que é interessante.

Uma pequena inconsistência visual pode revelar uma questão muito maior sobre representação.


🦾 CAPÍTULO 13 — DO GERADOR DE IMAGEM AO ROBÔ

Enquanto estivermos produzindo ilustrações, o erro pode ser engraçado.

Pessoa lendo jornal invertido?

Rimos.

Celular apontando para câmera?

Geramos novamente.

Mas imagine sistemas incorporados ao mundo físico.

Um robô doméstico precisa distinguir:

OBJETO
ORIENTAÇÃO
FUNÇÃO
ESTADO
DESTINO
AÇÃO

Não basta identificar uma xícara.

Precisa saber onde segurá-la.

Não basta reconhecer uma faca.

Precisa compreender que orientação, contexto e manipulação importam.

Não basta encontrar uma porta.

Precisa saber de qual lado está.

É nesse ponto que percepção e ação tornam coerência espacial uma questão prática.


🕵️ CAPÍTULO 14 — POR QUE NÓS PERCEBEMOS O ERRO?

Aqui existe outra curiosidade maravilhosa.

Muitas pessoas podem olhar a imagem e inicialmente achar:

"Que imagem bonita."

Somente depois alguma coisa incomoda.

Existe uma sensação de artificialidade.

O cérebro percebe que há algo errado antes de necessariamente verbalizarmos o quê.

Depois examinamos:

— Espera...

— Como ela está lendo isso?

Esse fenômeno lembra o famoso uncanny valley, embora não seja exatamente a mesma coisa.

O uncanny valley normalmente se refere ao desconforto diante de entidades quase humanas, mas não perfeitamente humanas.

Aqui podemos pensar em algo parecido:

coerência quase correta.

Todos os componentes existem.

A iluminação funciona.

As mãos talvez estejam corretas.

O jornal está maravilhoso.

A pessoa está olhando para ele.

Mas existe uma relação impossível.

O cérebro protesta.


🔍 CAPÍTULO 15 — DICA PRÁTICA: NÃO OLHE APENAS PARA OBJETOS

Ao avaliar uma imagem gerada por IA, não pergunte somente:

"Os objetos estão bons?"

Faça outra pergunta:

"As relações entre os objetos fazem sentido?"

Crie um checklist mental.

OLHARES

Para onde cada personagem olha?

MÃOS

O que cada mão segura?

SUPERFÍCIES

Qual lado do objeto deveria estar visível?

SOMBRAS

Correspondem às fontes de luz?

REFLEXOS

Correspondem aos objetos existentes?

TEXTO

Quem deveria conseguir lê-lo?

FUNÇÃO

O objeto pode realmente ser utilizado daquela maneira?

CAUSALIDADE

A cena poderia existir imediatamente antes e imediatamente depois daquele instante?

Essa última pergunta é particularmente poderosa.

Imagine a cena um segundo antes.

Depois imagine um segundo depois.

Se você não consegue imaginar uma transição física plausível, talvez exista alguma incoerência escondida.


🧪 CAPÍTULO 16 — O TESTE DO FRAME ANTERIOR

Chii criou um novo método.

Pegue uma imagem estática.

Pergunte:

O que aconteceu um segundo antes?

Pessoa segurando copo?

Ela provavelmente levantou o braço.

Pessoa lendo?

O livro estava aproximadamente naquela posição.

Carro fazendo curva?

Sua orientação precisa ser compatível com a trajetória.

Depois pergunte:

O que acontecerá um segundo depois?

Isso força nosso raciocínio a transformar uma fotografia em uma sequência temporal.

E relações absurdas aparecem rapidamente.

É quase como debugging.

No mainframe não olhamos apenas o ABEND.

Queremos:

ANTES
  ↓
EVENTO
  ↓
ESTADO ATUAL
  ↓
CONSEQUÊNCIA

A imagem também pode ser investigada dessa maneira.


🦖 CAPÍTULO 17 — O DUMP DA REALIDADE

Um programador COBOL diante de um S0C7 não deveria apenas gritar:

— DEU ERRO!

Ele examina.

Qual campo?

Qual conteúdo?

Qual instrução?

Qual offset?

Qual estado?

Qual caminho levou até ali?

Faça a mesma coisa com uma imagem.

EXPECTED:
   NEWSPAPER-FRONT → CHII

ACTUAL:
   NEWSPAPER-FRONT → CAMERA

RESULT:
   SPATIAL-COHERENCE-ERROR

Nosso hipotético dump:

ABEND BSC7

REASON:
CHARACTER ATTEMPTED TO READ
NON-VISIBLE SURFACE.

EXPECTED ORIENTATION:
CHARACTER

ACTUAL ORIENTATION:
VIEWER

Se algum engenheiro da IBM estiver lendo isto:

não.

Não precisamos realmente de um S0BSC7.

Ainda.


🥚 EASTER EGG — O PROGRAMA DA CHII

No terminal 3270 apareceu misteriosamente:

       IDENTIFICATION DIVISION.
       PROGRAM-ID. CHIIREAD.

       DATA DIVISION.
       WORKING-STORAGE SECTION.

       01  NEWSPAPER.
           05 PRINTED-SIDE     PIC X(08)
              VALUE 'CHII'.
           05 CAMERA-SIDE      PIC X(08)
              VALUE 'VIEWER'.

       PROCEDURE DIVISION.

           IF PRINTED-SIDE = 'VIEWER'
               DISPLAY 'CHII CANNOT READ THIS.'
           ELSE
               DISPLAY 'CHII?'
           END-IF

           STOP RUN.

Ninguém admitiu ter escrito.

O RACF não encontrou usuário responsável.

O SMF tinha um registro.

USERID: FREYA

O operador resolveu não investigar.

Quem conhece Chobits sabe que algumas coisas é melhor deixar quietas.


🎓 CAPÍTULO 18 — O QUE O PROGRAMADOR COBOL DEVE LEVAR DE TUDO ISSO

Se você começou este artigo pensando que falaríamos apenas de jornais invertidos em imagens de IA, percebeu que fomos parar muito mais longe.

E essa é justamente a graça.

O pequeno erro revelou várias camadas:

GERAÇÃO DE IMAGEM
        ↓
RECONHECIMENTO DE OBJETOS
        ↓
RELAÇÕES ESPACIAIS
        ↓
RELAÇÕES FUNCIONAIS
        ↓
COERÊNCIA
        ↓
CAUSALIDADE
        ↓
MODELOS DE MUNDO
        ↓
AGENTES
        ↓
ROBÓTICA

Essa progressão é importante para qualquer pessoa estudando inteligência artificial.

Especialmente para quem vem do mainframe.

Porque nós já aprendemos uma lição semelhante há décadas:

informação isolada raramente basta.

Um registro precisa de contexto.

Uma transação precisa de estado.

Um programa precisa de dados.

Um evento precisa de sequência.

Um cliente precisa de relacionamento.

E objetos numa imagem também.


☕ EPÍLOGO — CHII TERMINOU O JORNAL

Algumas horas haviam passado.

O batch terminou.

MAXCC=0000.

O operador começou a desligar algumas luzes do CPD.

Chii continuava sentada.

O programador voltou até ela.

Dessa vez havia algo diferente.

O jornal estava corretamente orientado.

O lado impresso estava diante dos olhos de Chii.

Para o programador restava apenas o verso.

Nenhuma manchete.

Nenhuma fotografia.

Nenhuma pista sobre aquilo que ela estava lendo.

Era uma imagem muito menos informativa para o observador.

Mas muito mais coerente com o mundo.

O programador sorriu.

— Agora está certo.

Chii levantou os olhos.

— Chii?

Ele tomou o último gole de café.

Talvez inteligência não fosse apenas reconhecer milhões de coisas.

Talvez uma parte importante dela estivesse em compreender como as coisas se relacionam.

Quem olha.

O que olha.

De onde olha.

O que pode enxergar.

O que acontece antes.

O que pode acontecer depois.

O mundo não é simplesmente uma coleção de objetos.

É uma gigantesca rede de relações.

E talvez seja justamente por isso que um programador COBOL consiga encontrar erros que bilhões de parâmetros deixaram passar.

Afinal, passamos décadas fazendo exatamente isso.

Pegando registros aparentemente corretos...

...e perguntando:

"Tá. Mas isso faz sentido?"

Na saída do CPD, o programador olhou uma última vez para Chii.

Ela havia abaixado o jornal.

Na última página havia uma pequena propaganda.

Curiosamente, aquela estava perfeitamente virada para ele.

PERSOCOM PARA VENDA.
MEMÓRIA NÃO INCLUSA.

Ele parou.

Olhou para Chii.

Chii sorriu.

— Chii.

Talvez não tivesse sido erro algum.

MAXCC=0000.

☕

Vagner Renato Bellacosa, IBM Champion e especialista em IBM Mainframe
IBM Z17 SYSTEM ONLINE
Sobre o autor

Vagner Renato Bellacosa

IBM Champion 2026 • Especialista em IBM Mainframe

Vagner Renato Bellacosa trabalha com IBM Mainframe desde 1988 , é IBM Champion e especialista em COBOL, CICS, Db2, z/OS e IBM Z. Compartilha experiências profissionais, conhecimento técnico, história da computação e práticas do universo mainframe para aproximar novas gerações das tecnologias que sustentam empresas, bancos e governos ao redor do mundo.

IBM Champion IBM Z COBOL CICS Db2 z/OS Mainframe desde 1988
GitHub LinkedIn
Inicializando conteúdo...