Reforço intermitente: o mecanismo que Skinner descreveu antes de existir loteria online
Décadas antes de qualquer aplicativo de aposta, um psicólogo americano já tinha mapeado, em laboratório, por que a recompensa imprevisível prende muito mais que a recompensa certa. Entender esse mecanismo não é motivo para pânico — é a melhor defesa que existe.
O experimento que começou por acaso
Nos anos 1950, o psicólogo B. F. Skinner montou uma caixa simples: dentro, um rato apertava uma alavanca e, de vez em quando, caía comida. Assistindo a isso repetidamente, ele confirmou uma ideia que hoje parece óbvia, mas que ele mediu com precisão: o que dá recompensa tende a se repetir. Se apertar a alavanca traz comida, o rato aperta mais. Skinner chamou esse aprendizado por consequência de condicionamento operante. [2]
Mas a parte interessante veio depois. Skinner percebeu que o segredo não estava só em ter recompensa — estava em como ela é entregue. Dar comida a cada aperto tem um efeito. Dar comida de vez em quando, sem hora marcada, tem outro, bem mais forte. Ele e o colega Charles Ferster testaram várias "regras de entrega" da recompensa e mediram quanto cada uma prendia o comportamento. [1]
Recompensa certa x recompensa imprevisível
Imagine duas máquinas. Na primeira, cada 10 apertos garantem, sempre, um prêmio. É previsível: você sabe exatamente quando a recompensa vem. Na segunda, o prêmio sai depois de um número variável de apertos — às vezes 3, às vezes 30, sem padrão. Em média dá 10, mas você nunca sabe qual aperto será o premiado.
Essa segunda máquina é o que Skinner chamou de reforço de razão variável — "variável" porque o número de tentativas até o prêmio muda toda vez. Foi essa regra que produziu o resultado mais impressionante: o animal apertava a alavanca mais rápido e, principalmente, não desistia — continuava apertando por muito tempo mesmo depois que a comida parava de cair. É o mesmo impulso de quem insiste na máquina de refrigerante que "comeu" a moeda: e se a próxima for a boa? [3]
Por que a imprevisibilidade prende mais? Quando a recompensa é certa, o cérebro relaxa entre uma e outra. Quando é imprevisível, cada tentativa carrega a possibilidade de ser a vez — e é essa expectativa, não o prêmio em si, que sustenta o comportamento.
Onde esse mecanismo aparece hoje
O reforço de razão variável não é uma curiosidade de laboratório. É o esqueleto de boa parte do que compete pela sua atenção:
- Caça-níqueis e raspadinhasO caso mais puro: cada tentativa tem chance imprevisível de prêmio, com feedback imediato. É o desenho mais próximo da 'segunda máquina' de Skinner.
- Apostas de cota fixa (bets)Cada aposta é uma nova tentativa com resultado incerto e rápido — alta frequência, reforço variável e retorno quase instantâneo.
- Redes sociais e notificaçõesPuxar para atualizar o feed é apertar a alavanca: às vezes vem algo interessante, às vezes não. A recompensa social variável mantém o dedo rolando.
- Loterias tradicionaisTambém usam recompensa imprevisível — mas com uma diferença crucial de frequência, que veremos a seguir.
A frequência muda tudo
Aqui está uma distinção que costuma passar batida. O que torna um mecanismo de recompensa variável mais ou menos arriscado não é só a imprevisibilidade — é a frequência com que você pode repetir a tentativa. Um caça-níquel permite centenas de tentativas por hora. Uma raspadinha, uma atrás da outra. Uma bet, a cada partida.
Uma loteria de sorteio tradicional, como a Mega-Sena ou a Lotofácil, opera na ponta oposta: você aposta e espera dias pelo resultado. Esse intervalo longo entre a ação e a recompensa reduz drasticamente o loop de reforço que Skinner descreveu. Não elimina o mecanismo — mas o desacelera. É uma das razões pelas quais jogos de resultado imediato exigem atenção redobrada em comparação com sorteios semanais. Escrevemos sobre isso ao falar da volta da Loteria Instantânea.
Saber o mecanismo é a defesa
Nada disso significa que apostar seja, por si só, um problema. Para a maioria das pessoas, uma aposta ocasional é entretenimento inofensivo. O ponto é outro: quando você entende que a sensação de "estou perto de ganhar" é um efeito projetado pela imprevisibilidade — e não um sinal real de que a sorte vai virar — fica mais fácil decidir com clareza em vez de no automático.
Estratégias concretas seguem direto da teoria: defina um limite de tempo e de dinheiro antes de começar (quando a alavanca ainda não está na sua mão); desconfie especialmente de formatos de alta frequência e resultado imediato; e trate o custo como o preço de um lazer, nunca como investimento. A matemática de qualquer loteria tem expectativa negativa — na média, aposta-se mais do que se recebe.
O Lotologia é um portal informativo independente sobre as loterias da Caixa Econômica Federal. Não vendemos bilhetes, não operamos apostas e não temos vínculo com a CAIXA. Jogue com responsabilidade. Saiba mais
- 1.Ferster, C. B. & Skinner, B. F. — Schedules of Reinforcement (1957), Appleton-Century-Crofts
- 2.Skinner, B. F. — Science and Human Behavior (1953), Macmillan
- 3.American Psychological Association — APA Dictionary of Psychology — variable-ratio schedule
