As operações motivacionais (OM), conceituadas como omnibus term para incluir operações estabelecedoras (OE) e operações abolidoras (OA), têm o importante mérito de restringir as influências motivacionais para o meio ambiente, tornando-as passíveis de descrição como eventos naturais, de programação, de manipulação, de experimentação, de descrição empírica. Não abrangem, porém, todas as influências que produzem (evocam e eliciam), enfraquecem, mantêm, selecionam comportamentos. No caso dos comportamentos dos seres humanos em suas rotinas cotidianas, as operações motivacionais têm uma aplicação restrita. Assim, privação de água e alimento em sujeitos infra-humanos podem ser manejadas, mensuradas e permitem previsão de como influenciam comportamentos. O manejo de choque elétrico com intensidade que produza dor e tenha, portanto, função aversiva também? Sim e não. Os efeitos que as operações motivacionais produzem não são independentes das contingências de reforçamento que interagem com elas. As operações motivacionais apresentadas em estudos experimentais com sujeitos infra-humanos são muito simples, atuando sobre organismos simples, com história de contingências simples e só podem ser generalizadas para os humanos com desenvolvimento atípico, com quadros psiquiátricos que restringem a autonomia do indivíduo, e em circunstâncias extremas: acidentes naturais, acidentes resultantes de tecnologia (carros, aviões, radiações nucleares etc.). Ao lado de tais operações motivacionais, há uma classe extremamente ampla de condições que influenciam e modificam, instalam, mantêm comportamentos em associação com operações motivacionais clássicas (privação, saciação, estimulação aversiva etc.). Seriam estas condições complexas também uma classe de operações motivacionais que necessitam ser conceituadas como tal ou constituem por si mesmas outra classe de operações que influenciam comportamentos? Quais são elas? São as contingências de reforçamento! Vamos a procedimentos e dados experimentais que suscitam algumas reflexões. Assim:
Azrin (1959) apresentou os resultados de um sujeito experimental (pombo) como representativo dos resultados de outros cinco sujeitos entre os quais foi variado o tamanho da FR (de 10 a 50) e a intensidade da punição (choques de 1 a 120 volts). O sujeito apresentado foi mantido em reforçamento positivo num esquema de FR 25, até o padrão comportamental se estabilizar. A contingência de punição foi, então, adicionada ao procedimento de reforçamento: cada bicada do pombo produzia um choque elétrico. Durante um período de 120 dias, a intensidade do choque foi sendo aumentada de 1 até 120 volts. Cada valor da punição foi mantido até que o padrão e o total de respostas emitidas não mostrassem tendência discernível em sessões sucessivas. Os resultados mostraram que os sujeitos experimentais se mantiveram respondendo em todas as intensidades de choque, e o autor apresenta as mudanças em padrões de comportamento nas intensidades mais altas. Ele se refere à ação seletiva da punição. Na secção de discussão Azrin (pp. 303-304) escreveu:
“Pode-se ver que a punição afeta o desempenho em razão fixa, aumentando seletivamente as pausas pós-reforçamento. Quanto maior a intensidade da punição, maior a pausa. A partir do momento em que responder é retomado [após pausas], a frequência total permanece virtualmente inalterada, independentemente da intensidade da punição. Qualquer redução do número total de respostas produzidas pela punição, portanto, deve ser atribuída ao aumento das pausas, não a qualquer decréscimo na frequência local de responder”
O autor prossegue seus comentários na seção “Observação Visual durante Punição” (p. 304):
“A observação visual dos sujeitos na presente investigação revela uma visão, de certo modo, dramática durante punição severa (80-120 volts). Imediatamente após o reforçamento, o sujeito usualmente se desloca completamente para longe do local do disco onde deve responder [bicar]. Quando o sujeito, afinal, retorna até o disco e executa a primeira resposta, o procedimento de punição produz um violento movimento de desiquilíbrio e bater agitado de asas. A violência da reação física a esta punição individual dá a impressão que nenhuma outra resposta será emitida por algum tempo. No entanto, o sujeito executa as restantes 24 respostas numa sucessão extremamente rápida, independentemente do fato de que o efeito físico da punição parece tornar difícil manter uma postura ereta, muito menos responder”.
Azrin (p. 304). escreveu sobre a recuperação da punição:
“Em cada um dos registros de resposta apresentado, o responder foi especialmente reduzido durante a parte inicial da sessão de punição, com recuperação progressiva tanto durante, como entre as sessões. [...]. Este fenômeno de recuperação parece se constituir em um dos mais dramáticos efeitos de punição”.
Os surpreendentes resultados demonstrados por Azrin (1959) não podem ser explicados por operações motivacionais simplesmente, mas pela interação dos três termos da tríplice contingência, que inclui como um procedimento fundamental a maneira como foi introduzida a intensidade crescente do choque elétrico. Descrição é explicação, esse é um dos conceitos pilares da análise do comportamento: aquilo que está tecnologicamente descrito está suficientemente explicado. À descrição acrescente-se manipulação de variáveis; aí sim descrição e manipulação se complementam para esclarecer a compreensão-explicação do fenômeno comportamental de interesse. Assim procedeu Azrin (1959), pois deu um passo além da descrição, ao demonstrar replicabilidade dos resultados intersujeitos e replicação dos padrões comportamentais em diferentes esquemas de FR com a introdução de alterações crescentes na intensidade do choque. Trata-se de controle experimental intrasujeito (uma intensidade de choque serve de linha de base para ser comparada com a seguinte e, assim, sucessivamente) e intersujeitos: as intensidades de choque são (igualmente) crescentes, mas o esquema de reforçamento é variado de FR10 a FR50, intersujeitos.
Aprendizagem de Esquiva Traumática: os resultados de vários procedimentos de extinção com cachorros
Outro estudo experimental de grande impacto pelos resultados demonstrados foi realizado por Solomon, Kamin e Wynne (1953) com cachorros. Os sujeitos experimentais foram treinados em uma caixa experimental de Mowrer-Miller modificada, em formato retangular (a descrição pormenorizada da caixa experimental pode ser encontrada em Solomon e Wynne, 1953, pp. 2 e 3), onde o espaço era dividido em dois compartimentos de igual tamanho, separados por uma barreira fixa a partir do chão da gaiola até metade da altura total e por uma barreira móvel na metade superior com mesma altura que a de baixo. A barreira móvel podia fazer movimento de guilhotina para cima a partir do meio e para baixo até o meio. Quando estava abaixada, impedia a passagem do sujeito experimental de um compartimento para o outro; quando era erguida, liberava a passagem dos sujeitos experimentais, que podiam pular por sobre a metade fixa da divisória sem dificuldade, passando assim de um compartimento para o outro e vice-versa. O chão de ambos os compartimentos era feito de barras metálicas que permitiam aplicar um choque doloroso nos animais. O procedimento consistiu em apresentar um CS (a luz do compartimento onde estava o sujeito experimental era apagada, a porta superior da barreira era levantada: assim permitia que o sujeito passasse de um compartimento para o outro), e a luz do outro compartimento era acesa). Passados 10 segundos, um choque intenso pré-tetânico (US) era ligado nas barras metálicas da base da gaiola onde o animal estava. O choque era mantido no compartimento escuro até que o animal pulasse para o outro compartimento, o iluminado. A porta superior da barreira era, então, baixada imediatamente depois da resposta de fuga, para impedir o retorno do cachorro. Havia um intervalo temporal padrão de 10 segundos entre CS-US, mantido em todas as tentativas de fuga. O intervalo entre tentativas (entre sucessivos CS) era de 3 minutos. Uma tentativa de fuga ou de choque foi definida como uma tentativa em que o cachorro levou o choque antes de pular a barreira. Uma tentativa de esquiva foi definida como aquela em que ele pulava a barreira sem receber choque. Ou seja, nas tentativas de esquiva, as respostas do sujeito ocorriam com latência inferior a 10 segundos; nas de fuga, tinham uma latência superior a 10 segundos. O procedimento, então, repetia-se com a inversão dos compartimentos (esquerda-direita, resposta de fuga ou esquiva, depois direita-esquerda, e assim sucessivamente).
Após o critério de aprendizagem ter sido atingido (dez tentativas sucessivas em que ocorreu esquiva), nenhum choque foi mais administrado na presença do CS, não importando o tempo que o animal levasse para pular. Tal procedimento, no qual o choque não era mais apresentado, foi chamado de extinção comum e realizado com 13 animais. Essa fase de extinção foi mantida por 20 dias; como eram feitas 10 tentativas por dia, os sujeitos foram expostos a pelo menos 200 tentativas.
Os resultados do experimento foram assim resumidos por Solomon, Kamin e Wynne (1953, pp. 292-293):
“Durante o procedimento de extinção comum, nenhum animal demorou para pular, de modo que não atenderam ao critério de não resposta ou latência infinita, que foi definido como dois minutos sem a resposta de pular, desde o início do CS. Em outras palavras, não se conseguiu a extinção. Os experimentadores chegaram à conclusão de que o procedimento de extinção simples não foi suficiente para remover a resposta de pular”.
Outro experimento foi então conduzido para testar a eficácia de um procedimento de extinção que impedia os sujeitos, fisicamente, de saltar na presença o CS. Esta técnica poderia ser denominada de “teste de realidade”. O animal foi forçado a uma sequência de eventos na qual o CS era apresentado, seguido de não saltar não era mais seguido de choque. O cachorro iria, como resultado deste novo “conhecimento” parar de pular? O procedimento consistia em manter uma barreira de vidro erguida, de tal maneira que era impossível saltar para o outro compartimento, a barreira estava presente nas tentativas 4 a 7. A barreira estava sinalizada com três fitas adesivas verticais, as quais indicavam para o cachorro a presença ou a ausência da barreira de vidro. Nas tentativas 1 a 3 e 8 a 10, o cachorro estava livre para saltar, como no experimento de extinção comum. Apenas dois dos nove cachorros pararam de saltar: o primeiro parou no quarto dia, o segundo parou no quinto dia do experimento e, testados nas 10 tentativas no dia seguinte, se mantiveram sem saltar.
De acordo com os autores (p. 295):
“Os resultados deste experimento mostraram que o procedimento com o uso da barreira de viro produz extinção em alguns cachorros. No entanto, durante o período de 10 dias em que o procedimento foi realizado, o procedimento falhou em extinguir a resposta de saltar na maioria dos cachorros”.
O próximo experimento avaliou os efeitos de extinção de choque, em conjunto com procedimento de punição. Foi delineado de maneira a testar o procedimento de extinção que punia (usando choque) a resposta de saltar. A expectativa era de que a punição com choque pararia a resposta de saltar. O choque tinha a duração de três segundos no compartimento para onde o animal saltava. Se o animal não saltasse na presença do CS, não haveria choque. A intensidade do choque era a mesma o treino inicial. Os autores relataram (pp. 295-296):
“Dos 13 cachorros neste procedimento, 10 não extinguiram a resposta em 100 tentativas extinção-choque. Três animais extinguiram. Todos eles deram latências infinitas [não saltaram] nas duas primeiras tentativas de punição por saltar. Atingiram o critério de não responder em 10 tentativas no final do segundo ia de choque-extinção”.
“Os resultados deste experimento indicaram que o procedimento choque-extinção produziu extinção abrupta em alguns animais. No entanto, no período de 10 dias em que ocorreu o procedimento, este falhou em extinguir a resposta de saltar na maioria dos cachorros. A punição pareceu aumentar a força da resposta de saltar na maioria dos cachorros, indicada pelo encurtamento do tempo de latência e maior vigor no salto”.
Finalmente, foram usados procedimentos para verificar os efeitos de uma combinação o procedimento com a barreira de vidro e o procedimento de choque-extinção. Nas primeiras três tentativas, a barreira de vidro não estava presente, mas, se o cachorro pulasse na presença do CS, ele pulava para o choque, que durava três segundos. Nas tentativas de 4 a 7, a barreira estava presente como no experimento anterior. Depois, nas tentativas 8 a 10, a barreira era removida e o salto para o choque era possível.
Os autores relataram (p. 296):
“Catorze os 16 cachorros extinguiram antes do sétimo dia do procedimento combinado. O critério de extinção foi como o os estudos anteriores, 10 latências infinitas no mesmo dia. Quando o cachorro não respondia nas três primeiras tentativas de um dia [sem barreira], a barreira não era usada e dava-se 10 tentativas de modo a testar a ocorrência da extinção. Os restantes dois animais não em 10 dias ou 100 tentativas. Os resultados deste experimento indicam que o procedimento combinado barreira de vidro e choque-extinção é altamente eficaz para produzir extinção da resposta de saltar. No entanto, há fortes indícios de que esta técnica é mais efetiva quando o procedimento de usar a barreira antecede o procedimento combinado, do que quando é precedido pelo choque-extinção (todos os seis cachorros que tinham tido dez dias de tentativas com barreira antes do procedimento combinado atingiram o critério em 30 tentativas ou menos; os oito cachorros que tiveram o procedimento choque-extinção antes do combinado atingiram o critério de extinção em menos de 70 tentativas do procedimento combinado”.
Conclui-se, então, que a contingência de fuga-esquiva sinalizada do choque tem efeito evocativo, bem como fortalecedor da resposta que evita o aparecimento do choque, no entanto, o enfraquecimento da resposta exige procedimentos específicos e diferenciados para atingir o critério de extinção.
Algumas Propriedades Quantitativas da Ansiedade
Estes e Skinner (1941) realizaram um experimento que foi considerado o paradigma experimental para estudar ansiedade. O sujeito experimental estava privado de comida e foi submetido a um esquema de reforçamento FI 4 min, ou seja, a primeira resposta após 4 minutos era reforçada. Durante a sessão de 60 minutos, havia duas apresentações de um som não contingente à resposta de pressão à barra, que permanecia ligado durante três minutos, ao fim dos quais um choque com função aversiva também não contingente à resposta-alvo era apresentado e o som desligado. Posteriormente, o som passou a ter a duração de 5 minutos e a combinação som-choque era apresentada apenas uma vez durante a sessão. A principal conclusão desse estudo foi que a frequência de respostas, durante a apresentação do som, sofria uma redução (que veio a ser denominada de supressão condicionada), embora o esquema de reforçamento intermitente se mantivesse em operação o tempo todo da sessão experimental. Os autores denominaram este procedimento de condicionamento de um estado de ansiedade. Estes e Skinner (1941; 1999, p. 561). Escreveram:
“A modificação do comportamento correlacionado com a antecipação de um estímulo perturbador [o som] não pode ser atribuído a reforçamento negativo da resposta de pressão à barra, pois o choque era sempre dado independentemente do comportamento do rato em relação à barra. ” [...]
Os autores concluíram (p. 569):
“Ansiedade é aqui definida como um estado emocional que surge em resposta a algum estímulo presente que tenha sido, no passado, seguido por um estímulo perturbador (disturbing). A magnitude do estado é medida por seus efeitos sobre a força de comportamento motivado por fome, neste caso a frequência com que os ratos pressionaram a barra sob efeito de um esquema de reforçamento periódico com comida. Apresentações repetidas de um som que terminava com um choque elétrico produziu um estado de ansiedade em resposta ao som, sendo que o primeiro indicador foi uma redução na força do comportamento motivado por fome durante o período do som. A depressão da taxa de responder durante ansiedade foi caracteristicamente seguida por um aumento compensatório na taxa”. [...]
Parece não haver dúvidas de que os autores atribuem os resultados comportamentais, bem como a ansiedade, aos efeitos aversivos da associação som-choque.
Supressão Condicionada Positiva: Supressão Condicionada Usando Reforçamento Positivo como Estímulo Incondicionado
Guilhardi (1975) escreveu:
“Azrin e Hake (1969, p.1) usaram um paradigma semelhante ao de Estes e Skinner (1941), mas, ao remover o E1 [O estímulo condicionado (som) usado por Estes-Skinner é chamado de E1 e o estímulo incondicionado (choque elétrico aversivo) de E2.], apresentaram alimento, água ou estimulação “gratificante” intracraniana como E2, ao invés de um choque aversivo. Os resultados foram uma redução na frequência de respostas na presença do E1. Neste estudo, como no procedimento de Estes e Skinner, o esquema de reforçamento positivo da linha de base continuava em operação, e o E2 era apresentado independentemente do comportamento do sujeito experimental. A redução de respostas durante E1 foi chamada por Azrin e Hake (1969) de “supressão condicionada positiva”, quando o E2 é um estímulo que, em outras ocasiões, funcionou como reforço positivo e “supressão condicionada negativa”, quando o E2 já mostrou ter a função de reforço negativo”.
O fenômeno da supressão de respostas durante o E1 não ocorre sistematicamente. Assim, LoLordo (1970) demonstrou o efeito de facilitação (aumento na taxa de respostas) durante o E1. Sucederam-se vários estudos experimentais, que manejaram parâmetros de diversas variáveis, visando determinar variáveis que controlam os fenômenos de “supressão” e “facilitação” das respostas durante E1. Guilhardi (1975) investigou o efeito (a) da duração do estímulo E1 que antecede a apresentação de um estímulo reforçador independente do comportamento E2 [usou uma gota de leite açucarado de tamanho cinco vezes maior que a gota de água usada na linha de base] e (b) da frequência de reforço da linha de base, sobre o desempenho operante de ratos em um paradigma de supressão condicionada positiva. Para três sujeitos experimentais, a linha de base foi mantida em VI 30seg e, para outros três, em um esquema VI 60seg. Durante o desempenho de linha de base, E1 era introduzido independentemente de qualquer resposta do sujeito, mantido por um intervalo fixo de tempo (E1 de duração curta 15 segundos; E1 de duração longa 60 segundos) e terminado com a apresentação do E2.
Os resultados desse procedimento foram diminuição da frequência de respostas durante E1 15 seg. em relação ao pré E1, independente da frequência de reforço na linha de base. O desempenho durante E1 60 seg. variou entre sujeitos: dois aumentaram, dois não alteraram e um reduziu a frequência de respostas em relação ao pré E1. Conclui-se que as alterações na frequência de respostas durante o E1 estão relacionadas com sua duração, mas as frequências programadas de reforços de linha de base investigadas não têm função relevante sobre o desempenho dos sujeitos durante E1. Os valores da razão de reforço antes e depois da introdução do E2 se relacionaram com a supressão de respostas. Os dados assim produzidos são consistentes com a literatura de pesquisa na área.
Assim escreveu Guilhardi (1975, p.11):
“A variável ‘duração do E1’ foi a mais amplamente investigada dentro da área de supressão condicionada positiva. [...] Stein, Sidman e Brady (1958) concluíram que a estimativa da porcentagem de reforços que seriam perdidos, se o animal suprimisse completamente durante o E1, era uma variável mais fidedigna do que a duração relativa do E1. Apresentaram, inclusive, evidências que sugeriram que a variável ‘duração relativa’ pareceu ter um efeito marcante sobre a supressão porque esta variável tinha uma alta correlação com a estimativa da porcentagem de reforços que seriam perdidos se o animal suprimisse completamente durante o E1. O fato de os dois paradigmas de supressão – positiva e negativa – apresentarem várias semelhanças funcionais (Azrin e Hake, 1969; Miczek e Grossman, 1971; Smith (1974) sugere que a análise feita por Stein et al. pode ser útil para se entender o que ocorre na supressão condicionada positiva. Não foi feito nenhum estudo sistemático para esclarecer este aspecto. ” [Para melhor compreender essa análise de Stein et al, no experimento de Estes - Skinner, se o rato parasse totalmente de responder durante os 5 minutos que demorava o E1, perderia um único reforço de 15 possíveis, pois a sessão tinha 60 minutos e o FI era de 4 minutos, logo disponibilizava 15 reforços. A perda de reforços seria inferior a 10%].
Não há necessidade de ir além nas evidências empíricas e nas análises conceituais a respeito das supressões condicionadas. Basta ter claro que as conclusões de Estes e Skinner não se restringem ao efeito aversivo do choque, mas elas se aproximam espantosamente das evidências empíricas dos experimentos sobre supressão condicionada positiva. E ainda falta muito a ser esclarecido. Mas, com certeza, as interrogações feitas pelos pesquisadores de ambas as áreas (o papel do esquema de reforçamento positivo da linha de base no paradigma da supressão condicionada positiva (Kelly, 1973); a duração do E1 (Smith, 1974); a quantidade de reforço E2 comparada com a quantidade na linha de base (LoLordo, 1970) etc.) só serão respondidas com estudos sistemáticos das contingências de reforçamento em operação: variações nas contingências de reforçamento (nos procedimentos experimentais usados) dificultam a organização dos papeis de cada variável experimental envolvida. Dados produzidos por contingências diferentes não podem ser satisfatoriamente comparados; seriam necessárias replicações sistemáticas dos procedimentos em que variasse apenas uma variável de cada vez (apenas duração de E1; apenas o número de reforços da linha de base; apenas E2 aversivo; apenas E2 reforçador etc.) enquanto todas as outras se mantivessem constantes... um longo projeto de pesquisa, enfim!
Não basta descrever as contingências de reforçamento: é necessário descrever as interações dos parâmetros de seus componentes.
Nos Estudos Experimentais, os Parâmetros das Contingências Bastam como Eventos com Funções Motivacionais
Os resultados dos experimentos de Solomon et. al. (1953) são impressionantes, em particular a ineficiência do procedimento de “teste de realidade” usado isoladamente e, mais ainda, o experimento em que os cachorros pulavam mais rápida e vigorosamente para o choque (punição positiva). O paradigma da esquiva dificulta a extinção do comportamento, mesmo sendo ele punido ou impossibilitado de ser emitido por algum tempo.
Os resultados do experimento de Azrin (1959) também impressionam: os pombos produziam choques até níveis certamente aversivos a cada bicada, em combinação com esquema de FR com reforço positivo, cuja razão foi aumentada até 50 respostas para um reforço. A engenhosa programação das contingências de reforçamento mostra que o efeito do choque é determinado por contingências e não por sua função aversiva em si.
Os resultados de Estes-Skinner (1941) levantam a questão de por que os sujeitos experimentais param de pressionar a barra, se a apresentação sinalizada do choque não é contingente a essa resposta, e suprimir comportamento leva a perda “desnecessária” de reforço.
Os resultados de Azrin e Hake (1969) evocam outras surpresas, pois colocam em questão as variáveis determinantes da supressão de respostas que, no experimento de Estes e Skinner, parecia estar relacionada ao evento aversivo sinalizado não contingente supressão de respostas (“ansiedade negativa”), enquanto Azrin e Hake demonstraram que um evento reforçador sinalizado não contingente produz supressão de respostas (“ansiedade positiva”). Posso acrescentar que na área de pesquisa da supressão condicionada positiva houve muitos experimentos (não é objetivo deste artigo relacioná-los) que estudaram parâmetros que compunham as contingências de reforçamento dos procedimentos; assim, duração do CS, frequência de reforços dos esquemas de reforçamento da linha de base, os quais demonstraram que não só ocorre supressão, mas também facilitação (aumento de respostas na presença do CS). Pode-se concluir que não é o paradigma em si o responsável pela supressão, mas as interações dos parâmetros das variáveis experimentais, que podem, inclusive, produzir aumento da emissão de respostas.
Concluo que em experimentos com animais ficou demonstrado que os parâmetros e maneiras de introduzir os componentes das contingências de reforçamento são ainda mais reveladores que fenótipos de contingências em si.
São os parâmetros, então, que atuam como operações motivacionais? Proponho que seja deixada de lado a preocupação da motivação e se fale sobre procedimentos que produzem tais e tais efeitos comportamentais. Os procedimentos tecnologicamente descritos e as contingências de reforçamento tecnicamente descritas bastam! Tal interpretação é ainda mais apropriada quando tratamos das “motivações” humanas, pois os contextos humanos são formados por inúmeras contingências de reforçamento que se influenciam reciprocamente, por variáveis históricas que nos limitam a descrições e análises arbitrárias de recortes do comportamento humano. Descrevê-los tecnologicamente, interpretá-los com base em evidências empíricas, aplicando a parcimônia como atitude interpretativa e movendo variáveis de forma sistemática para confirmar e manter ou corrigir e substituir interpretações confiáveis por mais confiáveis é possível e suficiente.
Nenhum comentário:
Postar um comentário