image

Bootcamps ilimitados e +750 cursos pra sempre

70
%OFF
Article image

JS

João Silva28/09/2026 19:06
Compartilhe

Como uma pessoa cega usa computador e celular nos dias de hoje?

    A resposta pode mudar sua forma de enxergar tecnologia

    Tem uma pergunta que muita gente que enxerga provavelmente já pensou, mas talvez nunca tenha tido coragem de fazer:

    como uma pessoa cega usa um computador ou um celular se praticamente tudo ali foi feito para ser visto?

    Como ela encontra um botão?

    Como sabe onde está um campo de texto?

    Como lê uma página?

    Como programa?

    Como usa WhatsApp?

    Como compra pela internet?

    Como sabe o que existe em uma imagem?

    E talvez a pergunta mais interessante:

    se a pessoa não vê a tela, o que exatamente ela está “vendo” quando navega?

    Sou uma pessoa com deficiência visual e uso tecnologia no meu dia a dia para estudar, aprender desenvolvimento Full Stack, inteligência artificial, cibersegurança, acessar serviços, produzir conteúdo e fazer várias outras atividades.

    E existe uma coisa que gostaria que mais pessoas soubessem:

    uma pessoa cega não precisa enxergar uma interface para compreender sua estrutura.

    Nós podemos ouvir essa estrutura.

    E depois que você entende como isso funciona, talvez nunca mais olhe para um site da mesma maneira.

    Primeiro: leitor de tela não é alguém narrando a tela

    Essa talvez seja a primeira grande confusão.

    Um leitor de tela não fica simplesmente dizendo:

    “Existe uma imagem à esquerda, um botão azul no canto superior e uma caixa branca embaixo.”

    Não funciona assim.

    No computador, softwares como o NVDA conseguem acessar informações fornecidas pelo sistema operacional e pelos aplicativos e transformá-las em fala ou braille. O NVDA, por exemplo, é um leitor de telas gratuito para Windows capaz de interagir com navegadores, editores de texto, aplicativos de escritório e muitas outras ferramentas.

    No iPhone existe o VoiceOver.

    No Android existe o TalkBack.

    O VoiceOver descreve elementos da interface por áudio, braille ou ambos, enquanto o TalkBack permite explorar os elementos do celular por toque e gestos.

    Mas aqui está a parte que realmente importa:

    não navegamos necessariamente pela aparência da tela. Navegamos pela estrutura da interface.

    O leitor de tela encontra elementos, não pixels

    Imagine uma página contendo:

    • um título;
    • três links;
    • uma caixa de pesquisa;
    • cinco botões;
    • um formulário;
    • uma imagem.

    Uma pessoa que enxerga pode bater o olho e perceber praticamente tudo de uma vez.

    Com um leitor de tela, a experiência é diferente.

    Podemos navegar entre títulos.

    Depois entre links.

    Depois entre campos.

    Depois entre botões.

    No Android, por exemplo, o TalkBack oferece controles de leitura para navegar por caracteres, palavras, linhas, parágrafos, títulos, controles e links.

    Ou seja:

    a página deixa de ser apenas uma composição visual.

    Ela se transforma em uma estrutura navegável.

    E isso revela uma coisa curiosa sobre desenvolvimento web:

    o código que o usuário comum nunca percebe pode determinar completamente a experiência de uma pessoa cega.

    Como usamos um computador sem mouse?

    Essa também costuma surpreender.

    Eu consigo realizar grande parte das atividades utilizando teclado.

    Em vez de procurar visualmente onde está determinado elemento, utilizamos comandos e atalhos.

    Tab pode mover o foco entre elementos interativos.

    Setas permitem navegar por determinadas estruturas.

    Comandos específicos do leitor de tela podem localizar títulos, links, campos, tabelas e outros elementos.

    Para quem está acostumado com mouse, pode parecer complicado.

    Mas pense por outro ângulo.

    Uma pessoa experiente usando leitor de telas não está tentando imitar uma pessoa enxergando.

    Ela desenvolveu outra forma de interação com a máquina.

    E em determinadas tarefas, teclado e atalhos podem ser extremamente rápidos.

    Existe uma diferença importante aqui:

    acessibilidade não significa transformar a experiência de uma pessoa cega em uma cópia da experiência visual.

    Significa permitir que a mesma informação e a mesma funcionalidade possam ser acessadas de outra maneira.

    E no celular? Como alguém toca no que não consegue ver?

    Aqui aparece outra pergunta clássica.

    Se um celular moderno praticamente não possui botões físicos, como uma pessoa cega usa a tela?

    Com gestos específicos.

    No Android com TalkBack, por exemplo, é possível deslizar para mover o foco entre elementos. Quando um item recebe foco, o leitor anuncia o que ele representa. Para ativá-lo, utiliza-se um gesto específico, como o toque duplo.

    Também é possível explorar a tela passando o dedo sobre ela e ouvindo os elementos encontrados.

    No iPhone, o VoiceOver segue uma lógica parecida: a pessoa navega pelo conteúdo utilizando gestos adaptados ao leitor de tela.

    Então imagine isto:

    você toca em determinado ponto.

    O celular anuncia:

    “WhatsApp.”

    Você toca duas vezes.

    O aplicativo abre.

    Depois desliza.

    “Conversas.”

    Mais um gesto.

    “Pesquisar.”

    Mais outro.

    “João.”

    A interface vai sendo construída mentalmente.

    Não porque estamos enxergando cores ou posições.

    Mas porque estamos recebendo informações estruturadas sobre aquilo que existe ali.

    Aqui está o segredo: acessibilidade começa no código

    Agora chegamos a uma coisa que todo desenvolvedor deveria entender.

    O leitor de tela pode ser excelente.

    Mas ele não consegue adivinhar tudo.

    Se você cria um botão e informa corretamente que aquilo é um botão, existe uma boa chance de o leitor de tela conseguir anunciar isso.

    Se coloca um rótulo correto em um campo, o usuário pode saber o que deve digitar.

    Se organiza a página com títulos adequados, conseguimos navegar por eles.

    Se uma imagem importante possui texto alternativo, conseguimos receber aquela informação.

    A W3C explica justamente que imagens precisam de alternativas textuais quando transmitem informação; sem isso, pessoas que utilizam leitores de tela podem ficar sem acesso ao conteúdo visual.

    Agora imagine o contrário.

    Um botão aparece e o leitor anuncia:

    “Botão sem nome.”

    Fantástico.

    Botão de quê?

    Comprar?

    Excluir conta?

    Transferir R$ 5?

    Explodir o planeta?

    Não faço ideia.

    Esse pequeno exemplo mostra uma coisa enorme:

    muitas vezes, a deficiência não está apenas na pessoa. A barreira está na interface.

    Antes da IA, o mundo digital podia terminar em uma imagem

    Leitores de tela já existem há muito tempo.

    Reconhecimento óptico de caracteres também não nasceu ontem.

    Então seria errado dizer que pessoas cegas ficaram esperando a inteligência artificial generativa chegar para usar computadores.

    Nós já estudávamos.

    Trabalhávamos.

    Programávamos.

    Navegávamos.

    Produzíamos conteúdo.

    Mas existiam barreiras que podiam interromper uma atividade de maneira brutal.

    Quando a informação existia apenas visualmente

    Imagine um site com uma imagem contendo informações importantes.

    Sem descrição.

    Sem texto alternativo.

    Para uma pessoa enxergando, está tudo ali.

    Para o leitor de tela?

    Talvez apenas:

    “Imagem.”

    Pronto.

    Acabou.

    É quase como alguém lhe entregar uma folha e dizer:

    “Tem uma informação muito importante aqui.”

    E depois arrancar a folha da sua mão.

    Interfaces inacessíveis viravam investigação

    Também existiam — e ainda existem — interfaces nas quais os controles não possuem nomes corretos.

    Documentos escaneados como imagens.

    CAPTCHAs visuais.

    PDFs sem camada de texto.

    Menus mal estruturados.

    Gráficos sem descrição.

    Fotos essenciais para compreender uma tarefa.

    Nessas situações, utilizávamos diferentes estratégias:

    • OCR;
    • tentativa e erro;
    • copiar conteúdo;
    • procurar outra versão;
    • utilizar ferramentas especializadas;
    • pedir ajuda para uma pessoa que enxerga.

    E essa última parte é importante.

    Às vezes o problema não era:

    “Eu não sei fazer isso.”

    Era:

    “A informação necessária para fazer isso foi apresentada apenas visualmente.”

    São duas coisas completamente diferentes.

    Então veio a IA e uma coisa começou a mudar

    É aqui que considero que entramos em uma das fases mais interessantes da acessibilidade digital.

    IA multimodal começou a interpretar não apenas texto, mas também imagens e interfaces.

    Isso significa que algo que antes podia ser simplesmente:

    “Imagem sem descrição.”

    agora pode se transformar em:

    “A imagem mostra um painel com três gráficos. O primeiro apresenta crescimento das vendas entre janeiro e março…”

    Caramba.

    Parece uma pequena mudança.

    Mas não é.

    Agora podemos fazer perguntas para uma imagem

    Ferramentas como Be My AI conseguem fornecer descrições de imagens para pessoas cegas ou com baixa visão e permitem fazer perguntas complementares sobre aquilo que foi analisado. A ferramenta também pode descrever telas e arquivos no computador.

    Microsoft Seeing AI também utiliza recursos de inteligência artificial para tarefas como leitura de textos, identificação de produtos e descrição de fotografias.

    A Apple também vem incorporando reconhecimento de imagens e descrições mais detalhadas ao ecossistema do VoiceOver.

    Agora pense no impacto disso.

    Não é apenas:

    “O que existe nesta imagem?”

    Podemos perguntar:

    Qual é o botão que aparece nesta tela?
    Existe alguma mensagem de erro?
    O gráfico está subindo ou descendo?
    Qual produto aparece na embalagem?
    Onde está determinada opção?
    O documento possui alguma informação que não foi reconhecida pelo leitor de tela?

    A imagem deixa de ser uma parede.

    Ela começa a virar informação interrogável.

    A IA virou uma espécie de ponte entre duas interfaces

    Essa talvez seja a parte que mais mudou minha forma de pensar.

    O leitor de tela trabalha muito bem quando a interface oferece boa informação de acessibilidade.

    Mas o mundo digital não é perfeito.

    Existem sites ruins.

    Aplicativos mal construídos.

    Documentos problemáticos.

    Imagens sem descrição.

    A IA começou a ocupar justamente o espaço entre:

    o que a interface deveria fornecer

    e

    o que ela realmente fornece.

    Um exemplo em desenvolvimento

    Imagine que estou estudando programação e alguma ferramenta apresenta uma informação de maneira extremamente visual.

    Antes eu poderia:

    1. tentar navegar;
    2. usar OCR;
    3. procurar documentação;
    4. pedir ajuda;
    5. desistir daquela interface e procurar outra.

    Hoje posso acrescentar outra possibilidade:

    pedir para uma IA interpretar aquela tela comigo.

    Não significa que ela sempre acertará.

    Mas existe agora uma camada intermediária que antes não existia dessa forma.

    Isso pode reduzir drasticamente o atrito.

    O que a IA realmente nos deu foi contexto

    Existe uma diferença enorme entre ler caracteres e compreender uma situação.

    OCR pode dizer:

    “Erro 403.”

    Uma IA pode ajudar a explicar:

    “A tela mostra uma mensagem de acesso negado e um botão para voltar à página anterior.”

    Percebe a diferença?

    Uma ferramenta extraiu texto.

    A outra tentou interpretar contexto.

    É exatamente isso que torna IA multimodal tão interessante para acessibilidade.

    Ela consegue transformar parte da informação visual em linguagem.

    E linguagem é justamente o território no qual leitores de tela trabalham muito bem.

    Mas atenção: IA não é desculpa para criar sites inacessíveis

    Aqui mora uma armadilha perigosa.

    Alguém pode ler tudo isso e pensar:

    “Então não precisamos mais de texto alternativo. A IA resolve.”

    Não!

    Definitivamente não.

    Um site acessível continua precisando ser construído corretamente.

    Botões precisam ter nomes.

    Formulários precisam de rótulos.

    Teclado precisa funcionar.

    Títulos precisam ser estruturados.

    Imagens importantes precisam de descrição.

    Isso beneficia a pessoa diretamente, sem obrigá-la a utilizar uma segunda ferramenta para compreender uma interface que deveria funcionar desde o começo.

    Além disso, IA pode errar.

    Pode interpretar uma imagem incorretamente.

    Pode omitir detalhes.

    Pode gerar uma descrição plausível que não corresponde exatamente ao conteúdo.

    Também existem questões de privacidade quando telas, documentos ou fotografias são enviados para serviços externos.

    Então a equação correta não é:

    IA substitui acessibilidade.

    É:

    acessibilidade bem construída + tecnologia assistiva + IA podem ampliar muito a autonomia.

    Talvez agora você esteja percebendo uma coisa

    Quando uma pessoa cega não consegue utilizar determinado site, a conclusão automática costuma ser:

    “Ela não consegue porque não enxerga.”

    Só que talvez a pergunta correta seja:

    “Esse site forneceu a informação necessária de uma forma que não depende exclusivamente da visão?”

    Muda tudo, não é?

    Porque agora deixamos de olhar apenas para a limitação individual.

    Começamos a olhar também para a arquitetura da tecnologia.

    A web pode ser visual sem ser exclusivamente visual

    Não precisamos eliminar imagens.

    Não precisamos acabar com interfaces bonitas.

    Não precisamos transformar todo site em uma página de texto.

    A questão é outra.

    Uma experiência pode ser extremamente visual e continuar acessível.

    Pode existir gráfico.

    Desde que a informação relevante também esteja disponível de outra maneira.

    Pode existir fotografia.

    Desde que seu significado não dependa apenas da visão.

    Pode existir botão com ícone.

    Desde que o controle tenha um nome acessível.

    Pode existir interação complexa.

    Desde que teclado e tecnologias assistivas consigam operar aquela interface.

    Essa é uma das coisas mais bonitas da acessibilidade:

    não se trata de empobrecer uma experiência para algumas pessoas. Trata-se de construir mais de um caminho até a mesma informação.

    O que uma pessoa que enxerga deveria levar deste artigo?

    Talvez cinco ideias.

    1. Pessoas cegas não “ouvem pixels”

    Nós navegamos por informações, estruturas, controles, texto, estados e semântica.

    2. Leitor de tela não faz milagres

    Se o desenvolvedor não fornece informação adequada, o leitor pode não ter o que anunciar.

    3. Não usar mouse não significa usar o computador “pior”

    É outra lógica de interação.

    Teclado, gestos, braille e áudio formam caminhos diferentes até a mesma tecnologia.

    4. IA mudou profundamente nossa capacidade de contornar barreiras

    Imagens, documentos, interfaces e situações anteriormente muito dependentes da visão podem agora ser interpretados com muito mais independência.

    5. Isso não elimina a responsabilidade de criar tecnologia acessível

    IA deveria ampliar acessibilidade.

    Não servir como desculpa para ignorá-la.

    A maior mudança talvez não esteja na tecnologia

    Quando comecei este artigo, fiz uma pergunta:

    como uma pessoa cega usa computador e celular?

    Talvez agora você perceba que existe uma pergunta ainda melhor:

    por que nós presumimos que uma interface precisa ser enxergada para ser compreendida?

    Essa suposição está escondida em muito do que construímos.

    Tela significa visual.

    Gráfico significa olhar.

    Botão significa encontrar com o mouse.

    Imagem significa ver.

    Mas tecnologia assistiva vem desafiando essa lógica há décadas.

    E a inteligência artificial adicionou uma nova camada.

    Hoje conseguimos transformar cada vez mais informação visual em linguagem.

    Podemos perguntar sobre uma imagem.

    Investigar uma tela.

    Entender parte de uma interface inacessível.

    Interpretar documentos.

    Receber contexto.

    Resolver tarefas que antes poderiam depender da ajuda de outra pessoa.

    Para mim, como pessoa com deficiência visual, isso não significa apenas conveniência.

    Significa mais possibilidades de agir de maneira independente.

    E talvez seja exatamente aí que esteja a verdadeira força da tecnologia.

    Não em fazer uma máquina parecer humana.

    Mas em permitir que mais humanos consigam fazer coisas que antes tinham sido desnecessariamente dificultadas para eles.

    Depois disso, fica difícil olhar para acessibilidade como um “recurso extra”.

    Ela começa a parecer aquilo que sempre deveria ter sido:

    boa tecnologia.

    E agora deixo uma pergunta para você:

    se amanhã você precisasse usar a internet inteira sem enxergar a tela, quantos dos sistemas que você usa hoje continuariam realmente funcionando?

    #Acessibilidade #InteligenciaArtificial #TecnologiaAssistiva #NVDA #EuSouDIOCampusExpert

    Compartilhe
    Recomendados para você
    Reclame AQUI - Dados e IA na Prática
    CI&T - Java AI Copilot
    Itaú - Java com Inteligência Artificial
    Comentários (0)