IA para criação de conteúdo? Estudo revela que 97% das tarefas apresentam falhas

Embora a inteligência artificial (IA) tenha avançado a passos largos, ela ainda encontra uma barreira significativa: a complexidade do mundo real. Um estudo conduzido pelo Center for AI Safety e pela Scale colocou à prova os modelos mais poderosos da atualidade — incluindo GPT-5, Gemini 2.5 Pro, Manus AI e Grok 4 — em projetos reais de trabalho remoto. O veredito foi contundente: em mais de 97% dos casos, as ferramentas não conseguiram entregar resultados com qualidade profissional.

O Teste: Projetos Reais vs. Perguntas Fechadas

Diferente dos testes convencionais que medem apenas lógica ou conhecimento enciclopédico, esta pesquisa utilizou o Índice de Trabalho Remoto (RLI). O sistema submeteu as IAs a briefings idênticos aos de freelancers humanos em áreas como:

  • Desenvolvimento de jogos e animação 2D/3D;
  • Arquitetura e design de produtos;
  • Análise de dados complexos.

Os projetos exigiam mais de 100 horas de dedicação e tinham valores de mercado superiores a US$ 10 mil. O objetivo era verificar se a máquina conseguiria gerenciar o fluxo completo de trabalho sem auxílio humano.

Onde a Inteligência Artificial tropeça

O desempenho mais “alto” registrado foi o do modelo Manus, que atingiu apenas 2,5% de automação bem-sucedida. Isso significa que a imensa maioria dos projetos entregues pelas IAs precisaria ser refeita ou sofreria correções drásticas por humanos. Segundo os pesquisadores, as principais deficiências são:

  • Incapacidade de lidar com ambiguidades: A IA tem dificuldade em interpretar instruções que não são 100% literais.
  • Falta de consistência: Os modelos perdem o fio da meada em projetos longos e estruturais.
  • Ausência de aprendizado contínuo: Diferente de um profissional que se ajusta ao receber um feedback durante o processo, a IA não demonstra adaptação em tempo real durante o desenvolvimento.

Apoio, não substituição

Os resultados contrariam as previsões mais pessimistas sobre a substituição imediata de profissionais criativos. O estudo reforça que, no estágio atual, a IA funciona como um copiloto de produtividade e não como um agente autônomo capaz de assumir responsabilidades totais.

Apesar do cenário atual de falhas, os autores observam que há uma evolução gradual. No entanto, por enquanto, a tomada de decisão estratégica e a adaptação criativa continuam sendo territórios exclusivamente humanos.

WhatsApp