Uma investigação recente apontou que modelos linguísticos de grande porte, como o GP-4 (que é usado em algumas variantes do ChatGPT e em várias ferramentas de IA generativa, como o Microsoft Copilot), são habilidosos na avaliação de documentos financeiros, ultrapassando a habilidade humana.
Os estudos conduzidos por acadêmicos da Universidade de Chicago sugerem implicações substanciais para o futuro das avaliações financeiras e das decisões tomadas à medida que a IA ganha mais destaque em análises detalhadas.
Foto: Divulgação
Além disso, a pesquisa ressalta a versatilidade dos modelos linguísticos generais e multifuncionais, como o GPT-4, que podem fornecer habilidades comparáveis às de ferramentas mais especializadas.
Os experimentos mostraram que o GPT-4 supera consistentemente o desempenho dos analistas humanos, mesmo quando não é fornecido um contexto textual explícito.
A tecnologia demonstrou uma precisão de cerca de 60%, enquanto os analistas humanos variaram entre 53% e 57%.
Entretanto, esses resultados não foram alcançados sem um trabalho inicial considerável; o estudo descreve o uso de sugestões de cadeias de pensamento pelos pesquisadores para melhorar a precisão e a adequação das respostas geradas pelo modelo.
Adicionalmente, foi observado que o GPT-4 e os analistas humanos complementam-se mutuamente: a IA se destaca em áreas onde os humanos podem ser ineficientes ou suscetíveis a vieses, enquanto os humanos agregam valor ao fornecerem contexto adicional quando necessário.
As habilidades do GPT-4 são atribuídas à sua vasta base de conhecimento e à sua compreensão teórica, permitindo-lhe extrair conclusões a partir de padrões de dados mesmo sem um treinamento financeiro específico.