Introdução
Com os recentes prêmios Nobel reconhecendo a contribuição da inteligência artificial para a ciência, os grandes modelos de linguagem (LLMs) estão transformando a pesquisa científica ao aumentar a produtividade e remodelar os métodos científicos. Hoje, os LLMs já participam do design experimental, análise de dados e fluxos de trabalho, destacando-se especialmente nas áreas de química e biologia.
Os avanços mais recentes da inteligência artificial já transformaram vários aspectos da sociedade, a economia global e as práticas acadêmicas de pesquisa. A IA generativa e os LLMs trazem oportunidades sem precedentes para transformar as práticas científicas, promover o desenvolvimento científico e acelerar a inovação tecnológica. Os Prêmios Nobel de Física e Química foram concedidos a vários líderes da IA, reconhecendo suas contribuições para a IA e modelos de ponta, como os LLMs. Isso indica que os LLMs transformarão ou impulsionarão a pesquisa científica, aumentando a produtividade e apoiando todas as fases do método científico. A aplicação da IA na ciência está florescendo, abrangendo diversos campos científicos e influenciando diferentes partes do método científico.
Embora os LLMs tenham grande potencial na geração de hipóteses e na síntese de dados, a IA e os LLMs ainda enfrentam desafios na ciência básica e na descoberta científica. Portanto, nossa opinião é que, até agora, o impacto da IA na ciência básica tem sido limitado — aqui, ciência básica é definida como a descoberta de novos princípios ou novas leis científicas. Este artigo revisa como os LLMs estão atualmente sendo usados como ferramentas técnicas para aprimorar o processo científico e como podem ser usados no futuro, à medida que se tornam mais poderosos e evoluem para assistentes científicos robustos. Combinando técnicas orientadas por dados com sistemas simbólicos, tais sistemas podem se fundir em motores híbridos, possivelmente liderando novas direções de pesquisa. Nosso objetivo é descrever a lacuna entre os LLMs como ferramentas técnicas e como 'motores criativos', estes últimos capazes de gerar novas descobertas científicas de alta qualidade e propor novas questões e hipóteses aos cientistas humanos. Primeiro, revisamos as aplicações atuais dos LLMs na ciência, com o objetivo de identificar as limitações que precisam ser resolvidas para avançar em direção ao motor criativo.
Aplicações Atuais
Os LLMs têm sido amplamente aplicados na análise de literatura científica, geração de protocolos experimentais, interpretação de dados e formação inicial de hipóteses. Por exemplo, na descoberta de medicamentos, os LLMs podem ajudar a prever propriedades moleculares; na ciência dos materiais, podem recomendar rotas de síntese. No entanto, essas aplicações permanecem em grande parte no nível de suporte, ainda incapazes de gerar insights científicos originais de forma independente.
Desafios e Limitações
Os desafios centrais enfrentados pelos LLMs incluem: falta de compreensão causal do mundo físico, propensão a 'alucinações', dependência da qualidade e viés dos dados de treinamento, e deficiências no raciocínio interdisciplinar. Na ciência básica, descobrir princípios inteiramente novos requer capacidade de raciocínio abstrato que vai além do reconhecimento de padrões, e essa é uma fraqueza dos LLMs atuais.
Direções Futuras
Para concretizar a transição dos LLMs de ferramentas para motores criativos, é necessário desenvolver sistemas híbridos: combinar a capacidade linguística dos LLMs com raciocínio simbólico, grafos de conhecimento e simulação física. Além disso, é crucial estabelecer métricas de avaliação claras para garantir que as saídas dos LLMs estejam alinhadas com os objetivos científicos humanos. A colaboração interdisciplinar e o alinhamento contínuo homem-máquina serão fundamentais.