Introducción
Con los recientes Premios Nobel que reconocen la contribución de la inteligencia artificial a la ciencia, los modelos de lenguaje de gran escala (LLMs) están transformando la investigación científica al aumentar la productividad y remodelar los métodos científicos. Hoy en día, los LLMs ya participan en el diseño experimental, el análisis de datos y los flujos de trabajo, destacándose especialmente en los campos de la química y la biología.
Los últimos avances en inteligencia artificial han transformado múltiples aspectos de la sociedad, la economía global y las prácticas de investigación académica. La IA generativa y los LLMs ofrecen oportunidades sin precedentes para transformar las prácticas científicas, impulsar el desarrollo científico y acelerar la innovación tecnológica. Los Premios Nobel de Física y Química han sido otorgados a varios líderes de la IA, reconociendo sus contribuciones a la IA y a modelos de vanguardia como los LLMs. Esto presagia que los LLMs transformarán o impulsarán la investigación científica al aumentar la productividad y apoyar todas las etapas del método científico. La aplicación de la IA en la ciencia está floreciendo, abarcando numerosos campos científicos e influyendo en diferentes partes del método científico.
Aunque los LLMs tienen un gran potencial en la generación de hipótesis y la síntesis de datos, la IA y los LLMs aún enfrentan desafíos en la ciencia básica y el descubrimiento científico. Por lo tanto, nuestro punto de vista es que, hasta ahora, el impacto de la IA en la ciencia básica ha sido limitado—entendiendo aquí la ciencia básica como el descubrimiento de nuevos principios o nuevas leyes científicas. Este artículo revisa cómo los LLMs se utilizan actualmente como herramientas técnicas para mejorar el proceso científico, y cómo podrían usarse en el futuro a medida que se vuelvan más potentes y se conviertan en asistentes científicos poderosos. La combinación de técnicas basadas en datos con sistemas simbólicos puede fusionarse en motores híbridos, lo que podría conducir a nuevas direcciones de investigación. Nuestro objetivo es describir la brecha entre los LLMs como herramientas técnicas y como 'motores de creatividad', estos últimos capaces de generar nuevos descubrimientos científicos de alta calidad y plantear nuevas preguntas e hipótesis a los científicos humanos. Primero revisamos las aplicaciones actuales de los LLMs en la ciencia, con el objetivo de identificar las limitaciones que deben superarse para avanzar hacia motores de creatividad.
Aplicaciones actuales
Los LLMs se han aplicado ampliamente en el análisis de literatura científica, la generación de protocolos experimentales, la interpretación de datos y la formación preliminar de hipótesis. Por ejemplo, en el descubrimiento de fármacos, los LLMs pueden ayudar a predecir propiedades moleculares; en ciencia de materiales, pueden recomendar rutas de síntesis. Sin embargo, la mayoría de estas aplicaciones permanecen a nivel de asistencia, sin poder generar aún de forma independiente conocimientos científicos originales.
Desafíos y limitaciones
Los desafíos centrales que enfrentan los LLMs incluyen: falta de comprensión causal del mundo físico, propensión a generar 'alucinaciones', dependencia de la calidad y los sesgos de los datos de entrenamiento, y deficiencias en el razonamiento interdisciplinario. En la ciencia básica, para descubrir principios completamente nuevos, se requiere una capacidad de razonamiento abstracto que vaya más allá del reconocimiento de patrones, y esto es precisamente la debilidad de los LLMs actuales.
Direcciones futuras
Para lograr la transición de los LLMs de herramientas a motores de creatividad, es necesario desarrollar sistemas híbridos: combinar las capacidades lingüísticas de los LLMs con el razonamiento simbólico, los grafos de conocimiento y la simulación física. Además, es crucial establecer métricas de evaluación claras para garantizar que los resultados de los LLMs se alineen con los objetivos científicos humanos. La colaboración interdisciplinaria y la alineación continua entre humanos y máquinas serán fundamentales.