ChatGPT o Claude: ¿cuál obtiene mejores resultados en modelos financieros?

Un benchmark de septiembre, que evaluó la construcción de modelos financieros en Excel ubicó a tres versiones de Claude por encima de los modelos de OpenAI.

PUBLICIDAD
Anthropic PBC's Code With Claude Developer Conference

La inteligencia artificial (IA) también empieza a competir en una de las tareas más habituales de las finanzas: la construcción de modelos en Excel. Un benchmark de Vals AI publicado el 29 de septiembre de 2026 puso a prueba distintos modelos de IA para evaluar su desempeño en la construcción de modelos financieros a partir de un brief.

VER MÁS: ¿Claude es gratis? Esto puedes hacer sin pagar y cuánto cuestan sus planes

PUBLICIDAD

El resultado de esta prueba favoreció a Claude frente a ChatGPT. Las tres primeras posiciones correspondieron a modelos de Anthropic: Claude Fable 5.1 obtuvo 76,7%, seguido de Claude Opus 5.5, con 75,9%, y Claude Sonnet 5.5, con 75,7%.

El modelo de OpenAI con la puntuación más alta fue GPT-5.6 Sol (max), con 72,3%. Le siguieron GPT-6 Astra (max), con 71,7%; GPT-6 Sol (max), con 71,5%; GPT-6 Luna (max), con 68,5%; y GPT-5.6 Luna (max), con 67,1%.

La diferencia entre el modelo de Claude con la puntuación más alta y el de OpenAI con el mejor resultado fue de 4,4 puntos porcentuales.

PUBLICIDAD

VER MÁS: Científicos cuestionan el alcance del hallazgo genético de Claude anunciado por Anthropic

Qué midió la prueba

El benchmark está enfocado específicamente en la modelización financiera en Excel. Los modelos reciben un brief de analista y deben generar un modelo financiero funcional, incluida su estructura y las fórmulas necesarias.

Por eso, la prueba no busca determinar qué modelo responde mejor preguntas sobre mercados, empresas o conceptos financieros. El objetivo es evaluar su desempeño en una tarea concreta: construir un modelo financiero en Excel.

Vals AI señala, además, que el acceso a herramientas y la capacidad para manejar archivos pueden influir en los resultados de este tipo de tareas.

PUBLICIDAD

Claude vs. ChatGPT: los resultados

ModeloResultado
Claude Fable 5.176,7%
Claude Opus 5.575,9%
Claude Sonnet 5.575,7%
GPT-5.6 Sol (max)72,3%
GPT-6 Astra (max)71,7%
GPT-6 Sol (max)71,5%
GPT-6 Luna (max)68,5%
GPT-5.6 Luna (max)67,1%

Tomando exclusivamente este benchmark, los modelos de Claude obtuvieron puntuaciones superiores a los de OpenAI incluidos en la prueba para la construcción de modelos financieros en Excel.

VER MÁS: Anthropic afirma que Claude lidera el 26% de su investigación y desarrollo

El resultado, sin embargo, corresponde a esta prueba específica y a las configuraciones evaluadas. No establece por sí solo cuál de las dos compañías ofrece el mejor modelo para cualquier tarea financiera.

Claude también gana terreno entre estudiantes de Economía

El economista Jorge Carrera, exdirector y exvicepresidente segundo del Banco Central de la República Argentina, compartió en septiembre los resultados de una encuesta anónima realizada entre alumnos de quinto año de Economía que cursan Finanzas Internacionales en la Universidad Nacional de La Plata.

Según los datos difundidos por Carrera, el 100% de los estudiantes consultados utiliza herramientas de inteligencia artificial para tareas académicas y el 79% las empleó en casi todos los trabajos prácticos y en el ensayo final.

En esa encuesta, Claude fue la herramienta preferida, con 60% de los votos, por delante de Gemini, con 23%, y ChatGPT, con 10%.

Carrera también comparó estos resultados con una encuesta realizada el año anterior y señaló un cambio en el uso de estas herramientas. Según los datos que compartió, ChatGPT pasó de ser utilizado por el 94% de los alumnos en 2025 al 54% en 2026, mientras que Claude alcanzó 81% y Gemini llegó a 60%.

Según el economista, los datos muestran la velocidad con la que está cambiando el ecosistema de herramientas de inteligencia artificial utilizado por los estudiantes.

PUBLICIDAD

Temas de este artículo