Gemini 4 Argon vs GPT-6 Astra: Google iguala a OpenAI en pruebas independientes, pero aparece una letra pequeña

Hace apenas horas la gran pregunta era si Gemini 4 Argon brillaba solamente en los benchmarks que Google había elegido para presentarlo. Ya tenemos una primera respuesta independiente y, mira, la cosa se puso bastante más interesante: Argon empata con GPT-6 Astra en inteligencia general, cuesta menos durante su lanzamiento y alucina muchísimo menos. Pero también consume una barbaridad de tokens y todavía existen dudas sobre su rendimiento trabajando con código real. L


¿Gemini 4 Argon realmente alcanza a GPT-6 Astra?

Hecho confirmado: Artificial Analysis probó Gemini 4 Argon con su nivel de razonamiento High y obtuvo 53 puntos en Intelligence Index, exactamente el nivel de GPT-6 Astra Max y un punto por encima de GPT-6.1 Sol Max. Claude Opus 5.5 continúa delante con aproximadamente 58. Esto importa porque ya no estamos hablando únicamente de números publicados por Google.

Argon también mostró algo particularmente interesante: en AA-Omniscience registró una tasa de alucinación del 15%, frente al 51% de Astra Max. Pero cuidado con celebrar antes de tiempo: su precisión fue del 50%, frente al 63% de Astra. En palabras sencillas, Argon parece bastante mejor reconociendo cuándo no sabe algo, pero eso no significa automáticamente que sepa más. T


Gemini 4 Argon tiene un problema escondido detrás del precio

Google ofrece inicialmente Argon por $2 por millón de tokens de entrada y $10 por millón de salida; después pasarán a $4 y $20. b

Artificial Analysis calcula actualmente unos $1.99 por tarea, frente a $3.26 para Astra Max. Suena brutal hasta mirar debajo del capó: Argon produjo en promedio unos 62.000 tokens de salida por tarea, frente a aproximadamente 27.000 de Astra. Su ventaja actual viene principalmente del precio del token, no de ser más eficiente. 


¿Tienes un negocio? . Publicalo aquí ,solo te tarda un minuto y conecta con personas que buscan lo que tú ofreces.Clic y descubre todas las ventajas que puede obtener tú ahora mismo. Es hora de llevarte al lugar que merece sin luchar con el algoritmo y AKubaa esta aqui para tu negocio sea visualizado.


¿Y cuando Gemini 4 Argon sale del benchmark?

Aquí está la parte que yo vigilaría. Reportes sobre comentarios internos apuntan a dudas entre algunos empleados de Google respecto al desempeño de Gemini 4 en determinadas tareas reales, incluido código. Google ha defendido que el modelo está en la frontera y sus propias pruebas muestran resultados fuertes. 9

Análisis de AK MundoVirtual: Argon ya demostró que Google volvió seriamente a la pelea. Lo que todavía no demostró es que haya ganado.

Mi opinión editorial: el campeón de un benchmark no necesariamente será el campeón de tu trabajo del lunes por la mañana. Y ahí estará la prueba definitiva cuando Argon llegue a desarrolladores y usuarios.

¿Tú elegirías una IA por sus benchmarks o esperarías a verla trabajando con problemas reales? Cuéntamelo en las redes de AK MundoVirtual y recuerda que puedes instalar nuestra web app para tener nuestros análisis tecnológicos siempre a mano.


Más en MundoVirtual:

Gemini 4 Argon: Google vuelve a la pelea de la IA, pero los benchmarks no cuentan toda la historia

CEO de Shopify amenaza con bloquear Claude Code por una batalla que parece pequeña, pero no lo es.

Deja un comentario

Esta pagina web utiliza cookies.    Más información
Privacidad