Hace apenas horas la gran pregunta era si Gemini 4 Argon brillaba solamente en los benchmarks que Google había elegido para presentarlo. Ya tenemos una primera respuesta independiente y, mira, la cosa se puso bastante más interesante: Argon empata con GPT-6 Astra en inteligencia general, cuesta menos durante su lanzamiento y alucina muchísimo menos. Pero también consume una barbaridad de tokens y todavía existen dudas sobre su rendimiento trabajando con código real. L
¿Gemini 4 Argon realmente alcanza a GPT-6 Astra?
Hecho confirmado: Artificial Analysis probó Gemini 4 Argon con su nivel de razonamiento High y obtuvo 53 puntos en Intelligence Index, exactamente el nivel de GPT-6 Astra Max y un punto por encima de GPT-6.1 Sol Max. Claude Opus 5.5 continúa delante con aproximadamente 58. Esto importa porque ya no estamos hablando únicamente de números publicados por Google.
Argon también mostró algo particularmente interesante: en AA-Omniscience registró una tasa de alucinación del 15%, frente al 51% de Astra Max. Pero cuidado con celebrar antes de tiempo: su precisión fue del 50%, frente al 63% de Astra. En palabras sencillas, Argon parece bastante mejor reconociendo cuándo no sabe algo, pero eso no significa automáticamente que sepa más. T
Gemini 4 Argon tiene un problema escondido detrás del precio
Google ofrece inicialmente Argon por $2 por millón de tokens de entrada y $10 por millón de salida; después pasarán a $4 y $20. b
Artificial Analysis calcula actualmente unos $1.99 por tarea, frente a $3.26 para Astra Max. Suena brutal hasta mirar debajo del capó: Argon produjo en promedio unos 62.000 tokens de salida por tarea, frente a aproximadamente 27.000 de Astra. Su ventaja actual viene principalmente del precio del token, no de ser más eficiente.

¿Tienes un negocio? . Publicalo aquí ,solo te tarda un minuto y conecta con personas que buscan lo que tú ofreces.Clic y descubre todas las ventajas que puede obtener tú ahora mismo. Es hora de llevarte al lugar que merece sin luchar con el algoritmo y AKubaa esta aqui para tu negocio sea visualizado.
¿Y cuando Gemini 4 Argon sale del benchmark?
Aquí está la parte que yo vigilaría. Reportes sobre comentarios internos apuntan a dudas entre algunos empleados de Google respecto al desempeño de Gemini 4 en determinadas tareas reales, incluido código. Google ha defendido que el modelo está en la frontera y sus propias pruebas muestran resultados fuertes. 9
Análisis de AK MundoVirtual: Argon ya demostró que Google volvió seriamente a la pelea. Lo que todavía no demostró es que haya ganado.
Mi opinión editorial: el campeón de un benchmark no necesariamente será el campeón de tu trabajo del lunes por la mañana. Y ahí estará la prueba definitiva cuando Argon llegue a desarrolladores y usuarios.
¿Tú elegirías una IA por sus benchmarks o esperarías a verla trabajando con problemas reales? Cuéntamelo en las redes de AK MundoVirtual y recuerda que puedes instalar nuestra web app para tener nuestros análisis tecnológicos siempre a mano.
Más en MundoVirtual:
Gemini 4 Argon: Google vuelve a la pelea de la IA, pero los benchmarks no cuentan toda la historia
CEO de Shopify amenaza con bloquear Claude Code por una batalla que parece pequeña, pero no lo es.