Thursday, 1 October 2026 | Updating Daily AI insight, written for builders

Gemini 4 Argon vs GPT-6.1 Sol vs Claude Sonnet 5.5: Tres nuevos modelos de IA comparados

  • Tres grandes modelos de IA llegaron en tres días: Claude Sonnet 5.5 (Anthropic, 28 de septiembre de 2026), GPT-6.1 Sol (OpenAI, 29 de septiembre) y Gemini 4 Argon (Google, 30 de septiembre).
  • Los tres se lanzan al mismo precio para desarrolladores: $2 por millón de tokens de entrada y $10 por millón de tokens de salida. El precio de Argon es introductorio y sube a $4 / $20 después.
  • La verdadera diferencia es quién puede usarlos hoy: Sonnet 5.5 está abierto a todos, incluidos los usuarios gratuitos de Claude; GPT-6.1 Sol es para planes de pago de ChatGPT (en ChatGPT Work y Codex) y la API; Gemini 4 Argon aún no está disponible públicamente.
  • Cada empresa reporta pruebas diferentes, por lo que aún no hay un ganador único justo. Google afirma las puntuaciones más altas; OpenAI y Anthropic destacan el costo por tarea.

La última semana de septiembre de 2026 trajo una acumulación inusual de lanzamientos. En tres días, Anthropic, OpenAI y Google lanzaron cada uno un modelo nuevo —y los tres llegaron exactamente al mismo precio para desarrolladores. Si intentas averiguar cuál es importante para ti, esta comparación lado a lado se atiene a lo que cada empresa ha publicado realmente.

Los tres modelos de un vistazo

Gemini 4 Argon GPT-6.1 Sol Claude Sonnet 5.5
Empresa Google DeepMind OpenAI Anthropic
Anunciado 30 de septiembre de 2026 29 de septiembre de 2026 (DevDay) 28 de septiembre de 2026
Postura El nuevo modelo frontera de Google Modelo de nivel medio mejorado, por debajo de GPT-6 Astra Modelo de nivel medio, por debajo de Claude Opus 5.5
Precio de API (entrada / salida por 1M de tokens) $2 / $10 introductorio, luego $4 / $20 $2 / $10 $2 / $10
Entrada en caché por 1M de tokens 95% de descuento en el precio de entrada $0.10 $0.20 (lecturas en caché)
Afirmación destacada Límite de salida de 1M tokens; 77,9% en DeepSWE v1.1 Resultados cercanos a Astra a una quinta del precio de Astra 30%+ más rápido que Sonnet 5, hasta 30% más barato por tarea
Acceso gratuito para consumidores No anunciado No (planes de ChatGPT de pago) Sí, reportado en el plan gratuito de Claude
¿Disponible hoy? No —solo probadores de confianza Sí Sí

Fuentes: Google, OpenAI y Anthropic anuncios.

Quién puede usar cada modelo ahora mismo

Para la mayoría de las personas, esta es la parte que importa, porque un modelo que no puedes acceder no es muy útil.

Claude Sonnet 5.5: disponible para todos

Sonnet 5.5 está disponible en las aplicaciones de Claude y en todas las nubes principales. El plan gratuito de Claude incluye modelos Sonnet, y los informes dicen que los usuarios gratuitos obtienen Sonnet 5.5, mientras que Opus 5.5 se mantiene en planes de pago. Detalles completos: Claude Sonnet 5.5 explicado.

GPT-6.1 Sol: planes de ChatGPT de pago y la API

OpenAI dice que GPT-6.1 Sol está disponible para Plus, Pro, Business, Enterprise y Edu usuarios en ChatGPT Work y Codex, y para desarrolladores como gpt-6.1-sol. OpenAI añade que «aún no está disponible en Chat», la pantalla de conversación regular de ChatGPT. Los usuarios gratuitos de ChatGPT no lo obtienen. ¿No estás seguro de qué plan de ChatGPT necesitas? Ver ChatGPT Gratis frente a Go frente a Plus frente a Pro. Para los anuncios de DevDay al respecto, lee nuestro informe de DevDay.

Gemini 4 Argon: aún no

Google ha lanzado Argon solo a defensores de ciberseguridad seleccionados a través de su Programa Fairwind y a su propio personal. Dice que el acceso se ampliará «lo antes posible», comenzando con clientes de API de pago y Google AI Ultra suscriptores, pero no ha dado una fecha. Detalles completos: Gemini 4 Argon explicado.

Precio: los mismos $2 / $10, con una trampa

Es raro que tres lanzamientos de modelos insignia rivales coincidan en precio. Para desarrolladores que pagan por token:

  • Claude Sonnet 5.5 mantiene los $2 / $10 de Sonnet 5 y Anthropic dice que necesita menos tokens por tarea, lo que la hace hasta 30% más barata en la práctica.
  • GPT-6.1 Sol mantiene GPT-6 Sollos $2 / $10 de Sonnet 5 y reduce el caché de entrada a $0.10. La propuesta de OpenAI es que casi iguala GPT-6 Astra — que cuesta $10 / $50 — a una quinta parte del precio.
  • Gemini 4 Argon comienza en $2 / $10 pero solo durante un período introductorio de duración no anunciada, luego se duplica a $4 / $20 — lo mismo que Claude Opus 5.5.

El precio por token es solo la mitad de la historia: un modelo que usa menos tokens, o completa la tarea en menos intentos, puede ser más barato incluso al mismo precio. Tanto OpenAI como Anthropic ahora publican figuras de costo por tarea exactamente por esa razón. Para estimar una factura de tu propio uso, prueba el Calculadora de costos de API de IA o compara todos los modelos actuales en Base de datos de modelos de IA.

Puntos de referencia: lo que cada empresa reporta

Aquí está el problema honesto al comparar estos tres: reportan principalmente pruebas diferentes, a menudo en diferentes versiones y en diferentes configuraciones de «esfuerzo». La tabla a continuación enumera los números principales de cada empresa lado a lado, pero un número más alto en una columna no prueba que un modelo supere a otro.

Área Gemini 4 Argon (Google) GPT-6.1 Sol (OpenAI) Claude Sonnet 5.5 (Anthropic)
Programación DeepSWE v1.1: 77,9% (estado del arte) DeepSWE v1.1: iguala GPT-6 Astra a ~⅕ del costo; 6,4 puntos por encima del mejor de GPT-6 Sol Terminal-Bench 4.0: 70,6%; CursorBench 4.0: 55,5%
Flujos de trabajo empresariales AutomationBench: 51,3% (#1) AutomationBench: 2,2 puntos por encima de Claude Opus 5.5 con esfuerzo medio, ~⅓ del costo GDPval-AA v2.1: 1844 (Opus 5.5: 1846)
Usar una computadora — OSWorld 2.0 sin conexión: dentro de 2,1 puntos de Astra a ~⅐ del costo por tarea OSWorld 2.1: 80,1%
Documentos, gráficos, video LVBench (video largo): 91,7% GDP.pdf: por encima de Opus 5.5 a menos de la mitad del costo por tarea Chartography: 61,6%
Precisión — Respuestas con error fáctico: 7,7% vs 11,4% para GPT-6 Sol (indicaciones difíciles, bajo esfuerzo) Humanity's Last Exam (con herramientas): 64,5%
Seguridad CWE-bench v1: 68% (empatado en primer lugar) — Se lanza con protecciones de ciberseguridad de nivel Opus

Algunas observaciones justas de estos números:

  • Programación: DeepSWE v1.1 es la única prueba de codificación que tanto Google como OpenAI citan. Google le da a Argon un sólido 77,9%; OpenAI no le da a Sol un número absoluto, solo que iguala GPT-6 Astra. Hasta que aparezcan resultados independientes, la afirmación de Argon es la más sólida.
  • Flujos de trabajo empresariales: AutomationBench es la otra prueba que tanto Google como OpenAI citan. Google dice que Argon es #1 con 51.3%. OpenAI dice que Sol supera a Claude Opus 5.5 allí por 2.2 puntos. Anthropic no lo reporta para Sonnet 5.5.
  • Sonnet 5.5 vs Opus 5.5: Los números de Anthropic muestran que su modelo de rango medio está casi al mismo nivel que su propio modelo superior en trabajo de oficina, a la mitad del precio.

Trata cada cifra aquí como marketing hasta que evaluadores externos como Artificial Analysis o LMArena publiquen sus propios resultados, lo que generalmente toma días a semanas después de un lanzamiento.

Seguridad: una semana inusualmente cautelosa

Los tres lanzamientos vinieron con más discusión de seguridad de la habitual:

  • OpenAI lanzó GPT-6.1 Sol en lugar del modelo más grande GPT-6.1 Astra, que retuvo después de que las pruebas internas plantearan preocupaciones sobre el engaño y actuar sin permiso (nuestro reporte). OpenAI dice que Sol muestra mejor alineación que GPT-6 Sol.
  • Google está lanzando Argon en fases, uniéndose al proceso de acceso previo a la versión del gobierno de EE. UU. y añadiendo monitores que pueden detener el modelo a mitad de la tarea.
  • Anthropic le dio a Sonnet 5.5 las mismas protecciones de ciberseguridad que sus modelos principales: las solicitudes de seguridad de mayor riesgo recurren a la versión anterior Sonnet 5.

¿Cuál deberías usar?

  • Quieres algo gratuito, hoy: Claude Sonnet 5.5 es el único de los tres con plan gratuito. Los usuarios de Gemini conservan los modelos actuales en la aplicación Gemini hasta que llegue Argon.
  • Ya pagas por ChatGPT: prueba GPT-6.1 Sol en ChatGPT Work o Codex para codificación, documentos y tareas multietapa.
  • Pagas por Google AI Ultra: busca Argon en la aplicación Gemini, pero no hay fecha. Nuestra guía sobre planes de Google AI explica qué incluye Ultra ahora.
  • Construyes aplicaciones: Sonnet 5.5 y GPT-6.1 Sol están disponibles a $2 / $10 hoy, así que prueba ambos en tus propias tareas. Argon vale la pena probar una vez que se abre la API, pero planifica que el precio se duplique después del período introductorio.
  • Estás eligiendo un chatbot, no un modelo: las características alrededor del modelo importan tanto como el modelo en sí — véase Claude frente a ChatGPT.

Preguntas frecuentes

¿Cuál es el mejor modelo de IA en este momento: Gemini 4 Argon, GPT-6.1 Sol o Claude Sonnet 5.5?

Aún no hay una respuesta única justa. Google reporta los puntuaciones más altas para Argon, pero Argon no está disponible públicamente. Entre los modelos que puedes usar hoy, GPT-6.1 Sol y Claude Sonnet 5.5 cuestan lo mismo y cada empresa reporta fortalezas en diferentes pruebas.

¿Gemini 4 Argon, GPT-6.1 Sol y Claude Sonnet 5.5 cuestan lo mismo?

Al lanzamiento, sí: $2 por millón de tokens de entrada y $10 por millón de tokens de salida a través de la API de cada empresa. El precio de Argon es introductorio y sube a $4 / $20 posteriormente.

¿Cuál de los tres puedo usar gratis?

Claude Sonnet 5.5, en el plan gratuito de Claude con límites de uso. GPT-6.1 Sol requiere un plan de pago de ChatGPT, y Gemini 4 Argon aún no tiene lanzamiento público.

¿Cuándo estará disponible Gemini 4 Argon?

Google no ha dado una fecha. Dice que el despliegue comenzará con clientes de API de pago y suscriptores de Google AI Ultra.

¿GPT-6.1 Sol es mejor que GPT-6 Astra?

No. OpenAI dice que casi iguala a Astra en codificación, uso de computadora y trabajo profesional a un quinto del precio de Astra, pero Astra aún obtiene puntuaciones más altas en las tareas más difíciles, como Terminal-Bench Science (68.1%).

Escrito por Mustafa Ihsan

Mustafa Ihsan es el fundador y editor de Convly.ai. Construyó y mantiene la base de datos de modelos de IA en vivo del sitio, su índice de relación precio-rendimiento y sus calculadoras gratuitas para requisitos de VRAM, costos de API y economía de auto-alojamiento. Escribe sobre precios de modelos, resultados de puntuaciones de referencia y el hardware necesario para ejecutar modelos de IA localmente, y siempre prefiere números medidos a afirmaciones de proveedores.

Scroll to Top