Informe de Modelos de IA de Julio de 2026: Kimi, DeepSeek, Qwen, Gemini, GPT y Claude
Un rastreador de modelos verificado del 24 de julio de 2026 que cubre lanzamientos, vistas previas, retrasos, cambios de acceso y las decisiones prácticas que los desarrolladores enfrentan en la actualidad.

Julio de 2026 produjo suficientes noticias de modelos para hacer obsoleta una lista estática de los "mejores LLM" antes de su publicación. El formato útil es un informe de estado: lo que puedes usar, lo que sigue siendo una vista previa, lo que está retrasado, qué migraciones son urgentes y lo que aún depende de una promesa futura.
Este informe de julio de 2026 sobre los últimos modelos de IA está verificado hasta el 24 de julio. Utiliza la documentación del proveedor para el estado del producto y los informes establecidos para el contexto de la capacidad o los retrasos. Evita convertir las afirmaciones de benchmarks de los proveedores en hechos independientes.
El estado en un minuto
El estado del mercado de modelos de julio de 2026 el 24 de julio de 2026: abarrotado, capaz y dividido en varias etapas de lanzamiento. GPT-5.6 y Claude Fable 5 están disponibles; Kimi K3 está disponible con los pesos programados para el 27 de julio; DeepSeek V4 es una vista previa de pesos abiertos; Qwen3.8-Max es una vista previa de producto seleccionado; Gemini 3.6 Flash y 3.5 Flash-Lite están disponibles mientras que 3.5 Pro permanece en pruebas con socios.
Esa redacción es importante. «Anunciado», «vista previa», «disponible a través de productos seleccionados», «disponible de forma general» y «de peso abierto» describen diferentes niveles de acceso. Un modelo puede ser utilizable en un producto de suscripción mientras que sus pesos, informe técnico, API pública o compromisos de nivel de servicio empresarial siguen faltando. Tratar esas etapas como intercambiables es cómo una guía de modelos útil se convierte en desinformación.
El rastreador
| Modelo | Estado el 24 de julio | Nota práctica | |---|---|---| | GPT-5.6 Sol, Terra, Luna | Generalmente disponible | Disponible en los productos y la API de OpenAI, con niveles por capacidad y costo | | Claude Fable 5 | Disponible | Destinado a la codificación ambiciosa y el trabajo de conocimiento a largo plazo | | Kimi K3 | Servicio disponible | Pesos completos y más detalles técnicos prometidos para el 27 de julio | | DeepSeek V4 Pro / Flash | Vista previa; API y pesos disponibles | Los nombres de modelo explícitos reemplazan los alias heredados que se retiran | | Qwen3.8-Max | Vista previa en productos seleccionados | El paquete técnico y de lanzamiento de acceso público completo sigue estando limitado | | Gemini 3.6 Flash | Disponible | El motor actual de Google para tareas de codificación, conocimiento, multimodales y de agentes | | Gemini 3.5 Flash-Lite | Disponible | Ruta Gemini de alto rendimiento y menor costo | | Gemini 3.5 Pro | Pruebas con socios | Sin fecha de disponibilidad general en la publicación del 21 de julio de Google |
Las tres historias operativas
Primero, la capacidad es una ventaja competitiva. La pausa temporal de suscripción de Kimi demostró que la demanda puede superar el suministro de inferencia incluso después de un lanzamiento exitoso. Segundo, la gestión del ciclo de vida es la calidad del producto. El retiro de deepseek-chat y deepseek-reasoner por parte de DeepSeek obliga a los desarrolladores a usar rutas V4 explícitas. Tercero, la moderación importa. Google lanzó nuevos modelos Flash mientras mantenía 3.5 Pro en pruebas en lugar de declarar una fecha de disponibilidad general artificial.
En conjunto, estas historias explican por qué los compradores necesitan respaldos, adaptadores de modelo, suites de regresión y un campo de estado de lanzamiento en cada catálogo interno.
Qué probar este mes
Prueba Kimi K3 si las sesiones de codificación prolongadas, la retroalimentación visual o las tareas de conocimiento extensas son el elemento central. Prueba DeepSeek V4 Flash y Pro como rutas separadas; no supongas que uno solo debe manejar todo el tráfico. Evalúa Qwen3.8-Max en los productos donde realmente se ofrece la vista previa. Para flujos de trabajo de agentes escalables, compara Gemini 3.6 Flash y 3.5 Flash-Lite. Mantén a GPT-5.6 Sol y Claude Fable 5 en la competencia de vanguardia para las tareas más difíciles.
Una forma práctica de evaluar el mercado de modelos de julio de 2026
No empieces con una tabla de clasificación. Empieza con un paquete de tareas extraído de tu propio trabajo: diez entradas representativas, el resultado esperado, un límite de tiempo y una lista corta de fallos no aceptables. Para un agente de codificación, incluye una corrección de errores, una pequeña funcionalidad, una reparación de pruebas y una tarea de navegación por repositorios. Para investigación, incluye una pregunta cuya respuesta cambia con el tiempo y que requiere fuentes enlazadas. Para trabajo con documentos, incluye tablas desordenadas, páginas escaneadas e instrucciones conflictivas.
Ejecuta a cada candidato con el mismo contexto, herramientas, permisos y criterios de éxito. Registra la finalización de la tarea, el tiempo de corrección humana, la latencia, el uso de tokens y el número de llamadas a herramientas fallidas. Los dos últimos son fáciles de ignorar, pero a menudo determinan la factura real. Un modelo que termina en un solo pase limpio puede ser más barato que un modelo de precio bajo que entra en bucles, reescribe archivos de forma innecesaria o necesita indicaciones repetidas.
Mantenga a un revisor humano en el ciclo para trabajos de gran relevancia. Los modelos pueden producir explicaciones plausibles pero incorrectas, exagerar lo que han verificado o realizar un cambio técnicamente válido que viola una regla empresarial. El diseño de producción más seguro otorga al agente solo los permisos que necesita, registra las acciones, requiere aprobación antes de pasos irreversibles y facilita la reversión.
Finalmente, repita la prueba después de actualizaciones significativas del modelo o del entorno de prueba. El rendimiento del agente es una propiedad de todo el sistema: el modelo, la instrucción, las definiciones de herramientas, la gestión de contexto, el tiempo de ejecución y la política de aprobación, no solo el nombre del modelo. Un resultado del entorno de otra empresa es evidencia, pero no es una garantía para el tuyo.
La decisión de compra que la mayoría de los equipos deberían tomar
Elige una cartera, no un campeón. Usa un modelo fronterizo capaz para la pequeña porción de trabajo en la que el fracaso es costoso o la tarea es inusualmente difícil. Enruta la clasificación rutinaria, la extracción, la traducción y la redacción de primera pasada a un modelo más rápido. Mantén al menos un proveedor alternativo o una opción de autoalojamiento para interrupciones, límites de capacidad, cambios de política y cambios de precio repentinos.
Antes de firmar un compromiso importante, calcula el costo por tarea aceptada en lugar del costo por millón de tokens. Incluye reintentos, llamadas a herramientas, entrada en caché, revisión humana, tiempo de ingeniería y el costo de respuestas lentas. Luego verifica la retención de datos, procesamiento regional, controles de acceso, registros de auditoría, límites de velocidad y términos de descontinuación de modelos. Esos detalles operativos rara vez aparecen en titulares del día de lanzamiento, pero deciden si un flujo de trabajo de IA sobrevive al contacto con la producción.
Los productos especializados pueden ser mejores que un modelo universal único en etapas particulares. Un modelo general puede investigar un concepto, estructurar un brief o revisar un plan, mientras que un producto enfocado en creatividad, codificación, legal o análisis se encarga de la ejecución. El mejor flujo de trabajo suele combinar herramientas con límites claros en lugar de forzar cada paso a través de un solo chatbot. Esto también facilita el reemplazo: un equipo puede actualizar una etapa sin rediseñar todo el proceso.
Donde Elser AI puede encajar naturalmente
Creative teams can pair general models with specialist products. A model may turn research into a structured visual brief, while Elser AI can create anime imagery, original characters, videos, and storyboards. This modular approach keeps each tool focused on what it is built to do.
Cómo separamos la evidencia del hype
Este artículo prioriza las notas de lanzamiento de primera parte, las páginas de modelos, la documentación de la API y los reportes con fuentes identificadas de organizaciones de noticias establecidas. Las afirmaciones de pruebas de referencia de proveedores se clasifican como afirmaciones de proveedores, ya que el conjunto de pruebas, la configuración de inferencia y las condiciones de comparación pueden alterar de forma sustancial una puntuación. No consideramos una captura de pantalla anónima, un apodo de arena, una cuenta atrás en redes sociales o el menú de modelos de un revendedor como prueba de un lanzamiento público.
El plazo límite es 24 de julio de 2026. El acceso a los productos puede variar según el país, el plan, la cuenta y la cohorte de despliegue, y los precios pueden cambiar sin un nuevo nombre de modelo. Confirme el identificador del modelo actual, la hoja de tarifas y la disponibilidad en la propia consola del proveedor antes de desplegar. Donde se prometa un informe técnico o ponderaciones para una fecha posterior, este artículo describe esa promesa como un plan futuro, no como una versión completada y lanzada.
Preguntas Frecuentes
¿Cuál es el último buque insignia ampliamente disponible?
GPT-5.6 y Claude Fable 5 son los buques insignia actuales y disponibles. “El más nuevo” no debe confundirse con el mejor para cada carga de trabajo.
¿Está Kimi K3 en peso abierto hoy?
El servicio de Moonshot está activo, pero el lanzamiento completo del peso está programado para el 27 de julio, tres días después de la fecha límite de este informe.
¿Es DeepSeek V4 solo un rumor?
No. Su API y sus pesos están disponibles, pero DeepSeek lo etiqueta explícitamente como Vista Previa.
¿Se puede usar Qwen3.8?
Qwen3.8-Max-Preview se reporta en los productos de suscripción y codificación seleccionados de Alibaba. Los detalles de un lanzamiento más amplio permanecen incompletos.
¿Qué pasó con Gemini 3.5 Pro?
Google afirma que está realizando pruebas con socios. La compañía lanzó 3.6 Flash y 3.5 Flash-Lite sin anunciar la disponibilidad general de Pro.
Conclusión
El mercado de julio premia la precisión. Kimi se ha lanzado pero está a la espera de los pesos completos; DeepSeek es accesible pero en Vista Previa; Qwen es una Vista Previa de producto seleccionado; El Pro de Gemini está en pruebas mientras los productos Flash más nuevos se envían; GPT-5.6 y Claude Fable 5 son opciones de vanguardia disponibles. Usa esas etiquetas, prueba el trabajo real y mantén tu arquitectura preparada para el próximo cambio.
Fuentes y verificación
- OpenAI: Lanzamiento de GPT-5.6
- Anthropic: Claude Fábula 5
- Moonshot AI: Kimi K3 blog técnico
- AP: Kimi suspende las nuevas suscripciones después de que la demanda supere la capacidad
- DeepSeek: Lanzamiento de la vista previa V4
- SCMP: Alibaba previsualiza Qwen3.8-Max-Preview
- Google: Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber
- Reuters: Lanzamiento de Gemini 3.5 Pro retrasado
Nota editorial: Este artículo fue investigado y verificado por última vez el 24 de julio de 2026. El acceso a los proveedores, los precios y el estado de la vista previa pueden cambiar; consulte la documentación de primera parte vinculada antes de tomar una decisión de producción.






































