Cada mañana publico un resumen de IA práctica: lo grande del día, herramientas nuevas y qué probar hoy. Generado con mi propio sistema de agentes y archivado aquí, edición a edición.
Archivo
Día de sacudida en OpenAI. Fidji Simo, la número dos que dirigía producto y negocio, deja el cargo por una enfermedad crónica y reparte sus funciones entre Brockman, Sarah Friar y Jason Kwon. A la vez, la compañía entierra su navegador Atlas y lo unifica todo en una "super app" de escritorio con ChatGPT, Codex y Work dentro. En modelos, dos cambios que tocan la factura de quien construye: la API de OpenAI ya conserva el razonamiento entre turnos y Anthropic vuelve a resetear los límites de uso para todos. Y "De X" trae el debate del día: los primeros números de coste por tarea de GPT-5.6 Sol frente a Fable 5.
Julio de 2026
Día doble en modelos. SpaceXAI y Cursor lanzan Grok 4.5, su primer modelo conjunto tras la compra de Cursor, con precio de derribo y rendimiento de clase Opus para coding. Casi a la vez, OpenAI estrena GPT-Live: voz full-duplex que escucha y habla a la vez y delega en el modelo frontera para lo difícil. En empresas, la infraestructura para agentes hace caja: Prime Intellect levanta 130 millones a valoración de 1.000 y el ex-CEO de GitHub abre una red Git distribuida pensada para flotas de agentes. "De X" trae los tres hilos verificados de la jornada.
El día lo marca el coste: Microsoft ha empezado a sustituir modelos de OpenAI y Anthropic por sus propios MAI en Excel y Outlook, con decenas de miles de prompts semanales ya corriendo con modelos que controla en casa. En modelos hay estreno grande —Meta lanza Muse Image, su primer modelo de imagen agéntico, que ya se cuela en el número 2 del Image Arena— y luz verde: el Departamento de Comercio levanta las restricciones a GPT-5.6 de OpenAI, que sale de forma amplia el jueves. Y otro entrante se suma a la guerra de agentes de coding: Perplexity construye en silencio su propia herramienta. "De X" vuelve con tres hilos verificados dentro de la ventana.
El día lo domina la confianza en las herramientas de coding: se confirma que Claude Code llevaba desde abril un marcador oculto que detectaba a usuarios chinos y lo camuflaba con esteganografía en el prompt; Anthropic lo admite como "experimento de marzo" y ya lo ha retirado. En paralelo, China obliga a ByteDance y Alibaba a apagar la creación de agentes antes del 15 de julio por su nueva ley, e Illinois firma la regulación de IA más dura del país. En modelos no hubo estrenos dentro de la ventana de 24 horas, así que "Lo grande" recoge tres movimientos de sector y el cambio de acceso a Claude Fable 5, que desde hoy deja de estar incluido y pasa a créditos. La sección "De X" no aparece: la sesión de la cuenta sigue caída y no había hilos verificables dentro de la ventana.
El día lo marca Microsoft por partida doble: fusionará sus apps de Copilot de consumo y empresa en una sola para agosto —con agentes "AutoPilot" de pago— y a la vez ha subido el precio de Microsoft 365 entre un 5% y un 43%, metiendo Copilot Chat de serie. Traducido: la IA de productividad deja de ser opcional y empieza a cobrarse a toda la base. Fuera de Redmond, Alibaba enseña músculo con un agente que descubre y sintetiza cuatro superconductores nuevos, y en el frente de modelos salta un aviso: GPT-5.5 mostraría una degradación medible en Codex. No hubo estrenos de modelo dentro de la ventana de 24 horas, así que "Lo grande" recoge los mayores movimientos de sector y modelo del día. La sección "De X" no aparece hoy: la sesión de la cuenta sigue caída y no había hilos verificables dentro de la ventana.
Sábado sin estrenos de modelo: el foco del día se va a la economía y la geopolítica de la IA. Reino Unido pone cifras a la mayor apuesta pública por la IA sanitaria —10.000 millones de libras y un triaje dentro de la app del NHS—, mientras un análisis de Our World in Data confirma que casi todos los modelos más usados del mundo se entrenan en EE.UU. o China. En paralelo, dos lecturas incómodas para builders: los modelos baratos ya están reescribiendo el gasto de las empresas, y un estudio de California apunta que a quien más golpea la IA es a los trabajadores más cualificados. En X, la conversación la dominan el hito de China entrenando un modelo de billón de parámetros sin Nvidia y el aviso de seguridad sobre agentes: deja de confiar en ellos por defecto.
Día de choques. Alibaba prohíbe a sus empleados usar Claude Code desde el 10 de julio tras acusar a la herramienta de esconder código que detecta a usuarios chinos —Anthropic dice que era un mecanismo antifraude, ya retirado, y el episodio se convierte en la mayor conversación del sector. En paralelo, Midjourney da la vuelta a su demanda por copyright y exige que Disney, Universal y Warner revelen cómo usan IA por dentro. En modelos, Meta promete una actualización de Muse Spark "mucho mejor en código" que ya alcanzaría a GPT-5.5, y ByteDance abre la ventana de lanzamiento de Seedance 2.5, su modelo de vídeo que genera 30 segundos de una sola pasada.
Otra jornada sin lanzamientos de modelos frontera, pero con el tablero moviéndose donde importa: en cómo se despliega y quién controla la IA. Microsoft crea "Frontier Company", una unidad de 2.500 millones de dólares y 6.000 ingenieros para meterse dentro de las empresas y montarles los sistemas de IA a resultados —el mismo modelo de "ingeniería desplegada" que AWS, OpenAI y Anthropic ya empujan. Al mismo tiempo, Zuckerberg reconoce en un town hall interno que el desarrollo de agentes no ha acelerado como esperaba: el baño de realidad llega desde la empresa que más dinero está metiendo. En modelos, Z.ai (Zhipu) lanza ZCode, un entorno de código gratis alrededor de GLM-5.2 que socava el precio de Claude Code y Cursor, mientras la Casa Blanca ultima estándares voluntarios que condicionarán cuándo pueden salir los modelos frontera —Google negocia antes de sacar Gemini 3.5 Pro.
Jornada sin lanzamientos de modelos nuevos, pero con el tablero de empresas moviéndose fuerte. Square mete el checkout dentro de ChatGPT y Claude: sus restaurantes reciben pedidos desde la conversación, sin setup y sin comisión de marketplace —el comercio agéntico deja de ser demo y empieza a facturar. Apple abre Safari a los agentes con un servidor MCP nativo en su Technology Preview, de modo que cualquier agente puede inspeccionar y depurar una web en local. En Washington, OpenAI propone donar hasta un 5% de la empresa al gobierno de EE. UU. —unos 42.600 millones de dólares— para sembrar un "fondo de riqueza pública" y aliviar la presión política. Y Meta empieza a cobrar por la IA de sus gafas, la primera señal de que la IA on-device en wearables pasa a modelo de suscripción. Por debajo, el aviso que más importa a quien construye: el protocolo MCP publica su Release Candidate y se vuelve stateless.
Jornada bisagra en el coste y la disponibilidad de la IA. Anthropic firma un doblete: lanza Claude Sonnet 5 —clase Opus a precio de Sonnet, ya el modelo por defecto en Claude Code de Pro— y, el mismo día, recupera Fable 5 y Mythos 5 después de que EE. UU. levante los controles de exportación que los habían congelado dos semanas. En paralelo, el despliegue en empresa se industrializa: AWS mete 1.000 millones de dólares en una unidad de ingenieros incrustados con clientes, copiando el modelo FDE de OpenAI y Anthropic. Y por debajo, la palanca que lo mueve todo: OpenAI dice haber recortado a la mitad su factura de inferencia solo con software, sin chips nuevos. En X, el debate del día no es si Sonnet 5 es bueno, sino cuánto cuesta de verdad por tarea. Y en herramientas, los repos que tiran son de vídeo, voz y seguridad agéntica.
Junio de 2026
Día de adopción y de fricción. Por arriba, California convierte a Claude en el asistente estándar de todas sus agencias estatales con un 50% de descuento —el mayor despliegue de Anthropic en el sector público de EE. UU.—, mientras la geopolítica del hardware muerde: Taiwán registra las oficinas de Super Micro por el contrabando de chips de Nvidia y la acción cae más de un 9%. En plataformas, X se suma a Slack y AWS y lanza un MCP hospedado que enchufa la API de X a cualquier agente sin montar nada. Y en modelos, el open source Ornith-1.0 vive su pico de atención por adelantar a Claude Opus 4.7 en SWE-Bench, con la comunidad dividida sobre si la cifra es real. En X, la guerra del coste manda: Meta veta Claude Code y Codex puertas adentro por miedo a la destilación, Coinbase recorta a la mitad su factura de IA huyendo a modelos chinos, y Chamath levanta 135 millones para construir software dirigido por negocio. Y en herramientas, todo gira en torno a lo mismo: routing, inferencia local y MCP para bajar la factura de tokens.
El hilo del día sigue siendo el coste y el control de los modelos. Desde China, la firma de seguridad 360 presenta "Yitian Tulong", una pareja de herramientas que dice igualar a Mythos de Anthropic apilando IA sobre su propia base de vulnerabilidades: el contraataque al cierre de los modelos frontera estadounidenses. En modelos propios, Microsoft pone su MAI-Code-1-Flash —5.000 millones de parámetros, sin destilación de terceros— a disposición de Copilot Business y Enterprise. En empresas, OpenAI ficha al exjefe de Uber India para liderar su segundo mayor mercado, y Shopify abre su receta para abaratar la IA en producción: destilar un modelo frontera a un Qwen afinado por tarea en un día, hasta 30 veces más barato. En la conversación social: Gary Marcus y el "Efecto Klarna" a cuenta de Ford recontratando ingenieros, el desglose del arsenal de 360 y el fichaje indio de OpenAI. En herramientas: el agente de código abierto que ya roza las 180.000 estrellas, el desarrollo guiado por especificación y dos lanzamientos recientes para automatizar el navegador y cazar el "drift" del código generado por IA.
El día gira sobre el coste y el control de los modelos frontera. El Gobierno de EE. UU. levanta el bloqueo a Mythos 5 de Anthropic y lo autoriza para un centenar de "socios de confianza", mientras Fable 5 sigue vetado: el acceso a los modelos punteros pasa a aprobarse cliente por cliente. En paralelo, la presión de coste estalla: la startup Lindy mueve el 100% de su tráfico de Claude a DeepSeek y se ahorra millones, y Anthropic da marcha atrás en su cambio de facturación ante una guerra de precios con OpenAI. Y en movimiento de empresas, OpenAI ficha al jefe del Vision Pro y las gafas de Apple para fabricar sus propios dispositivos. En la conversación social: el fichaje contado por Gurman, Mark Cuban sobre por qué la gente odia los data centers y el desglose de la nueva tabla de precios. En herramientas: una capa de búsqueda sin base de datos vectorial, el toolkit oficial de agentes de AWS y 60 blueprints de agentes con guardarraíles.
Día de pulsos grandes. El Gobierno de EE. UU. obliga a OpenAI a escalonar el lanzamiento de GPT-5.6: preview limitada y aprobación de acceso cliente por cliente, el primer caso de revisión gubernamental previa de un modelo frontera. En el sector, Adobe se compra Topaz Labs para meter mejora y escalado de imagen y vídeo on-device dentro de Firefly; General Intuition cierra 320 millones a 2.300 de valoración (Khosla, Bezos, Schmidt) para entrenar agentes con horas de videojuegos; y OpenAI se inclina por retrasar su salida a bolsa a 2027 por el peso de sus compromisos de cómputo. En la conversación social: la exclusiva de la revisión de GPT-5.6, el debate sobre qué pasa cuando se prohíben los modelos top y la lectura de la compra de Topaz. Y en herramientas: un agente que controla webs desde dentro de la página, el stack de Claude Code de Garry Tan, un framework para correr agentes en sandbox y una VM lista para llevar Claude Code al móvil.
Día de movimientos de primer nivel. OpenAI presenta con Broadcom su primer chip propio, Jalapeño, un acelerador de inferencia diseñado en nueve meses y un 50% más barato que una GPU comparable: el primer paso serio para soltarse de Nvidia. En el frente geopolítico, Anthropic acusa a Alibaba de orquestar la mayor campaña de "destilación adversarial" que ha visto —casi 25.000 cuentas falsas y 28,8 millones de conversaciones con Claude— para entrenar a Qwen. En modelos, mal día para Google: retrasa Gemini 3.5 Pro a julio mientras pierde investigadores clave, y un nuevo ranking coloca al chino GLM-5.2 entre los cuatro mejores del mundo por delante de Gemini. En la conversación social: el desglose del chip de OpenAI, el hilo sobre la acusación a Alibaba y la lectura de la fuga de talento de DeepMind. Y en herramientas: ojos web para tus agentes, un formato para pasarle tu identidad visual al código, memoria de codebase por MCP, un escáner de seguridad de skills y un agente que conduce tu Chrome ya logueado.
El día lo marca el dinero: una ola de ventas global por miedo a la burbuja de la IA hunde las bolsas —el Kospi coreano cae casi un 10% y salta el cortacircuitos, el Nasdaq pierde un 2,2% y SoftBank se desploma un 15%—, con la duda de fondo de si el gasto en infraestructura va a dar el retorno prometido. En productos, Anthropic mete a Claude dentro de Slack como compañero permanente con el lanzamiento de Claude Tag, y NVIDIA convierte una década de librerías de ciencias de la vida en un kit para que los agentes aceleren el descubrimiento científico. En modelos, Krea libera los pesos de su modelo de imagen Krea 2. En la conversación social: el desglose del crash coreano, la lectura de un insider de Anthropic sobre Claude Tag y las primeras manos sobre los pesos abiertos de Krea 2. Y en herramientas: el marketplace oficial de plugins de Claude, orquestación de flotas de agentes, edición de vídeo para IA y dos productos recién salidos para builders.
El día lo manda el cómputo: SpaceX firma con Reflection un acuerdo de hasta 6.300 millones de dólares para alquilar GPUs en Colossus 2, su cuarto gran contrato de capacidad en meses. En paralelo, AWS lanza Lambda MicroVMs —sandboxes aislados con Firecracker pensados explícitamente para ejecutar código de usuario y generado por IA—, una pieza de infraestructura directa para cualquiera que corra agentes. Y los modelos abiertos siguen apretando: Zhipu, creadora de GLM-5.2, supera los 128.000 millones de dólares de capitalización y se convierte en la empresa de IA más valiosa de China, mientras GLM-5.2 adelanta a GPT-5.5 en una nueva evaluación de trabajo agéntico a una fracción del coste. En la conversación social: el cómputo como verdadero cuello de botella, el "momento útil de verdad" de los pesos abiertos y la tesis de que los repos más estrellados ya no tienen código. Y en herramientas: agregación de noticias con IA, estudio de voz y de vídeo open-source, y cache para abaratar la inferencia.
El día lo abre un cambio de forma en los modelos: Sakana lanza Fugu, un "modelo" que en realidad es un orquestador entrenado para repartir cada tarea entre un pool de modelos detrás de un solo endpoint. En empresas, el veto de EE.UU. a los modelos top de Anthropic deja de ser un episodio puntual —el testimonio de la NSA lo amplía y bloquea a Samsung, SK Hynix y a gobiernos enteros—, y Anthropic anuncia que desde el 8 de julio pedirá foto de ID, selfie y geometría facial a los usuarios de Claude Free/Pro/Max. En modelos, hoy se abre la ventana de GPT-5.6 (contexto de 1,5M) con Sonnet 5 rumoreado al lado. En la conversación social: la tesis de que la orquestación de modelos es ya el producto, el debate por la verificación facial y el escrutinio a los benchmarks de Fugu. Y en herramientas: skills para ingenieros, un modelo abierto de forecasting, memoria persistente para agentes y un navegador hecho para automatización.
El día lo marca el precio de construir con agentes. Microsoft cancela las licencias de Claude Code a miles de ingenieros porque el billing por tokens se comió el presupuesto, y a la vez el coste por uso de Codex se dispara 10-20x y vacía el plan en dos o tres prompts: el fin de los subsidios de inferencia ya está aquí. En empresas, Google enciende su carrito agéntico para que un agente pague por ti, y se conocen los detalles de la ronda récord de 7.400 M$ de DeepSeek. En la conversación social, el sector discute si Microsoft "prohibió la IA" o solo cambió de proveedor, y si el código que escribe la IA debería aceptarse aunque funcione. En herramientas: filtraciones de system prompts, agentes con ojos en la web, una alternativa a Salesforce pensada para IA y un n8n que montan los propios agentes.
El día lo marca el baile de talento y de silicio. John Jumper —Nobel de Química por AlphaFold— deja Google DeepMind tras nueve años y ficha por Anthropic, justo cuando Google da un giro y empieza a vender sus TPU a clientes externos copiando el manual de Nvidia. En modelos, el open-weights GLM-5.2 se mide de tú a tú con Claude Opus 4.8 en coding agéntico a una quinta parte del precio. En la conversación social, todo gira alrededor de Anthropic: el propio anuncio de Jumper, la reacción al vaciado de DeepMind y la tesis de una salida a bolsa millonaria. En herramientas: un escáner de seguridad de NVIDIA para skills de agentes, una forma de convertir cualquier API en servidor MCP, cuentas efímeras de Cloudflare para que los agentes desplieguen solos y un índice de código que ataca las alucinaciones.
La IA deja de ser promesa y empieza a reordenar empresas enteras. Accenture cae a su nivel más bajo desde 2017 porque el gasto en IA se come la demanda de consultoría tradicional, y State Farm rompe los contratos de sus 19.000 agentes para obligarles a vender con IA. En modelos, Claude Code abre artifacts —páginas vivas que se generan dentro de la sesión— y Artificial Analysis estrena AA-Briefcase, un examen de "trabajo de conocimiento" de frontera donde Fable 5 manda. En la conversación social: el coste real de correr Fable 5, las primeras reseñas de GPT-5.6 y el cabreo de los agentes de State Farm. En herramientas: una skill de research con 44k estrellas, una plataforma de coding agéntico, una base de datos vectorial embebida y dos lanzamientos para publicar en redes y aislar agentes.
El mapa de modelos se mueve. Por primera vez ChatGPT cae por debajo del 50% de cuota mundial mientras Gemini y Claude ganan terreno, y el reparto de usuarios cambia a qué LLM conviene construirle producto. Encima, uno de los padres del transformer deja Google para irse a OpenAI justo antes de su IPO, y Microsoft se planta vendiendo modelos de IA en China pese a las objeciones de OpenAI y Anthropic. La cumbre del G7 sienta a los tres grandes laboratorios con líderes mundiales. En la conversación social: Block enseña números de su flota de agentes, Lovable abre flujo desde Claude y un hilo desmenuza por qué el harness manda más que el modelo. En herramientas: compresión de contexto trending, un "deshacer" para agentes y coordinación multiagente por mensajes.
El día gira en torno al coding con IA y a su precio. SpaceX compra Anysphere, la matriz de Cursor, por 60.000 millones en acciones: el editor de código con IA más usado cambia de dueño y reordena el mapa de herramientas. Databricks libera Genie One, un agente que ejecuta trabajo real sobre los datos de la empresa. Y un análisis sitúa a DeepSeek V4 Pro al 5% del coste de Claude, otra vuelta de tuerca a la guerra de precios. En la conversación social: una optimización 100x en C guiada por un LLM, un playbook de cine con IA que sí consiguió financiación y picaresca con agentes en el trabajo. En herramientas: un ataque a la cadena de suministro de Mastra, dos atajos para abaratar tokens y MCP, y un caso de RAG agéntico llevado a producción de verdad.
El día va de músculo: dinero, cómputo y un modelo abierto. Salesforce se lleva Fin (la antigua Intercom) por unos 3.600 millones para reforzar Agentforce; Microsoft se ve obligada a apoyarse en la nube de Amazon porque GitHub se queda sin capacidad de cómputo para IA; y Moonshot libera Kimi K2.7-Code, un modelo de coding agéntico que recorta un 30% los tokens de razonamiento. En la conversación: la tesis de que el sistema de archivos es el nuevo primitivo de los agentes, la marcha atrás de Anthropic con los créditos del Agent SDK y dos avisos de seguridad sobre comandos inseguros y búsquedas manipulables. En herramientas: un control plane open source de Databricks, un medidor de coste por PR, Claude Code dentro de Visual Studio y un transporte binario para MCP.
El día va de negocio de la IA, no de modelos. OpenAI lanza una red global de partners con 150 millones y meta de 300.000 consultores certificados; Meta coloca a Alexandr Wang al frente de su próximo modelo; y hoy 15 de junio entran en vigor en Anthropic dos cambios que tocan a cualquiera que construya: se apagan los Claude 4 originales de la API y el Agent SDK sale de tu suscripción a un crédito aparte. En la conversación: la queja por el tono de Claude, la tesis "Claude Code ha muerto" y un ataque que dispara la factura de los agentes. En herramientas: el MCP oficial de MDN, motion design por prompt y un agente que lleva un issue hasta el PR.
El caso del día tiene autor: según el Wall Street Journal, el aviso del CEO de Amazon al Tesoro de EE.UU. fue lo que detonó el veto a Fable 5 y Mythos 5 de ayer. En paralelo, el Ayuntamiento de Río publica un modelo frontera abierto de 397B y Google demanda a una red de estafas que usaba Gemini. En la trinchera del builder: un visor de coste en vivo para agentes, transcripción de vídeo a markdown y una alerta de gusanos que ya apuntan a quien desarrolla con MCP.
Día de movimientos grandes en lo macro: Estados Unidos ordena suspender el acceso a dos modelos frontera de Anthropic, 42 fiscales abren investigación a OpenAI a días de su salida a bolsa y Z.ai lanza GLM-5.2 con un millón de tokens de contexto. En la trinchera del builder, una tanda de herramientas frescas: dibujar tu vault como grafo, verificar refactors de IA y disparar Codex desde el móvil.
La edición de hoy viene muy centrada en operación real: agentes que pueden gastar o comerciar, controles de presupuesto, memoria de largo plazo, seguridad MCP y nuevas piezas para coding agents. Menos demo aislada y más “cómo lo meto en producción sin que se descontrole”.
La señal del día no es “otro agente más”: es infraestructura alrededor del agente — evaluación, permisos, observabilidad, costes y seguridad. También sube el ruido regulatorio y reputacional alrededor de OpenAI.
El día viene cargado de agentes: más herramientas para ejecutar código, gobernar MCP, automatizar flujos y llevar IA a equipos reales. La señal útil está en seguridad, observabilidad y workflows reproducibles.