
OpenAI lanza Agents API y convierte el arnés de Codex en infraestructura: por qué el 86% menos de fallos liquida los frameworks agénticos caseros
OpenAI abre en beta pública su Agents API, trasladando la arquitectura de ejecución, compactación de contexto y subagentes de Codex a un servicio gestionado. Con reducciones de fallos del 86% y caídas de costes del 60% en entornos reales, la industria entra en una nueva fase: construir frameworks agénticos propios ya no aporta ventaja competitiva.

Salesforce lanza agentes ‘job-ready’ y un runtime multi-semana: por qué 7.000 millones de tareas marcan el fin de los chatbots de un solo turno
Salesforce presenta su catálogo de agentes Agentforce listos para el trabajo (‘job-ready’) y su Long-Horizon Runtime para sostener objetivos operativos a lo largo de días y semanas, respaldado por más de 7.000 millones de tareas de trabajo agéntico procesadas.

Anthropic lanza Smart Reports en Claude Enterprise: de pagar tokens a ciegas a convertir la fricción en skills compartidos
Anthropic introduce Smart Reports en Claude Enterprise para auditar el uso real de IA en las organizaciones, diagnosticar cuellos de botella y bucles de reintento, y convertir automáticamente los patrones de trabajo individuales en habilidades estandarizadas para toda la empresa.

Cohere lanza North Small Translate: por qué un modelo abierto de 218B MoE desbanca a DeepL y derriba el ‘impuesto’ de los LLM generalistas
Cohere y Cohere Labs presentan North Small Translate, un modelo Mixture-of-Experts de 218B parámetros (25B activos) que supera a DeepL NextGen en WMT26 y procesa tareas a /bin/bash,000676: un 98% más económico que usar LLMs de razonamiento general.

Meta lanza Muse y lleva la ejecución de tareas a WhatsApp: por qué cambia las reglas del comercio, la productividad y el perímetro empresarial
Meta ha lanzado Muse, su agente personal de IA capaz de navegar, rellenar formularios, negociar y comprar en segundo plano. Al integrarlo directamente en WhatsApp e impulsarlo con máquinas virtuales aisladas y una cuota gratuita de 100 millones de tokens semanales, la compañía cambia el campo de batalla de la IA: de las ventanas de chat a la ejecución operativa sin fricción.

OpenAI lanza GPT-6 Astra y cruza el umbral crítico de ciberseguridad: qué cambia para las empresas y cuáles son sus 5 casos de uso de mayor ROI
OpenAI lanza GPT-6 Astra, su primer modelo en alcanzar el umbral de ciberseguridad crítica bajo el Preparedness Framework. Con un 72,6% en OSWorld y 99,2% en ingeniería inversa, analizamos su arquitectura agéntica, su economía a 0/M tokens y los 5 casos de uso empresariales donde su ROI resulta imbatible.

3,1 días de trabajo por cada jornada humana: qué revela el ‘Research Intern’ de OpenAI sobre la nueva economía de la IA
OpenAI anunció haber alcanzado el hito de su ‘Research Intern’ autónomo, acumulando 3,1 días-agente de trabajo por cada jornada humana y un consumo diario de inferencia superior a 600 dólares por investigador. Analizamos cómo este salto transforma la economía del trabajo cognitivo, por qué el código dejó de ser el cuello de botella y qué implicaciones tiene para las empresas.

El 32% de las empresas frena compras de software para construirlo con agentes de IA: la gran paradoja del ‘Build vs. Buy’ en 2026
El informe State of AI 2026 de McKinsey revela un giro histórico: el 32% de las empresas ha descartado comprar software comercial para construirlo internamente con agentes de código. Sin embargo, el impacto en beneficios empresariales sigue estancado en el 37%. Analizamos la anatomía de esta paradoja, la brecha entre sectores regulados y tecnológicos, el coste oculto del ‘Context Tax’ y la guía estratégica para decidir cuándo construir y cuándo comprar en la era de los agentes autónomos.

Anthropic, Google y OpenAI dividen la IA en dos regímenes: qué cambia para las empresas cuando la frontera exige verificación
En las primeras 72 horas de septiembre de 2026, los lanzamientos de Claude Fable 5.1/Mythos 5.1 (Anthropic), Gemini 3.8 Flash Cyber (Google) y Astra (OpenAI) inauguraron la era de los modelos de IA de doble régimen. Analizamos por qué el acceso a la frontera ahora exige verificación institucional (‘Know Your Agent’), cómo el recorte del 75% en lectura de caché reconfigura el coste de los agentes y qué decisiones de arquitectura deben tomar las empresas hoy.

Por qué la gobernanza en papel no frena a un agente en ejecución: la seguridad de la IA se muda al endpoint con AIDR
Con la llegada de agentes de IA autónomos que ejecutan código y llaman herramientas con privilegios de sistema, la ciberseguridad empresarial enfrenta un punto de inflexión. CrowdStrike lanza Falcon Guardian para llevar la detección y respuesta (AIDR) al endpoint.

De 60 horas a 45 minutos semanales: por qué los agentes de operaciones de pago marcan el verdadero salto de la IA a la línea de flotación del negocio
Con el despliegue de Relay por Cashfree y modelos unificados como Vulcan de Razorpay, la IA pasa de la asistencia conversacional a la ejecución financiera directa. Analizamos cómo los agentes autónomos de pago reducen 60 horas de tareas manuales a 45 minutos y transforman el software hacia precios basados en resultados.

Tencent libera Hy4 preview con 770B parámetros y licencia Apache 2.0: qué cambia para la autonomía y el cómputo empresarial
Tencent ha liberado en código abierto bajo licencia Apache 2.0 su nuevo modelo insignia Hy4 preview: 770B parámetros en arquitectura MoE con solo 49B activos por token y 1M de contexto. Analizamos su impacto en costes de inferencia, soberanía de datos y despliegues empresariales.