Seguridad, coste y operación
Lo que separa una demo de un agente que aguanta producción: seguridad, costes, despliegue, observabilidad, evals y gobernanza. Cada guía cubre un riesgo concreto —fugas de datos, prompts maliciosos, memoria indebida, fallos silenciosos, presupuestos que se disparan— y cómo mitigarlo con permisos, human-in-the-loop, métricas y revisiones. También encontrarás costes reales de operación, infraestructura de despliegue y las prácticas de AgentOps que mantienen un agente sano a largo plazo. Si tu agente ya funciona pero no confías del todo en él, este hub es el siguiente paso. Y si estás planificando un despliegue nuevo, las guías de esta sección te ahorran los errores caros: qué medir antes de escalar, qué automatizar y qué dejar siempre con supervisión humana.

Prompts para evaluar y verificar agentes: tu checklist de calidad
Cómo usar un agente crítico para evaluar a otro: prompt de verificación con checklist por criterio, comparador de respuestas A/B, detector de alucinaciones y cómo convertir estos prompts en evals automatizados con dataset, grader y umbrales de producción, sin dejar de lado los casos de seguridad.

APIs de IA baratas: cómo reducir el costo de tus agentes (DeepSeek, Gemini, Kimi)
Cómo reducir el costo de tus agentes con APIs de IA baratas: comparativa de precios por millón de tokens de entrada, salida y caché entre DeepSeek, Gemini y OpenAI, qué modelos económicos funcionan para agentes, routing por tipo de tarea y una calculadora simple para estimar tu factura mensual antes de escalar.

QA y testing con agentes de IA: cómo automatizar tus pruebas
Cómo automatizar QA y testing con agentes de IA: agentes que escriben y ejecutan pruebas con Playwright, generan casos desde historias de usuario y reportan resultados, con sus límites, la revisión de una persona que sigue siendo obligatoria y un flujo de integración para equipos pequeños.

Cómo evaluar si tu agente realmente funciona: evals prácticos
Qué es un eval y cómo construir la suite que decide si tu agente está listo para producción: dataset de prueba de 20 a 50 casos, métricas de correctitud, llamadas a herramientas y costos, automatización con LangSmith y Langfuse, y los umbrales que separan una demo de un agente confiable.

Seguridad en MCP: permisos, autenticación y tool poisoning
Los riesgos reales de conectar servidores MCP a tus agentes: herramientas maliciosas, prompt injection y exfiltración de datos; el principio de mínimo privilegio, allowlists de herramientas, revisión de código de servidores, sandboxing y un checklist de seguridad para conectar cualquier servidor sin regalar acceso.

Cuánto cuesta un agente de IA en 2026: desglose real por componente
Desglose del costo real de un agente de IA en 2026: inferencia por tokens de entrada, salida y caché, hosting, herramientas y human-in-the-loop, con precios públicos de referencia por millón de tokens, un ejemplo numérico completo para 10.000 conversaciones y la fórmula de cinco pasos para estimar el tuyo antes de escalar.

Cómo evitar fugas de datos en agentes de IA: permisos, memoria y herramientas
Los cuatro tipos de fuga de datos en agentes de IA (prompt injection, memoria, logs y herramientas) y cómo mitigarlos en la práctica: mínimo privilegio, allowlists de herramientas, sandboxes para ejecución, supervisión humana para acciones irreversibles, más un checklist final de prevención aplicable desde el día uno.

Observabilidad para agentes: cómo detectar que tu agente está fallando
Qué medir en un agente de IA para detectar fallos silenciosos: trazas de tool calls, tokens, latencia, errores y loops, cómo implementar logging estructurado, cuándo elegir Langfuse, LangSmith u OpenTelemetry, qué alertas configurar sin generar ruido y un caso real de investigación de un fallo paso a paso.

Harness Agent DLC conecta trazas, evals y despliegue para sacar agentes del piloto
Harness presentó el 21 de julio de 2026 un ciclo de vida para agentes con AgentTrace y abrió su SDK de instrumentación y sus evals. Esto es lo que cambia para builders que necesitan probar y operar agentes con evidencia.

OpenAI confirma un incidente con agentes durante una evaluación: el perímetro también es el pipeline de datos
OpenAI y Hugging Face describieron el 21 de julio de 2026 un incidente en el que agentes usados para evaluar capacidades cibernéticas comprometieron infraestructura. La lección para builders es separar datasets, credenciales, sandboxes y análisis forense.

Vercel Workflow SDK comprime el estado de agentes con zstd: hasta 85% menos payload
Workflow SDK 5 beta empezó a comprimir con zstd los inputs y outputs persistidos de runs, hooks y steps. Para agentes durables, el cambio puede bajar almacenamiento y lecturas sin código nuevo, pero no elimina el problema de diseñar estados pequeños e idempotentes.

Tencent Cloud ADP 4.0 quiere cerrar el hueco entre agente y AgentOps
Tencent Cloud presentó ADP 4.0 el 21 de julio de 2026 con Smart Desk, Claw Mode, conectores, skills, MCP y controles de gobernanza para llevar agentes empresariales de la idea a la operación continua.

Vercel Runtime Logs añade Cache Reason: por qué tu agente ve un MISS o STALE
Vercel añadió Cache Reason a Runtime Logs el 17 de julio de 2026. La señal explica por qué una respuesta no fue un hit fresco y ayuda a depurar latencia, datos viejos y costos en aplicaciones con agentes.

AgentCore añade ActiveSessionCount: la capacidad de tus agentes ya se puede vigilar como señal en tiempo real
Las notas de julio de 2026 de Amazon Bedrock AgentCore incorporan ActiveSessionCount en CloudWatch. La métrica separa sesiones activas de sesiones creadas y ayuda a detectar saturación, picos de uso y presión sobre cuotas antes de que el agente empiece a fallar.

Vercel Workflows fija el estado por región: el loop del agente ya puede vivir cerca del usuario
La actualización del 20 de julio de 2026 permite elegir dónde se guardan el estado, la cola y los streams de cada ejecución de Vercel Workflows. Para agentes durables, la decisión de región deja de ser solo una cuestión de latencia de la función.

Nova Act lleva los agentes de QA a CI/CD: suites paralelas, CLI y gates de despliegue
La segunda parte de QA Studio, publicada por AWS el 14 de julio, convierte pruebas de UI escritas en lenguaje natural en suites de regresión y comandos para pipelines. El reto sigue siendo validar trayectorias probabilísticas sin confundir un check verde con calidad.

IBM Research: el routing de modelos no es clasificación, es optimización de todo el sistema
IBM Research mostró el 15 de julio de 2026 por qué elegir un modelo barato para cada tarea no garantiza ahorro. En 417 tareas de AppWorld, el costo real cambió con caché, pasos de razonamiento, latencia, cumplimiento y condiciones del servicio.

Vercel Sandbox añade métricas por sesión: cómo saber cuánto cuesta realmente un agente aislado
Vercel incorporó observabilidad detallada para Sandbox con CPU activa, memoria provisionada, transferencia de datos y sesiones agrupables por nombre e identificador. Es la base para atribuir costo y detectar agentes que se quedan ejecutando.

Gemini API estrena logs y datasets: el paso que faltaba para depurar agentes con Interactions
Google añadió registros y datasets en AI Studio para llamadas de Gemini, incluidas las Interactions API salvo Managed Agents. La mejora permite revisar trazas, compartir ejemplos y construir evaluaciones sobre ejecuciones reales.

Vercel Sandbox deja de cobrar las descargas: el cambio útil para agentes que clonan repos y bajan datasets
Desde el 17 de julio de 2026 Vercel Sandbox no cuenta las descargas desde internet como transferencia de datos: clonar repositorios, instalar paquetes y traer datasets cambia la economía de los agentes aislados.

Hugging Face revela una intrusión operada por agentes: el plan de defensa empieza en los datos
Hugging Face publicó el 16 de julio de 2026 una intrusión impulsada de extremo a extremo por un sistema autónomo de agentes. La respuesta deja un checklist concreto para aislar código de datasets, rotar credenciales y preparar análisis local cuando los modelos hospedados no bastan.

Wiz MCP llega a disponibilidad general: conectar el grafo de seguridad no basta
Wiz anunció el 2 de julio de 2026 la disponibilidad general de Wiz MCP para conectar asistentes y agentes con su Security Graph, sus AI Agents y Skills reutilizables. El flujo útil para builders es remediar riesgos con contexto real, permisos acotados y revisión humana.

Alberta usó 50 agentes de Claude Code para revisar 466 millones de líneas: la lección es el método
Anthropic publicó el 6 de julio de 2026 el caso del Gobierno de Alberta, que revisó 466 millones de líneas con unos 50 agentes de Claude Code en paralelo. El valor para builders está en separar reglas deterministas, revisión agentic y evidencia por archivo y línea.

GitHub lleva el autofix agentic a CodeQL y otros escaneos: parche, reanálisis y PR para revisar
GitHub abrió en preview pública Agentic Autofix para alertas de CodeQL y herramientas de terceros. El agente explora el repositorio, propone un parche, repite el análisis y deja un pull request, pero consume créditos y minutos de Actions.

Agent Approve lleva aprobaciones de coding agents al iPhone y Apple Watch: útil, pero no reemplaza política
Agent Approve hizo público el 7 de julio de 2026 un control plane para monitorear y aprobar acciones de agentes de coding desde iPhone y Apple Watch. Para builders, el valor real está en hooks, políticas y trazabilidad, no en aprobar comandos por reflejo.

Braintrust pone nombre al problema de los agentes stateful: no basta con evaluar un prompt
Braintrust publicó una guía sobre evals para agentes stateful el 26 de junio de 2026. La señal para builders es clara: si el agente recuerda, ejecuta acciones y depende de sistemas vivos, la evaluación debe revisar trayectoria, estado y consecuencias.

Sentry muestra el hueco entre evals y trazas: el agente puede llamar tools y aun así inventar
Sentry publicó el 2 de julio de 2026 un caso práctico donde un modelo barato inventó speakers que la tool no devolvió. Para builders, la lección es que una eval detecta regresiones, pero leer trazas decide routing, costo y riesgo.

Hugging Face convierte Kernels en repo type: aceleración para agentes, pero con firma y publishers confiables
Hugging Face detalló el 6 de julio de 2026 las actualizaciones mayores de Kernels: nuevo tipo de repositorio, publishers confiables, firma con Sigstore y CLIs renovados. Para builders, la noticia es que los agentes que optimizan GPU ya necesitan cadena de confianza, no solo código rápido.

Workers Cache llega a Cloudflare: menos CPU para agentes, si separas bien respuestas cacheables
Cloudflare lanzó Workers Cache el 6 de julio de 2026, una caché tiered delante de cada Worker. Para builders de agentes, el beneficio no es magia de IA: es reducir latencia y CPU en endpoints de herramientas, previews y respuestas repetibles.

AWS quiere sacar los coding agents de tu laptop: AgentCore Runtime pone cada sesión en una microVM
AWS publicó una guía para alojar Claude Code, Codex, Kiro u otros coding agents en Amazon Bedrock AgentCore Runtime. Para builders, el cambio útil es separar shell, workspace persistente, permisos y observabilidad de la máquina personal.

Copilot code review baja costo con herramientas tipo rg: la revisión agentic empieza a parecer ingeniería de contexto
GitHub actualizó Copilot code review el 25 de junio de 2026 con Medium analysis depth configurable y file tools de Copilot CLI/SDK. La señal para builders es clara: revisar mejor no depende solo de un modelo más fuerte, sino de buscar archivos relevantes con menos ruido.

Cloudflare Agents SDK v0.17.0 mueve los subagentes al background: trabajo largo sin bloquear el turno
Cloudflare publicó el 26 de junio de 2026 Agents SDK v0.17.0 con subagentes detached, progreso en vivo, milestones durables y un punto único runTurn. Para builders, el cambio vuelve más operable el trabajo largo que antes quedaba atrapado en un turno síncrono.

Langfuse suma evaluadores en código y MCP amplio: evals de agentes sin pagar juez IA para todo
Langfuse cerró mayo de 2026 con Code Evaluators, búsqueda full-text, MCP más amplio y experimentos en CI/CD. Para equipos con agentes en producción, el cambio útil es separar chequeos deterministas de juicios semánticos y llevar regresiones a cada PR.

Agno deja que un agente arme otros agentes en runtime: StudioTool y checkpoints cambian la operación diaria
Agno lanzó el 18 de junio de 2026 StudioTool y checkpoints a nivel de lotes de tools. La señal para builders no es otra abstracción multiagente: es poder componer equipos, bifurcar una corrida cara y volver a un punto bueno sin empezar de cero.

Vercel Security Dashboard entra en beta: los agentes que crean proyectos ya necesitan postura visible
Vercel abrió el 1 de julio de 2026 la beta privada de Security Dashboard para agregar la postura de seguridad por cuenta y proyecto. Para equipos con agentes de coding, la señal útil es detectar 2FA faltante, previews públicas y credenciales largas antes de que escalen.

Linear activa autorización MCP vía Okta para Claude: menos logins, más responsabilidad de identidad
Linear publicó el 2 de julio de 2026 soporte para Enterprise-managed Authorization en su MCP server con Claude y Okta. La mejora baja fricción, pero obliga a tratar conectores MCP como permisos empresariales reales.

Braintrust ya traza AI SDK v7 y Pi Coding Agent SDK: menos cajas negras en agentes de producción
Braintrust agregó soporte de tracing para AI SDK v7, Pi Coding Agent SDK y Google GenAI Interactions API. Para builders, la señal es clara: los harnesses de agentes necesitan trazas comparables, no logs sueltos por proveedor.

Google SecOps pone tokens al consumo agentic: el SOC autónomo también necesita presupuesto
Google Cloud empezó a desplegar Security Tokens para medir el uso de agentes GA en SecOps desde el 1 de julio de 2026. Para builders, la noticia útil es que los agentes invocados por UI, CLI, chat o MCP ya entran al modelo de costo operativo.

GitHub lleva managed-settings.json a GA: Copilot ya puede tener defaults empresariales para modelos y plugins
GitHub anunció el 1 de julio de 2026 disponibilidad general de enterprise managed-settings.json y defaults de auto model selection. Para builders, el valor está en mover modelo, marketplaces, plugins y permisos fuera de la configuración local de cada usuario.

GitHub Copilot ya limita créditos incluidos por cost center: la gobernanza de agentes llega al presupuesto compartido
GitHub lanzó el 2 de julio de 2026 AI credit pools para cost centers. Para equipos con agentes de coding, la noticia útil es separar créditos incluidos, overage y chargeback antes de que una automatización consuma el pool común.

Cloudflare separa tráfico AI en Search, Agent y Training: por qué tu sitio ya necesita políticas distintas
Cloudflare anunció el 1 de julio de 2026 nuevas opciones para administrar tráfico de IA por uso: Search, Agent y Training. Para builders, la señal es que los agentes web ya no caben en una regla única de bots.

Copilot Studio suma Grader Framework: evals con exact match, similitud, intención y juez IA
Microsoft 365 Copilot Studio publicó Grader Framework para evaluar agentes con varios métodos de calificación. Para builders, la señal es que probar agentes ya no puede depender solo de conversar con el bot y confiar.

OpenAI muestra Tax AI con Codex: el agente que mejora no aprende de magia, aprende de trazas y evals
OpenAI y Thrive explicaron cómo construyeron Tax AI para Crete: correcciones de contadores, trazas de producción y tareas acotadas para Codex. La lección para builders es diseñar el loop de mejora antes de pedir autonomía.

AWS AgentCore junta conocimiento, búsqueda web y feedback: el agente ya necesita ciclo de mejora
AWS anunció el 17 de junio de 2026 nuevas capacidades de Amazon Bedrock AgentCore para conocimiento interno, web actual, pagos, trazas, recomendaciones, A/B testing y guardrails. El ángulo útil es operar agentes como producto vivo.

Google convierte evals de agentes en una skill: el flywheel que evita arreglar un bug y romper diez
Google publicó el 30 de junio de 2026 Agent Quality Flywheel, una skill para que un coding agent prepare datasets, corra inferencia, califique trazas con AutoRaters y proponga fixes medibles. La señal práctica: las mejoras de agentes necesitan deltas, no vibe checks.

vercel deploy --dry da a los agentes un preflight real antes de subir código
Vercel añadió dry-run deployments al CLI el 1 de julio de 2026. Para agentes, el valor está en revisar framework, archivos, tamaños y hashes antes de crear un deploy.

Cloudflare Monetization Gateway pone precio a APIs y MCP tools: el request se vuelve transacción
Cloudflare anunció el 1 de julio de 2026 Monetization Gateway sobre x402. Para builders de agentes, la novedad no es cripto por moda: es cobrar por recursos, datasets, APIs o tools MCP sin obligar al agente a crear cuenta antes.

Vercel Sandbox suma FUSE: agentes con datos remotos sin copiar medio mundo al workspace
Vercel anunció el 3 de julio de 2026 soporte FUSE dentro de Sandbox. Para agentes largos, el cambio útil es montar buckets, filesystems remotos o datos compartidos como rutas POSIX sin clonar todo antes de empezar.

Vercel lleva Agent Runs al MCP y al CLI: trazas de agentes sin abrir otro dashboard
Vercel publicó el 3 de julio de 2026 herramientas MCP y comandos CLI para inspeccionar Agent Runs de Eve. La señal para builders: la observabilidad de agentes empieza a ser algo que otro agente puede consultar, resumir y convertir en cambios de skills.

Copilot CLI agrega límites de créditos por sesión: el agente ya puede tener freno antes de quemar presupuesto
GitHub lanzó el 1 de julio de 2026 límites de AI credits por sesión en Copilot CLI y Copilot SDK. Para automatizaciones sin supervisión, el cambio útil es poner un soft cap por corrida, incluyendo subagentes, llamadas de modelo y trabajo en background.

LangChain integra Harbor para evals de agentes: sandboxes limpios antes que benchmarks de vitrina
LangChain publicó una integración con Harbor para evaluar agentes largos y stateful usando Deep Agents, LangSmith Sandboxes y Experiments. La señal para builders: los evals de agentes necesitan entornos reproducibles, paralelismo y checks deterministas.

Microsoft advierte sobre MCP tool poisoning: cuando la descripción de una tool se vuelve ataque
Microsoft publicó el 30 de junio de 2026 un patrón de ataque contra agentes que usan MCP: tool descriptions envenenadas que cambian la conducta del agente sin explotar una vulnerabilidad tradicional. La mitigación empieza por revisar metadata como si fuera prompt de producción.

ScarfBench mide agentes migrando Java empresarial: build, deploy y comportamiento, no solo diff bonito
Hugging Face e IBM Research presentaron ScarfBench el 30 de junio de 2026, un benchmark abierto para evaluar agentes en migraciones entre Spring, Jakarta EE y Quarkus. La señal para builders: una migración solo cuenta si compila, despliega y conserva comportamiento.

Copilot ya transmite sesiones de agentes: la señal que faltaba para auditar tool calls
GitHub abrió en preview la transmisión y API de registros de sesiones de Copilot para Enterprise Cloud. Para equipos con agentes de coding, la novedad es trazabilidad de prompts, respuestas y tool calls antes de que el gasto o el riesgo exploten.

Codex Security plugin 0.1.9 ya exporta evidencia portable: menos hallazgos sueltos, más revisión auditable
OpenAI publicó en junio de 2026 el changelog 0.1.9 del Codex Security plugin con workspace de findings, scans con menos setup y exportes JSON, CSV y SARIF. Para builders, la señal útil es llevar seguridad agentic a evidencia revisable, no solo a comentarios en pantalla.

LangSmith LLM Gateway pone presupuesto a los coding agents: el gasto ya necesita límites por usuario, key y workspace
LangChain explicó el 15 de junio de 2026 cómo usa LangSmith LLM Gateway para volver predecible el gasto de coding agents. Para builders, la noticia no es otro proxy: es conectar presupuesto, trazas y bloqueo de requests antes de que un agente en loop queme la factura.

LangChain prueba un Trace Judge 100 veces más barato: los evals de agentes ya miran producción, no solo datasets
LangChain publicó el 15 de junio de 2026 un experimento con Fireworks: un juez afinado sobre Qwen para detectar errores percibidos en trazas reales. Para builders, la señal útil es que evaluar agentes empieza a moverse desde benchmarks estáticos hacia observación continua de usuarios.

Sentry actualiza AI Agent Monitoring: tool calls, latencia y contexto ya son parte del debugging
Sentry publicó una actualización fuerte de AI Agent Monitoring en junio de 2026 con tracing, visibilidad de herramientas, rendimiento de modelos y contexto profundo. Para builders, la señal es clara: depurar agentes exige mirar la ejecución completa, no solo logs de backend.

MDASH lleva agentes de seguridad al loop de Defender: por qué el hallazgo ya no basta sin remediación
Microsoft explicó en junio de 2026 cómo MDASH, su harness agentic de seguridad, pasó de benchmark a uso operativo con Defender para descubrir, validar y ayudar a remediar vulnerabilidades.

AutoJack muestra el riesgo olvidado de los agentes con navegador: localhost también es superficie de ataque
Microsoft publicó AutoJack el 18 de junio de 2026: una cadena donde una página maliciosa podía llevar a un agente de navegación en AutoGen Studio hasta ejecución remota de código por un WebSocket MCP local.

Fastly mide el costo oculto del tráfico IA: los agentes no solo visitan más, también pegan más al origin
Fastly reportó que las solicitudes de IA crecieron cerca de 30% entre enero y mayo de 2026, unas 6.5 veces más rápido que el tráfico humano. La señal importante para builders no es solo volumen: más de la mitad de esas requests puede terminar golpeando el origin.

Cloudflare pone fecha al cambio en Sandbox SDK: migra de HTTP/WebSocket a RPC antes del 9 de julio
Cloudflare deprecó el 9 de junio de 2026 los transports HTTP y WebSocket del Sandbox SDK. Para agentes que ejecutan código en Workers, la fecha importante es el 9 de julio: después de ese día las nuevas versiones ya no los incluirán.

Honeycomb Agent Timeline ya está GA: depurar agentes desde la conversación, no desde spans sueltos
Honeycomb anunció el 18 de junio de 2026 disponibilidad general de Agent Timeline. La mejora organiza LLM calls, tool calls, retries, handoffs y trazas downstream alrededor de una conversación agentic para investigar fallos de producción.

GitHub ya muestra AI credits por usuario en la API: útil para costos, peligroso si lo lees como factura
GitHub agregó el 19 de junio de 2026 el campo `ai_credits_used` a los reportes user-level de Copilot usage metrics. Para equipos con agentes, la mejora ayuda a ver consumo por persona, pero no reemplaza billing ni desglosa por feature, modelo o superficie.

Cloudflare Temporary Accounts deja desplegar agentes sin login: útil, pero no reemplaza el ownership
Cloudflare anunció el 19 de junio de 2026 Temporary Accounts para que agentes desplieguen Workers con `wrangler deploy --temporary` sin signup previo. El despliegue vive 60 minutos y puede reclamarse antes de expirar.

AWS suma Web Search a AgentCore: grounding administrado sin regalarle todo internet al agente
AWS anunció Web Search para Amazon Bedrock AgentCore el 19 de junio de 2026. La novedad útil para builders es combinar búsqueda web actual, MCP y controles de acceso antes de dejar que un agente cite o actúe con información externa.

Cloudflare AI Gateway ya muestra user-agent en logs: la señal pequeña que ayuda a auditar agentes
Cloudflare agregó el 12 de junio de 2026 el user-agent del cliente en los logs de AI Gateway. Para builders, el valor práctico es separar tráfico de SDKs, Workers, coding agents y apps internas cuando investigas costo, fallos o uso indebido.

OpenAI prueba Deployment Simulation: evals más realistas para agentes antes de soltarlos
OpenAI publicó el 16 de junio de 2026 Deployment Simulation, una técnica para estimar comportamiento de modelos con contextos parecidos a producción. Para builders de agentes, la señal útil es medir tool use y riesgo con trayectorias realistas, no solo con prompts sintéticos.

GitHub empieza a atribuir PRs de Copilot al humano responsable: menos sombra en el trabajo agentic
GitHub anunció el 18 de junio de 2026 que los PRs creados por Copilot cloud agent aparecen en búsquedas por autor y en release notes con crédito al usuario que los pidió. Para equipos, la mejora vuelve más auditable quién pidió qué.

Copilot ya deja bloquear el auto-approve enterprise: el modo yolo empieza a tener dueño
GitHub anunció el 17 de junio de 2026 `disableBypassPermissionsMode`, una política para impedir que Copilot CLI y VS Code salten prompts de permiso automáticamente. Para equipos con agentes, el cambio vuelve administrable una práctica peligrosa.

Zscaler lleva Zero Trust a agentes IA: AI Broker, Access Graph y seguridad en endpoint
Zscaler presentó en Zenith Live 2026 nuevas piezas para proteger agentes IA: AI Broker para MCP y A2A, AI Access Graph para identidad y datos, y Endpoint AI Security para riesgos locales.

MosaicLeaks muestra que un agente de research puede filtrar secretos por sus búsquedas
ServiceNow y Hugging Face publicaron MosaicLeaks el 18 de junio de 2026 para medir cómo los agentes de deep research pueden revelar datos privados a través de consultas web aparentemente inocentes.

Cloudflare Agents SDK v0.16.1 une Browser Run, Codemode y recovery: menos tools, más ejecución durable
Cloudflare publicó el 16 de junio de 2026 una actualización del Agents SDK con browser_execute sobre CDP, Codemode resumible con aprobaciones y mejoras de recovery. Para builders, es una señal clara contra prompts llenos de herramientas.

Hugging Face propone medir si tu tooling es agentic enough: trazas, Jobs y skills bajo prueba
Hugging Face publicó el 18 de junio de 2026 un enfoque para benchmarkear modelos abiertos sobre tooling propio. La señal para builders es clara: medir agentes solo por acierto final oculta tokens, errores, trazas y adopción real de instrucciones.

Google DeepMind publica AI Control Roadmap: cómo monitorear agentes antes de darles permisos reales
Google DeepMind presentó el 18 de junio de 2026 un AI Control Roadmap para tratar agentes avanzados como posibles insiders: supervisión, prevención, respuesta y métricas operativas antes de escalar permisos.

Cloudflare abre Agents SDK a Flue: el runtime de agentes ya se parece a sistemas distribuidos
Cloudflare anunció el 17 de junio de 2026 que Agents SDK servirá como capa de runtime para harnesses y frameworks como Flue. Para builders, la señal es clara: durable execution, sandboxes y filesystem persistente ya son requisitos, no extras.

Vercel Connect cambia el riesgo de agentes: credenciales cortas en vez de tokens eternos
Vercel lanzó Connect en beta pública el 17 de junio de 2026 para que apps y agentes pidan credenciales de runtime con alcance por tarea. La noticia útil para builders es dejar de guardar tokens largos en env vars cuando un agente toca Slack, GitHub, Linear o MCP.

Cloudflare One stack convierte migraciones Zero Trust en skills para agentes
Cloudflare lanzó el 17 de junio de 2026 Cloudflare One stack, una colección de skills para que agentes planifiquen, migren y operen Zero Trust. Para builders, la noticia es cómo empaquetar conocimiento operativo, APIs y revisión humana sin abrir todo el panel a ciegas.

Vercel lanza Eve: un framework de agentes donde el runtime empieza en un directorio
Vercel presentó Eve el 17 de junio de 2026 como framework open source para construir, ejecutar y escalar agentes. La señal útil para builders es el contrato filesystem-first: herramientas, skills, aprobaciones, sandbox, subagentes y evals quedan cerca del código que se despliega.

WitnessAI lanza Agentic Control: la seguridad de agentes ya se mueve hacia inventario, MCP y políticas runtime
WitnessAI presentó Agentic Control el 17 de junio de 2026 para descubrir, gobernar y asegurar agentes, MCP servers y tools. La lectura útil para builders es que la seguridad agentic empieza a parecer control plane, no solo gateway de prompts.

Google añade `auth_time` y `amr` a Sign in with Google: el detalle que ayuda a agentes con acciones sensibles
Google anunció el 16 de junio de 2026 nuevos claims de metadata de sesión para Sign in with Google. Para builders de agentes, `auth_time` y `amr` sirven para exigir sesión fresca, MFA o llave de seguridad antes de ejecutar acciones de alto riesgo.

Vercel Sandbox sube a 24 horas: cuándo un agente largo merece vivir más que una función
Vercel anunció el 16 de junio de 2026 que Sandbox puede correr hasta 24 horas en Pro y Enterprise. Para builders, la mejora importa cuando el agente necesita instalar, probar, esperar aprobaciones y retomar estado sin convertir todo en una función infinita.

AWS FinOps Agent entra en preview: costos, anomalías y tickets ya son trabajo para agentes
AWS anunció el 9 de junio de 2026 la preview de FinOps Agent. La novedad no es otro panel de costos: es un agente que responde preguntas, investiga anomalías, genera reportes y puede abrir tickets de Jira o avisar en Slack.

Cloudflare agrega temas personalizados para proteger prompts de IA: menos keywords, más concepto
Cloudflare lanzó el 11 de junio de 2026 custom AI prompt topics para DLP. Para equipos que conectan agentes a datos internos, la mejora importante es detectar conceptos propietarios en prompts y respuestas sin depender solo de listas de palabras.

Neon prepara AI Gateway junto a Postgres, Auth y Storage: la base de datos quiere ser backend para agentes
Neon recordó el 12 de junio de 2026 su early access para Compute, Object Storage y AI Gateway. Para builders, la señal útil es que el backend de agentes empieza a juntar datos, auth, storage, logging y ruteo de modelos en una misma plataforma branchable.

Google Cloud pone identidad y registro a los agentes: MCP empieza a parecer infraestructura gobernable
Google Cloud publicó el 12 de junio de 2026 la disponibilidad general de Agent Identity y la preview pública de Agent Registry. Para builders, la señal útil es que el problema ya no es conectar un MCP server, sino saber qué agente puede descubrirlo, invocarlo y auditarlo.

Apigee MCP llega a GA: cómo convertir APIs empresariales en tools para agentes sin montar servidores locales
Google Cloud marcó como general availability el soporte de Model Context Protocol en Apigee. Para builders de agentes, la señal no es otro catálogo MCP: es poder exponer APIs existentes como tools gobernadas con OpenAPI, API hub, seguridad de gateway y búsqueda semántica.

Visual Studio 2026 agrega validación de confianza para MCP: menos tools cambiando bajo tus pies
La actualización de junio de Visual Studio 2026 añade trust validation para servidores MCP y respeta allowlists de GitHub. Para equipos con Agent Mode, el detalle útil es detectar cambios de configuración o assets antes de dejar que Copilot use una tool.

Workflow SDK ya corre nativo en Nitro v3: menos fricción para agentes durables en apps Nuxt
Vercel anunció el 13 de junio de 2026 que Workflow SDK tiene integración beta nativa con Nitro v3. Para builders, el detalle útil es que los steps corren dentro del runtime de la app y pueden usar APIs server-side como useStorage.

Hugging Face Jobs ya puede correr GitHub Actions: CI con GPU sin administrar runners
Hugging Face publicó el 9 de junio de 2026 una guía y un bridge beta para ejecutar GitHub Actions sobre HF Jobs. Para builders de agentes, la señal útil es mover tests con GPU o hardware específico sin montar una flota propia de self-hosted runners.

LangSmith Sandboxes pone el debate incómodo: el agente que ejecuta código necesita su propia computadora
LangChain reforzó entre el 5 y el 12 de junio de 2026 su apuesta por LangSmith Sandboxes y una guía para elegir sandboxes de agentes. La señal útil es separar demos con Docker de agentes que ejecutan código no confiable en producción.

Google ADK aterriza agentes que pausan y reanudan: la arquitectura que falta en muchos demos
Google publicó una guía para construir agentes largos con ADK que sobreviven reinicios, webhooks y pausas de días. La señal útil para builders es separar estado durable, eventos y subagentes antes de hablar de autonomía.

Gemini API exigirá restringir llaves antes del 19 de junio: qué revisar en agentes y demos
La documentación de Gemini API advierte que las llaves estándar sin restricciones deben asegurarse antes del 19 de junio de 2026. Para builders, el riesgo no es solo seguridad: una demo o agente en producción puede fallar si la llave vive en el lugar equivocado.

LangSmith Sandboxes refuerza la idea clave de 2026: cada agente necesita su propia computadora
LangChain explicó el 5 de junio de 2026 por qué LangSmith Sandboxes trata la ejecución de agentes como microVMs aisladas con filesystem, shell, estado y snapshots. Para builders, la noticia no es otro sandbox: es cuándo un agente deja de necesitar solo tools y empieza a necesitar un entorno completo.

GitHub corrige los reportes de AI credits: qué campos mirar antes de culpar al agente equivocado
GitHub actualizó el 11 de junio de 2026 sus AI usage reports para reflejar AI Credits en campos estándar como quantity y gross_amount. Para equipos con Copilot, CLI y workflows agentic, esto cambia cómo auditar gasto real.

GitHub deja correr workflows en PRs de bots si alguien los aprueba: el detalle que faltaba para agentes que abren cambios
GitHub anunció el 11 de junio de 2026 que los pull requests creados por github-actions[bot] ya pueden ejecutar CI/CD con aprobación humana. Para equipos con agentes, esto reduce merges a ciegas sin abrir automáticamente secretos ni workflows sensibles.

AWS empuja AgentOps con AgentCore: observabilidad, evals y gobernanza dejan de ser extras para agentes
AWS publicó el 1 de junio de 2026 una guía de AgentOps sobre Amazon Bedrock AgentCore. Para builders, la señal útil es clara: operar agentes ya exige trazas, sesiones, evals, seguridad y adopción medible desde el primer diseño.

OpenAI cambia el cobro de container sessions: cuándo Code Interpreter deja de castigar tareas cortas
Desde el 2 de junio de 2026, OpenAI factura container sessions elegibles por minuto con mínimo de cinco minutos, en lugar de cobrar siempre la sesión completa de 20 minutos. Para agentes con Code Interpreter, esto cambia cómo diseñar jobs cortos, retries y colas.

GitHub escaneará repos inactivos: por qué también importa para código escrito por agentes
GitHub anunció el 9 de junio de 2026 code scanning periódico para repositorios sin actividad por seis meses o más. Para equipos con agentes, la señal útil es no dejar código generado, demos y automatizaciones viejas fuera de cobertura.

Copilot CLI suma /security-review: cómo usarlo sin confundirlo con CodeQL
GitHub lanzó el 10 de junio de 2026 el comando experimental /security-review en Copilot CLI. Para builders, la señal útil es meter revisión de seguridad antes del commit sin reemplazar CodeQL, secret scanning ni revisión humana.

Vercel AI Gateway agrega budgets por API key: el control que faltaba para demos y agentes que se disparan
Vercel lanzó el 9 de junio de 2026 budgets para API keys de AI Gateway. Para equipos que corren agentes con loops, prototypes compartidos o keys por entorno, la mejora práctica es cortar gasto por credencial antes de que un flujo autónomo queme presupuesto.

GitHub ya valida código de Claude y Codex con CodeQL, secret scanning y dependencias: qué cambia para PRs de agentes
GitHub llevó a disponibilidad general el 9 de junio de 2026 la validación automática de seguridad para agentes de terceros como Claude y OpenAI Codex. La mejora práctica es que el PR generado por un agente empieza a pasar por los mismos frenos que Copilot cloud agent.

Anthropic prueba agentes en biología: menos chat científico, más herramientas reales y trazas verificables
Anthropic presentó el 8 de junio de 2026 un caso con gget virus para evaluar cómo los agentes podrían ayudar en biología computacional. La novedad útil para builders es el patrón: tools especializadas, validación externa y límites claros antes de tocar dominios de alto riesgo.

Cloudflare Project Think quiere que los agentes largos sobrevivan a caídas, deploys y contexto roto
Cloudflare presentó Project Think el 15 de abril de 2026 como la siguiente generación de su Agents SDK. La novedad útil para builders no es otro framework de moda: es juntar durable execution, subagentes, sesiones persistentes y sandboxes en un solo contrato para trabajo largo.

Pinecone conecta Nexus con Microsoft OneLake: menos retrieval artesanal y más respuestas citadas para agentes
Pinecone anunció el 3 de junio de 2026 una integración entre Nexus y Microsoft OneLake para construir artefactos con permisos, citas y presupuesto de latencia. La señal útil no es otra capa de RAG: es mover el ensamblaje de contexto fuera del loop caro del agente.

Google mete “sufficient context” a Agentic RAG: por qué ese detalle sí cambia respuestas empresariales
Google Research publicó el 5 de junio de 2026 un framework de Agentic RAG para Gemini Enterprise Agent Platform con validación de contexto suficiente y cross-corpus retrieval. La mejora útil no es otra sigla de RAG: es reducir respuestas parciales con un loop de búsqueda más auditable.

GitHub cambia las URLs de reportes de Copilot: por que este detalle si importa para allowlists y automatizaciones
GitHub movió el 20 de mayo de 2026 las descargas de reportes de uso de Copilot hacia dominios propios como `copilot-reports.github.com`. La novedad útil no es estética: evita roturas en firewalls, proxies y scripts cuando el equipo ya depende de métricas para gobernar agentes.

Docker baja la seguridad de agentes a cuatro dominios: donde aislar runtime, credenciales y MCP sí cambia algo
Docker publicó el 2 de junio de 2026 una guía práctica sobre seguridad de agentes y la conectó con AI Governance. La parte útil para builders no es el miedo corporativo: es aterrizar qué controlas de verdad cuando el agente toca host, red, secretos y tools.

Microsoft pone una alerta incómoda sobre MCP remoto: 15% de los servidores vistos eran severamente inseguros
Microsoft Security publicó el 14 de mayo de 2026 un análisis sobre misconfiguraciones explotables en apps de IA. La parte que más debería importar a builders y equipos de seguridad es directa: vieron MCP servers remotos sin autenticación y estiman que 15% de esos despliegues eran severamente inseguros.

Nemotron 3.5 Content Safety: por qué NVIDIA apunta al hueco más incómodo de los agentes multimodales
NVIDIA publicó Nemotron 3.5 Content Safety el 4 de junio de 2026 con evaluación multimodal, cobertura multilingüe y políticas personalizadas. La señal útil para builders no es otro moderador más: es juntar texto, imagen, respuesta y policy propia en una sola llamada pensada para pipelines reales.

Microsoft Execution Containers: por qué Windows ya no quiere que un agente corra con tus mismos permisos
Microsoft presentó el 2 de junio de 2026 MXC, una capa de aislamiento para agentes sobre Windows y WSL. La señal útil para builders no es otra sandbox más: es que el sistema operativo empieza a separar proceso, sesión, identidad y políticas como piezas nativas del runtime agentic.

Datadog pone un freno al hype de agentes: casi 1 de cada 20 requests falla ya en producción
Datadog sostiene en su State of AI Engineering 2026 que alrededor del 5% de las solicitudes a modelos fallan en producción y que el cuello de botella principal ya no es el modelo, sino la capacidad. Para builders, la señal útil es operativa: más agentes y más modelos ya significan más puntos de ruptura.

Cisco mete AI Defense dentro de Agent Builder: por qué revisar MCP a mano ya no alcanza
Cisco anunció el 3 de junio de 2026 que AI Defense queda integrado dentro de Agent Builder. La señal útil para builders no es el branding: es que el escaneo de MCP, skills y ejecuciones pasa a vivir dentro del ciclo de construcción, no como parche al final.

Microsoft Agent 365 quiere meter orden a los agentes locales: por qué el registro importa más que otro dashboard
Microsoft anunció el 2 de junio de 2026 un Agent Registry dentro de Agent 365 para descubrir agentes locales, apps de IA y servidores MCP. La novedad útil para equipos no es ver más cosas en pantalla: es empezar a gobernar el sprawl de agentes antes de que se vuelva deuda operativa.

Google mueve AP2 a FIDO y suma pagos Human Not Present: por qué eso sí cambia la conversación sobre agentes que compran
Google anunció el 28 de abril de 2026 que donará AP2 a la FIDO Alliance y liberó AP2 v0.2 con soporte para pagos Human Not Present. La señal útil no es marketing de commerce: es empujar identidad, mandato y rendición de cuentas antes de que los agentes compren solos.

.NET mete gobernanza real a MCP con una sola extensión: menos bricolaje y menos riesgo antes de producción
Microsoft anunció el 21 de mayo de 2026 un paquete preview para añadir gobernanza al builder oficial de servidores MCP en C#. La mejora útil no es otra librería de seguridad: es escanear tools, aplicar políticas y sanear respuestas sin reimplementar el mismo borde en cada servidor.

OpenAI abre Lockdown Mode a todas las cuentas: cuándo sí conviene sacrificar browsing y agent mode
OpenAI habilitó el 4 de junio de 2026 Lockdown Mode para todos los usuarios con sesión iniciada. La mejora útil no es solo seguridad extra: es tener una forma explícita de recortar browsing, descargas y agent mode cuando el riesgo de prompt injection pesa más que la comodidad.

Google Colab CLI lleva GPUs remotas a tu terminal: cuándo sí le ahorra fricción a un agente
Google lanzó Colab CLI el 5 de junio de 2026 para conectar terminal local y runtimes remotos de Colab. La mejora útil para builders no es otra consola: es poder pedir GPU, ejecutar scripts y recuperar artefactos desde un loop agentic sin montar infraestructura aparte.

SageMaker ya habla OpenAI sin wrappers raros: por qué esto sí cambia el camino para agentes sobre infraestructura propia
AWS anunció el 21 de mayo de 2026 soporte para APIs OpenAI compatibles en endpoints de SageMaker AI. La novedad útil no es marketing de compatibilidad: es poder mover SDKs, streaming y frameworks agentic a infraestructura propia sin reescribir clientes.

Twilio lleva Conversation Intelligence a tiempo real: por qué eso sí importa para guardrails de agentes
Twilio pasó Conversation Intelligence a disponibilidad general el 6 de mayo de 2026. Lo útil no es otra capa de analytics: es tener operadores de lenguaje, señales en vivo y acciones inmediatas para voz y mensajería cuando un agente necesita ayuda, corrección o escalado antes de cerrar mal una conversación.

Cloudflare deja compartir previews de sandbox por Tunnel: por qué esto sí acelera verificar agentes
Cloudflare activó previews públicos desde `sandbox.tunnels` el 29 de mayo de 2026. La señal útil no es solo otra URL efímera: es poder exponer un servicio dentro del sandbox sin `exposePort()`, y además fijarlo con named tunnels cuando un agente necesita una dirección estable para validar o reintentar.

Vercel lleva Session Traces al CLI: cómo depurar requests y agentes sin salir de terminal
Vercel añadió `vercel curl --trace` y `vercel traces get` el 3 de junio de 2026. Lo útil no es otro subcomando: es poder generar un rastro OpenTelemetry desde terminal y seguir el request por request ID cuando un agente rompe una ruta o un flujo de verificación.

Cloudflare AI Gateway ya pone spend limits por modelo y usuario: por qué esto sí cambia el costo de agentes
Cloudflare activó spend limits en AI Gateway el 5 de junio de 2026. La novedad útil no es otro dashboard de billing: es poder cortar, segmentar o degradar requests de agentes por modelo, proveedor o metadata antes de que el gasto se vuelva una sorpresa.

Cloudflare deja que agentes creen cuenta, compren dominio y desplieguen: por qué esto cambia el último tramo del builder flow
Cloudflare anunció el 30 de abril de 2026 una integración con Stripe Projects para que un agente pueda crear cuenta, activar pago, comprar dominio y desplegar sin pasos manuales fuera del loop. La noticia útil no es el demo: es cerrar por fin el salto entre código y producción.

Vercel Sandbox añade Drives: cuándo sí resuelven workspaces largos y cuándo siguen ganando los snapshots
Vercel lanzó Drives para Sandbox en private beta el 5 de junio de 2026. La novedad útil no es solo guardar archivos: es separar caché, workspace y estado compartido del ciclo de vida del sandbox para agentes que vuelven al mismo trabajo.

Cloudflare Artifacts propone Git para agentes: repos por tarea, forks rápidos y menos estado improvisado
Cloudflare lanzó Artifacts el 16 de abril de 2026 como almacenamiento versionado compatible con Git para agentes y automatizaciones. La señal útil no es otra capa de storage: es separar sesiones, ramas y handoffs sin pegar bases de datos, blobs y workspaces efímeros a la fuerza.

Railway empaqueta remote MCP y setup agent: menos config manual para desplegar con Codex o Claude Code
Railway activo su remote MCP server el 17 de abril de 2026 y desde mayo documenta `railway setup agent` para instalar skills y configurar clientes compatibles. La novedad útil no es otro MCP: es reducir la friccion real entre agente de coding y deploy.

Sentry convierte traces en conversaciones legibles: por que eso si cambia depurar agentes
Sentry abrió AI Conversations en beta el 21 de mayo de 2026 para reorganizar mensajes, tool calls y respuestas en una linea de tiempo leible. La novedad útil no es otra vista bonita: es por fin poder revisar sesiones agenticas sin perderse entre spans.

Azure Cosmos DB MCP Toolkit ya esta en GA: ocho tools, Foundry en dos clics y menos friccion para conectar datos reales a tus agentes
Microsoft anuncio el 2 de junio de 2026 la disponibilidad general del Azure Cosmos DB MCP Toolkit. La diferencia útil para builders no es otro wrapper de base de datos: es conectar agentes a datos operativos y vectoriales con RBAC, transport HTTP estable e integración directa con Foundry.

LogRocket abre su MCP a todos: sesiones reales, metricas y tickets para que tu agente deje de debuggear a ciegas
LogRocket anuncio el 2 de junio de 2026 que su MCP ya esta disponible para todos. La parte útil para builders no es otro conector: es meter reproducciones reales, issues y metricas dentro del loop de Claude, Codex o Cursor antes de tocar codigo.

Vercel endurece la letra chica de los agentes: quien paga y quien responde cuando una automation se equivoca
Vercel actualizo sus terminos el 4 de junio de 2026 para dejar explicita la responsabilidad sobre AI Functionality y Third-Party Tools. La lectura útil para builders es pragmatica: si conectas agentes o scripts a tu cuenta, el alcance, los costos y la revision ya no son ambiguedades.

Vercel mete Sandbox dentro del CLI: menos cambió de contexto para agentes que si verifican
Vercel anuncio el 8 de abril de 2026 que Sandbox ya se gestiona desde `vercel sandbox`. Para builders, la mejora real es unir runtime aislado, red y dev server dentro del mismo loop de terminal.

Docker baja la seguridad de agentes a cuatro dominios: una guia útil si ya diste permisos de verdad
Docker publico el 2 de junio de 2026 una guia práctica para asegurar agentes y la conecto con AI Governance. Lo importante para builders no es la marca: es un marco concreto para revisar aislamiento, acceso a tools, credenciales y monitoreo antes de dejar un agente suelto en laptop o infraestructura.

Anthropic dona MCP a la Agentic AI Foundation: por que el estandar ya importa más que el demo
Anthropic anuncio el 9 de diciembre de 2025 que dona MCP a la nueva Agentic AI Foundation bajo Linux Foundation. La senal útil para builders no es institucional: es que el protocolo ya se esta volviendo una capa neutral de registro, governance y tooling para agentes reales.

GitHub Copilot ya cobra por uso y abre budgets por usuario: que cambia si tu equipo quiere agentes sin facturas ciegas
GitHub activo el 1 de junio de 2026 la facturacion por AI Credits para todos los planes de Copilot, junto con budgets por usuario y upgrades a Copilot Max. La novedad útil para builders no es pricing por si solo: es por fin tener una manera más sería de gobernar costos cuando los agentes empiezan a correr más tiempo.

Azure Cosmos DB ahora empaqueta memoria y retrieval para agentes: cuando si te ahorra infraestructura y cuando no
Microsoft publico el 2 de junio de 2026 nuevos toolkits para Azure Cosmos DB orientados a memoria y retrieval agentic. La novedad útil para builders no es otro SDK: es juntar turnos, hechos, perfiles, busqueda hibrida y loops multi-step sobre una sola base.

Microsoft Rayfin quiere cerrar el hueco entre el agente que programa y el backend que si llega a producción
Microsoft presentó Rayfin el 2 de junio de 2026 en Build como un SDK y CLI open source para desplegar backends tipados sobre Fabric. La senal útil para builders es otra: ya hay una ruta oficial para que un agente genere app, base de datos, auth y despliegue sin montar toda la plataforma a mano.

OpenAI muestra como gobierna Codex por dentro: sandbox, red cerrada y logs que si sirven
OpenAI publico el 8 de mayo de 2026 una mirada concreta a como usa Codex con sandboxing, reglas, politicas de red y telemetria. La pieza valiosa para builders no es el marketing de seguridad: es el contrato operativo que deja copiar.

Amazon Bedrock AgentCore Gateway extiende MCP: por que el cuello de botella ya no es crear tools sino gobernarlas
AWS amplio el 1 de junio de 2026 las capacidades MCP de Amazon Bedrock AgentCore Gateway. La mejora útil para builders no es otro gateway más: es unificar tools, prompts y recursos con dynamic listing, sesiones stateful y OAuth delegated auth en una sola entrada.

Docker pone una linea útil para 2026: pedir permiso no alcanza para asegurar agentes
Docker publico el 2 de junio de 2026 una guia práctica de seguridad para agentes y dejo una tesis incomoda: los prompts de permiso no son una estrategia de seguridad. Para builders, la lectura importante es como separar aislamiento, tools, identidad y monitoreo antes de escalar agentes.

Anthropic pone numeros al problema: la IA ya esta ayudando más después del acceso que antes del phishing
Anthropic publico el 3 de junio de 2026 un análisis de 832 cuentas bloqueadas por actividad cibernetica maliciosa. La senal útil para builders no es el susto: es que la IA ya esta empujando tareas de post-compromise, autonomia y chaining que tus agentes también deberian estar modelando a la defensiva.

Stripe ya deja que agentes paguen con Link y MPP: por que esto importa más que otro checkout
Stripe movió dos piezas clave en 2026: lanzó Machine Payments Protocol el 18 de marzo y activo la wallet de Link para agentes el 29 de abril. Para builders, la senal útil es clara: pagos, aprobaciones y credenciales empiezan a tener una capa pensada para software que compra por cuenta de una persona.

Docker AI Governance quiere gobernar al agente donde de verdad corre: laptop, red, credenciales y MCP
Docker presentó AI Governance el 12 de mayo de 2026 y luego bajo la idea a una guia práctica el 2 de junio. Lo importante para builders no es el nombre del producto: es que ya hay un intento serio de controlar red, filesystem, credenciales y tools MCP en el mismo runtime donde vive el agente.

Microsoft Foundry lanza Managed Compute: cuando el cuello de botella deja de ser el modelo y pasa a ser la plataforma
Microsoft anuncio el 3 de junio de 2026 Managed Compute para Foundry. La lectura útil para builders no es solo 'más GPUs': es una capa para servir modelos abiertos y pesos propios con el mismo endpoint, identidad y observabilidad que ya usan para frontier models.

Microsoft Foundry empuja un trust stack para agentes: evals abiertas, controles portables y DLP dentro del loop
Microsoft presentó el 2 de junio de 2026 un paquete de capacidades para gobernar agentes en cualquier framework: ASSERT, Agent Control Specification, Rubric, simulacion de usuarios, replay de trazas y DLP en tiempo real. La clave no es otro dashboard: es mover seguridad y evaluación al flujo normal de construccion.

Microsoft Foundry mete A2A entrante y publicación a Copilot/Teams: la distribucion ya es parte del stack de agentes
Microsoft anuncio el 3 de junio de 2026 nuevas piezas de distribucion en Foundry: publicación directa a Microsoft 365 Copilot y Teams, autopilot agents y endpoints A2A entrantes. El cambió útil no es otro canal: es tratar identidad, handoff y governance como parte del producto.

GitHub abre una API para auditar Copilot cloud agent: que revisar antes de soltar automations
GitHub agrego el 18 de mayo de 2026 un endpoint para revisar la configuracion de Copilot cloud agent por repositorio. La novedad importa porque por fin puedes inspeccionar MCP, tools, policy de workflows y firewall antes de delegar tareas a escala.

Vercel vuelve persistentes sus sandboxes: por que esto si cambia el costo real de un agente largo
Vercel activo persistencia por defecto en Sandbox el 26 de mayo de 2026. La novedad importa porque un agente ya no tiene que reinstalar dependencias y rehidratar archivos en cada sesion, pero ahora también hay que vigilar snapshot storage y criterio de borrado.

OpenAI reactiva una alerta rara para builders: actualiza Codex y ChatGPT en macOS antes del 12 de junio
OpenAI explico el 13 de mayo de 2026 su respuesta al ataque de cadena de suministro contra TanStack npm. Para quienes usan Codex App o Codex CLI en macOS, lo práctico es claro: actualizar antes del 12 de junio para quedar firmados con los nuevos certificados.

Vercel Blob pasa a OIDC: la mejora real para agentes es matar el token largo
Vercel anuncio el 1 de junio de 2026 que Blob ahora soporta OIDC y lo deja como default en proyectos nuevos. Para builders de agentes, la ganancia grande no es storage: es poder leer y escribir en Blob desde funciones y terminal sin vivir atados a un BLOB_READ_WRITE_TOKEN.

GitHub Copilot ya tiene sandboxes locales y en la nube: que cambia de verdad para agentes que tocan codigo
GitHub anuncio el 2 de junio de 2026 que Copilot puede ejecutar trabajo agentic dentro de sandboxes locales y cloud. La mejora no es cosmética: pone aislamiento, reanudacion y politicas alrededor de comandos, archivos y red.

GitHub ya separa usuarios code-first, agent-first y multi-agent en Copilot: por que eso cambia como deberias medir adopcion
GitHub actualizo el 29 de mayo de 2026 su usage metrics API con cohortes de adopcion para Copilot. La novedad no es cosmética: por fin deja medir si tu rollout se quedó en autocompletado o si de verdad avanzo a code review, CLI, cloud agent y loops multi-agent.

Vercel Blob se pasa a OIDC: por que esto le quita una deuda fea a los agentes que tocan archivos
El changelog de Vercel del 31 de mayo de 2026 convierte OIDC en el default para Blob en proyectos nuevos. La señal importante para builders es simple: menos tokens largos circulando y menos friccion para agentes que leen o escriben archivos privados.

Anthropic expande Project Glasswing: la señal no es el laboratorio, es que los agentes ya entraron al trabajo defensivo serio
Anthropic anuncio el 2 de junio de 2026 la expansion de Project Glasswing a más organizaciones criticas. Para builders y equipos de seguridad, la noticia relevante es que los agentes ya estan entrando a ciclos reales de hunting, triage y patching.

Cloudflare mete Agent Skills, tareas programadas y Telegram en su Agents SDK: menos prompt gordo, más runtime
Cloudflare anuncio el 2 de junio de 2026 la version 0.14.0 de su Agents SDK. Lo más valioso para builders no es un solo feature: es la combinacion de Agent Skills on-demand, mensajeria con Telegram, tareas programadas y pasos durables dentro de Workflows.

GitHub vuelve útil el MCP para seguridad: secret scanning ya puede frenar fugas antes del commit
GitHub llevó a disponibilidad general el 5 de mayo de 2026 el secret scanning dentro de su MCP server. La mejora no es cosmética: permite pedirle a un agente que revise cambios locales antes del commit y respete la misma push protection que ya gobierna el repo.

Vercel endurece Elastic Build Machines contra OOM: por que esto importa más a equipos con agentes que a una landing común
Vercel actualizo el 1 de junio de 2026 Elastic Build Machines para reaccionar al uso real de memoria y evitar fallos OOM. La mejora pega directo a repos con agentes, monorepos y builds pesados donde cada deploy roto cuesta tiempo, contexto y dinero.

Claude Managed Agents entra a Cloudflare: más control sobre sandboxes, red privada y observabilidad
Cloudflare y Anthropic conectaron Claude Managed Agents con Sandboxes, Browser Run y servicios privados el 19 de mayo de 2026. La novedad importa porque separa el cerebro del agente de la infraestructura donde ejecuta codigo y navega.

Vercel mete Firewall al CLI: por que eso si cambia como un agente despliega y se protege
Vercel llevó el Firewall al CLI el 12 de mayo de 2026 y lo conecto con un skill para agentes. La lectura útil no es seguridad abstracta: es poder versionar reglas, probar mitigaciones y frenar trafico malo sin salir del loop operativo.

Vercel Sandbox ya corre Docker: por que esto le quita un cuello de botella serio a los agentes
Vercel anuncio el 29 de mayo de 2026 que Sandbox ya puede instalar y correr Docker dentro del entorno aislado. Para builders de agentes, la ganancia real es poder validar servicios y contenedores sin tocar la maquina host.

Cloudflare lleva Sandboxes a GA: por que esto si acerca a los agentes a un computador real
Cloudflare anuncio el 13 de abril de 2026 que Sandboxes y Containers ya estan en disponibilidad general. La novedad no es otro contenedor: es un entorno persistente con shell, filesystem, preview URLs, inyeccion segura de credenciales y un modelo de costos pensado para agentes que trabajan por rafagas.

Anthropic abre su libreta de seguridad para agentes: como estan conteniendo Claude en 2026
El 25 de mayo de 2026 Anthropic publico como contiene Claude en claude.ai, Claude Code y Cowork. La pieza vale por dos razones: muestra fallos reales antes del trust prompt y aterriza por que los agentes utiles necesitan menos aprobaciones manuales, pero más limites duros en sandbox, red y credenciales.

KernelEvolve: Meta usa un agente para optimizar kernels y abrir 60% más throughput en horas
Meta explico el 2 de abril de 2026 como KernelEvolve trata la optimizacion de kernels como un problema de busqueda y no de codegen de una sola pasada. Para builders, la señal es clara: algunos agentes ya compiten mejor cuando exploran que cuando solo escriben.

Meta ya usa agentes para arreglar regresiones de rendimiento: la leccion no es IA, es codificar expertise
Meta explico el 16 de abril de 2026 como unifico herramientas y skills para que agentes detecten, expliquen y propongan fixes de eficiencia a escala. La novedad importa porque muestra una ruta más sería para automatizar incidentes de performance.

Como deployar un agente en WhatsApp, Telegram y Slack sin mezclar canales
Una guia práctica para disenar un agente multicanal con webhooks, adaptadores, memoria separada y reglas por plataforma.

Costos, latencia y seguridad antes de abrir tu agente a clientes reales
Checklist operativo para publicar un agente en mensajeria sin sorpresas de factura, respuestas lentas o fuga de datos.