Safari 27 permite que los agentes de codificación de IA controlen el navegador directamente

Apple integró un servidor del Protocolo de Contexto de Modelo (MCP) directamente en Safari 27, dando a agentes de codificación de IA como Claude Code, Codex y Gemini la capacidad de abrir pestañas, hacer clic en botones, leer registros de consola, inspeccionar solicitudes de red y capturar capturas de pantalla dentro de una ventana de navegador real en funcionamiento, convirtiendo a Safari de un objetivo que los desarrolladores probaban manualmente en una herramienta que un agente de IA puede operar por sí mismo.
La función apareció primero en Safari Technology Preview 247 en julio y se lanzó ampliamente con Safari 27 junto con una publicación del blog de WebKit que detallaba el conjunto completo de herramientas el 17 de septiembre. Aborda un punto de dolor específico y familiar en la codificación asistida por IA: un agente puede generar código frontend que parece plausible, pero hasta ahora no tenía forma de ver realmente si ese código se renderizaba correctamente, arrojaba errores de consola o realizaba las solicitudes de red que el desarrollador esperaba. El servidor MCP de Safari cierra ese ciclo dando al agente casi 20 herramientas, incluyendo browser_console_messages para leer registros almacenados en búfer, list_network_requests para resumir URLs, métodos y códigos de estado, screenshot para verificación visual, y un conjunto de herramientas de interacción con páginas que cubren clics, escritura, desplazamiento y desplazamiento del cursor.
Habilitarlo requiere una activación deliberada: los desarrolladores deben ir a la Configuración de Safari, abrir el menú Developer, y marcar "Permitir automatización remota y agentes externos" antes de que cualquier cliente MCP pueda conectarse. Apple ha delimitado la integración para evitar convertirse en un riesgo de privacidad por diseño en lugar de por política: el servidor no puede tocar los datos de AutoFill ni el historial de navegación, WebKit dice que no tiene acceso alguno a datos personales de Safari, y no realiza solicitudes de red propias más allá de las que ya ocurren en la página que el agente está inspeccionando.
El movimiento coloca a Safari en una carrera de tres vías que comenzó con el Protocolo DevTools de Chrome, usado durante mucho tiempo por herramientas como Puppeteer y Playwright para la automatización del navegador, y continuó con el servidor Playwright MCP de Microsoft, que ya daba a los agentes un control similar sobre navegadores basados en Chromium. La versión de Apple tiene un alcance más limitado —herramientas de lectura e interacción para desarrolladores que depuran sus propios sitios, no automatización web de propósito general— pero es la primera vez que un proveedor importante de navegador lanza el control de agentes como una función integrada de origen, en lugar de requerir un marco de automatización separado.
Para equipos que ya usan agentes de codificación de IA en su flujo de trabajo, la ventaja práctica es un ciclo de depuración más corto: en lugar de describir un error de renderizado a un agente en texto y esperar que la solución funcione, el agente puede abrir la página él mismo, ver el estado real del DOM, revisar la consola en busca del error y verificar su propia solución antes de devolver el control. El alcance de privacidad importa para la adopción —una función de automatización de navegador que tocara contraseñas guardadas o historial de navegación sería difícil de vender a la mayoría de los equipos de ingeniería— pero también significa que el servidor MCP de Safari está deliberadamente limitado a las páginas actualmente abiertas, no una forma de propósito general de dejar que un agente navegue por la web sin supervisión.
Publicado originalmente por 9to5Mac / WebKit Blog. Lee el artículo original para más detalles.
Ver fuente original