La web levanta su segunda capa: protocolos e índices diseñados para agentes
Quien controle cómo las máquinas acceden a la información captura el siguiente margen
En la historia de internet, las infraestructuras que definen quién captura el valor llegan primero como herramientas técnicas discretas y solo después revelan su escala. El protocolo HTTP no parecía relevante hasta que fue el único canal viable para la web comercial. Los buscadores no parecían amenaza para los directorios hasta que lo eran. Algo similar está pasando ahora, en un arco que va de agosto 2025 a hoy: la web está siendo rediseñada para un tipo de usuario que no es humano.
El patrón que se acumula
La evidencia no llegó de golpe. En agosto, Keenable salió del sigilo con $26 millones de seed y una premisa concreta: construir un índice de búsqueda web diseñado específicamente para agentes de IA, no para humanos. Un día después, Radar hizo lo mismo pero para podcasts: transcribió y analizó más de 130.000 episodios, haciéndolos accesibles vía API y MCP para que los agentes puedan consultarlos. En paralelo, WebMCP articuló la propuesta técnica de enseñarle a cualquier sitio web a hablar directamente con agentes. Y acceptmarkdown.com propone un mecanismo de negociación de contenido via Accept headers: los servidores sirven Markdown a agentes y HTML a navegadores humanos, sin duplicar la lógica de contenido.
Ninguno de estos proyectos se coordina con los otros. No hay un consorcio, no hay una especificación única que todos implementen. Lo que hay es un mercado que detectó la señal: los agentes van a consumir contenido web a escala, y hoy ese proceso es un patchwork de scraping, parseo de HTML y llamadas a APIs ad-hoc. Cada uno de estos proyectos está apostando a que la capa de infraestructura para agentes todavía no tiene dueño.
Por qué la infraestructura captura el margen
La lente correcta para leer esto es la teoría de la agregación: en mercados donde el producto subyacente se vuelve commodity, quien controla la relación con el usuario final captura el margen. Los buscadores no crean contenido; indexan y distribuyen acceso a él, y por eso Google capturó la mayor parte del valor en la web informacional. El mismo patrón ya aparece en la distribución de IA: quien controla el acceso al modelo captura el margen, no quien lo entrenó.
El mismo mecanismo está en juego aquí. Un agente que busca información no llega directamente a cada fuente: pasa por un índice, por un protocolo, por una capa de acceso. Quien construya esa capa — y la haga lo suficientemente buena como para que los agentes la prefieran — puede cobrar por el acceso, puede filtrar, puede decidir qué información llega y cuál no.
La diferencia con Google es la velocidad. Keenable salió del sigilo hace días. El estándar de acceso para agentes todavía no existe. Eso significa que la ventana para establecer una posición dominante está abierta, y lo que se construya en los próximos doce meses importa desproporcionadamente.
Quién gana, quién pierde
Los grandes proveedores de búsqueda tienen ventaja en datos e infraestructura, pero sus índices fueron diseñados para humanos. Optimizar para agentes requiere repensar el formato de los resultados, la latencia, el costo por consulta, y la semántica del ranking. Trabajo no trivial que harán, pero más lento que startups que nacen sin la arquitectura legada.
Los publishers y creadores de contenido están en una posición incómoda. Si los agentes leen su contenido vía un índice intermediario, el tráfico directo — y con él la publicidad y el registro — puede evaporarse. El mecanismo es parecido al de las páginas de respuestas de Google: el usuario obtiene la información sin visitar la fuente. Para el publisher, la infraestructura de agentes puede ser tan dañina como lo fue el featured snippet.
Los beneficiados más claros son quienes construyan el estándar de facto. Si un esquema de negociación de formato como acceptmarkdown se adopta ampliamente, cada sitio web que lo implemente está eligiendo su proveedor de protocolo. El desafío de orquestación que ya viven los equipos de experiencia de cliente — agentes desplegados más rápido que la arquitectura que los soporta — muestra que la demanda existe y que el caos del presente es la oportunidad del estándar futuro. Mientras tanto, la carrera por hacer el modelo más rápido y barato convierte al modelo mismo en commodity: la infraestructura de acceso, no el modelo, es donde se va a jugar la próxima ronda de captura de valor.
Qué mirar para confirmar o refutar
La tesis: en doce meses habrá uno o dos estándares de facto para cómo los agentes acceden al contenido web — un índice dominante y un protocolo de negociación de formato que la mayoría de los servidores implemente. Si a mediados de 2027 el mercado sigue fragmentado y cada agente hace scraping ad-hoc sin protocolo común, la tesis habrá sido errónea.
Para un decisor LATAM/España: si la empresa publica contenido web que quiere que los agentes encuentren y usen, hay decisiones de infraestructura que tomar — qué protocolo adoptar, si exponerse vía MCP o API propia, si indexarse en plataformas como Keenable. No es urgente esta semana, pero es el tipo de decisión que conviene tomar antes de que el estándar se cierre.
- OpenAI, Anthropic, Google, and 100 other companies call for action to defend against rogue AI· 27-ago-2026
- Hugging Face is selling a cute $399 open source duck robot, Microduck· 27-ago-2026
- AI’s memory crunch is coming for Android apps· 27-ago-2026
- Robot brain builders are pushing out of their GPT-2 era· 26-ago-2026
- Plaud’s new earphones come with an eSIM-enabled case for talking to AI agents· 27-ago-2026