Cloudflare AI Search: la beta y cómo crear buscadores

En pocas palabras: Cloudflare lanzó AI Search en beta pública en agosto de 2026. Ofrece un buscador híbrido (vectorial + BM25) para tus datos, sin Workers ni Vectorize. La beta gratis da 5 millones de tokens de ingesta, 10 GB y 2.000 consultas mensuales.

Cloudflare puso en beta AI Search a principios de agosto de 2026, un servicio para armar buscadores híbridos sobre tus propios archivos y sitios web sin tener que coser Workers, D1, Vectorize y otros ladrillos de su plataforma (la famosa “ausencia de primitivas” que anunciaron). La promesa es directa: apuntás a tu data y Cloudflare se ocupa del crawling, los embeddings, el almacenamiento y la API de consulta. Ideal si querés agregar búsqueda interna potente a una tienda, un blog o una base de documentos sin levantar infraestructura de cero.

En 30 segundos

  • Cloudflare lanzó AI Search en beta pública en agosto de 2026, sin fecha de salida definitiva.
  • Combina búsqueda vectorial (semántica) con BM25 (palabras clave) en paralelo y opcionalmente aplica reranking con cross-encoder.
  • La beta incluye 5 millones de tokens de ingestión, 10 GB de almacenamiento y 2000 consultas por mes sin costo.
  • Indexa sitios web completos, archivos sueltos vía API e imágenes (procesamiento aparte pago), con límite de 500 páginas diarias en plan gratuito.
  • Expone la búsqueda como endpoint público REST y también como endpoint MCP para integrar agentes de IA.

Cloudflare AI Search es un servicio administrado de búsqueda híbrida que combina búsqueda semántica (vectorial) con búsqueda de texto completo (BM25), lanzado por Cloudflare en agosto de 2026. Permite indexar sitios web, archivos estáticos e imágenes sin configurar infraestructura propia y expone los resultados a través de una API pública o un endpoint MCP para agentes. La idea central es que no necesitás armar la tubería conectando Workers, R2, D1 y Vectorize manualmente; el servicio lo resuelve con un par de comandos.

¿Cómo funciona la búsqueda híbrida de AI Search?

Cloudflare AI Search ejecuta en paralelo dos tipos de búsqueda cada vez que llega una consulta. Por un lado corre una búsqueda semántica que convierte la pregunta en un embedding y recupera documentos por similitud vectorial. Por otro lado corre una búsqueda de texto completo con el algoritmo BM25, que atrapa coincidencias exactas de palabras y frases. Después fusiona ambos rankings usando Reciprocal Rank Fusion (RRF) o max fusion —vos elegís cuál— y, si activás la opción de reranking, un modelo cross-encoder vuelve a ordenar los resultados para afinar la relevancia (el blog oficial de Cloudflare ya usa este sistema para su propia búsqueda interna, según la documentación).

El flujo es así de simple porque Cloudflare se encarga de generar los embeddings con modelos seleccionados gratis durante la beta, almacenar los vectores y cachear las consultas recurrentes. Lo único que tenés que definir es si querés más peso en lo semántico o en las keywords, y si vale la pena el costo extra del reranking (que todavía no cobran con los modelos incluidos, ojo, pero después de la beta podría cambiar). Para más detalles técnicos, mirá nuestra guía sobre secretos en Cloudflare.

¿Cuánto cuesta Cloudflare AI Search durante la beta?

Durante la beta, el servicio factura por uso pero arranca con allotments gratuitos mensuales generosos. Si te mantenés dentro de esos límites, no pagás un centavo. En cuanto los superás, empieza a correr la tarifa.

ConceptoAllotment gratuito mensualCosto extra
Ingestión de datos5 millones de tokensUSD 0,75 por cada millón de tokens
Almacenamiento10 GBUSD 2 por GB-mes
Consultas semánticas2000 consultasUSD 0,75 por cada mil consultas
Consultas full-text (keywords)2000 consultas (dentro del total)USD 0,10 por cada mil consultas
Embedding y rerankingSin costo con modelos seleccionadosPendiente de definición fuera de beta
Cloudflare AI Search diagrama explicativo

Los precios son oficiales de la documentación de Cloudflare a agosto de 2026. El almacenamiento de 10 GB te alcanza para bastante texto plano y metadatos, pero si empezás a tirar PDFs pesados o imágenes sin comprimir, el contador se mueve rápido. Y las 2000 consultas gratis suenan bien, pero un agente que pregunte seguido te las consume en horas (sí, en serio).

¿Cómo crear una instancia de AI Search desde la CLI?

Si ya usás Wrangler, crear un namespace de AI Search es un solo comando. Abrís la terminal, te autenticás con wrangler login y tirás algo como esto para indexar un sitio con sitemap:

npx wrangler ai-search create --namespace mi-tienda --source https://mitienda.com.ar --type web --parse-type sitemap --hybrid-search Cubrimos ese tema en detalle en nuestro análisis sobre DNS autoritativos.

Si tu sitio no tiene sitemap, cambiás --parse-type por discover y el crawler se las arregla siguiendo enlaces internos. La opción --hybrid-search habilita desde el vamos la búsqueda combinada, que es lo que vas a querer casi siempre. Después del alta, el sistema empieza a rastrear y en unos minutos ya podés tirar consultas de prueba desde el dashboard o con un curl al endpoint generado.

No hace falta tocar Workers, R2 ni Vectorize. El namespace que creaste encapsula toda la infraestructura de crawling, indexado y búsqueda. Eso es justamente lo que Cloudflare vende como “sin primitivas que coser”.

¿Cómo exponer un endpoint público de búsqueda?

Por defecto el namespace es privado. Para que cualquiera pueda consultar sin autenticación, habilitás URLs públicas desde la consola o por API y obtenés dos endpoints: /search para consultas REST y /mcp para que agentes conversen directamente. También podés montarlos sobre un dominio personalizado tuyo.

Si necesitás que el buscador quede restringido a un equipo interno, Cloudflare Access te permite poner una capa de autenticación sin tener que escribir código. Activás Access en el namespace, definís políticas por mail o dominio, y listo. La integración con MCP es un detalle clave: cualquier agente que hable el protocolo Model Context Protocol puede consultar tu instancia sin adaptadores extra, lo que abre la puerta a flujos donde un asistente de IA busca en tu base de conocimiento privada y responde con fuentes. Relacionado: el arranque en frío de los contenedores.

¿Qué tipos de datos se pueden indexar?

Tres fuentes principales: sitios web completos (con o sin sitemap), archivos subidos directamente mediante API e imágenes, estas últimas con un costo de procesamiento adicional que factura por página o por token visual. Arrancás creando una instancia y elegís el tipo de fuente; después podés adjuntar metadatos a cada documento para filtrar después por fecha, categoría o lo que necesites.

Los límites de la beta son concretos: 100 mil archivos por instancia, cada archivo de hasta 4 MB y, si estás en plan gratuito, el crawler no pasa de 500 páginas por día. Esto último es importante si tenés un sitio grande: la indexación inicial puede demorarse varios días. Con un plan pago, la velocidad de rastreo aumenta, pero los límites finales van a depender del contrato que elijas cuando termine la beta.

¿Cómo usar AI Search con un agente mediante MCP?

El endpoint MCP expone las capacidades de búsqueda de manera que un agente pueda invocarlas sin parsear JSON crudo. En la práctica, el agente recibe una descripción de la herramienta, manda una consulta en lenguaje natural y obtiene los documentos relevantes junto con una respuesta generada opcional, usando un modelo de Workers AI (Cloudflare sugiere el flujo de query rewriting automático antes de buscar para mejorar los resultados).

Para engancharlo desde un Worker propio, usás el binding ai_search_namespaces que inyecta la instancia directamente en el runtime. Un ejemplo sencillo sería un Worker que recibe la pregunta de un chatbot, la pasa al namespace y devuelve los snippets con su fuente. Todo corre en la red de Cloudflare, con latencia mínima incluso para consultas que necesitan reranking. Más contexto en la diferencia de costos entre R2 y S3.

Errores comunes al arrancar con AI Search

  • Asumir que ilimitado significa gratis para siempre. Muchos se lanzan a indexar sitios gigantes sin mirar el costo por consulta semántica. Con 2000 consultas gratis al mes, un agente que reescribe queries y pregunta cuatro veces por interacción te puede dejar seco en un par de días. Siempre revisá las métricas de consumo desde el día uno.
  • No configurar el sitemap ni el parse-type adecuado. Si tu sitio no tiene sitemap y elegís sitemap en vez de discover, el crawler se queda esperando un archivo que no existe y no indexa nada. O peor, dejás el límite de 500 páginas diarias y no te das cuenta de que el rastreo quedó a medio camino durante una semana.
  • Esperar precisión de Google sin activar reranking. La búsqueda híbrida sin cross-encoder puede devolver resultados “parecidos” pero no exactamente lo que buscás, sobre todo en colecciones chicas. El reranking con el modelo gratuito incluido mejora la cosa bastante y no agrega costo durante la beta; no desactivarlo por defecto a menos que midas que no lo necesitás.

Qué significa para empresas y equipos en Latinoamérica

Para un ecommerce local que quiere sumar un buscador inteligente sin pagar licencias caras, AI Search es una opción concreta. Podés indexar el catálogo de productos, los artículos del blog y hasta preguntas frecuentes, y después exponer todo en una API que tu frontend consume directo. El costo inicial es bajo si te mantenés en los allotments gratuitos, y la infraestructura corre en el edge de Cloudflare, que tiene presencia en varias ciudades de la región, así que la latencia no es un problema.

Si estás armando el sitio que vas a indexar, una buena base es tenerlo alojado en un hosting con soporte para certificados SSL y dominios .com.ar o .com; servicios como donweb.com te resuelven el dominio y el hosting para arrancar sin vueltas. Lo importante es que el crawler de AI Search pueda acceder sin bloqueos y que el sitemap esté limpio, cosa de ahorrarte tiempo en la indexación.

Preguntas Frecuentes

¿Qué es Cloudflare AI Search?

Es un servicio administrado de búsqueda híbrida lanzado por Cloudflare en agosto de 2026. Combina búsqueda semántica y de texto completo para que indexes tus propios archivos y sitios web sin configurar Workers, bases de datos vectoriales o pipelines de ingesta.

¿Cómo funciona la búsqueda híbrida de AI Search?

Ejecuta en simultáneo una búsqueda vectorial con embeddings y una búsqueda full-text con BM25, fusiona los resultados con RRF o max fusion, y si lo activás, un cross-encoder reordena los documentos para mejorar la precisión.

¿Cuánto cuesta Cloudflare AI Search?

Durante la beta hay allotments gratuitos mensuales: 5 millones de tokens de ingestión, 10 GB de almacenamiento y 2000 consultas. Una vez superados, se paga USD 0,75 por millón de tokens ingeridos, USD 2 por GB-mes de almacenamiento, USD 0,75 por cada mil consultas semánticas y USD 0,10 por cada mil consultas full-text. Embedding y reranking con modelos seleccionados no suman costo.

¿Cómo indexar un sitio web en AI Search?

Usás la CLI de Wrangler con npx wrangler ai-search create, especificando el namespace, la URL de origen, el tipo de parseo (sitemap o discover) y la opción --hybrid-search. En minutos el crawler empieza a trabajar y el endpoint de búsqueda queda listo.

¿Qué límites tiene la beta gratuita de AI Search?

Podés almacenar hasta 100 mil archivos de 4 MB como máximo cada uno, y el crawler en plan gratuito está limitado a 500 páginas diarias. Además, las 2000 consultas gratis al mes son un techo blando; si lo pasás, empezás a pagar según el tarifario de la beta.

Conclusión

Cloudflare AI Search baja la barrera para meter búsqueda híbrida en productos propios sin atarte a un ecosistema cerrado de terceros. La beta es funcional, los allotments gratuitos alcanzan para experimentar y los costos extra son predecibles, aunque todavía queda la incógnita del precio final cuando termine la beta y la evolución de los límites de rastreo. Para equipos chicos que ya están en el universo Cloudflare, es un atajo enorme. Si recién arrancás y necesitás un sitio donde montar todo, con un buen proveedor local de hosting y dominio vas a poder poner a prueba el servicio sin dolores de cabeza.

Fuentes

Te puede interesar...