Search & discovery

Meilisearch

Motor de búsqueda autoalojable con tolerancia a erratas y búsqueda híbrida, por palabra clave y semántica, tras una sola API REST

meilisearch/meilisearchRust59,175 as of 2026-09-04
By Jake Luo · Published 4 sept 2026

Meilisearch es un motor de búsqueda que ejecutas tú: un único binario en Rust con una API REST que da a un sitio o una aplicación resultados tolerantes a erratas y a medida que escribes, y que puede mezclar coincidencia por palabra clave con búsqueda semántica en una sola consulta. Tenía 59.175 estrellas en GitHub a 4 de septiembre de 2026 y publicó la v1.53.1 el 13 de agosto de 2026, con el núcleo bajo licencia MIT y un pequeño conjunto de funciones de escalado bajo otra comercial. Para quien funda una empresa, lo que hay que planificar no es la caja de búsqueda. Es que las consultas que la gente teclea ahí son la investigación de demanda más barata a tu alcance, y nadie las registra si tú no lo decides.

Qué es Meilisearch

Meilisearch (github.com/meilisearch/meilisearch) es un motor de búsqueda escrito en Rust por Meili SAS, una empresa con sede en Francia. Ejecutas el binario, envías documentos JSON a un índice y lo consultas por HTTP; hay bibliotecas cliente oficiales para casi cualquier lenguaje. El proyecto arrancó en abril de 2018 y está en desarrollo continuo: las versiones fueron de la v1.52.0 el 3 de agosto de 2026 a la v1.53.1 el 13 de agosto de 2026, la rama principal recibe commits funcionales casi a diario y había 315 incidencias abiertas en el momento de la captura.

  • La tolerancia a erratas y la búsqueda mientras escribes vienen de serie No hace falta afinar una tubería de relevancia para tener una caja usable. El objetivo declarado del proyecto son resultados en menos de 50 milisegundos, y una consulta mal escrita sigue encontrando.
  • La búsqueda híbrida ocurre en una sola consulta Combina coincidencia por palabra clave y búsqueda vectorial, así que una frase que no comparte ni una palabra con tus documentos puede encajar por significado. El generador de vectores lo pones tú.
  • Filtros, facetas, ordenación y geo vienen incluidos Son las piezas que convierten una caja de búsqueda en una interfaz de exploración: la diferencia entre consultar un dato y dejar que la gente recorra un catálogo.
  • La multi-inquilinía se resuelve con tokens por inquilino Claves acotadas que limitan lo que puede ver cada usuario, que es como se mete la búsqueda dentro de un producto con muchos clientes sin mantener un índice por cliente.
  • El soporte de idiomas está declarado de forma explícita, y eso importa El proyecto nombra un tratamiento optimizado para chino, japonés, hebreo y las lenguas con alfabeto latino. Comprueba tus idiomas contra esa lista en lugar de darlo por hecho.
  • Se conecta con las pilas de IA Hay integración con LangChain y un servidor de Model Context Protocol, por si quieres que sea un agente y no una persona quien consulte tu índice.

La línea de la licencia, y por dónde pasa

Conviene leer esto antes de comprometerse, porque el repositorio no es sencillamente MIT. Su archivo LICENSE declara `SPDX-License-Identifier: MIT AND BUSL-1.1`: la Community Edition es MIT y de uso comercial libre, mientras que una Enterprise Edition — sharding e instantáneas por streaming a S3 — queda bajo la Business Source License 1.1, que según el propio proyecto no se permite en producción sin un acuerdo comercial. Es un reparto de open core, y el detalle útil es por dónde pasa la línea. Un solo nodo es enteramente MIT. Llegas a la frontera comercial cuando se te queda pequeña una máquina, lo que para casi cualquier producto joven queda muy lejos.

Dos cosas menores que conviene decidir al instalar y no después. Existe una opción alojada, Meilisearch Cloud, y no es solo hospedaje: el proyecto menciona analítica y monitorización entre lo que añade, algo relevante para la sección siguiente. Y el binario autoalojado recoge telemetría anónima por defecto; la documentación explica cómo desactivarla, así que conviértelo en una decisión consciente mientras sigues en el archivo de configuración.

El argumento de crecimiento es el registro de consultas, no la caja

La búsqueda interna es el único lugar de tu web donde quien te visita te dice, sin que se lo pidas y con sus propias palabras, qué esperaba encontrar. No hay incentivo para ser amable como en una encuesta, y a diferencia de la investigación de palabras clave el volumen es pequeño pero la intención es innegable: son personas que ya están en tu sitio, ya interesadas, escribiendo lo que querían.

Meilisearch responde la consulta. En la versión autoalojada no te entrega un panel con lo que se ha preguntado — la analítica figura entre los extras de Cloud — así que registrarlo te toca a ti. Es una tarde de trabajo y ahí está todo el beneficio. Hazlo en este orden.

  1. Registra cada consulta con su número de resultados La cadena tecleada, cuántos resultados volvieron y en qué página se escribió. Dos columnas y una marca de tiempo bastan para empezar; ya lo enriquecerás.
  2. Lee primero las consultas sin resultados Es la línea más valiosa de todo el registro. Alguien quería algo lo bastante concreto como para teclearlo y no devolviste nada. Unas son erratas que el motor debería haber absorbido, otras son funciones que no tienes, y otras son cosas que sí tienes con un nombre que nadie usa.
  3. Ordena el resto por frecuencia y lee en voz alta las veinte primeras Las palabras que usan tus clientes no suelen ser las de tu portada. Esa distancia es investigación gratuita de posicionamiento, y solo cuesta leerla.
  4. Arregla el vocabulario antes que el producto Los sinónimos son un cambio de configuración. Si la gente busca "factura" y tu producto dice "facturación", enseña ambas al índice antes de concluir nada sobre la demanda.
  5. Lleva lo que quede al contenido y a las palabras clave Una consulta escrita por alguien que ya está en tu sitio dice más sobre la intención de búsqueda que una estimación de volumen de una herramienta — mira investigación de palabras clave para una startup.

Un aviso salido de nuestra propia experiencia, porque este es el fallo que se esconde. Publicamos en ocho idiomas. Una vez auditamos nuestros textos buscando una palabra que habíamos prohibido en la comunicación con clientes, usando una búsqueda con límites de palabra, y salió limpia — mientras 149 casos reales seguían en los archivos. El patrón no podía encajar con texto en chino, japonés ni coreano, que no separa las palabras con espacios, así que la comprobación devolvió silencio y leímos ese silencio como salud. La búsqueda tiene exactamente esa forma: si tu índice parte por espacios, la consulta de una visitante japonesa no devuelve nada, y tu registro se lee como "nadie busca en japonés" en vez de "la búsqueda está rota en japonés". Meilisearch nombra un tratamiento optimizado para un conjunto concreto de idiomas; si vendes en una escritura que no está en él, teclea tú mismo una consulta real en esa escritura antes de fiarte del registro.

Dónde encaja, y cuándo no

La búsqueda deja de ser un lujo más o menos cuando tu navegación ya no cabe en una pantalla. Un conjunto de documentación, un archivo de blog, un catálogo de productos o un directorio cruzan esa línea antes de lo que se espera. Nuestro propio sitio de marketing está muy por encima — unas 450 páginas en ocho idiomas en el momento de escribir esto — y es justo el tamaño de corpus en el que a quien llega le sirve más teclear que rebuscar en un menú.

Ahora bien, sé honesto con el límite: la calidad de la búsqueda es un problema de contenido disfrazado de infraestructura. Un motor rápido sobre documentos pobres y mal titulados devuelve resultados malos y rápidos, y ningún ajuste lo salva. Ejecutarlo tú también es un compromiso operativo: un proceso, un disco, copias de seguridad, actualizaciones. Para muchos sitios pequeños la búsqueda integrada de tu CMS o un servicio alojado es la respuesta correcta, y Meilisearch se gana el sitio cuando quieres controlar la relevancia, la necesitas dentro de tu propia aplicación o te importa dónde vive el dato. Si estás eligiendo antes la capa de abajo, PocketBase cubre el backend de la aplicación y docmd el lado de la documentación.

El orden que sugerimos: lanza la búsqueda porque quien te visita la necesita, captura las consultas desde el primer día porque almacenarlas no cuesta nada y no se pueden recuperar hacia atrás, y léelas cada mes como investigación de clientes y no como una métrica de rendimiento. Convertir lo aprendido en páginas, posicionamiento y contacto es la mitad lenta — ahí es donde AgentCeres — el Director de Crecimiento con IA, en agentceres.com — redacta contigo, y una persona aprueba todo lo que sale.

FAQ

¿Necesito Meilisearch si mi sitio ya tiene buscador?
Probablemente no. Si la búsqueda integrada de tu CMS, tu framework o tu plataforma ya devuelve lo correcto, es un problema resuelto y cambiarla es trabajo sin beneficio visible. Los casos en los que compensa un motor dedicado son un corpus grande o multilingüe donde la coincidencia ingenua falla, la búsqueda dentro de tu propio producto y no en una web de marketing, y necesitar una relevancia que puedas ajustar de verdad. Adóptalo por una de esas razones, no porque la búsqueda suene a infraestructura que deberías poseer.
¿Basta la parte MIT para un producto comercial?
Para un despliegue de un solo nodo, sí: la Community Edition es MIT y el proyecto declara que es de uso comercial libre. La Enterprise Edition cubre el sharding y las instantáneas por streaming a S3 bajo la Business Source License 1.1, que según el proyecto necesita un acuerdo comercial para producción. Lee tú mismo LICENSE y LICENSE-EE en el repositorio antes de construir sobre las funciones de escalado; el reparto puede moverse entre versiones y un resumen no sustituye al archivo.
¿Qué te enseñan de verdad los registros de búsqueda?
Sobre todo vocabulario y huecos. Las consultas sin resultados nombran cosas que la gente esperaba que tuvieras, o sea, una lista de producto y contenido escrita por tus propios visitantes. Las consultas frecuentes muestran qué palabras usan para lo que vendes, que casi nunca son las de tu portada. Ninguna de las dos sustituye hablar con clientes, pero ambas son gratis, continuas y ya están ocurriendo lea alguien el registro o no.
Related projects
PocketBaseUn backend de código abierto en Go que llega como un solo ejecutable: SQLite con suscripciones en tiempo real, usuarios, almacenamiento de archivos y panel de administración incluidosdocmdCompilador de documentación que genera un sitio de docs y los archivos de contexto legibles por máquina que consumen los sistemas de IA, desde una sola fuente MarkdownPayloadCMS headless y framework de aplicación de código abierto, nativo de Next.js, que se instala en la carpeta app que ya tienes

You built it. Now grow it.

AgentCeres is a managed AI marketing team — specialists draft the SEO, social, and outreach that fill your links, you approve what ships. 14-day free trial, from $39/month.

Start free trialMore projects