Un motor de búsqueda léxica local para pequeñas colecciones documentales. Divide los documentos en fragmentos, crea vectores TF-IDF normalizados y clasifica los pasajes por similitud coseno. Los resultados conservan su fuente, número de fragmento y términos coincidentes.
Se incluyen ejemplos didácticos sin datos privados ni dependencias de IA remota.
Funciones incluidas
- Archivos TXT y Markdown locales
- Fragmentos con solapamiento configurable
- Clasificación por coseno y términos coincidentes
- Índice JSON portátil
- Ejemplos originales y pruebas de límites
Licencia y primeros pasos
Código original bajo licencia MIT, copyright 2026 STELLARR STUDIO. Se permite el uso personal y comercial conservando el aviso de licencia. Incluye guías en francés e inglés. Las marcas y dependencias conservan sus propios derechos.
Lea el README para conocer los requisitos, los comandos de inicio, las pruebas y los límites de despliegue. No se incluyen alojamiento, capacidad de cómputo, APIs externas ni asistencia a medida.
Archivos incluidos
.gitignoreexamples/documents/donnees.txtexamples/documents/interfaces.mdexamples/documents/restauration.mdkit.jsonLICENSEREADME.en.mdREADME.mdsearch.pyTEST_REPORT.mdtest_search.pyTHIRD_PARTY_NOTICES.mdverification.json