Um motor local de pesquisa lexical para pequenas coleções de documentos. Divide os documentos em segmentos, constrói vetores TF-IDF normalizados e ordena as passagens por semelhança de cosseno. Os resultados conservam a fonte, o número do segmento e os termos correspondentes. São fornecidos exemplos pedagógicos sem dados privados nem dependências de IA remotas.
Funcionalidades incluídas
- Ficheiros TXT e Markdown locais
- Segmentos sobrepostos configuráveis
- Ordenação por cosseno e termos correspondentes
- Índice JSON portátil
- Exemplos originais e testes de limites
Licença e primeiros passos
Código original sob licença MIT, copyright 2026 STELLARR STUDIO. Utilização pessoal e comercial permitida com conservação do aviso de licença. Guias em francês e inglês incluídos. As marcas e dependências conservam os seus próprios direitos.
Consulte o README para conhecer os requisitos, comandos de arranque, testes e limites de implementação. Alojamento, computação, APIs externas e apoio à medida não estão incluídos.
Ficheiros incluídos
.gitignoreexamples/documents/donnees.txtexamples/documents/interfaces.mdexamples/documents/restauration.mdkit.jsonLICENSEREADME.en.mdREADME.mdsearch.pyTEST_REPORT.mdtest_search.pyTHIRD_PARTY_NOTICES.mdverification.json