Un runner d’évaluation reproductible à partir de fichiers JSON. Il calcule correspondance exacte, F1 lexical, présence ou absence de phrases et longueur maximale. Les réponses manquantes restent des échecs visibles. Un adaptateur optionnel appelle une IP locale Ollama, sans proxy ni redirection automatique. Ces métriques ne constituent pas une preuve de véracité, de sûreté ou de qualité globale.
Dans cette base
- Évaluation hors ligne de fichiers de réponses
- F1 lexical et contraintes explicites
- Code de sortie adapté à une CI
- Adaptateur Ollama limité au loopback
- Tests HTTP locaux sans modèle téléchargé
Licence et prise en main
Code original sous licence MIT, copyright 2026 STELLARR STUDIO. Usage personnel et commercial autorisé, avec conservation de la notice de licence. Guides français et anglais inclus. Les marques et les dépendances conservent leurs droits propres.
Consultez le README pour les prérequis, les commandes de démarrage, les tests et les limites avant déploiement. L’hébergement, le calcul, les API externes et l’accompagnement ne sont pas inclus.
Fichiers inclus
.gitignoreevaluate.pyexamples/cases.jsonexamples/responses-failing.jsonexamples/responses.jsonkit.jsonLICENSEREADME.en.mdREADME.mdtest_evaluate.pyTEST_REPORT.mdTHIRD_PARTY_NOTICES.mdverification.json