À venir · Roadmap Applied AI

EvalGate

État : non réalisé

Objectif

Construire une plateforme reproductible d’évaluation des systèmes LLM/agents.

Preuve recherchée

Datasets versionnés, graders, comparaison de configurations, qualité/coût/latence, quality gate en CI.

Stack envisagée

PythonFastAPIPydanticPostgreSQL / pgvectorNext.js / TypeScriptDockerGitHub Actions

Stack commune au parcours Applied AI (pas encore mise en œuvre sur ce projet précis).