Evaluator Agent
A11.1llm-wiredAvalia se o OS entendeu o contexto (bench).
runtime: mastra· autonomia default: L4·
evaluator_agentFunção e trabalho
Roda o Finaya Arrangement Bench e produz scorecards por dimensão (Arrangement Confidence, gates corretos, arquitetura adequada) + FFHI.
Dado que gera — Eval Scorecard
Scorecard de aderência ao contexto por dimensão.
meta-domínio:
evidence· schema: agent-runtime/agents/evaluator + bench-svcarrangement_confidencenumber
dimension_scoresRecord<string,number>
ffhiobject
verdictenum
Par reviewer adversarial
↔
evaluator-reviewerValida se os critérios de avaliação e pesos das dimensões estão corretos.
Dados corporativos consumidos/produzidos
← lê
Finaya Arrangement Bench● partial
10 cenários POC/bench · /bench/eval-reports · bench-svc→ escreve
Evidence & Governance Fabric● partial
/evidence · /audit · mfe-evidence :3023