Favur Evals
favur.dev

Vendor

Moonshot AI

2 model versions evaluated ·5 runs in the corpus · rubric v15

Model versions

Model versions from Moonshot AI
ModelMeta-scoreAppearancesBest atLast seen
Moonshot AI Kimi Code k2.767.42Sprint-Plan Agent2026-07-10
Moonshot AI Kimi k2.670.03Sprint-Review Agent2026-07-17

Runs (primary model)

Runs where a Moonshot AI model was primary, ranked by composite
RunSoWDateComposite
Kimi k2.6circlesJul 202663.3
Kimi Code k2.7circlesJul 202661.1
Kimi Code k2.7circlesJul 202659.3
Kimi k2.6circlesJun 202653.1
Kimi k2.6circlesJul 202649.9

Every run on Favur Evals is scored by the same deterministic engine, on the same Statements of Work. The benchmark is self-funded — no vendor sponsorship, credits, or grants.