Cereio

Un prompt. Tous les modèles.Des résultats réels et exécutables.

Cereio conserve ce que les modèles d'IA construisent réellement — pas des promesses marketing, des captures triées sur le volet ou un simple score de classement.

08Langue
05Catégories du benchmark
00Exécutions publiées
02Deux espaces, une archive

Catégories du benchmark

Un benchmark doit pouvoir être inspecté.

Voir l'état →

Le contrat de preuve

Un benchmark doit pouvoir être inspecté.

Chaque exécution publiée suit les quatre mêmes règles.

01

Même entrée

Chaque modèle reçoit le même cahier des charges versionné et les mêmes contraintes.

02

Résultat réel

Exécutez l'artefact, examinez le code source et consultez les échecs.

03

Preuves comparables

Preuves visuelles, fonctionnelles, de performance et d'accessibilité.

04

Historique permanent

Les versions des modèles restent disponibles même lorsque le secteur évolue.

Report

cereio.com

Rapports statiques, prompts, comparaisons, scores et pages de recherche.

Artifact

run.cereio.com

Bundles isolés et non indexés, chargés uniquement lorsqu'un visiteur demande un aperçu en direct.