Un chiffre n'est utile que si sa provenance est claire. Voici ce qu'OutilsIA détecte, estime, mesure et vérifie réellement.
L'échelle de preuve OutilsIA
Le score ou le modèle conseillé peuvent être utiles avant un benchmark, mais ils restent alors des estimations. Seul un test exécuté localement produit une performance mesurée.
Preuves utilisées dans les guides matériel
Nos pages GPU, RAM, Mac et build PC ramènent chaque recommandation à une contrainte vérifiable. Tous les matériels cités ne sont pas physiquement présents sur notre banc : dans ce cas, la compatibilité est explicitement une estimation et non un benchmark.
| Signal vérifié | Comment nous l'observons | Impact sur le verdict achat |
|---|---|---|
| VRAM et RAM | Valeurs détectées sur la machine ou données constructeur clairement identifiées. | Détermine si les poids et le contexte disposent d'une marge réaliste. |
| Runtime exact | Ollama Windows, WSL ou Linux et référence complète du modèle. | Évite d'attribuer au runtime Windows un modèle ou un test exécuté sous WSL. |
| Vitesse locale | Tokens/s et durée seulement après exécution du benchmark. | Sépare « compatible sur le papier » de « mesuré sur cette machine ». |
| Thermique et bruit | Capteur ou observation en charge lorsque cette preuve existe ; sinon la donnée reste inconnue. | Interdit de déduire un throttling ou une alimentation insuffisante sans mesure. |
| Prix observé | Prix et variante visibles au moment de la vérification, susceptibles de changer. | L'app peut conclure qu'aucun achat n'est utile si aucun palier n'est débloqué. |
Quand un benchmark est lancé dans Local Cockpit, le modèle, le runtime et le profil de test sont enregistrés avec le résultat. Nous mesurons :
Avant l'installation, le moteur rapproche la mémoire disponible, la taille quantifiée et l'usage choisi. Il classe alors le modèle comme adapté, possible avec limites ou déconseillé. Ce verdict est une estimation jusqu'au premier benchmark local.
Nous ne prétendons pas posséder ni tester physiquement chaque GPU cité. Une fiche terrain valide doit provenir d'une machine réelle, pointer vers un rapport accessible et conserver la cohérence du GPU, du modèle, du runtime, du build et de la mesure. La campagne multi-machines est publiée progressivement.
Aucun test n'est sponsorise par un editeur. Nous achetons ou utilisons les versions gratuites des outils que nous testons. Aucun editeur ne nous paie pour publier un avis favorable.
Nos revenus : le logiciel et l'expertise, pas les liens d'achat. OutilsIA édite Local Cockpit et des outils gratuits. Aucune page ne monétise via des liens d'affiliation. Les recommandations techniques restent indépendantes.
Nous disons quand c'est nul. Un outil mediocre recoit une critique mediocre. Notre credibilite repose sur l'honnetete, pas sur la complaisance.
Le domaine évolue vite, mais une date récente n'est pas une preuve de qualité. La date de modification n'est changée que lorsqu'une information visible et substantielle est réellement revue.
OutilsIA collabore avec Strategy Arena Research sur des benchmarks et papers ouverts (Dragon Labyrinth, calibration LLMs, agents POMDP). Datasets en CC-BY 4.0.