Vrai Prix
Le calcul, en entier

Voici exactement
comment le prix est calculé

Notre différenciateur est la transparence totale. Cette page documente chaque étape — données, fusion, modèle, validation, moteur — au niveau de détail d'un rapport technique.

  1. 01

    Propriété identifiée

  2. 02

    Rôle d'évaluation récupéré

  3. 03

    Ventes comparables sélectionnées

  4. 04

    Caractéristiques ajustées

  5. 05

    Estimation calculée

  6. 06

    Intervalle de confiance produit

01

Données sources

Deux corpus publics forment la fondation de Vrai-Prix. Premièrement, les rôles d'évaluation foncière géoréférencés du Québec, publiés en données ouvertes par le ministère des Affaires municipales et de l'Habitation (MAMH) : six millésimes complets (2021 à 2026), de 3 626 120 à 3 747 008 unités d'évaluation par millésime, soit 22,15 millions d'observations unité-année. Chaque unité porte sa géométrie ponctuelle (NAD83, EPSG:4269), son matricule, son usage (code CUBF), ses caractéristiques de bâtiment et de terrain, et ses valeurs au rôle.

Deuxièmement, 745 119 transactions immobilières publiées entre janvier 2021 et juillet 2026, couvrant 1 100 municipalités, chacune géolocalisée et documentée (prix, date, type, année de construction, aire d'étages, valeurs au rôle).

Millésimes de rôle

2021 · 2022 · 2023 · 2024 · 2025 · 2026

Unités d'évaluation (2026)

3 747 008

Observations unité-année

22 150 285

Transactions

745 119 (2021-01 → 2026-07)

Municipalités couvertes

1 100

Système de référence

NAD83 (EPSG:4269), projeté EPSG:32198

02

Fusion spatiale transaction ↔ unité d'évaluation

Chaque transaction est appariée à son unité d'évaluation par coordonnées XY, dans le rôle de l'année de la transaction. L'appariement se fait en deux passes, en coordonnées projetées Québec Lambert (EPSG:32198).

Passe A — spatiale : parmi les 25 plus proches voisins dans un rayon de 200 m, chaque candidat reçoit un score : +100 si la valeur au rôle est identique à celle portée par la transaction, +60 si la valeur du rôle antérieur concorde, +30 si l'année de construction concorde, +30 si l'aire d'étages concorde à ±0,6 m², moins 0,5 point par mètre de distance. Le meilleur score gagne.

Passe B — jointure par valeur : les tours à condos placent des centaines d'unités sur le même point ; la géométrie seule ne suffit pas. Pour toute transaction sans concordance exacte de valeur en passe A, on cherche l'unité de valeur au rôle strictement identique dans un rayon de 500 m. En dernier recours, les millésimes adjacents (année ±1) sont essayés — les rôles triennaux étant déposés à des années différentes selon les municipalités.

Résultat : 99,88 % des transactions appariées, 82,2 % avec concordance exacte de la valeur au rôle, distance médiane de 0,6 m (p90 = 12 m). Ce lien est vérifiable transaction par transaction.

03

Modèle hédonique de masse

Le cœur du système est un modèle de gradient boosting (LightGBM) entraîné à prédire le logarithme du prix de vente. L'échantillon d'entraînement compte 689 231 transactions, après exclusion des ventes non représentatives du marché : appariement incertain, prix hors de 50 000 $ à 20 M$, ratio prix/évaluation hors de l'intervalle [0,3 ; 4].

Dix-huit variables décrivent chaque propriété au moment de la vente : aire d'étages, superficie et frontage du terrain, nombre d'étages, de logements, de locaux non résidentiels et de chambres locatives, âge du bâtiment, usage CUBF (et sa famille), lien physique, genre de construction, municipalité et région (variables catégorielles), latitude, longitude, temps continu (mois écoulés) et mois de l'année, plus les valeurs au rôle (terrain, bâtiment, total, croissance vs rôle antérieur, part du terrain).

Hyperparamètres : 255 feuilles, taux d'apprentissage 0,05, sous-échantillonnage 85 %, arrêt précoce sur ensemble de validation (~825 itérations retenues). La rétro-transformation du logarithme applique le facteur de correction de Duan (smearing, 1,04). Deux modèles de régression quantile (α = 0,10 et 0,90), entraînés sur les mêmes variables, produisent la fourchette P10-P90 propre à chaque propriété. Un second modèle « hédonique pur », sans les valeurs au rôle, sert de contrôle.

Le modèle final est appliqué aux 3,75 millions d'unités de chaque millésime (temps fixé à la mi-année), produisant 22 millions d'estimations historisées 2021-2026.

04

Validation — norme IAAO

La validation suit la norme de l'International Association of Assessing Officers (IAAO) sur les études de ratios : ratio médian (estimation/prix), coefficient de dispersion (COD), différentiel lié au prix (PRD) et coefficient de biais lié au prix (PRB). Deux protocoles : un ensemble aléatoire réservé de 15 % (102 943 ventes jamais vues) et un test temporel strict (entraînement sans 2026, test sur les 68 364 ventes de 2026).

Le COD provincial (22,7) dépasse la cible urbaine IAAO (≤ 15) — attendu pour un modèle unique couvrant aussi les marchés ruraux minces ; le segment condo (11,9) y satisfait pleinement. Le ratio médian de 0,995 indique l'absence de biais systématique.

MétriqueHoldout aléatoireTest temporel 2026
Erreur médiane (MdAPE)11,0 %14,0 %
± 20 % du prix réel72,1 %66,7 %
R² (log)0,7890,743
Ratio médian (cible 0,90-1,10)0,9950,961
COD (cible ≤ 15-20)22,7 (condos 11,9)23,7
PRD (cible 0,98-1,03)1,0921,075
PRB (cible ±0,05)−0,104−0,082
05

Moteur d'estimation en ligne

Au moment de la consultation, l'estimation affichée combine deux sources indépendantes. (1) L'estimation du modèle hédonique, pré-calculée pour la propriété. (2) Une estimation par comparables : les ventes candidates sont cherchées dans un rayon adaptatif (2,2 km, élargi jusqu'à ~28 km si le marché est mince, minimum 30 candidates sur 30-36 mois), filtrées par famille de type et par aire d'étages (±20 %, relâché à ±40 % puis abandonné sous 6 candidates).

Chaque comparable est ajusté, en dollars affichés : ajustement de marché (indice mensuel, section 06), ajustement de superficie (50 % du $/m² du comparable par m² d'écart, plafonné à ±25 % du prix), ajustement d'âge (0,5 % du prix par année d'écart, plafonné à ±10 %). Le poids de chaque comparable est le produit de trois gaussiennes : distance (σ = 1 500 m), récence (σ = 24 mois) et similarité de superficie (σ = 25 %). L'estimation comparables est la médiane pondérée des prix ajustés (12 meilleures retenues).

Combinaison : 65 % modèle + 35 % comparables lorsque les deux existent (≥ 3 comparables) ; sinon la source disponible seule. La fourchette affichée est l'intervalle P10-P90 du modèle, recentré sur l'estimation finale.

L'indice de confiance (0-100, niveaux A ≥ 75, B ≥ 60, C ≥ 45, D < 45) agrège : le nombre de comparables (+2,5/comparable, max 25), leur dispersion (jusqu'à +20 quand la déviation médiane est faible), la présence du modèle (+15) et une pénalité de largeur de fourchette au-delà de 30 %. Aucune estimation n'est affichée sans son niveau de confiance.

06

Indice de marché mensuel

L'ajustement temporel des comparables repose sur un indice mensuel par type de propriété : médiane du prix au mètre carré des ventes du mois (minimum 5 ventes), lissée par médiane mobile centrée de 3 mois, normalisée au dernier mois observé. Une vente de janvier 2024 comparée en août 2026 est ainsi ramenée aux conditions de marché actuelles avant tout autre ajustement.

07

Limites connues

L'honnêteté méthodologique exige de nommer ce que le système ne voit pas. Les rénovations intérieures, garages, piscines et l'état d'entretien n'apparaissent pas dans les données ouvertes du rôle. Dans les marchés ruraux minces, la dispersion dépasse les cibles IAAO urbaines — l'indice de confiance le reflète. Les unités d'une même tour à condos partagent un point géographique : sans numéro d'appartement, la recherche peut retourner une unité voisine. Les valeurs au rôle utilisées comme variables sont établies 18 à 24 mois avant leur entrée en vigueur. Enfin, une estimation statistique, aussi rigoureuse soit-elle, ne remplace pas l'évaluation d'un évaluateur agréé (OEAQ) ni l'analyse d'un courtier pour une mise en vente.

08

Méthode du coût — onglet Coût

L'onglet Coût applique la troisième approche de l'évaluation : V = valeur du terrain + coût de remplacement à neuf (RCN) − dépréciation. Il s'agit d'un coût de REMPLACEMENT (composantes modernes équivalentes : mur 2 × 6 R24, comble R50, poutrelles ajourées), pas d'un coût de reproduction à l'identique. La formule n'est jamais masquée et chaque nombre est retraçable : source → observation → conversion d'unité → prix canonique → formule → résultat.

Sources. Main-d'œuvre : grilles publiques « Coût horaire de la main-d'œuvre » de l'APCHQ (fondées sur les conventions collectives CCQ, secteur résidentiel léger, compagnon) — coût EMPLOYEUR complet (taux + vacances 13 % + avantages sociaux + AE, RQAP, FSS, CCQ, CNESST…), jamais le seul salaire ; le connecteur CCQ tourne en détection de changement. Indices : Statistique Canada 18-10-0289-01 (indices des prix de la construction de bâtiments, Montréal et Québec, résidentiel et divisions), trimestriel, pour actualiser les observations anciennes (Cost_t1 = Cost_t0 × Index_t1 / Index_t0). Matériaux : observations de prix publiques chez Canac, BMR et Patrick Morin (URL et date conservées, prix régulier préféré au prix promotionnel, médiane robuste multi-source, aberrations marquées mais jamais effacées). Articles sans observation détaillant (béton livré, fermes, fenêtres sur mesure, armoires…) : prix de référence interne étiqueté « hypothèse », qui abaisse la couverture observée et la confiance. Benchmarks : Altus Group (Canadian Cost Guide) par import manuel après téléchargement légal ; RSMeans par import licencié seulement. L'interface ne déclenche jamais de collecte : la synchronisation des sources tourne la nuit, hors du chemin de l'utilisateur.

Assemblages et quantités. Un assemblage (≈ 100 au catalogue : fondations, structure, enveloppe, toiture, ouvertures, finitions, cuisine, salle de bain, plomberie, CVCA, électricité, extérieur) réunit des articles (quantité par unité × (1 + pertes) × prix), des heures de métier (× coût employeur) et de l'équipement. Le moteur de géométrie dérive les quantités à partir de la description du bâtiment avec des hypothèses de prise de quantités affichées dans chaque formule : rapport de forme 1,5, hauteur d'étage 9 pi, montants à 16 po c/c, 1 fenêtre de 10 pi² par 90 pi² de plancher (≈ 11 % vitré), 0,09 pi lin de cloison par pi², toit = empreinte × facteur de pente × 1,10 de débords, excavation = (empreinte + 3 pi × périmètre) × profondeur. Chaque quantité peut être remplacée (source « saisi ») et chaque assemblage exclu.

Coûts directs, indirects, frais généraux, profit, contingence. Direct = Σ(matériaux × facteur matériaux + main-d'œuvre × facteur main-d'œuvre + équipement × facteur équipement). Indirects = direct × Σ pourcentages (plans 3 %, permis 0,8 %, inspection 0,5 %, assurances 1,5 %, mobilisation 1,5 %, gestion 3 %, financement 2 %, administration 1 % — hypothèses documentées, modifiables). Frais généraux = (direct + indirects) × 7 % ; profit = (direct + indirects + frais généraux) × 8 % ; contingence = (direct + indirects) × 3 % — trois notions distinctes, jamais fusionnées. RCN = direct + indirects + frais généraux + profit + contingence.

Localisation. Les conventions collectives de l'industrie (Loi R-20) fixent des taux uniformes au Québec : facteur main-d'œuvre 1,00 partout sauf régions éloignées (Abitibi, Côte-Nord, Gaspésie, Nord-du-Québec — primes et hébergement). Les facteurs matériaux et équipement (1,00 à Montréal, jusqu'à 1,20 au Nord-du-Québec) traduisent le transport et la disponibilité : hypothèses documentées, résolues par municipalité, puis par centre le plus proche, puis « rural ».

Dépréciation. Physique : méthode âge-vie (âge effectif ÷ vie économique, plafonnée à 90 %) ou, en mode avancé, composante par composante — chaque groupe (structure 75 ans, toiture 22, enveloppe 40, ouvertures 30, intérieur 25, cuisine 20, salles de bain 22, mécanique 22, électricité 35, site 25) porte sa vie et sa condition ; les règles condition → âge effectif (neuf 0 %, excellent 10 %, rénové 12 %, très bon 20 %, bon 35 %, moyen 55 %, sous la moyenne 70 %, mauvais 85 % de la vie) sont des hypothèses stockées en base et modifiables. Fonctionnelle : déficiences saisies, curables (coût de correction) ou incurables (perte de valeur). Externe : montant saisi, 0 $ par défaut — jamais calculée sans preuve.

Terrain. En mode propriété, la valeur du terrain au rôle 2026 (MAMH) est préremplie et identifiée comme telle ; vous pouvez la conserver, la remplacer (comparables de terrains, technique résiduelle) ou la retirer. La valeur au rôle n'est pas la valeur marchande du terrain : elle est fixée 18 à 24 mois avant l'entrée en vigueur du rôle.

Fourchette et confiance. Chaque ligne porte un écart-type (dispersion des prix observés ou ±8 % observé / ±15 % référence / ±20 % hypothèse, heures ±15 %, incertitude de quantité selon sa source) ; les lignes se combinent en racine des carrés, plus une composante systématique (localisation 2-4 %, modèle d'assemblages 5 %) ; P10/P90 = RCN ± 1,28 σ. L'indice de confiance (0-100, A ≥ 80, B ≥ 65, C ≥ 50, D) additionne fraîcheur des observations (20), couverture observée des matériaux (20), localisation (15), main-d'œuvre officielle (15), benchmarks (10) et complétude des caractéristiques du bâtiment (20). Un benchmark hors plage est signalé, jamais utilisé pour recaler le moteur.

Annonces à vendre. Pour une propriété réellement à vendre (onglet À vendre), l'analyse IA du bâtiment lit les photos et le texte de l'annonce pour en déduire les composantes visibles (structure, revêtements, toiture, fenêtres, finitions, état) ; chaque inférence porte sa confiance et sa provenance, peut être corrigée à la main, puis est chiffrée par le même moteur déterministe. Le modèle ne produit jamais de montant : il décrit, le moteur chiffre.

Reproductibilité et limites. Chaque estimation enregistre sa version de méthode, de base de coûts et d'assemblages, la date des prix et un instantané des prix et taux utilisés : elle se reconstruit à l'identique. Limites : hypothèses de quantités génériques (pas de plans), prix de référence pour une partie des articles, dépréciation dépendante de la condition saisie, condos limités à l'unité (parties communes exclues). Les trois lectures de la valeur (hédonique, comparables, coût) sont comparées, jamais moyennées.

Formule

V = terrain + RCN − (D_phys + D_fonct + D_ext)

Main-d'œuvre

APCHQ (coût employeur complet) · CCQ

Indices

StatCan 18-10-0289-01 (trimestriel)

Matériaux

Canac · BMR · Patrick Morin (+ références étiquetées)

Assemblages

≈ 100, ≈ 550 composants, ≈ 180 articles

Confiance

20 + 20 + 15 + 15 + 10 + 20 = 100

09

La mesure à l'épreuve du marché — propriétés à vendre

L'onglet À vendre confronte le moteur à la réalité du marché : plus de 70 000 propriétés réellement en vente au Québec (base Immo-Ka, rafraîchie chaque nuit) sont jumelées spatialement à leur unité du rôle d'évaluation (bbox lat/lng, départage par type, superficie et année ; distance médiane ≈ 14 m), puis évaluées par le moteur exactement comme une fiche ordinaire. La page /stats/marche publie le résultat : ratio médian estimation / prix demandé, erreur absolue médiane (MdAPE), calibration de l'indice de confiance A-D, performance par type, région et tranche de prix.

Le duel des méthodes. Chaque annonce est aussi évaluée par les approches classiques — méthode du coût calibrée (terrain au marché + coût unitaire net du bâtiment, calibrés sur les ventes des 18 derniers mois grâce à la composition de la valeur au rôle), rôle indexé (IAAO) et hédonique — et par un ensemble médian. L'hybride 65/35 reste la mesure principale ; l'écart entre les lectures est une information, pas un défaut.

L'atelier d'évaluation. Sur chaque fiche, vous pouvez refaire l'évaluation vous-même : bassin de ventes réelles (et d'annonces actives) autour du sujet, choix des comparables, grille d'ajustements en dollars pré-remplie par le moteur (marché, superficie, âge) et complétée à volonté, pondération, réconciliation (médiane, moyenne, pondérées), puis confrontation avec la mesure Vrai-Prix, le prix demandé et le rôle. Vos choix restent sur votre appareil.

Ce que l'écart mesure vraiment. Le prix demandé n'est pas la valeur marchande : l'écart entre la mesure et le prix affiché additionne l'erreur du modèle ET la stratégie de mise en marché du vendeur. Seule la vente conclue tranche — c'est pourquoi le corpus d'apprentissage reste les 745 000 transactions réelles, et non les annonces.

Annonces mesurées

≈ 66 000 sur ≈ 71 000 actives

Jumelage

spatial ≤ 75 m (repli 250 m), distance médiane ≈ 14 m

Mesure principale

hybride 65 % modèle · 35 % comparables

Rafraîchissement

quotidien (snapshot Immo-Ka + ré-évaluation)

Sources : rôles d'évaluation foncière du Québec (MAMH, données ouvertes) · IAAO Standard on Ratio Studies · IAAO Standard on AVMs

Vrai Prix

Estimations bâties sur les rôles d'évaluation foncière du Québec (MAMH, données ouvertes) et 745 119 transactions réelles. Modèle hédonique + comparables ajustés, calcul montré en entier. Estimation statistique à titre indicatif.