Filtrer les résultats par

Search Help
Currently selected filters that can be removed

Mot(s)-clé(s)

Année de publication

1 facets displayed. 1 facets selected.

Enquête ou programme statistique

134 facets displayed. 0 facets selected.

Contenu

1 facets displayed. 0 facets selected.
Aide à l'ordre
entrées

Résultats

Tout (393)

Tout (393) (0 to 10 of 393 results)

  • Articles et rapports : 13-26-0004
    Description : Le plan d'accessibilité de StatCan vise à garantir que tous les employés de StatCan et des Opérations des enquêtes statistiques soient soutenus dans un environnement de travail exempt d'obstacles, où leurs besoins en matière d'accessibilité sont satisfaits. « Statistique Canada : La voie vers l'accessibilité 2023-25» est destinée à être mise à jour continuellement. Alors que nous progressons vers l'instauration d'un StatCan accessible et inclusif, nos actes et nos engagements changeront et évolueront. Le Plan sera mis à jour pour veiller à ce que l'on accorde une importance soutenue et pertinente aux domaines qui en ont le plus besoin.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200001
    Description : Des modèles de régression à erreurs emboîtées sont couramment utilisés pour intégrer des variables auxiliaires propres aux unités afin d’améliorer les estimations sur petits domaines. En cas d’erreur de spécification relative à la structure de la moyenne du modèle, l’erreur quadratique moyenne de prédiction (EQMP) fondée sur le plan des meilleurs prédicteurs linéaires sans biais empiriques (MPLSBE) augmente généralement. La méthode de meilleure prédiction observée (MPO) a été proposée dans le but d’améliorer l’EQMP fondée sur le plan par rapport à la méthode MPLSBE. Dans la présente étude, nous menons des expériences de simulation de Monte Carlo pour comprendre l’effet d’erreurs de spécification de la structure de la moyenne sur différents estimateurs sur petits domaines. Nos résultats laissent entendre que la méthode MPO reposant sur des variables auxiliaires au niveau de l’unité ne fournit pas de meilleurs résultats que la méthode MPLSBE pour ce qui est de l’EQMP fondée sur le plan, sauf si le nombre de petits domaines m est extrêmement grand. À l’inverse, les rendements de la méthode MPO s’améliorent nettement lorsque des variables auxiliaires au niveau du domaine sont utilisées. La présente étude inclut à la fois des données analytiques et numériques pour illustrer ces observations; elle fournit en outre des renseignements pratiques pour faire face aux erreurs de spécification de modèle dans le contexte d’estimations sur petits domaines (EPD).
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200002
    Description : La présente étude permet d’examiner les effets de l’intervieweur sur la non-réponse des ménages dans le cadre de trois vagues de la Household Finance and Consumption Survey (HFCS ou enquête sur les finances et la consommation des ménages en français) en Autriche à l’aide d’un modèle multiniveau. Traiter la non-réponse à sa source est crucial pour maintenir la qualité et la représentativité des données d’enquête. Nos conclusions indiquent que la variation du comportement de réponse expliquée par les effets de l’intervieweur a diminué, passant d’un tiers à la première vague à 7 % à la troisième vague. Les intervieweurs efficaces tendent à être titulaires d’un grade universitaire, à être mariés, à être propriétaires et à avoir une plus grande charge de travail. De plus, une rémunération moyenne plus élevée dans la municipalité du ménage influe négativement sur la participation aux enquêtes. Ces renseignements soulignent l’intérêt d’une sélection ciblée des intervieweurs et de stratégies de formation pour améliorer les taux de réponse.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200003
    Description : Dans la présente étude, une procédure d’inférence selon un modèle de séries chronologiques structurel multivarié est élaborée pour la production de chiffres mensuels sur la confiance des consommateurs. Les données d’entrée pour le modèle sont cinq séries d’estimations directes pour les indices mesurant la confiance des consommateurs, tirées de l’Enquête sur la confiance des consommateurs des Pays-Bas. Le modèle améliore l’exactitude des estimations directes, puisqu’il permet une meilleure séparation des erreurs de mesure et d’échantillonnage par rapport aux paramètres cibles estimés. Les erreurs-types pour les mouvements mois-à-mois sont clairement plus petites dans le modèle de séries chronologiques. Un deuxième problème abordé dans cette étude est lié à la transition vers un nouveau processus d’enquête en 2017. Des modèles de séries chronologiques structurels combinés à un essai parallèle sont appliqués pour estimer les discontinuités causées par le remaniement. Un algorithme conçu pour les variables de la confiance des consommateurs est élaboré pour construire des séries de données d’entrée ininterrompues pour le modèle de séries chronologiques structurel mentionné précédemment. Cette méthode d’inférence a facilité une transition harmonieuse vers un nouveau plan d’enquête et a donné lieu à des séries ininterrompues sur la confiance des consommateurs remontant jusqu’à 1986. Cette méthode est mise en œuvre pour la production de chiffres mensuels officiels sur la confiance des consommateurs aux Pays-Bas.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200004
    Description : La catégorie des modèles linéaires généralisés (GLM) est une généralisation flexible de la régression par les moindres carrés ordinaires qui permet de relier le modèle linéaire à la variable réponse à l’aide d’une fonction de lien et suppose que l’ampleur de la variance de chaque mesure est fonction de sa valeur prédite. La multicolinéarité dans les GLM peut faire augmenter les variances des coefficients estimés et peut provoquer une mauvaise prédiction dans certaines régions de l’espace de régression. Elle peut également entraîner une statistique de Wald non significative, même lorsque les variables explicatives sont hautement prédictives dans un modèle de la famille des GLM. Peu de recherches ont étudié de près le diagnostic de multicolinéarité dans les GLM, en particulier lorsque des données d’enquête complexes sont utilisées. Dans le présent article, nous développons des facteurs d’inflation de la variance (VIF) qui mesurent l’augmentation de la variance d’un estimateur de paramètre due à la multicolinéarité dans les GLM. De plus, nous étendons les VIF et les indices de conditionnement pour les appliquer à des données d’enquête complexes, en tenant compte des caractéristiques du plan, par exemple les poids, les grappes et les strates. Ces méthodes sont illustrées au moyen de données provenant d’une enquête auprès des ménages sur la santé et la nutrition.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200005
    Description : L’utilisation de sources de données non probabilistes à des fins statistiques et pour des statistiques officielles a gagné en popularité au cours des dernières années. L’inférence statistique fondée sur des échantillons non probabilistes devient toutefois plus difficile en raison de sa nature biaisée et de l’absence de représentativité. Dans le présent article, nous proposons un estimateur de pondération probabiliste inverse équilibrant les quantiles (PPIEQ) pour des échantillons non probabilistes. Nous appliquons ici l’idée de Harms et Duchesne (2006) permettant d’utiliser les renseignements sur les quantiles dans le processus d’estimation afin de reproduire des totaux connus et la répartition de variables auxiliaires. Nous parlons de l’estimation des probabilités de PPIEQ et de sa variance. Notre étude par simulation a montré la robustesse des estimateurs proposés par rapport à une spécification erronée de modèle, qui aident ainsi à réduire les biais et l’erreur quadratique moyenne. En dernier lieu, nous avons appliqué les méthodes proposées pour estimer la proportion d’emplois vacants destinés à des travailleurs ukrainiens en Pologne en utilisant un ensemble intégré de données administratives et d’enquête sur les postes vacants.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200006
    Description : Les organismes nationaux de statistique consacrent des ressources à la promotion de l’utilisation des données administratives dans les statistiques officielles. Cependant, les données administratives ne sont pas élaborées en vue de produire des statistiques. Il s’agit plutôt du résultat d’un événement ou d’une opération en lien avec des procédures administratives d’organisations, d’administrations publiques et d’organismes gouvernementaux. Il est donc essentiel d’évaluer la qualité des données administratives en ce qui concerne les sources d’erreur, tout particulièrement la représentativité par rapport à la population cible. Dans le présent document, on exploite la force des échantillons probabilistes de référence ou des recensements qui peuvent servir à déceler le manque de représentativité dans les données administratives, et l’on présente des indicateurs de qualité fondés sur des mesures de distance et des indicateurs de représentativité (indicateurs R). On fait état de leur application à l’aide d’une étude par simulation et l’on se penche sur une application réelle en utilisant un ensemble de données administratives du bureau national de la statistique du Royaume-Uni.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200007
    Description : Les échantillons probabilistes sont considérés comme la référence pour recueillir des renseignements dans les études basées sur la population, mais l’on utilise fréquemment, dans la pratique, des échantillons non probabilistes en raison de leur faible coût, de leur commodité et de l’absence de base de sondage pour l’enquête. Les estimations naïves fondées sur des échantillons non probabilistes risquent, en l’absence d’ajustements, d’être trompeuses en raison d’un biais de sélection. Une approche valide d’intégration des données comprenant l’imputation massive, la pondération par le score de propension et le calage a récemment été utilisée pour améliorer la représentativité des échantillons non probabilistes. L’efficacité de l’approche d’imputation massive dépend des hypothèses sous-jacentes du modèle. Dans le présent article, nous proposons d’utiliser l’apprentissage profond pour l’imputation massive dans une combinaison d’échantillons probabilistes et non probabilistes et de le comparer à plusieurs approches modernes d’imputation massive basée sur l’apprentissage automatique, y compris la modélisation additive généralisée, l’arbre de régression, la forêt aléatoire et le renforcement extrême du gradient (XGBoosting). Dans l’étude par simulation, les approches basées sur l’apprentissage profond se sont révélées plus robustes et efficaces que d’autres approches d’imputation massive contre l’invalidation des hypothèses sous-jacentes du modèle dans les scénarios de non-linéarité.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200008
    Description : Une estimation à partir de données d’enquête classique fondée sur le plan repose sur un plan de sondage adéquatement défini afin d’obtenir une inférence valable. Nous tenons compte des propriétés de l’estimation par régression en cas d’erreur de spécification du plan de sondage, dans lequel les probabilités d’inclusion nominale et réelle ne sont pas nécessairement les mêmes. Cette situation générale d’erreur de spécification d’un plan de sondage comporte beaucoup de défis dans le contexte moderne dans lequel sont réalisées les enquêtes. Dans ce contexte, une analyse asymptotique de l’estimateur par la régression, une expression du biais et une expression de la variance sont présentées. En outre, un estimateur de la variance convergent est obtenu et une expression qui estime le biais en partie ou en totalité est présentée. Cette dernière expression peut être utilisée en tant qu’indicateur de la présence d’un biais causé par l’erreur de spécification d’un spécialiste. Une étude par simulation est menée afin d’étayer la théorie exposée.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200009
    Description : Nous présentons et appliquons une méthodologie pour améliorer l’inférence des paramètres pour petits domaines en utilisant des données tirées de plusieurs sources. Les présents travaux prolongent ceux de Cahoy et Sedransk (2023) qui ont montré la façon d’intégrer des statistiques sommaires provenant de sources multiples. Notre méthodologie pour effectuer des inférences sur la proportion de personnes dans les comtés de Floride qui ne sont pas couvertes par un régime d’assurance-maladie s’appuie sur des distributions a priori hiérarchiques globales-locales. Les résultats d’une vaste étude par simulation montrent que cette méthodologie, fondée sur de multiples sources de données, permettra de produire de meilleures inférences. Parmi les cinq variantes du modèle qui ont été évaluées, celles reposant sur les distributions a priori de type horseshoe pour l’ensemble des variances produisent de meilleurs résultats que celles reposant sur les distributions a priori de type LASSO pour les variances locales.
    Date de diffusion : 2025-12-23
Stats en bref (73)

Stats en bref (73) (0 to 10 of 73 results)

  • Stats en bref : 45-20-00032025009
    Description : Vous croyez tout savoir sur les sapins de Noël? Mettez vos connaissances à l’épreuve! Dans cet épisode spécial de Hé-coutez bien!, nos collègues s’affrontent dans un quiz consacré à l’industrie canadienne du sapin de Noël. Découvrez quel pays a lancé cette tradition, combien les producteurs canadiens ont récolté en 2023, les chiffres étonnants des exportations et importations, ainsi que d’autres anecdotes festives. Après l’écoute, vous deviendrez l’expert incontournable des sapins de Noël pendant vos soirées des Fêtes!
    Date de diffusion : 2025-12-19

  • Stats en bref : 11-621-M2025016
    Description : Dans un contexte de changements continus au chapitre des droits de douane, de la réglementation commerciale et de la politique américaine, l’Enquête canadienne sur la situation des entreprises demeure un outil important pour comprendre l’incidence des droits de douane sur les entreprises du Canada. Au moyen des analyses des deuxième et troisième trimestres de 2025, qui traitaient de l’imposition des nouveaux droits de douane et des réactions aux contre-mesures, le présent document fournit les constatations mises à jour pour le quatrième trimestre de 2025 et tirées de l’enquête menée du 1er octobre au 5 novembre 2025.
    Date de diffusion : 2025-12-18

  • Stats en bref : 89-20-00062025001
    Description : Cette vidéo est conçue pour vous aider à évaluer de manière critique les données qui vous sont présentées. Aucunes données ne sont parfaites. En comprenant les forces et les limites des données, vous pouvez éviter d'être induit en erreur et ainsi prendre des décisions éclairées en étant mieux informé.
    Date de diffusion : 2025-12-15

  • Stats en bref : 11-627-M2025059
    Description : Cette infographie du Laboratoire de données rurales de Statistique Canada présente un aperçu visuel des principaux faits saillants et des conclusions statistiques tirées de la base de données Profils des entreprises du Canada rural de 2023. La base de données fournit les profils financiers des petites et moyennes entreprises canadiennes dont les revenus annuels totaux sont de 30 000 à 5 000 000 dollars et de 5 000 001 à 20 000 000 dollars, respectivement. L'infographie présente des observations concernant les petites entreprises des régions rurales et petites villes du Canada.
    Date de diffusion : 2025-12-12

  • Stats en bref : 11-627-M2025061
    Description : Cette infographie donne un aperçu de l'industrie du bois d'œuvre, en présentant les principaux indicateurs et tendances liés à la production, aux exportations et à l'évolution des prix. Elle met en évidence des données importantes, illustre l'état du marché et offre un aperçu du paysage actuel du bois d'œuvre au Canada.
    Date de diffusion : 2025-12-12

  • Stats en bref : 11-627-M2025055
    Description : Cette infographie est fondée sur les données déclarées par la police dans le cadre du Programme de déclaration uniforme de la criminalité. Elle présente les données relatives aux contacts subséquents avec la police, sur une période de neuf ans, des personnes vivant dans les régions rurales des provinces canadiennes qui ont été identifiées comme l’auteur présumé d’une infraction criminelle en 2014.
    Date de diffusion : 2025-12-09

  • Stats en bref : 11-627-M2025051
    Description : À l’aide des données de l’Enquête canadienne sur l’incapacité de 2022, cette infographie met en évidence les tendances et les expériences des personnes racisées ayant une incapacité.
    Date de diffusion : 2025-12-03

  • Stats en bref : 11-627-M2025052
    Description : À l’aide des données de l’Enquête canadienne sur l’incapacité de 2022, cette infographie met en évidence les tendances et les expériences des personnes ayant une incapacité de type dynamique.
    Date de diffusion : 2025-12-03

  • Stats en bref : 11-627-M2025060
    Description : Victimes d'homicide déclarées par la police et taux pour 100 000 habitants, selon la région géographique (national, provincial et RMR).
    Date de diffusion : 2025-12-02

  • Stats en bref : 11-627-M2025056
    Description : Cette illustration présente les données sur les Dépenses des administrations publiques selon la fonction, au Canada pour l’exercice 2024-2025. Elle donne une ventilation des dépenses selon l'objectif socio-économique pour lequel les fonds sont utilisés.
    Date de diffusion : 2025-11-27
Articles et rapports (299)

Articles et rapports (299) (0 to 10 of 299 results)

  • Articles et rapports : 13-26-0004
    Description : Le plan d'accessibilité de StatCan vise à garantir que tous les employés de StatCan et des Opérations des enquêtes statistiques soient soutenus dans un environnement de travail exempt d'obstacles, où leurs besoins en matière d'accessibilité sont satisfaits. « Statistique Canada : La voie vers l'accessibilité 2023-25» est destinée à être mise à jour continuellement. Alors que nous progressons vers l'instauration d'un StatCan accessible et inclusif, nos actes et nos engagements changeront et évolueront. Le Plan sera mis à jour pour veiller à ce que l'on accorde une importance soutenue et pertinente aux domaines qui en ont le plus besoin.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200001
    Description : Des modèles de régression à erreurs emboîtées sont couramment utilisés pour intégrer des variables auxiliaires propres aux unités afin d’améliorer les estimations sur petits domaines. En cas d’erreur de spécification relative à la structure de la moyenne du modèle, l’erreur quadratique moyenne de prédiction (EQMP) fondée sur le plan des meilleurs prédicteurs linéaires sans biais empiriques (MPLSBE) augmente généralement. La méthode de meilleure prédiction observée (MPO) a été proposée dans le but d’améliorer l’EQMP fondée sur le plan par rapport à la méthode MPLSBE. Dans la présente étude, nous menons des expériences de simulation de Monte Carlo pour comprendre l’effet d’erreurs de spécification de la structure de la moyenne sur différents estimateurs sur petits domaines. Nos résultats laissent entendre que la méthode MPO reposant sur des variables auxiliaires au niveau de l’unité ne fournit pas de meilleurs résultats que la méthode MPLSBE pour ce qui est de l’EQMP fondée sur le plan, sauf si le nombre de petits domaines m est extrêmement grand. À l’inverse, les rendements de la méthode MPO s’améliorent nettement lorsque des variables auxiliaires au niveau du domaine sont utilisées. La présente étude inclut à la fois des données analytiques et numériques pour illustrer ces observations; elle fournit en outre des renseignements pratiques pour faire face aux erreurs de spécification de modèle dans le contexte d’estimations sur petits domaines (EPD).
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200002
    Description : La présente étude permet d’examiner les effets de l’intervieweur sur la non-réponse des ménages dans le cadre de trois vagues de la Household Finance and Consumption Survey (HFCS ou enquête sur les finances et la consommation des ménages en français) en Autriche à l’aide d’un modèle multiniveau. Traiter la non-réponse à sa source est crucial pour maintenir la qualité et la représentativité des données d’enquête. Nos conclusions indiquent que la variation du comportement de réponse expliquée par les effets de l’intervieweur a diminué, passant d’un tiers à la première vague à 7 % à la troisième vague. Les intervieweurs efficaces tendent à être titulaires d’un grade universitaire, à être mariés, à être propriétaires et à avoir une plus grande charge de travail. De plus, une rémunération moyenne plus élevée dans la municipalité du ménage influe négativement sur la participation aux enquêtes. Ces renseignements soulignent l’intérêt d’une sélection ciblée des intervieweurs et de stratégies de formation pour améliorer les taux de réponse.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200003
    Description : Dans la présente étude, une procédure d’inférence selon un modèle de séries chronologiques structurel multivarié est élaborée pour la production de chiffres mensuels sur la confiance des consommateurs. Les données d’entrée pour le modèle sont cinq séries d’estimations directes pour les indices mesurant la confiance des consommateurs, tirées de l’Enquête sur la confiance des consommateurs des Pays-Bas. Le modèle améliore l’exactitude des estimations directes, puisqu’il permet une meilleure séparation des erreurs de mesure et d’échantillonnage par rapport aux paramètres cibles estimés. Les erreurs-types pour les mouvements mois-à-mois sont clairement plus petites dans le modèle de séries chronologiques. Un deuxième problème abordé dans cette étude est lié à la transition vers un nouveau processus d’enquête en 2017. Des modèles de séries chronologiques structurels combinés à un essai parallèle sont appliqués pour estimer les discontinuités causées par le remaniement. Un algorithme conçu pour les variables de la confiance des consommateurs est élaboré pour construire des séries de données d’entrée ininterrompues pour le modèle de séries chronologiques structurel mentionné précédemment. Cette méthode d’inférence a facilité une transition harmonieuse vers un nouveau plan d’enquête et a donné lieu à des séries ininterrompues sur la confiance des consommateurs remontant jusqu’à 1986. Cette méthode est mise en œuvre pour la production de chiffres mensuels officiels sur la confiance des consommateurs aux Pays-Bas.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200004
    Description : La catégorie des modèles linéaires généralisés (GLM) est une généralisation flexible de la régression par les moindres carrés ordinaires qui permet de relier le modèle linéaire à la variable réponse à l’aide d’une fonction de lien et suppose que l’ampleur de la variance de chaque mesure est fonction de sa valeur prédite. La multicolinéarité dans les GLM peut faire augmenter les variances des coefficients estimés et peut provoquer une mauvaise prédiction dans certaines régions de l’espace de régression. Elle peut également entraîner une statistique de Wald non significative, même lorsque les variables explicatives sont hautement prédictives dans un modèle de la famille des GLM. Peu de recherches ont étudié de près le diagnostic de multicolinéarité dans les GLM, en particulier lorsque des données d’enquête complexes sont utilisées. Dans le présent article, nous développons des facteurs d’inflation de la variance (VIF) qui mesurent l’augmentation de la variance d’un estimateur de paramètre due à la multicolinéarité dans les GLM. De plus, nous étendons les VIF et les indices de conditionnement pour les appliquer à des données d’enquête complexes, en tenant compte des caractéristiques du plan, par exemple les poids, les grappes et les strates. Ces méthodes sont illustrées au moyen de données provenant d’une enquête auprès des ménages sur la santé et la nutrition.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200005
    Description : L’utilisation de sources de données non probabilistes à des fins statistiques et pour des statistiques officielles a gagné en popularité au cours des dernières années. L’inférence statistique fondée sur des échantillons non probabilistes devient toutefois plus difficile en raison de sa nature biaisée et de l’absence de représentativité. Dans le présent article, nous proposons un estimateur de pondération probabiliste inverse équilibrant les quantiles (PPIEQ) pour des échantillons non probabilistes. Nous appliquons ici l’idée de Harms et Duchesne (2006) permettant d’utiliser les renseignements sur les quantiles dans le processus d’estimation afin de reproduire des totaux connus et la répartition de variables auxiliaires. Nous parlons de l’estimation des probabilités de PPIEQ et de sa variance. Notre étude par simulation a montré la robustesse des estimateurs proposés par rapport à une spécification erronée de modèle, qui aident ainsi à réduire les biais et l’erreur quadratique moyenne. En dernier lieu, nous avons appliqué les méthodes proposées pour estimer la proportion d’emplois vacants destinés à des travailleurs ukrainiens en Pologne en utilisant un ensemble intégré de données administratives et d’enquête sur les postes vacants.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200006
    Description : Les organismes nationaux de statistique consacrent des ressources à la promotion de l’utilisation des données administratives dans les statistiques officielles. Cependant, les données administratives ne sont pas élaborées en vue de produire des statistiques. Il s’agit plutôt du résultat d’un événement ou d’une opération en lien avec des procédures administratives d’organisations, d’administrations publiques et d’organismes gouvernementaux. Il est donc essentiel d’évaluer la qualité des données administratives en ce qui concerne les sources d’erreur, tout particulièrement la représentativité par rapport à la population cible. Dans le présent document, on exploite la force des échantillons probabilistes de référence ou des recensements qui peuvent servir à déceler le manque de représentativité dans les données administratives, et l’on présente des indicateurs de qualité fondés sur des mesures de distance et des indicateurs de représentativité (indicateurs R). On fait état de leur application à l’aide d’une étude par simulation et l’on se penche sur une application réelle en utilisant un ensemble de données administratives du bureau national de la statistique du Royaume-Uni.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200007
    Description : Les échantillons probabilistes sont considérés comme la référence pour recueillir des renseignements dans les études basées sur la population, mais l’on utilise fréquemment, dans la pratique, des échantillons non probabilistes en raison de leur faible coût, de leur commodité et de l’absence de base de sondage pour l’enquête. Les estimations naïves fondées sur des échantillons non probabilistes risquent, en l’absence d’ajustements, d’être trompeuses en raison d’un biais de sélection. Une approche valide d’intégration des données comprenant l’imputation massive, la pondération par le score de propension et le calage a récemment été utilisée pour améliorer la représentativité des échantillons non probabilistes. L’efficacité de l’approche d’imputation massive dépend des hypothèses sous-jacentes du modèle. Dans le présent article, nous proposons d’utiliser l’apprentissage profond pour l’imputation massive dans une combinaison d’échantillons probabilistes et non probabilistes et de le comparer à plusieurs approches modernes d’imputation massive basée sur l’apprentissage automatique, y compris la modélisation additive généralisée, l’arbre de régression, la forêt aléatoire et le renforcement extrême du gradient (XGBoosting). Dans l’étude par simulation, les approches basées sur l’apprentissage profond se sont révélées plus robustes et efficaces que d’autres approches d’imputation massive contre l’invalidation des hypothèses sous-jacentes du modèle dans les scénarios de non-linéarité.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200008
    Description : Une estimation à partir de données d’enquête classique fondée sur le plan repose sur un plan de sondage adéquatement défini afin d’obtenir une inférence valable. Nous tenons compte des propriétés de l’estimation par régression en cas d’erreur de spécification du plan de sondage, dans lequel les probabilités d’inclusion nominale et réelle ne sont pas nécessairement les mêmes. Cette situation générale d’erreur de spécification d’un plan de sondage comporte beaucoup de défis dans le contexte moderne dans lequel sont réalisées les enquêtes. Dans ce contexte, une analyse asymptotique de l’estimateur par la régression, une expression du biais et une expression de la variance sont présentées. En outre, un estimateur de la variance convergent est obtenu et une expression qui estime le biais en partie ou en totalité est présentée. Cette dernière expression peut être utilisée en tant qu’indicateur de la présence d’un biais causé par l’erreur de spécification d’un spécialiste. Une étude par simulation est menée afin d’étayer la théorie exposée.
    Date de diffusion : 2025-12-23

  • Articles et rapports : 12-001-X202500200009
    Description : Nous présentons et appliquons une méthodologie pour améliorer l’inférence des paramètres pour petits domaines en utilisant des données tirées de plusieurs sources. Les présents travaux prolongent ceux de Cahoy et Sedransk (2023) qui ont montré la façon d’intégrer des statistiques sommaires provenant de sources multiples. Notre méthodologie pour effectuer des inférences sur la proportion de personnes dans les comtés de Floride qui ne sont pas couvertes par un régime d’assurance-maladie s’appuie sur des distributions a priori hiérarchiques globales-locales. Les résultats d’une vaste étude par simulation montrent que cette méthodologie, fondée sur de multiples sources de données, permettra de produire de meilleures inférences. Parmi les cinq variantes du modèle qui ont été évaluées, celles reposant sur les distributions a priori de type horseshoe pour l’ensemble des variances produisent de meilleurs résultats que celles reposant sur les distributions a priori de type LASSO pour les variances locales.
    Date de diffusion : 2025-12-23
Revues et périodiques (21)

Revues et périodiques (21) (0 to 10 of 21 results)

  • Tableau : 57-003-X
    Description : Cette publication présente des définitions, des notes explicatives, la méthodologie et les coefficients de conversion énergétique pour le Bulletin sur la disponibilité et l'écoulement de l'énergie au Canada.
    Date de diffusion : 2025-11-13

  • Revues et périodiques : 45-26-0001
    Description : La Stratégie ministérielle de développement durable (SMDD) décrit les actions ministérielles, avec des indicateurs de performance mesurables, qui soutiennent les stratégies de mise en œuvre de la Stratégie fédérale de développement durable 2022-2026. La SMDD décrit également la vision de Statistique Canada en matière de développement durable, qui consiste à produire des données permettant de déterminer si le Canada évolue vers un avenir plus durable, et met en évidence les projets liés aux objectifs de développement durable.
    Date de diffusion : 2025-10-31

  • Revues et périodiques : 11-631-X
    Description : Statistique Canada prépare régulièrement des présentations à l’aide de résultats statistiques concernant l’économie, la société et l’environnement du pays. Ces présentations peuvent être élaborées dans le cadre de conférences, de réunions avec des intervenants ou d’autres événements tenus durant l’année pour permettre à l’organisme de promouvoir le rôle des statistiques officielles et de mieux comprendre les besoins des utilisateurs de données. Cette série offre un accès en ligne à ces présentations, ainsi qu’à de nouvelles, créées pour favoriser la diffusion à un large public des résultats de recherche sur un vaste éventail de sujets.
    Date de diffusion : 2025-10-27

  • Revues et périodiques : 81-599-X
    Géographie : Canada
    Description : Les feuillets d'information dans cette série fournissent un aperçu des aspects particuliers de l'éducation au Canada et résument les tendances principales des données dans certains tableaux publiés dans le cadre du Programme d'indicateurs pancanadiens de l'éducation (PIPCE).

    La mission du PIPCE est de publier un ensemble de mesures statistiques sur les systèmes d'éducation au Canada à l'intention des responsables de l'élaboration des politiques, des praticiennes et praticiens et du grand public. Le but est de suivre la performance des systèmes d'éducation dans l'ensemble des provinces et territoires, et dans le temps. Le PIPCE est un effort conjoint de Statistique Canada et du Conseil des ministres de l'Éducation (Canada) (CMEC).

    Date de diffusion : 2025-10-24

  • Revues et périodiques : 18-001-X
    Géographie : Canada
    Description : La série de Rapports sur les projets spéciaux sur les entreprises, publiés de façon occasionnelle, traite principalement des résultats d'enquêtes spéciales ou de projets spéciaux menés par le Centre des projets spéciaux sur les entreprises. Les rapports portent sur une vaste gamme de sujets, dont le rendement des entreprises et les tendances commerciales, les totalisations personnalisées de données sur les entreprises, les études sur les répercussions économiques, les nouveaux cadres de mesure et indicateurs visant à appuyer l'élaboration, la surveillance et l'évaluation du rendement de programmes, les indicateurs économiques territoriaux et d'autres études spéciales.
    Date de diffusion : 2025-10-10

  • Revues et périodiques : 12-206-X
    Description : Le présent rapport fait la synthèse des réalisations annuelles du Programme de recherche et développement en méthodologie (PRDM) de la Direction des méthodes statistiques modernes et de la science des données de Statistique Canada. Ce programme comprend les activités de recherche et développement en méthodes statistiques susceptibles d’être appliquées à grande échelle aux programmes statistiques de l’organisme; ce sont des activités qui, autrement, ne s’exerceraient pas complètement dans le cadre des services réguliers de méthodologie offerts à ces programmes. Ajoutons que, dans le but de promouvoir l’utilisation des résultats des travaux de recherche et de développement, le PRDM comporte des activités de soutien pour la mise en application de travaux de développement antérieurs fructueux. Certaines activités de recherche exploratoire sont également rapportées.
    Date de diffusion : 2025-10-10

  • Revues et périodiques : 16-508-X
    Description : Les feuillets d’information de l'environnement contiendront de courts documents d’analyse spécialisés, à thème unique, portant sur des enjeux clés de l’environnement changeant en lien avec la population canadienne. Dans cette série, les analyses porteront notamment sur les sujets suivants : l’air et le climat, la pollution et les déchets, la protection et la qualité de l’environnement, et les ressources naturelles.
    Date de diffusion : 2025-10-02

  • Revues et périodiques : 82-622-X
    Géographie : Canada
    Description : La Série de documents de travail de la recherche sur la santé sert à publier des résultats d'analyse de travaux en cours; de la documentation de référence pour des projets de recherches particuliers (p. ex. des documents sur la méthodologie); des rapports détaillés à l'intention de clients particuliers; et des recueils de tableaux de données. La publication d'un document dans cette série n'empêche pas la publication d'aspects particuliers des travaux dans une revue à comité de lecture.
    Date de diffusion : 2025-10-02

  • Revues et périodiques : 11-522-X
    Description : Depuis 1984, une série de conférences annuelles a été parrainée par Statistique Canada. Le recueil de la conférence est disponible depuis 1987.
    Date de diffusion : 2025-09-08

  • Revues et périodiques : 14-28-0001
    Description : La publication Qualité de l'emploi au Canada de Statistique Canada vise à aider les Canadiens et les organisations canadiennes à mieux comprendre la qualité de l'emploi au moyen d'un cadre statistique soutenu par la communauté internationale. La qualité de l'emploi est traitée comme un concept multidimensionnel se caractérisant par différents éléments et se rapportant de diverses façons aux besoins humains. Pour englober tous les aspects pertinents, le cadre définit sept dimensions et douze sous-dimensions de la qualité de l'emploi.
    Date de diffusion : 2025-08-18