Recherche par mot-clé
Filtrer les résultats par
Search HelpMot(s)-clé(s)
Sujet
- Revenu, pensions, dépenses et richesse (10)
- Santé (1)
- Travail (7)
- Population et démographie (2)
- Méthodes statistiques (76)
- Transport (1)
- Sciences et technologie (3)
- Rendement des entreprises et propriété (1)
- Crime et justice (1)
- Éducation, formation et apprentissage (2)
- Familles, ménages et état matrimonial (2)
- Logement (1)
Type
Année de publication
Enquête ou programme statistique
- Recensement de la population (6)
- Enquête sur les dépenses des ménages (4)
- Enquête nationale auprès des ménages (4)
- Enquête sur la dynamique du travail et du revenu (3)
- Enquête sur le milieu de travail et les employés (2)
- Enquête sur l'innovation (2)
- Programme de déclaration uniforme de la criminalité (1)
- Enquête sociale générale - Famille (1)
- Enquête nationale sur la santé de la population: Volet établissements de soins de santé, longitudinal (1)
Résultats
Tout (88)
Tout (88) (0 to 10 of 88 results)
- Revues et périodiques : 12-206-XDescription : Le présent rapport fait la synthèse des réalisations annuelles du Programme de recherche et développement en méthodologie (PRDM) de la Direction des méthodes statistiques modernes et de la science des données de Statistique Canada. Ce programme comprend les activités de recherche et développement en méthodes statistiques susceptibles d’être appliquées à grande échelle aux programmes statistiques de l’organisme; ce sont des activités qui, autrement, ne s’exerceraient pas complètement dans le cadre des services réguliers de méthodologie offerts à ces programmes. Ajoutons que, dans le but de promouvoir l’utilisation des résultats des travaux de recherche et de développement, le PRDM comporte des activités de soutien pour la mise en application de travaux de développement antérieurs fructueux. Certaines activités de recherche exploratoire sont également rapportées.Date de diffusion : 2025-10-10
- Articles et rapports : 11-522-X202500100034Description : Jusqu'à maintenant, les Canadiens n'avaient pas accès à des données détaillées sur l'emplacement des ventes du secteur de la fabrication. Grâce à l'intégration des données de l'enquête annuelle (Enquête annuelle sur les industries manufacturières et de l'exploitation forestière), un tableau de l'emplacement des ventes selon l'industrie et la province d'origine a été élaboré au profit des enquêtes annuelles et mensuelles sur les industries manufacturières à Statistique Canada. Bien qu'il ne s'agisse pas d'une question de l'enquête mensuelle, les répondants à l'enquête annuelle sont priés d'indiquer leur répartition des ventes en pourcentage dans 15 emplacements. Pour aborder la difficulté de générer une répartition au niveau de l'établissement des répondants œuvrant dans plusieurs provinces, trois approches ont été comparées : utiliser la répartition totale des répondants pour tous leurs établissements; viser l'optimisation; et utiliser les répartitions des répondants d'une seule province. La répartition imputée des ventes selon l'emplacement à partir des données annuelles a ensuite été appliquée à la valeur des ventes mensuelles. Les établissements mensuels non couplés aux répondants annuels ont été imputés à l'aide d'une stratégie comportant la répartition agrégée de leur groupe industrie-province dans l'enquête annuelle. Enfin, on a réussi à produire, dans le cadre de l'enquête mensuelle, des estimations ponctuelles et une variance d'échantillonnage (ainsi qu'un coefficient de variation) pour tout le tableau des ventes selon les emplacements d'origine et de destination, ainsi que pour chaque industrie. Le présent exposé aborde les défis liés à l'imputation des ventes selon l'emplacement (particulièrement en ce qui concerne les répondants ayant des établissements dans plusieurs provinces). L'objectif est d'assurer que les ventes correspondent aux totaux marginaux des provinces d'origine et de répartir les emplacements en fonction des données tirées du programme annuel aux estimations mensuelles.Date de diffusion : 2025-09-08
- Articles et rapports : 11-522-X202500100035Description : Par le passé, le processus de vérification et d'imputation du Recensement de la population au Canada se déroulait à l'aide d'une méthodologie d'imputation par le plus proche voisin, selon laquelle la distance entre une unité rejetée et un donneur potentiel est obtenue au moyen d'une combinaison pondérée de variables auxiliaires. La révision du modèle entre les cycles peut être un processus compliqué et long, étant donné qu'il n'existe pas d'approche normalisée pour la sélection des variables et la pondération entre les sujets. La présente étude illustre la possibilité pour l'algorithme de sélection des variables Relief de créer une approche de sélection et de pondération des variables axée sur l'apprentissage automatique qui est normalisée et comparable entre les cycles de recensement et parmi les nombreux sujets du recensement. Un aperçu de la façon dont ce processus peut être appliqué en pratique sera présenté, suivi des résultats sur plusieurs sujets qui indiquent une amélioration générale par rapport aux méthodes précédentes.Date de diffusion : 2025-09-08
- Articles et rapports : 12-001-X202500100004Description : La collecte de données d’enquête est souvent limitée par une non-réponse totale ou partielle. Pour réduire la dépendance à des hypothèses robustes relatives aux mécanismes d’absence de données, les statisticiens peuvent utiliser des renseignements sur les distributions marginales de population connues, par exemple, découlant de recensements ou de bases de données administratives. Une approche en ce sens est le recours au cadre de données manquantes avec marges auxiliaires, qui repose sur l’imputation multiple à la fois pour la non-réponse totale et la non-réponse partielle, de sorte que les estimations pondérées par les poids d’enquête correspondent aux distributions marginales connues. Toutefois, ce cadre repose sur la spécification et l’estimation d’une distribution conjointe pour les indicateurs de données d’enquête et de non-réponse, ce qui peut présenter des défis du point de vue du calcul et de la pratique pour des données comportant de nombreuses variables de divers types. Nous proposons deux adaptations du cadre de données manquantes avec marges auxiliaires afin de simplifier la tâche d’imputation. Tout d’abord, plutôt que de préciser un modèle conjoint pour les données des unités répondantes, nous avons recours à une imputation hot deck aléatoire tout en utilisant toujours les distributions marginales connues. Ensuite, plutôt qu’un échantillonnage à partir de distributions conditionnelles découlant du modèle conjoint pour les données manquantes dues à une non-réponse partielle, nous appliquons une imputation multiple par équations en séries pour la non-réponse partielle avant une imputation pour la non-réponse totale. À l’aide d’études par simulations avec des mécanismes de données manquantes non ignorables, nous démontrons que la démarche proposée peut fournir des estimations ponctuelles et par intervalle plus exactes que des modèles ne tirant pas profit de l’information auxiliaire. Nous illustrons cette démarche à l’aide de données relatives à la participation électorale tirée de la Current Population Survey des États-Unis.Date de diffusion : 2025-06-30
- Articles et rapports : 12-001-X202500100013Description : Cette discussion de l’article de Rao et Lohr se concentre sur l’utilisation de procédures d’apprentissage automatique pour estimer les paramètres d’une population finie. Bien que ces méthodes suscitent un intérêt croissant au sein des instituts nationaux de statistique, plusieurs domaines restent largement inexplorés et devront recevoir une attention particulière dans les années à venir. Dans cette discussion, je souligne les sujets potentiels pour des travaux de recherche et développement futurs dans ce domaine en évolution rapide.Date de diffusion : 2025-06-30
- Revues et périodiques : 62F0026MDescription : Cette série fournit de la documentation détaillée sur les problèmes, les concepts, la méthodologie, la qualité des données et d'autres éléments de recherche pertinents liés aux dépenses des ménages tirées de l'Enquête sur les dépenses des ménages, de l'Enquête sur les réparations et les rénovations effectuées par les propriétaires-occupants et de l'Enquête sur les dépenses alimentaires.Date de diffusion : 2025-05-21
- Articles et rapports : 12-001-X202200100008Description :
La méthode d’imputation multiple à classes latentes (IMCL) allie l’imputation multiple à l’analyse de classe latente afin de corriger une classification erronée dans des ensembles de données combinés. De plus, l’IMCL permet de générer un ensemble de données multi-imputé qu’il est possible d’utiliser pour l’estimation directe de différentes statistiques, faisant en sorte que l’incertitude due à une classification erronée soit intégrée au moment d’estimer la variance totale. Dans la présente étude, les auteurs ont examiné la façon dont il est possible d’ajuster la méthode d’IMCL pour l’utiliser à des fins de recensement. Ils ont plus précisément étudié le mode de prise en charge, par la méthode d’IMCL, d’un registre de population fini et complet, la façon dont la méthode permet de corriger simultanément une classification erronée de multiples variables latentes et la façon dont elle permet d’intégrer plusieurs restrictions de vérification. Une étude par simulations montre que la méthode d’IMCL peut habituellement reproduire des fréquences par cellule dans des tableaux à basse et à haute dimensionnalité, comportant de faibles quantités de biais. Il est en outre possible d’estimer adéquatement la variance, même si elle est surestimée lorsque les fréquences par cellule sont moindres.
Date de diffusion : 2022-06-21 - Articles et rapports : 12-001-X202000100006Description :
Dans les enquêtes, les bornes logiques entre variables ou entre vagues d’enquêtes compliquent l’imputation des valeurs manquantes. Nous proposons une nouvelle méthode d’imputation multiple par la régression pour traiter les non-réponses d’enquête avec bornes logiques bilatérales. La méthode d’imputation proposée satisfait automatiquement aux conditions de bornes sans procédure supplémentaire d’acceptation ou de rejet et utilise l’information sur les bornes pour dériver une valeur imputée et déterminer la pertinence de la valeur imputée. Les résultats de la simulation montrent que notre nouvelle méthode d’imputation surpasse les méthodes d’imputation actuelles pour les estimations de la moyenne et des quantiles, quels que soient les taux de valeurs manquantes, les distributions d’erreurs et les mécanismes de valeurs manquantes. Nous appliquons notre méthode pour imputer la variable du « nombre d’années de tabagisme » autodéclaré dans les dépistages médicaux successifs de la population coréenne.
Date de diffusion : 2020-06-30 - Enquêtes et programmes statistiques — Documentation : 12-539-XDescription :
Ce document réunit des lignes directrices et des listes de contrôles liées à de nombreuses questions dont on doit tenir compte dans la poursuite des objectifs de qualité que sous-tend l'exécution des activités statistiques. Le document s'attarde principalement à la façon d'assurer la qualité grâce à la conception ou à la restructuration efficace et adéquate d'un projet ou d'un programme statistique, des débuts jusqu'à l'évaluation, la diffusion et la documentation des données. Ces lignes directrices sont fondées sur les connaissances et l'expérience collective d'un grand nombre d'employés de Statistique Canada. On espère que les Lignes directrices concernant la qualité seront utiles au personnel chargé de la planification et de la conception des enquêtes et d'autres projets statistiques, ainsi qu'à ceux qui évaluent et analysent les résultats de ces projets.
Date de diffusion : 2019-12-04 - 10. Comment décomposer la variance due à la non-réponse : une méthode fondée sur l’erreur d’enquête totale ArchivéArticles et rapports : 12-001-X201800254957Description :
Lorsqu’une méthode d’imputation linéaire est utilisée pour corriger la non-réponse, et sous certaines hypothèses, on peut attribuer au niveau des unités non-répondantes la variance totale. L’imputation linéaire n’est pas aussi restrictive qu’il n’y paraît car les méthodes les plus populaires comme l’imputation par ratio; donneur; moyenne et valeur auxiliaire sont toutes des méthodes d’imputation linéaires. Le cadre théorique ainsi que l’expression donnant la décomposition de la variance due à la non-réponse au niveau de l’unité seront présentés. Des résultats par simulation seront aussi présentés. Cette décomposition peut être utilisée pour prioriser le suivi de non-réponse, prioriser les corrections manuelles ou simplement orienter l’analyse des données.
Date de diffusion : 2018-12-20
- Précédent Go to previous page of Tout results
- 1 (actuel) Go to page 1 of Tout results
- 2 Go to page 2 of Tout results
- 3 Go to page 3 of Tout results
- 4 Go to page 4 of Tout results
- 5 Go to page 5 of Tout results
- 6 Go to page 6 of Tout results
- 7 Go to page 7 of Tout results
- 8 Go to page 8 of Tout results
- 9 Go to page 9 of Tout results
- Suivant Go to next page of Tout results
Données (2)
Données (2) ((2 results))
- Microdonnées à grande diffusion : 82M0010XDescription :
L'Enquête nationale sur la santé de la population (ENSP) vise à recueillir de l'information sur la santé de la population canadienne. Le premier cycle de collecte de données a débuté en 1994. La composante des établissements de soins de santé vise les résidents à long terme (plus de six mois) d'établissements de soins comportant quatre lits ou plus à travers le Canada , à l'exclusion du Yukon et des Territoires du Nord-Ouest. Le document a pour but de faciliter la manipulation du fichier de microdonnées 1996-1997 qui comprend les résultats de l'enquête. Les principales variables comprennent : démographie, état de santé, conditions chroniques, limitation d'activités, socio-demographie, et autres.
Date de diffusion : 2000-08-02 - 2. Enquête sociale générale, cycle 10 : la famille (1995) - Fichier de microdonnées à grande diffusion ArchivéMicrodonnées à grande diffusion : 12M0010XDescription :
Le cycle 10 a permis de recueillir des données auprès de personnes âgées de 15 ans et plus et mettait l'accent sur la famille. Au nombre des divers sujets traités, on compte les antécédents matrimoniaux, les unions libres, les enfants biologiques et adoptés et les enfants d'unions antérieures, l'origine familiale, le départ des enfants et les intentions de fécondité.
La population cible de l'ESG (Enquête sociale générale) se composait de toutes les personnes de 15 ans et plus vivant dans un ménage privé dans l'une des dix provinces.
Date de diffusion : 1997-02-28
Analyses (62)
Analyses (62) (0 to 10 of 62 results)
- Revues et périodiques : 12-206-XDescription : Le présent rapport fait la synthèse des réalisations annuelles du Programme de recherche et développement en méthodologie (PRDM) de la Direction des méthodes statistiques modernes et de la science des données de Statistique Canada. Ce programme comprend les activités de recherche et développement en méthodes statistiques susceptibles d’être appliquées à grande échelle aux programmes statistiques de l’organisme; ce sont des activités qui, autrement, ne s’exerceraient pas complètement dans le cadre des services réguliers de méthodologie offerts à ces programmes. Ajoutons que, dans le but de promouvoir l’utilisation des résultats des travaux de recherche et de développement, le PRDM comporte des activités de soutien pour la mise en application de travaux de développement antérieurs fructueux. Certaines activités de recherche exploratoire sont également rapportées.Date de diffusion : 2025-10-10
- Articles et rapports : 11-522-X202500100034Description : Jusqu'à maintenant, les Canadiens n'avaient pas accès à des données détaillées sur l'emplacement des ventes du secteur de la fabrication. Grâce à l'intégration des données de l'enquête annuelle (Enquête annuelle sur les industries manufacturières et de l'exploitation forestière), un tableau de l'emplacement des ventes selon l'industrie et la province d'origine a été élaboré au profit des enquêtes annuelles et mensuelles sur les industries manufacturières à Statistique Canada. Bien qu'il ne s'agisse pas d'une question de l'enquête mensuelle, les répondants à l'enquête annuelle sont priés d'indiquer leur répartition des ventes en pourcentage dans 15 emplacements. Pour aborder la difficulté de générer une répartition au niveau de l'établissement des répondants œuvrant dans plusieurs provinces, trois approches ont été comparées : utiliser la répartition totale des répondants pour tous leurs établissements; viser l'optimisation; et utiliser les répartitions des répondants d'une seule province. La répartition imputée des ventes selon l'emplacement à partir des données annuelles a ensuite été appliquée à la valeur des ventes mensuelles. Les établissements mensuels non couplés aux répondants annuels ont été imputés à l'aide d'une stratégie comportant la répartition agrégée de leur groupe industrie-province dans l'enquête annuelle. Enfin, on a réussi à produire, dans le cadre de l'enquête mensuelle, des estimations ponctuelles et une variance d'échantillonnage (ainsi qu'un coefficient de variation) pour tout le tableau des ventes selon les emplacements d'origine et de destination, ainsi que pour chaque industrie. Le présent exposé aborde les défis liés à l'imputation des ventes selon l'emplacement (particulièrement en ce qui concerne les répondants ayant des établissements dans plusieurs provinces). L'objectif est d'assurer que les ventes correspondent aux totaux marginaux des provinces d'origine et de répartir les emplacements en fonction des données tirées du programme annuel aux estimations mensuelles.Date de diffusion : 2025-09-08
- Articles et rapports : 11-522-X202500100035Description : Par le passé, le processus de vérification et d'imputation du Recensement de la population au Canada se déroulait à l'aide d'une méthodologie d'imputation par le plus proche voisin, selon laquelle la distance entre une unité rejetée et un donneur potentiel est obtenue au moyen d'une combinaison pondérée de variables auxiliaires. La révision du modèle entre les cycles peut être un processus compliqué et long, étant donné qu'il n'existe pas d'approche normalisée pour la sélection des variables et la pondération entre les sujets. La présente étude illustre la possibilité pour l'algorithme de sélection des variables Relief de créer une approche de sélection et de pondération des variables axée sur l'apprentissage automatique qui est normalisée et comparable entre les cycles de recensement et parmi les nombreux sujets du recensement. Un aperçu de la façon dont ce processus peut être appliqué en pratique sera présenté, suivi des résultats sur plusieurs sujets qui indiquent une amélioration générale par rapport aux méthodes précédentes.Date de diffusion : 2025-09-08
- Articles et rapports : 12-001-X202500100004Description : La collecte de données d’enquête est souvent limitée par une non-réponse totale ou partielle. Pour réduire la dépendance à des hypothèses robustes relatives aux mécanismes d’absence de données, les statisticiens peuvent utiliser des renseignements sur les distributions marginales de population connues, par exemple, découlant de recensements ou de bases de données administratives. Une approche en ce sens est le recours au cadre de données manquantes avec marges auxiliaires, qui repose sur l’imputation multiple à la fois pour la non-réponse totale et la non-réponse partielle, de sorte que les estimations pondérées par les poids d’enquête correspondent aux distributions marginales connues. Toutefois, ce cadre repose sur la spécification et l’estimation d’une distribution conjointe pour les indicateurs de données d’enquête et de non-réponse, ce qui peut présenter des défis du point de vue du calcul et de la pratique pour des données comportant de nombreuses variables de divers types. Nous proposons deux adaptations du cadre de données manquantes avec marges auxiliaires afin de simplifier la tâche d’imputation. Tout d’abord, plutôt que de préciser un modèle conjoint pour les données des unités répondantes, nous avons recours à une imputation hot deck aléatoire tout en utilisant toujours les distributions marginales connues. Ensuite, plutôt qu’un échantillonnage à partir de distributions conditionnelles découlant du modèle conjoint pour les données manquantes dues à une non-réponse partielle, nous appliquons une imputation multiple par équations en séries pour la non-réponse partielle avant une imputation pour la non-réponse totale. À l’aide d’études par simulations avec des mécanismes de données manquantes non ignorables, nous démontrons que la démarche proposée peut fournir des estimations ponctuelles et par intervalle plus exactes que des modèles ne tirant pas profit de l’information auxiliaire. Nous illustrons cette démarche à l’aide de données relatives à la participation électorale tirée de la Current Population Survey des États-Unis.Date de diffusion : 2025-06-30
- Articles et rapports : 12-001-X202500100013Description : Cette discussion de l’article de Rao et Lohr se concentre sur l’utilisation de procédures d’apprentissage automatique pour estimer les paramètres d’une population finie. Bien que ces méthodes suscitent un intérêt croissant au sein des instituts nationaux de statistique, plusieurs domaines restent largement inexplorés et devront recevoir une attention particulière dans les années à venir. Dans cette discussion, je souligne les sujets potentiels pour des travaux de recherche et développement futurs dans ce domaine en évolution rapide.Date de diffusion : 2025-06-30
- Revues et périodiques : 62F0026MDescription : Cette série fournit de la documentation détaillée sur les problèmes, les concepts, la méthodologie, la qualité des données et d'autres éléments de recherche pertinents liés aux dépenses des ménages tirées de l'Enquête sur les dépenses des ménages, de l'Enquête sur les réparations et les rénovations effectuées par les propriétaires-occupants et de l'Enquête sur les dépenses alimentaires.Date de diffusion : 2025-05-21
- Articles et rapports : 12-001-X202200100008Description :
La méthode d’imputation multiple à classes latentes (IMCL) allie l’imputation multiple à l’analyse de classe latente afin de corriger une classification erronée dans des ensembles de données combinés. De plus, l’IMCL permet de générer un ensemble de données multi-imputé qu’il est possible d’utiliser pour l’estimation directe de différentes statistiques, faisant en sorte que l’incertitude due à une classification erronée soit intégrée au moment d’estimer la variance totale. Dans la présente étude, les auteurs ont examiné la façon dont il est possible d’ajuster la méthode d’IMCL pour l’utiliser à des fins de recensement. Ils ont plus précisément étudié le mode de prise en charge, par la méthode d’IMCL, d’un registre de population fini et complet, la façon dont la méthode permet de corriger simultanément une classification erronée de multiples variables latentes et la façon dont elle permet d’intégrer plusieurs restrictions de vérification. Une étude par simulations montre que la méthode d’IMCL peut habituellement reproduire des fréquences par cellule dans des tableaux à basse et à haute dimensionnalité, comportant de faibles quantités de biais. Il est en outre possible d’estimer adéquatement la variance, même si elle est surestimée lorsque les fréquences par cellule sont moindres.
Date de diffusion : 2022-06-21 - Articles et rapports : 12-001-X202000100006Description :
Dans les enquêtes, les bornes logiques entre variables ou entre vagues d’enquêtes compliquent l’imputation des valeurs manquantes. Nous proposons une nouvelle méthode d’imputation multiple par la régression pour traiter les non-réponses d’enquête avec bornes logiques bilatérales. La méthode d’imputation proposée satisfait automatiquement aux conditions de bornes sans procédure supplémentaire d’acceptation ou de rejet et utilise l’information sur les bornes pour dériver une valeur imputée et déterminer la pertinence de la valeur imputée. Les résultats de la simulation montrent que notre nouvelle méthode d’imputation surpasse les méthodes d’imputation actuelles pour les estimations de la moyenne et des quantiles, quels que soient les taux de valeurs manquantes, les distributions d’erreurs et les mécanismes de valeurs manquantes. Nous appliquons notre méthode pour imputer la variable du « nombre d’années de tabagisme » autodéclaré dans les dépistages médicaux successifs de la population coréenne.
Date de diffusion : 2020-06-30 - Articles et rapports : 12-001-X201800254957Description :
Lorsqu’une méthode d’imputation linéaire est utilisée pour corriger la non-réponse, et sous certaines hypothèses, on peut attribuer au niveau des unités non-répondantes la variance totale. L’imputation linéaire n’est pas aussi restrictive qu’il n’y paraît car les méthodes les plus populaires comme l’imputation par ratio; donneur; moyenne et valeur auxiliaire sont toutes des méthodes d’imputation linéaires. Le cadre théorique ainsi que l’expression donnant la décomposition de la variance due à la non-réponse au niveau de l’unité seront présentés. Des résultats par simulation seront aussi présentés. Cette décomposition peut être utilisée pour prioriser le suivi de non-réponse, prioriser les corrections manuelles ou simplement orienter l’analyse des données.
Date de diffusion : 2018-12-20 - Articles et rapports : 11-633-X2017006Description :
Ce document décrit une méthode d’imputation des codes postaux manquants dans une base de données longitudinale. La base de données Cohorte santé et environnement du Recensement du Canada (CSERCan) de 1991, qui contient des renseignements sur les répondants au questionnaire détaillé du Recensement de 1991, couplée avec les fichiers des déclarations de revenus T1 pour la période allant de 1984 à 2011, est utilisée pour illustrer et valider la méthode. La cohorte contient jusqu’à 28 champs consécutifs de codes postaux de résidences, mais en raison des vides fréquents dans l’historique des codes postaux, les codes postaux manquants doivent être imputés. Pour valider la méthode d’imputation, deux expériences ont été mises au point dans lesquelles 5 % et 10 % de tous les codes postaux issus d’un sous-ensemble comportant des historiques complets ont été effacés de façon aléatoire et imputés.
Date de diffusion : 2017-03-13
- Précédent Go to previous page of Analyses results
- 1 (actuel) Go to page 1 of Analyses results
- 2 Go to page 2 of Analyses results
- 3 Go to page 3 of Analyses results
- 4 Go to page 4 of Analyses results
- 5 Go to page 5 of Analyses results
- 6 Go to page 6 of Analyses results
- 7 Go to page 7 of Analyses results
- Suivant Go to next page of Analyses results
Références (24)
Références (24) (10 to 20 of 24 results)
- 11. Profession : rapport technique du Recensement de 2001 (produits de référence, Recensement de 2001) ArchivéEnquêtes et programmes statistiques — Documentation : 92-388-XDescription :
Ce rapport technique présente des renseignements de base sur les concepts et la qualité des données visant à faciliter l'utilisation et l'interprétation des données du recensement sur la profession. Il donne un aperçu des activités de collecte, de codage (selon la Classification nationale des professions pour statistiques de 2001), de contrôle et d'imputation des données sur la profession du recensement de 2001 ainsi qu'une description des changements apportés aux procédures du recensement de 2001 par rapport à celles des recensements précédents. Le rapport fournit également une analyse du degré de qualité des données du recensement de 2001 sur la profession et donne une description des modifications apportées à la Classification type des professions de 1991 utilisée lors des recensements de 1991 et de 1996 en vue d'établir la Classification nationale des professions pour statistiques de 2001 (CNP-S 2001), utilisée pour le recensement de 2001. Le rapport traite également de la comparabilité dans le temps des données codées selon ces deux classifications. Les annexes renferment un tableau présentant les données chronologiques des recensements de 1991, 1996 et 2001.
Date de diffusion : 2004-07-15 - Enquêtes et programmes statistiques — Documentation : 62F0026M2002001Description :
Ce rapport présente les indicateurs de qualité produits pour l'Enquête sur les dépenses des ménages de 2000. On y trouve les indicateurs de qualité habituels qui peuvent aider les utilisateurs à interpréter les données, tels que les coefficients de variation, les taux de non-réponse, les taux de glissement et les taux d'imputation.
Date de diffusion : 2002-06-28 - Enquêtes et programmes statistiques — Documentation : 62F0026M2001001Description :
Ce document présente les indicateurs de qualité produits pour l'enquête sur les dépenses des ménages de 1998. On y trouve les indicateurs de qualité usuels utiles aux utilisateurs pour l'interprétation des données tel que les coefficients de variation, les taux de non-réponse, les taux d'imputation et l'impact des données imputées sur les estimations. On y a également ajouté certains indicateurs moins fréquemment utilisés comme les taux de glissement et des mesures de la représentativité de l'échantillon pour certaines caractéristiques qui permettent d'évaluer la méthodologie de l'enquête.
Date de diffusion : 2001-10-15 - Enquêtes et programmes statistiques — Documentation : 62F0026M2001002Description :
Ce document présente les indicateurs de qualité produits pour l'enquête sur les dépenses des ménages de 1999. On y trouve les indicateurs de qualité usuels utiles aux utilisateurs pour l'interprétation des données tel que les coefficients de variation, les taux de non-réponse, les taux d'imputation et l'impact des données imputées sur les estimations. On y a également ajouté certains indicateurs moins fréquemment utilisés comme les taux de glissement et des mesures de la représentativité de l'échantillon pour certaines caractéristiques qui permettent d'évaluer la méthodologie de l'enquête.
Date de diffusion : 2001-10-15 - Enquêtes et programmes statistiques — Documentation : 62F0026M2001003Description :
L'objectif de ce document est de fournir une description détaillée de la méthodologie de l'Enquête sur les dépenses des ménages. Les sujets traités incluent: la population cible; le plan d'échantillonnage; la collecte des données; le traitement des données; la pondération et l'estimation; l'estimation de l'erreur d'échantillonnage; et la suppression des données et la confidentialité.
Date de diffusion : 2001-10-15 - Enquêtes et programmes statistiques — Documentation : 75F0002M2000010Description :
Dans ce rapport, on explique le concept de revenu et on définit les diverses sources de revenu, ainsi que les variables calculées de revenu. On y présente, en outre, de l'information sur les nombreux aspects du recensement susceptibles d'influer sur les estimations de revenu du recensement.
Date de diffusion : 2000-07-26 - Enquêtes et programmes statistiques — Documentation : 11-522-X19990015638Description :
Le symposium de 1999 porte sur les techniques et les méthodes servant à combiner des données de sources différentes et sur l'analyse des ensembles de données qui en résultent. Dans le cadre de la présente communication, nous montrons qu'il est utile d'adopter une telle approche d'intégration pour s'attaquer à un problème statistique complexe. Le problème en soi se décrit facilement - il s'agit de la façon de se rapprocher le plus possible d'un recensement parfait et surtout de la façon d'obtenir des dénombrements de recensement qui soient complets. De façon générale, le sous-dénombrement est évalué dans le cadre d'une enquête post-censitaire (EPC) menée après le recensement. Au Royaume-Uni en 1991, l'EPC n'a pas réussi à cerner entièrement le sous-dénombrement, ce qui fait que l'on a dû se servir de méthodes démographiques pour évaluer l'étendue du sous-dénombrement. Les problèmes que l'approche conventionnelle de l'EPC a posés en 1991 ont donné lieu à un projet de recherche conjoint entre l'Office for National Statistics et le département de la statistique sociale de l'University of Southampton qui visait à élaborer une méthode qui permette de mener un recensement avec résultats finals au Royaume-Uni en 2001. Autrement dit, le sous-dénombrement sera pris en compte non seulement aux niveaux supérieurs de totalisation, mais aussi aux niveaux inférieurs auxquels les tableaux de recensement sont produits. Ainsi, tous les résultats de recensement seront cohérents à l'interne et leurs totalisations seront cohérentes avec les estimations nationales de la population. Cette méthode s'appuie sur l'intégration de renseignements tirés d'un certain nombre de sources de données en vue de constituer le recensement avec résultats finals.
Date de diffusion : 2000-03-02 - 18. Modélisation des carrières au sein de la population active pour le modèle de simulation « lifepaths » ArchivéEnquêtes et programmes statistiques — Documentation : 11-522-X19990015648Description :
On estime les paramètres d'un modèle stochastique des carrières au sein de la population active tenant compte de la répartition des périodes corrélées d'emploi, de chômage (avec et sans recherche d'emploi) et de non appartenance à la population active. Aucune source unique de données n'est complètement satisfaisante si l'on veut que le modèle refléte les tendances infra-annuelles de l'emploi, ainsi que la progression vers l'âge de la retraite. Par contre, on peut calculer une approximation d'après plusieurs sources de données distinctes.
Date de diffusion : 2000-03-02 - 19. Une évaluation de méthodes de fusion de données ArchivéEnquêtes et programmes statistiques — Documentation : 11-522-X19990015666Description :
L'échantillon de fusion obtenu par un procédé d'appariement statistique peut être considéré comme un échantillon tiré d'une population artificielle. Nous dérivons la distribution de cette population artificielle. Si la corrélation entre des variables spécifiques est le seul point d'intérêt, l'importance de l'indépendance conditionnelle peut être réduite. Dans une étude de simulation, nous examinons les effets de la non-confirmation de certaines hypothèses formulées pour obtenir la distribution de la population artificielle. Enfin, nous présentons des idées au sujet de l'établissement de la supposée indépendance conditionnelle par l'analyse de classes latentes.
Date de diffusion : 2000-03-02 - Enquêtes et programmes statistiques — Documentation : 11-522-X19990015668Description :
À la suite des problèmes d'estimation du sous-dénombrement qu'a posé le Recensement de l'Angleterre et du Pays de Galles de 1991, on s'est fixé comme objectif pour le Recensement de 2001 de créer une base de données entièrement corrigée pour tenir compte du sous-dénombrement net. Dans la présente communication, on examine l'application d'une méthode d'imputation pondérée par donneur qui se fonde sur des renseignements provenant tant du recensement que de l'Enquête sur la couverture du recensement (ECR). Le US Census Bureau envisage une approche similaire pour le Recensement des États-Unis de l'an 2000 (voir Isaki et coll. 1998). La méthode proposée fait la distinction entre les personnes qui ne sont pas dénombrées lors du recensement parce qu'on a manqué leur ménage et celles qui ne sont pas dénombrées dans les ménages qui ont été recensés. Les données de recensement sont couplées aux données de l'ECR. On utilise la régression logistique multinominale pour estimer la probabilité que des ménages soient omis dans le recensement, ainsi que la probabilité que des personnes ne soient pas dénombrées au sein de ménages recensés. On calcule des poids de couverture pour les ménages et pour les personnes d'après les probabilités estimatives, puis on les inègre à la méthode d'imputation par donneur.
Date de diffusion : 2000-03-02