Filtrer les résultats par

Search Help
Currently selected filters that can be removed

Mot(s)-clé(s)

Année de publication

1 facets displayed. 1 facets selected.

Enquête ou programme statistique

104 facets displayed. 0 facets selected.

Contenu

1 facets displayed. 0 facets selected.
Aide à l'ordre
entrées

Résultats

Tout (386)

Tout (386) (0 to 10 of 386 results)

  • Articles et rapports : 12-001-X202400200001
    Description : La règle de Cochran stipule qu’un intervalle de confiance (de Wald) à 95 % bilatéral standard autour de la moyenne d’un échantillon tiré d’une population présentant une asymétrie positive est raisonnable lorsque la taille de l’échantillon est supérieure à 25 fois le carré du coefficient d’asymétrie de la population. Nous examinons si une variante de cette règle brute s’applique à une proportion estimée à partir d’un échantillon aléatoire simple stratifié.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200002
    Description : Le présent article porte sur la possibilité que la qualité des données d’enquête fluctue au fil de la journée. Après avoir exposé l’argument sur le plan théorique, les données recueillies au moyen d’un panel du Survey of Unemployed Workers in New Jersey (enquête sur les chômeurs au New Jersey) sont analysées. Plusieurs indicateurs indirects de l’erreur de réponse sont examinés, notamment la non-réponse partielle, la durée des interviews, l’arrondissement et les mesures de la qualité des données du journal sur l’emploi du temps. Les données probantes que nous avons rassemblées pour l’effet de l’heure de la journée sur les interviews sont fiables ou inexistantes. La non-réponse partielle et la probabilité que la durée des interviews fasse partie des 5 % des durées les plus courtes semblent augmenter en soirée, mais une évaluation plus détaillée demande de recourir à des variables instrumentales.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200003
    Description : La répartition optimale de l’échantillon dans le cadre d’un échantillonnage stratifié est l’une des questions fondamentales des techniques d’enquête. Il s’agit d’une procédure consistant à diviser la taille globale de l’échantillon en strates de telle sorte que, pour des plans d’échantillonnage donnés dans les strates, la variance de l’estimateur stratifié /pi du total (ou de la moyenne) de la population pour une variable à l’étude donnée atteigne son minimum. Dans le présent travail, nous considérons la répartition optimale d’un échantillon, sous des bornes inférieures et supérieures imposées conjointement sur les tailles d’échantillon dans les strates. Nous nous intéressons à la fonction de variance d’une forme générique qui, en particulier, couvre le cas de l’échantillonnage aléatoire simple sans remise dans les strates. L’objectif du présent document est double. Tout d’abord, nous établissons (à l’aide des conditions de Karush-Kuhn-Tucker) une forme générique de la solution optimale, appelée « conditions d’optimalité ». Ensuite, sur la base des conditions d’optimalité établies, nous dérivons un algorithme récursif efficace, appelé « RNABOX », qui résout le problème de répartition étudié. Le RNABOX peut être considéré comme une généralisation de l’algorithme récursif classique de répartition de Neyman, un outil populaire pour la répartition optimale lorsque seules des bornes supérieures sont imposées à la taille des strates d’échantillonnage. Nous mettons en œuvre le RNABOX dans R dans le cadre de notre paquet stratallo qui est disponible dans le dépôt Comprehensive R Archive Network (CRAN).
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200004
    Description : Tout en évitant de préciser la relation paramétrique entre la variable d’étude et les covariables, nous illustrons l’avantage d’inclure une composante spatiale pour mieux tenir compte des covariables dans nos modèles en vue de faire une inférence prédictive bayésienne. Nous traitons chaque combinaison unique de covariables comme une strate individuelle, puis nous utilisons les techniques d’estimation sur petits domaines pour faire une inférence à propos de la population moyenne finie de la variable de réponse continue. Les deux modèles spatiaux utilisés sont le modèle d’autorégression conditionnel et le modèle d’autorégression conditionnelle simple. Nous incluons les effets spatiaux en créant la matrice d’adjacence à partir de la distance de Mahalanobis entre les covariables. Nous démontrons également la façon d’incorporer les poids d’enquête dans les modèles spatiaux en cas de données d’enquête probabiliste. Nous comparons les résultats des deux modèles non spatiaux, à savoir le modèle Scott-Smith et le modèle Battese, Harter et Fuller, aux modèles spatiaux. Nous illustrons la comparaison entre les deux modèles mentionnés et une application au moyen des données sur l’indice de masse corporelle de huit comtés en Californie. Notre but est d’obtenir des strates voisines donnant des prédictions similaires et d’augmenter la différence entre les strates qui ne sont pas voisines. Finalement, l’utilisation des modèles spatiaux montre un regroupement global moindre par rapport aux modèles non spatiaux, ce qui correspond au résultat souhaité.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200005
    Description : Les plans d’enquête adaptatifs (PEA) permettent d’adapter les protocoles de recrutement aux sous-groupes de population qui présentent un intérêt pour une enquête. Ces dernières années, l’optimisation efficace d’un PEA a fait l’objet de recherches et de plusieurs applications. Toutefois, le rendement d’un PEA optimisé au fil du temps réagit aux variations temporelles des propensions à répondre. On ne comprend pas encore entièrement la façon dont les stratégies d’adaptation peuvent s’adapter à une telle variation au fil du temps. Dans la présente étude, nous proposons une approche d’optimisation robuste dans le contexte d’enquêtes séquentielles multimodales à l’aide d’une analyse bayésienne. Cette approche s’exprime sous la forme d’un problème de programmation mathématique qui tient explicitement compte de l’incertitude attribuable à la variation temporelle. Des décisions en matière de PEA peuvent alors être prises en tenant compte de la variation chronologique de la propension à répondre conditionnelle au mode et des corrélations de la propension à répondre entre les modes. La démonstration de cette approche fait appel à une étude de cas : l’Enquête sur la santé aux Pays-Bas de 2014 à 2017. Nous évaluons la sensibilité du rendement des PEA 1) au niveau budgétaire et 2) à la durée des données de série chronologique historiques applicables. Nous concluons que la dépendance au niveau budgétaire n’est que modérée et que la dépendance aux données historiques est tempérée par le degré de saisonnalité au cours de l’année.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200006
    Description : À mesure que les plans de sondage à mode mixte deviennent de plus en plus populaires, leurs effets sur la qualité des données ont attiré l’attention de plusieurs chercheurs. La plupart des études se sont concentrées sur les propriétés de biais des plans de sondage à mode mixte; peu d’entre elles ont cherché à savoir si les plans de sondage à mode mixte ont des structures de variance hétérogènes entre les modes. Bien que de nombreuses caractéristiques des plans de sondage à mode mixte, comme l’utilisation d’intervieweurs variés, les différences systématiques entre les répondants, les différents niveaux de biais dû à la désirabilité sociale, entre autres, peuvent conduire à des variances hétérogènes dans les estimations ponctuelles des moyennes de population propre à un mode, la présente étude permet d’examiner précisément si les variances de l’intervieweur demeurent cohérentes entre les différents modes dans les études multimodales. Pour répondre à cette question de recherche, nous utilisons les données recueillies grâce à deux modèles d’études distincts. Dans le premier modèle, lorsque les intervieweurs sont responsables soit du mode face à face, soit du mode téléphonique, nous examinons s’il y a des différences de mode dans les variances de l’intervieweur pour : 1) les questions politiques de nature délicate; 2) les éléments internationaux; 3) les indicateurs d’éléments manquants sur des éléments internationaux, grâce aux données sur la Jordanie de la vague 6 de l’Arab Barometer. Dans le deuxième modèle, nous nous appuyons sur les données de base de la Health and Retirement Study (HRS) de 2016 pour examiner la question sur trois sujets lorsque les intervieweurs sont responsables des deux modes. Les sujets traités comprennent : 1) l’échelle d’évaluation de la dépression du Center for Epidemiological Studies-Depression (CES-D); 2) les observations des intervieweurs; 3) l’échelle d’activité physique. Pour tenir compte du manque de plans de sondage interpénétrés dans les deux sources de données, nous incluons des covariables au niveau du répondant dans nos modèles. Nous constatons des différences importantes dans les variances de l’intervieweur sur un élément (12 éléments au total) dans l’enquête de l’Arab Barometer, alors que pour la HRS, les résultats sont de 3 sur 18. Dans l’ensemble, nous constatons que l’ampleur des variances de l’intervieweur est plus grande en personne que par téléphone pour les éléments de nature délicate. Nous effectuons des simulations pour comprendre le pouvoir de détecter les effets du mode d’enquête dans les tailles d’échantillons typiquement modestes de l’intervieweur.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200007
    Description : Il est possible d’appliquer la méthode de capture-recapture pour mesurer la couverture des sources de données administratives et de mégadonnées dans les statistiques officielles. Dans sa forme de base, elle comporte le couplage de deux sources tout en supposant un couplage parfait et d’autres hypothèses types. En pratique, des erreurs de couplage surviennent et constituent une source potentielle de biais quand le couplage est fondé sur des quasi-identificateurs. Ces erreurs comprennent des faux positifs et des faux négatifs, où les premiers se produisent quand un lien est établi entre des enregistrements provenant de différentes unités, et les deuxièmes surviennent lorsqu’il n’y a pas de lien entre des enregistrements provenant de la même unité. Jusqu’à présent, les solutions trouvées ont reposé sur des vérifications manuelles coûteuses ou ont posé l’hypothèse restrictive de l’indépendance conditionnelle. Dans le présent article, on assouplit ces exigences en modélisant plutôt le nombre de liens à partir d’un enregistrement. Cette méthode peut aussi être adoptée pour estimer l’exactitude du couplage sans vérifications manuelles, quand on lie deux sources ayant chacune de la sous-couverture.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200008
    Description : Lorsqu’ils souhaitent diffuser des fichiers à grande diffusion pour des données confidentielles, les organismes de statistique peuvent générer des données entièrement synthétiques. Nous proposons une méthode pour construire des données entièrement synthétiques à partir d’enquêtes dont les données sont recueillies selon des plans d’échantillonnage complexes. Notre méthode respecte la stratégie générale proposée par Rubin (1993). Plus précisément, nous générons des pseudo-populations en appliquant la méthode du bootstrap bayésien en population finie pondéré pour tenir compte des poids d’enquête, tirons des échantillons aléatoires simples de ces pseudo-populations, estimons des modèles de synthèse en utilisant ces échantillons aléatoires simples et diffusons des données simulées tirées des modèles sous la forme de fichiers à grande diffusion. Pour faciliter l’estimation de la variance, nous utilisons le cadre d’imputation multiple et deux stratégies de génération de données. Dans la première, nous générons plusieurs ensembles de données à partir de chaque échantillon aléatoire simple. Dans la seconde, nous générons un seul ensemble de données synthétiques à partir de chaque échantillon aléatoire simple. Nous présentons des règles de combinaison de l’imputation multiple pour chaque scénario. Nous illustrons les propriétés d’échantillonnage répété des règles de combinaison au moyen d’études par simulations, ce qui comprend des comparaisons avec la génération de données synthétiques en fonction de méthodes de pseudo-vraisemblance. Nous appliquons les méthodes proposées à un sous-ensemble de données tirées de l’American Community Survey.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200009
    Description : De nombreuses études sont aux prises avec un problème de comparaison d’estimations obtenues à l’aide de différentes méthodologies d’enquête, notamment des différences de base de sondage, d’instruments de mesure et de modes d’exécution. L’enjeu se présente dans les enquêtes multimodales et les enquêtes remaniées. Un remaniement majeur des processus d’enquête pourrait avoir une incidence systématique sur les estimations d’enquêtes; il est donc important de quantifier et d’ajuster de telles discontinuités entre les plans de sondage pour assurer la comparabilité des estimations au fil du temps. Nous proposons une approche d’estimation sur petits domaines pour rapprocher deux ensembles d’estimations d’enquête et l’appliquons à deux enquêtes du Marine Recreational Information Program (MRIP), qui surveille la pêche récréative le long des côtes de l’océan Atlantique et du golfe du Mexique aux États-Unis. Nous développons un modèle log-normal pour les estimations issues des deux enquêtes, en tenant compte de la dynamique temporelle par régression sur la taille de la population et les facteurs saisonniers État-par-vague et en tenant partiellement compte des propriétés de couverture changeantes par régression sur la pénétration du téléphone sans fil. À l’aide des variances de plan de sondage estimées, nous développons un modèle de régression qui est analytiquement cohérent avec le modèle de moyenne log-normal. Nous utilisons les variances de plan de sondage modélisées dans une procédure d’estimation sur petits domaines de Fay-Herriot, afin d’obtenir les meilleurs prédicteurs linéaires sans biais empiriques des estimations rapprochées de l’effort de pêche (nécessitant des prédictions pour de nouveaux ensembles de covariables), et de fournir une approximation asymptotiquement valide de l’erreur quadratique moyenne.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200010
    Description : Des travaux récents sur l’estimation des domaines d’enquête ont montré que l’intégration a priori d’hypothèses sur l’ordonnancement des moyennes des domaines de population réduit la variance des estimateurs et fournit des intervalles de confiance plus petits ayant une bonne couverture. Dans le présent document, nous montrons dans quelle mesure les hypothèses d’ordonnancement partiel permettent une estimation fondée sur un modèle des moyennes d’échantillon dans des domaines pour lesquels la taille de l’échantillon est nulle, lorsque les estimations de la variance et les intervalles de confiance sont conservateurs. Les restrictions d’ordre peuvent également améliorer considérablement l’estimation et l’inférence dans les domaines de petite taille. Des exemples de données d’enquêtes bien connues démontrent l’utilité de ces méthodes. Le code permettant de mettre en œuvre les exemples à l’aide du paquet R csurvey est fourni en annexe.
    Date de diffusion : 2024-12-20
Stats en bref (91)

Stats en bref (91) (0 to 10 of 91 results)

  • Stats en bref : 11-627-M2024058
    Description : Cette infographie offre un aperçu de la diversité et des caractéristiques démographiques de la population musulmane au Canada. Fondée sur les données du Recensement de la population de 2001 et de 2021, l’infographie explore des aspects tels que la répartition de la population musulmane par province et territoire et par groupe d’âge, les principaux groupes racisés, les principaux pays de naissance et les principales langues le plus souvent parlées à la maison par la population musulmane au Canada.
    Date de diffusion : 2024-12-16

  • Stats en bref : 11-627-M2024059
    Description : Cette infographie présente les principaux résultats de l’accès aux services dans la langue officielle minoritaire au Canada à partir de l’Enquête sur la population de langue officielle en situation minoritaire de 2022.
    Date de diffusion : 2024-12-16

  • Stats en bref : 11-627-M2024060
    Description : Cette infographie présente les principaux résultats concernant les intentions des parents d'inscrire leurs enfants dans une école de langue officielle minoritaire ou majoritaire, d'après l'Enquête sur la population de langue officielle en situation minoritaire de 2022.
    Date de diffusion : 2024-12-16

  • Stats en bref : 11-627-M2024048
    Description : Fondée sur des données déclarées par la police dans 2023, cette infographie constitue une représentation visuelle de certaines données. Les résultats incluent les résultats au niveau national, provincial et territorial. S'y trouvent également des constatations sur les caractéristiques des victimes ainsi qu'à la fréquence des homicides liés aux gangs et aux armes à feu.
    Date de diffusion : 2024-12-11

  • Stats en bref : 45-20-00032024007
    Description : Les stratégies employées par les personnes malveillantes sont de plus en plus complexes. Rares sont les personnes qui n’ont jamais subi une forme ou une autre de cyberattaque. Nous avons voulu savoir si la cybercriminalité est en hausse au Canada, ce que représente le phénomène relativement nouveau de l’assurance contre les cyberrisques, et la mesure dans laquelle les consommateurs peuvent subir les répercussions d’une atteinte à la sécurité qui touche une entreprise. De nouvelles données de l’Enquête canadienne sur la cybersécurité et le cybercrime ont été diffusées. Dans cet épisode, nous nous sommes entretenus avec Howard Bilodeau, économiste à Statistique Canada, qui a répondu à nos questions sur l’évolution de la cybersécurité pour les entreprises et sur ce que cela signifie pour chacun et chacune d’entre nous.
    Date de diffusion : 2024-12-09

  • Stats en bref : 11-627-M2024057
    Description : Cette infographie examine les taux de pauvreté de différents groupes de femmes âgées (65 ans et plus) au Canada. S'appuyant sur le recensement de la population de 2021, elle examine spécifiquement les taux de pauvreté et de faible revenu de différents groupes de femmes âgées, y compris les immigrantes âgées et les femmes racialisées.
    Date de diffusion : 2024-12-04

  • Stats en bref : 11-627-M2024054
    Description : À l’aide des données de l’Enquête canadienne sur l’incapacité de 2022, cette infographie met en évidence les tendances et les expériences des personnes atteintes de l’incapacités liées à la dextérité. Ce communiqué fait partie d’une série d’infographies qui mettent l’accent sur des types d'incapacité spécifiques.
    Date de diffusion : 2024-12-03

  • Stats en bref : 11-627-M2024055
    Description : À l’aide des données de l’Enquête canadienne sur l’incapacité de 2022, cette infographie met en évidence les tendances et les expériences des personnes atteintes de l’incapacités liées à la flexibilité. Ce communiqué fait partie d’une série d’infographies qui mettent l’accent sur des types d'incapacité spécifiques.
    Date de diffusion : 2024-12-03

  • Stats en bref : 11-627-M2024056
    Description : À l’aide des données de l’Enquête canadienne sur l’incapacité de 2022, cette infographie met en évidence les tendances et les expériences des personnes atteintes de l’incapacités liées à la mobilité. Ce communiqué fait partie d’une série d’infographies qui mettent l’accent sur des types d'incapacité spécifiques.
    Date de diffusion : 2024-12-03

  • Stats en bref : 11-621-M2024016
    Description : Ce article s'appuie sur des données administratives pour examiner la répartition de la main-d'œuvre selon le genre, l'âge, et le statut de travailleur à temps plein de 2015 à 2023 pour les industries arts de la scene, des sports-spectacles et autres industries connexes, et sur celles du divertissement et des loisirs.
    Date de diffusion : 2024-11-28
Articles et rapports (290)

Articles et rapports (290) (0 to 10 of 290 results)

  • Articles et rapports : 12-001-X202400200001
    Description : La règle de Cochran stipule qu’un intervalle de confiance (de Wald) à 95 % bilatéral standard autour de la moyenne d’un échantillon tiré d’une population présentant une asymétrie positive est raisonnable lorsque la taille de l’échantillon est supérieure à 25 fois le carré du coefficient d’asymétrie de la population. Nous examinons si une variante de cette règle brute s’applique à une proportion estimée à partir d’un échantillon aléatoire simple stratifié.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200002
    Description : Le présent article porte sur la possibilité que la qualité des données d’enquête fluctue au fil de la journée. Après avoir exposé l’argument sur le plan théorique, les données recueillies au moyen d’un panel du Survey of Unemployed Workers in New Jersey (enquête sur les chômeurs au New Jersey) sont analysées. Plusieurs indicateurs indirects de l’erreur de réponse sont examinés, notamment la non-réponse partielle, la durée des interviews, l’arrondissement et les mesures de la qualité des données du journal sur l’emploi du temps. Les données probantes que nous avons rassemblées pour l’effet de l’heure de la journée sur les interviews sont fiables ou inexistantes. La non-réponse partielle et la probabilité que la durée des interviews fasse partie des 5 % des durées les plus courtes semblent augmenter en soirée, mais une évaluation plus détaillée demande de recourir à des variables instrumentales.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200003
    Description : La répartition optimale de l’échantillon dans le cadre d’un échantillonnage stratifié est l’une des questions fondamentales des techniques d’enquête. Il s’agit d’une procédure consistant à diviser la taille globale de l’échantillon en strates de telle sorte que, pour des plans d’échantillonnage donnés dans les strates, la variance de l’estimateur stratifié /pi du total (ou de la moyenne) de la population pour une variable à l’étude donnée atteigne son minimum. Dans le présent travail, nous considérons la répartition optimale d’un échantillon, sous des bornes inférieures et supérieures imposées conjointement sur les tailles d’échantillon dans les strates. Nous nous intéressons à la fonction de variance d’une forme générique qui, en particulier, couvre le cas de l’échantillonnage aléatoire simple sans remise dans les strates. L’objectif du présent document est double. Tout d’abord, nous établissons (à l’aide des conditions de Karush-Kuhn-Tucker) une forme générique de la solution optimale, appelée « conditions d’optimalité ». Ensuite, sur la base des conditions d’optimalité établies, nous dérivons un algorithme récursif efficace, appelé « RNABOX », qui résout le problème de répartition étudié. Le RNABOX peut être considéré comme une généralisation de l’algorithme récursif classique de répartition de Neyman, un outil populaire pour la répartition optimale lorsque seules des bornes supérieures sont imposées à la taille des strates d’échantillonnage. Nous mettons en œuvre le RNABOX dans R dans le cadre de notre paquet stratallo qui est disponible dans le dépôt Comprehensive R Archive Network (CRAN).
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200004
    Description : Tout en évitant de préciser la relation paramétrique entre la variable d’étude et les covariables, nous illustrons l’avantage d’inclure une composante spatiale pour mieux tenir compte des covariables dans nos modèles en vue de faire une inférence prédictive bayésienne. Nous traitons chaque combinaison unique de covariables comme une strate individuelle, puis nous utilisons les techniques d’estimation sur petits domaines pour faire une inférence à propos de la population moyenne finie de la variable de réponse continue. Les deux modèles spatiaux utilisés sont le modèle d’autorégression conditionnel et le modèle d’autorégression conditionnelle simple. Nous incluons les effets spatiaux en créant la matrice d’adjacence à partir de la distance de Mahalanobis entre les covariables. Nous démontrons également la façon d’incorporer les poids d’enquête dans les modèles spatiaux en cas de données d’enquête probabiliste. Nous comparons les résultats des deux modèles non spatiaux, à savoir le modèle Scott-Smith et le modèle Battese, Harter et Fuller, aux modèles spatiaux. Nous illustrons la comparaison entre les deux modèles mentionnés et une application au moyen des données sur l’indice de masse corporelle de huit comtés en Californie. Notre but est d’obtenir des strates voisines donnant des prédictions similaires et d’augmenter la différence entre les strates qui ne sont pas voisines. Finalement, l’utilisation des modèles spatiaux montre un regroupement global moindre par rapport aux modèles non spatiaux, ce qui correspond au résultat souhaité.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200005
    Description : Les plans d’enquête adaptatifs (PEA) permettent d’adapter les protocoles de recrutement aux sous-groupes de population qui présentent un intérêt pour une enquête. Ces dernières années, l’optimisation efficace d’un PEA a fait l’objet de recherches et de plusieurs applications. Toutefois, le rendement d’un PEA optimisé au fil du temps réagit aux variations temporelles des propensions à répondre. On ne comprend pas encore entièrement la façon dont les stratégies d’adaptation peuvent s’adapter à une telle variation au fil du temps. Dans la présente étude, nous proposons une approche d’optimisation robuste dans le contexte d’enquêtes séquentielles multimodales à l’aide d’une analyse bayésienne. Cette approche s’exprime sous la forme d’un problème de programmation mathématique qui tient explicitement compte de l’incertitude attribuable à la variation temporelle. Des décisions en matière de PEA peuvent alors être prises en tenant compte de la variation chronologique de la propension à répondre conditionnelle au mode et des corrélations de la propension à répondre entre les modes. La démonstration de cette approche fait appel à une étude de cas : l’Enquête sur la santé aux Pays-Bas de 2014 à 2017. Nous évaluons la sensibilité du rendement des PEA 1) au niveau budgétaire et 2) à la durée des données de série chronologique historiques applicables. Nous concluons que la dépendance au niveau budgétaire n’est que modérée et que la dépendance aux données historiques est tempérée par le degré de saisonnalité au cours de l’année.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200006
    Description : À mesure que les plans de sondage à mode mixte deviennent de plus en plus populaires, leurs effets sur la qualité des données ont attiré l’attention de plusieurs chercheurs. La plupart des études se sont concentrées sur les propriétés de biais des plans de sondage à mode mixte; peu d’entre elles ont cherché à savoir si les plans de sondage à mode mixte ont des structures de variance hétérogènes entre les modes. Bien que de nombreuses caractéristiques des plans de sondage à mode mixte, comme l’utilisation d’intervieweurs variés, les différences systématiques entre les répondants, les différents niveaux de biais dû à la désirabilité sociale, entre autres, peuvent conduire à des variances hétérogènes dans les estimations ponctuelles des moyennes de population propre à un mode, la présente étude permet d’examiner précisément si les variances de l’intervieweur demeurent cohérentes entre les différents modes dans les études multimodales. Pour répondre à cette question de recherche, nous utilisons les données recueillies grâce à deux modèles d’études distincts. Dans le premier modèle, lorsque les intervieweurs sont responsables soit du mode face à face, soit du mode téléphonique, nous examinons s’il y a des différences de mode dans les variances de l’intervieweur pour : 1) les questions politiques de nature délicate; 2) les éléments internationaux; 3) les indicateurs d’éléments manquants sur des éléments internationaux, grâce aux données sur la Jordanie de la vague 6 de l’Arab Barometer. Dans le deuxième modèle, nous nous appuyons sur les données de base de la Health and Retirement Study (HRS) de 2016 pour examiner la question sur trois sujets lorsque les intervieweurs sont responsables des deux modes. Les sujets traités comprennent : 1) l’échelle d’évaluation de la dépression du Center for Epidemiological Studies-Depression (CES-D); 2) les observations des intervieweurs; 3) l’échelle d’activité physique. Pour tenir compte du manque de plans de sondage interpénétrés dans les deux sources de données, nous incluons des covariables au niveau du répondant dans nos modèles. Nous constatons des différences importantes dans les variances de l’intervieweur sur un élément (12 éléments au total) dans l’enquête de l’Arab Barometer, alors que pour la HRS, les résultats sont de 3 sur 18. Dans l’ensemble, nous constatons que l’ampleur des variances de l’intervieweur est plus grande en personne que par téléphone pour les éléments de nature délicate. Nous effectuons des simulations pour comprendre le pouvoir de détecter les effets du mode d’enquête dans les tailles d’échantillons typiquement modestes de l’intervieweur.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200007
    Description : Il est possible d’appliquer la méthode de capture-recapture pour mesurer la couverture des sources de données administratives et de mégadonnées dans les statistiques officielles. Dans sa forme de base, elle comporte le couplage de deux sources tout en supposant un couplage parfait et d’autres hypothèses types. En pratique, des erreurs de couplage surviennent et constituent une source potentielle de biais quand le couplage est fondé sur des quasi-identificateurs. Ces erreurs comprennent des faux positifs et des faux négatifs, où les premiers se produisent quand un lien est établi entre des enregistrements provenant de différentes unités, et les deuxièmes surviennent lorsqu’il n’y a pas de lien entre des enregistrements provenant de la même unité. Jusqu’à présent, les solutions trouvées ont reposé sur des vérifications manuelles coûteuses ou ont posé l’hypothèse restrictive de l’indépendance conditionnelle. Dans le présent article, on assouplit ces exigences en modélisant plutôt le nombre de liens à partir d’un enregistrement. Cette méthode peut aussi être adoptée pour estimer l’exactitude du couplage sans vérifications manuelles, quand on lie deux sources ayant chacune de la sous-couverture.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200008
    Description : Lorsqu’ils souhaitent diffuser des fichiers à grande diffusion pour des données confidentielles, les organismes de statistique peuvent générer des données entièrement synthétiques. Nous proposons une méthode pour construire des données entièrement synthétiques à partir d’enquêtes dont les données sont recueillies selon des plans d’échantillonnage complexes. Notre méthode respecte la stratégie générale proposée par Rubin (1993). Plus précisément, nous générons des pseudo-populations en appliquant la méthode du bootstrap bayésien en population finie pondéré pour tenir compte des poids d’enquête, tirons des échantillons aléatoires simples de ces pseudo-populations, estimons des modèles de synthèse en utilisant ces échantillons aléatoires simples et diffusons des données simulées tirées des modèles sous la forme de fichiers à grande diffusion. Pour faciliter l’estimation de la variance, nous utilisons le cadre d’imputation multiple et deux stratégies de génération de données. Dans la première, nous générons plusieurs ensembles de données à partir de chaque échantillon aléatoire simple. Dans la seconde, nous générons un seul ensemble de données synthétiques à partir de chaque échantillon aléatoire simple. Nous présentons des règles de combinaison de l’imputation multiple pour chaque scénario. Nous illustrons les propriétés d’échantillonnage répété des règles de combinaison au moyen d’études par simulations, ce qui comprend des comparaisons avec la génération de données synthétiques en fonction de méthodes de pseudo-vraisemblance. Nous appliquons les méthodes proposées à un sous-ensemble de données tirées de l’American Community Survey.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200009
    Description : De nombreuses études sont aux prises avec un problème de comparaison d’estimations obtenues à l’aide de différentes méthodologies d’enquête, notamment des différences de base de sondage, d’instruments de mesure et de modes d’exécution. L’enjeu se présente dans les enquêtes multimodales et les enquêtes remaniées. Un remaniement majeur des processus d’enquête pourrait avoir une incidence systématique sur les estimations d’enquêtes; il est donc important de quantifier et d’ajuster de telles discontinuités entre les plans de sondage pour assurer la comparabilité des estimations au fil du temps. Nous proposons une approche d’estimation sur petits domaines pour rapprocher deux ensembles d’estimations d’enquête et l’appliquons à deux enquêtes du Marine Recreational Information Program (MRIP), qui surveille la pêche récréative le long des côtes de l’océan Atlantique et du golfe du Mexique aux États-Unis. Nous développons un modèle log-normal pour les estimations issues des deux enquêtes, en tenant compte de la dynamique temporelle par régression sur la taille de la population et les facteurs saisonniers État-par-vague et en tenant partiellement compte des propriétés de couverture changeantes par régression sur la pénétration du téléphone sans fil. À l’aide des variances de plan de sondage estimées, nous développons un modèle de régression qui est analytiquement cohérent avec le modèle de moyenne log-normal. Nous utilisons les variances de plan de sondage modélisées dans une procédure d’estimation sur petits domaines de Fay-Herriot, afin d’obtenir les meilleurs prédicteurs linéaires sans biais empiriques des estimations rapprochées de l’effort de pêche (nécessitant des prédictions pour de nouveaux ensembles de covariables), et de fournir une approximation asymptotiquement valide de l’erreur quadratique moyenne.
    Date de diffusion : 2024-12-20

  • Articles et rapports : 12-001-X202400200010
    Description : Des travaux récents sur l’estimation des domaines d’enquête ont montré que l’intégration a priori d’hypothèses sur l’ordonnancement des moyennes des domaines de population réduit la variance des estimateurs et fournit des intervalles de confiance plus petits ayant une bonne couverture. Dans le présent document, nous montrons dans quelle mesure les hypothèses d’ordonnancement partiel permettent une estimation fondée sur un modèle des moyennes d’échantillon dans des domaines pour lesquels la taille de l’échantillon est nulle, lorsque les estimations de la variance et les intervalles de confiance sont conservateurs. Les restrictions d’ordre peuvent également améliorer considérablement l’estimation et l’inférence dans les domaines de petite taille. Des exemples de données d’enquêtes bien connues démontrent l’utilité de ces méthodes. Le code permettant de mettre en œuvre les exemples à l’aide du paquet R csurvey est fourni en annexe.
    Date de diffusion : 2024-12-20
Revues et périodiques (5)

Revues et périodiques (5) ((5 results))

  • Revues et périodiques : 89-28-0001
    Description : Tableaux de donneés courts et ciblés liés à l’actualité.
    Date de diffusion : 2024-09-25

  • Revues et périodiques : 91-215-X
    Description : Cette publication présente les estimations annuelles de la population totale ainsi que les estimations annuelles de la population selon l'âge et le genre pour le Canada, les provinces et les territoires. Elle présente également les estimations des composantes démographiques suivantes : naissances, décès, immigration, émigration, émigration de retour, solde des résidents non permanents et migration interprovinciale selon la province ou le territoire d'origine et de destination. Tout comme les estimations de la population, ces composantes sont disponibles à la fois pour la population totale ainsi que selon l'âge et le genre.

    La publication Estimations démographiques annuelles - Canada, provinces et territoires contient les estimations les plus récentes ainsi qu'une série historique d'estimations annuelles. De plus, elle contient des faits saillants et une analyse des plus récentes tendances démographiques ainsi qu'une brève description des concepts, méthodes et qualité des estimations.

    Date de diffusion : 2024-09-25

  • Revues et périodiques : 96-325-X
    Géographie : Canada
    Description : Cette publication comprend des articles analytiques courts et à la portée de tous, qui examinent de manière détaillée les principaux résultats et les tendances émergentes observés dans le Recensement de l’agriculture et d’autres sources de données liées à l’agriculture. Les sujets d’analyse comprennent les questions liées aux terres agricoles, aux cultures, au bétail, aux finances agricoles, à la technologie, à l’environnement et à la population agricole, ainsi que d’autres aspects économiques et sociaux de l’industrie agricole canadienne. Les articles analytiques sont rédigés dans un langage clair et simple, et sont destinés à être une source d’information précieuse pour un large public, notamment les analystes politiques, les étudiants, les chercheurs, les exploitants agricoles, les médias et le grand public.
    Date de diffusion : 2024-03-07

  • Revues et périodiques : 75-004-M
    Géographie : Canada
    Description : Les documents de cette série portent sur divers sujets touchant les données sur le travail. Ils ont pour but de montrer les tendances récentes ou historiques observées à partir des enquêtes produites par le Centre d’information sur le marché du travail, soit l'Enquête sur la population active, l'Enquête sur l'emploi, la rémunération et les heures, l’Enquête sur la couverture de l'assurance-emploi, le programme des statistiques de l'assurance-emploi et les diverses données provenant de source administrative. Tous les documents publiés font l'objet d'une révision interne et d'une révision par les pairs. Cette démarche vise à s'assurer que les documents sont conformes au mandat de Statistique Canada à titre d'organisme statistique public et qu'ils adhèrent à des normes généralement reconnues régissant les bonnes méthodes professionnelles.
    Date de diffusion : 2024-03-04

  • Revues et périodiques : 98-200-X
    Description : Ces courts articles analytiques, basés sur les données recueillies lors du Recensement de la population, permettent de jeter un regard sur des sujets d’intérêt précis portant sur la population canadienne. Ils sont offerts pour chacune des diffusions principales du Recensement de la population.
    Date de diffusion : 2024-02-28