Qualité des données, concepts et méthodologie : Méthodologie et qualité des données

Avertissement Consulter la version la plus récente.

Information archivée dans le Web

L’information dont il est indiqué qu’elle est archivée est fournie à des fins de référence, de recherche ou de tenue de documents. Elle n’est pas assujettie aux normes Web du gouvernement du Canada et elle n’a pas été modifiée ou mise à jour depuis son archivage. Pour obtenir cette information dans un autre format, veuillez communiquer avec nous.

Base de sondage et échantillonnage

La population couverte pour l'enquête des stocks à la ferme au 31 décembre représente toutes les exploitations agricoles du Canada énumérées dans le Recensement de l'agriculture sauf les fermes institutionnelles, les fermes des réserves indiennes et les fermes des Territoires du Nord-Ouest, du Yukon et de la région de l'Atlantique.

Chaque cinq ans le Recensement de l'agriculture recueille l'information sur les exploitations agricoles à travers le Canada, incluant les fermes institutionnelles, les pâturages communautaires, les réserves indiennes, etc. Le Recensement de l'agriculture donne une liste des fermes et de leur superficie en culture à partir de laquelle un échantillon probabiliste pour l'enquête sur les stocks à la ferme au 31 décembre a été sélectionné.

Les enquêtes probabilistes peuvent utiliser deux types de bases d'échantillonnage : la base de sondage de type liste et la base aréolaire. Dans l'enquête sur les stocks à la ferme au 31 décembre, seulement la base de sondage de type liste est utilisée pour la sélection de l'échantillon. La base de sondage de type liste est stratifiée en groupes homogènes sur la base des caractéristiques du Recensement (par exemple : la taille de la ferme et la superficie en culture) et sur les frontières géographiques sous provinciales. Un échantillon d'environ 11 500 fermes a été tiré de la liste de base pour l'enquête sur les stocks à la ferme au 31 décembre.

Collecte des données

La collecte des données pour l'enquête sur les stocks à la ferme au 31 décembre a eu lieu du 2 au 9 janvier 2009.

Toute la collecte des données pour les enquêtes sur les grandes cultures est faite sur le système "Interviews téléphoniques assistés par ordinateur" (ITAO).

Vérification et imputation

Avec l'introduction du système ITAO, il est maintenant possible d'exécuter des procédures de vérification au moment même de l'enquête. Les programmes informatiques de vérification de ce système donnent des messages qui informent les interviewers au téléphone sur la possibilité d'erreurs de données, lesquelles peuvent être corrigées immédiatement. Le système ITAO réduit significativement le besoin d'un suivi téléphonique, diminuant ainsi le fardeau des répondants et la durée du traitement de l'enquête.

Taux de réponse

Habituellement, à la fin de la collecte des données, 80 % des questionnaires ont été complètement remplis. Le taux de refus des enquêtes est approximativement de 5 %. La différence entre le taux de questionnaires remplis et le taux de refus peut être expliquée par les cas où il n'y a pas eu de contact et de réponse. Les facteurs de pondération théorique sont ajustés par un processus appelé ajustement des facteurs de pondération dans les cas sans réponse de façon partielle ou totale. Aucune imputation n'est effectuée pour les données manquantes.

Erreurs d'échantillonnage et non liées à l'échantillonnage

Les statistiques contenues dans cette publication sont basées sur un échantillon d'exploitations agricoles tiré au hasard et, comme telles, sont sujettes à des erreurs d'échantillonnage et non liées à l'échantillonnage. La qualité globale des estimations dépend ainsi de l'effet combiné de ces deux types d'erreurs.

Les erreurs d'échantillonnage augmentent parce que les estimations sont dérivées des données d'un échantillon et non de la population totale. Ces erreurs dépendent de facteurs tels que la taille de l'échantillon, le plan d'échantillonnage et la méthode d'estimation. Une caractéristique importante de l'échantillonnage probabiliste est que les erreurs d'échantillonnage peuvent être mesurées à partir de l'échantillon lui-même.

Les erreurs non liées à l'échantillonnage sont des erreurs qui surviennent au cours de la réalisation de l'enquête pour différentes raisons. Par exemple, les cas sans réponse sont une source importante d'erreur. La couverture, la différence dans l'interprétation des questions, les informations incorrectes fournies par les répondants, les erreurs d'enregistrement, la codification et le traitement des données sont d'autres exemples d'erreurs non liées à l'échantillonnage.

Estimation

Les données recueillies sont pondérées pour produire des indicateurs non biaisés et représentatifs de la population. Ces indicateurs de niveau sont alors soumis à un processus de validation basé sur une analyse faite par des spécialistes et sur la consultation avec les statisticiens provinciaux avant qu'une estimation finale soit publiée.

Pour établir les estimations des stocks de céréales à la ferme, on procède à une enquête auprès des exploitations agricoles, mais l'un des principaux outils servant à la vérification de ces estimations est le bilan des exploitations agricoles. Ce tableau reflète l'activité dans les exploitations agricoles seulement avant que les céréales n'entrent dans le système commercial. Les ressources et les utilisations doivent s'équilibrer.

Les ressources sont composées des stocks d'ouverture et de la production des exploitations agricoles. Les utilisations comprennent les livraisons, les semences à la ferme, les stocks de fermeture des exploitations, ainsi que les aliments pour animaux, les déchets et les impuretés. Les données sur la production et sur les stocks à la ferme sont établies au moyen de grandes enquêtes auprès des agriculteurs canadiens. Les données sur les semences à la ferme sont fondées sur les taux moyens d'ensemencement.

Les livraisons sont constituées en grande partie de livraisons de céréales autorisées, obtenues auprès de la Commission canadienne des grains (CCG). Statistique Canada (SC) apporte des ajustements à ces livraisons pendant le processus d'estimation pour tenir compte des problèmes de qualité et du retard des données de la CCG. Les ajustements sont calculés principalement à partir des tableaux sur les bilans commerciaux, qui sont produits à l'aide de données tirées de la publication Statistiques hebdomadaires des grains de la CCG. Cependant, les livraisons publiées dans les tableaux du bilan agricole de SC comportent les données publiées de la CCG et les estimations de SC des livraisons sans permis aux marchés intérieurs et d'exportation ainsi qu'à la capacité garantie aux producteurs.

L'élément aliments pour animaux, déchets et impuretés est un poste résiduel au bilan. Les indicateurs tels le nombre d'unités animales consommatrices de céréales, les conditions de la récolte ayant un effet sur la qualité des céréales, les ratios établis d'impuretés par rapport aux céréales livrées et les inspections des céréales, servent à assurer l'exactitude des données. Si l'estimation pour cet élément sort de l'ordinaire, c'est qu'une autre série de données, comme celle des livraisons, posait un problème, ou qu'il peut y avoir une variation des caractéristiques de l'alimentation des animaux. Les stocks à la ferme sont estimés à partir des indicateurs de l'enquête, conjointement avec les autres éléments du bilan. Par conséquent, toute anomalie apparente relativement aux aliments pour animaux, aux déchets et aux impuretés est peu susceptible d'indiquer la présence d'un problème relativement au niveau des stocks à la ferme.

Les tableaux sur le bilan national contiennent d'autres renseignements pouvant servir à l'estimation des stocks à la ferme. On peut obtenir des renseignements plus détaillés sur ces tableaux dans le numéro d'octobre de la publication de Statistique Canada intitulée La revue des céréales et des graines oléagineuses, no 22-007XWB au catalogue.

Révisions

Les données des stocks sont sujettes à des révisions pour deux années après leur première parution. Toutes révisions seront publiées dans le rapport des stocks au 31 juillet, lequel est disponible en septembre.

Le tableau suivant indique la magnitude et la direction des révisions faites par le passé aux stocks à la ferme de décembre. La magnitude de ces changements est mesurée par la moyenne des variations en pourcentage de l'estimation préliminaire par rapport à l'estimation finale. La direction des révisions est mesurée par le nombre d'années que l'estimation préliminaire est en dessous ou au-dessus de l'estimation finale révisée.

Les données indiquent, par exemple, que les estimations préliminaires des stocks à la ferme pour le blé sont révisées, en moyenne, dans une magnitude de 2,5 % et habituellement à la baisse.

Qualité des données

Les estimations des stocks à la ferme au 31 décembre sont basées sur des indicateurs de niveau obtenus à partir d'une enquête probabiliste sur les exploitations agricoles. L'erreur potentielle introduite par l'échantillonnage peut être calculée à partir de l'échantillon en utilisant une mesure statistique appelée le coefficient de variation (c.v.). Pour un échantillonnage répété, les chances sont de 95 % que la différence relative entre l'estimation de l'échantillon et ce qui aurait été obtenu d'une énumération de toutes les exploitations agricoles, serait moins que le double du coefficient de variation. Cet ensemble de valeur acceptable est appelé intervalle de confiance. Cependant, les estimations publiées peuvent ne pas être les mêmes que les indicateurs de niveau (dû à la validation et au processus de consultation). Ces estimations demeurent, toutefois, à l'intérieur de l'intervalle de confiance de l'indicateur de niveau de l'enquête. Pour l'enquête des stocks à la ferme au 31 décembre, les c.v. au niveau canadien vont de 3 % à 10 % pour les cultures principales.

Confidentialité des données

La confidentialité des données est assujettie à la Loi de la Statistique qui interdit la divulgation de données individuelles et agrégées quand des individus ou des entreprises pourraient être identifiés.

Suivant | Précédent