Portail HAL Insee
Not a member yet
1187 research outputs found
Sort by
RMéS, le référentiel de métadonnées statistiques de l’Insee
International audienceUnderstanding what a statistical result covers in order to facilitate its interpretation or reuse is what statistical metadata is all about. They are of many kinds: definitions, classifications, characteristics of the source used to produce the result, etc. To make this information accessible, Insee's statistical metadata repository, RMéS, structures it and centralizes it, ensuring the consistency of the information through identification rules. The implementation of international standards for describing metadata facilitates their use, automatically or manually. This also allows sharing with other entities. The environment for communicating with the repository has also been set up: services are offered throughout the life cycle of a statistical operation, both to supply the repository and to access its content. The use of RMéS goes beyond simple reuse: some client applications can rely on metadata to automatically produce components of the statistical process, for example to specify questionnaires, or even eventually describe controls or dissemination products. Cross-functional and structuring for statistical production, RMéS appears as a potential vector for coordination within the Public Statistical Service.Permettre de comprendre ce que recouvre un résultat statistique afin de faciliter son interprétation ou sa réutilisation, voilà tout l'enjeu des métadonnées statistiques. Elles sont de multiples natures : définitions, nomenclatures, caractéristiques de la source mobilisée pour produire le résultat, etc. Pour rendre ces informations accessibles, le référentiel de métadonnées statistiques de l'Insee, RMéS, les structure, les centralise, assurant la cohérence de l'information grâce à des règles d'identification. L'adoption de standards internationaux pour décrire les métadonnées facilite leur usage, automatique ou manuel, et les échanges avec d'autres organismes. L'environnement permettant de communiquer avec le référentiel a également été mis en place : des services sont offerts tout au long du cycle de vie d'une opération statistique, aussi bien pour alimenter le référentiel que pour accéder à son contenu. L'usage d'RMéS va plus loin qu'une simple réutilisation : certaines applications clientes peuvent mobiliser les métadonnées pour produire automatiquement des composants du processus statistique, par exemple pour spécifier des questionnaires, voire à terme décrire des contrôles ou des produits de diffusion. Transversal et structurant pour la production statistique, RMéS apparaît comme un potentiel vecteur de la coordination au sein du Service Statistique Public
Le Centre d’accès sécurisé aux données (CASD), un service pour la data science et la recherche scientifique
International audienceGiving researchers access to individual data collected by the Official Statistical System constitutes a major scientific challenge. This very detailed information requires a very high level of security in order to avoid any disclosure which would be prejudicial to the citizen, or any use by an unauthorised third party. To meet this security requirement, INSEE created in 2010 the Secure Data Access Centre (Centre d'accès sécurisé aux données, or CASD) whose teams have designed a secure device, allowing remote access whilst ensuring strong user authentication and confinement of the files. The CASD, now autonomous, has developed over time, extending its perimeter to other data producers and other types of highly detailed, sensitive data such as health data or administrative data. This service provides new solutions to the issue of record linkage and reproducibility of research work based on confidential data. The research community in France uses increasingly CASD's services. The experience is original, although relatively recent compared with that of foreign partners : it enables now CASD to expand on an international level.L'accès des chercheurs aux données individuelles collectées par le Service statistique public constitue un enjeu scientifique majeur. Ces informations très détaillées exigent un très haut niveau de sécurité pour éviter toute dissémination préjudiciable au citoyen, ou toute utilisation par un tiers non autorisé. Pour répondre à ce besoin de sécurité, l'Insee a créé en 2010 le CASD, Centre d'accès sécurisé aux données : les équipes du centre ont conçu un équipement sécurisé, permettant un accès à distance, tout en garantissant une authentification forte des utilisateurs et un confinement des fichiers. Le CASD, désormais autonome, s'est développé au fil du temps, élargissant son champ à d'autres producteurs et à d'autres types de données très détaillées et sensibles telles les données de santé ou les données administratives. Ce service propose de nouvelles solutions à la problématique des appariements et de la reproductibilité des études sur données confidentielles. Le CASD est de plus en plus utilisé par la communauté de la recherche en France, et son expérience originale, bien que relativement récente comparé à celle de ses partenaires étrangers, lui permet de s'ouvrir à l'international
Le modèle Avionic : la modélisation input/output des comptes nationaux
This document presents the AVIONIC model (Variantial Input/Output National Analysis Importedand Content) developed at the national accounts department of INSEE. The model is based onFrench symmetric input-output tables, in order to propose three types of modeling: the estimation ofthe amounts of imports or value added generated by a component of the final demand (modeling incontent of the final demand); the effect on production and imports of an exogenous variation onFrench final demand (modeling of a variation in final demand); and finally, the effect on the price ofproduction of an exogenous variation on the price of inputs (modeling of price variation). The modelis applicable at a detailed level of the nomenclature (level G, 138 products). Its price modeling is quiteinnovative because it includes price transmission coefficients that reflect the fact that the spread of aprice increase depends on the behavior of the companies in each branch. The model also allows toconsider extensions by mobilizing various data (employment data, materials...). Finally, the modeladapts to international databases developed recently at the OECD (TiVA) or at Eurostat (Figaro),which rely on inter-country TES.Ce document présente le modèle Avionic (Analyse variantielle input/output nationale importée et en contenus) développé au département des comptes nationaux de l'Insee. Le modèle s'appuie sur les tableaux entrées-sorties symétriques français, afin de proposer trois types de modélisations : l'estimation des montants d'importations ou de valeur ajoutée générés par une composante de la demande finale (modélisation en contenus de la demande finale) ; l'effet sur la production et les importations d'un choc exogène sur la demande finale française (modélisation d'une variation de la demande finale) ; et enfin l'effet sur le prix de production d'un choc exogène sur le prix des intrants (modélisation de variation de prix). Le modèle est applicable à un niveau détaillé de la nomenclature (niveau G, 138 produits). Sa modélisation en prix est assez novatrice car elle intègre des coefficients de transmission des prix qui traduisent le fait que la propagation d'une hausse de prix dépend dans chaque branche, du comportement des entreprises. Le modèle permet aussi d'envisager des extensions en mobilisant des données variées (données d'emploi, de matières…). Enfin le modèle s'adapte aux bases de données internationales développées récemment à l'OCDE (TiVA) ou à Eurostat (Figaro) qui s'appuient sur des TES inter-pays
La rénovation de la nomenclature socioprofessionnelle (2018-2019) : rapport du groupe de travail du Cnis
Un groupe de travail est constitué au sein du Cnis pour proposer une rénovation de la nomenclature des professions et catégories socio-professionnelles (PCS). Les travaux du groupe démarrent début 2018 et un suivi des travaux sera présenté à la Commission "Emploi, qualification et revenus du travail" du Cnis. La nomenclature PCS, dont la dernière rénovation date de 2003, est très largement utilisée pour décrire les emplois et étudier les groupes sociaux (structures de revenus, comportements de santé, modes de vie, pratiques culturelles, etc.). En juin 2016, Eurostat a promulgué une nomenclature socio-économique européenne (ESeG) construite à partir de la nomenclature internationale ISCO de 2008. Améliorer l’articulation de la PCS avec ces nomenclatures internationales fait partie des objectifs du moyen terme (2014-2018) du Cnis
Essais sur l'estimation structurelle de la demande
Estimation of structural demand models in differentiated product markets plays an important role in economics. It allows to better understand consumers’ choices and, amongst other, to assess the effects of mergers, new products, and changes in regulation. The standard approach consists in specifying a utility model, typically an additive random utility model, computing its demands, and inverting them to obtain inverse demand equations, which will serve as a basis for estimation. However, since these inverse demands have generally no closed form, estimation requires numerical inversion and non-linear optimization, which can be painful and time-consuming. This dissertation adopts a different approach, developing novel inverse demand models, which are consistent with a utility model of heterogeneous consumers. This approach allows to accommodate rich substitution patterns thanks to simple linear regressions with data on market shares, prices and product characteristics. The first chapter of this dissertation develops the inverse product differentiation logit (IPDL) model, which generalizes the nested logit models to allow for richer substitution patterns, including complementarity. It also shows that the IPDL model belongs to the class of generalized inverse logit (GIL) models, which includes a vast majority of additive random utility models that have been used for demand estimation purposes. The second chapter develops the flexible inverse logit (FIL) model, a GIL model that uses a flexible nesting structure with a nest for each pair of products. It shows that the FIL model, projected into product characteristics space, makes the price elasticities depending on product characteristics directly and, using Monte Carlo simulations, that it is able to mimic those from the "flexible" random coefficient logit model. The third chapter studies the micro-foundation of the GIL model. It shows that the restrictions that the GIL model imposes on the inverse demand function are necessary and sufficient for consistency with a model of heterogeneous and utility-maximizing consumers, called perturbed utility model. It also shows that any GIL model yields a demand function that satisfies a slight variant of the Daly-Zachary conditions, which allows to combine substitutability and complementarity in demand.L’estimation structurelle des modèles de demande sur des marchés de produits différenciés joue un rôle important en économie. Elle permet de mieux comprendre les choix des consommateurs et, entre autres, de mesurer les effets d’une fusion d’entreprise, de l’introduction d’un nouveau produit sur le marché ou d’une nouvelle régulation. L’approche traditionnelle consiste à spécifier un modèle d’utilité, typiquement un modèle d’utilité aléatoire additif, à en calculer ses demandes et à inverser ces dernières pour obtenir des équations de demande inverse qui serviront de base pour l’estimation. Toutefois, en général, ces demandes inverses n’ont pas de forme analytique. L'estimation exige donc une inversion numérique et l’emploi de procédures d’estimation non-linéaire, qui peuvent être difficiles à mettre en oeuvre et chronophages.Cette thèse adopte une approche différente, en développant de nouveaux modèles de demande inverse qui sont cohérents avec un modèle d’utilité de consommateurs hétérogènes. Cette approche permet de capter de façon plus flexible les substitutions entre les produits, grâce à de simples régressions linéaires basées sur des données incluant les parts de marché, les prix et les caractéristiques des produits. Le premier chapitre de cette thèse développe le modèle inverse product differentiation logit (IPDL), qui généralise les modèles logit emboîtés, permettant ainsi de capter de façon flexible les substitutions entre les produits, y compris de la complémentarité. Il montre que le modèle IPDL appartient à une classe de modèles de demande inverse, nommée generalized inverse logit (GIL), laquelle inclut une grande majorité de modèles d’utilité aléatoire additifs qui ont été utilisés à des fins d'estimation de la demande. Le second chapitre développe le modèle flexible inverse logit (FIL), un modèle GIL qui utilise une structure de nids flexible avec un nid pour chaque pair de produits. Il montre que le modèle FIL, projeté dans l’espace des caractéristiques des produits, permet d’obtenir des élasticités-prix qui dépendent directement des caractéristiques des produits et, en utilisant des simulations de Monte-Carlo, qu’il est capable de reproduire celles du "flexible" modèle logit à coefficients aléatoires. Le troisième chapitre étudie la micro-fondation du modèle GIL. Il montre que les restrictions que le modèle GIL impose sur la fonction de demande inverse sont des conditions nécessaires et suffisantes de cohérence avec un modèle de consommateurs hétérogènes maximisant leur fonction d’utilité, connu sous le nom de perturbed utility model (PUM). Il montre également que tout modèle GIL génère une fonction de demande qui satisfait une légère variante des conditions de Daly-Zachary, laquelle permet de combiner substituabilité et complémentarité en demande
Usages de la cigarette électronique en France à 17 ans : résultats de l’enquête nationale ESCAPAD 2017
International audienc
It Takes Two to Tango Income and Payroll Taxes in Progressive Tax Systems: LIS working papers series - No. 779
LIS working papers series - No. 779The literature on tax systems generally considers each type of tax in a self-contained way, with its own distributive characteristics. While the income tax is considered as a progressive tax, social insurance contributions are seen as being regressive, namely because of ceilings. Using a database of comparative micro-data at the household level (LIS data, 22 OECD countries, 1999-2016 period), supplemented with OECD data on employer contributions, we measure effective tax rates over the entire income distribution. Our results jeopardize the conventional economic wisdom on the role of income and payroll taxes in tax progressivity, and on their respective impact on inequality reduction. We show that, in all countries of our sample, the progressivity of income tax increases as soon as the progressivity of social insurance contributions decreases. This implies that income and payroll tax schedules are not independent. Even more, they act in a complementary way. While payroll tax heavily compress inequalities at the bottom of the income distribution, income tax reduces inequalities at the top
: Quels effets sur les résultats au baccalauréat ?
International audienceInsee 53 Les notes au baccalauréat d'un élève sont-elles influencées par le niveau de ses camarades de classe de terminale ? Nous utilisons des données administratives exhaustives anonymisées permettant un suivi longitudinal de la scolarité des élèves pour évaluer les effets de pairs en classe de terminale sur les résultats au baccalauréat entre 2010 et 2016. Nous autorisons l'effet des pairs à varier en fonction du niveau initial de l'élève, tel que mesuré par sa note au brevet des collèges, et nous avons recours à une typologie de classes pour étudier l'effet de la composition globale de la classe. Nous nous appuyons sur la variabilité entre classes et entre cohortes à lycée et série donnés, et nous restreignons l'analyse à un échantillon de lycées au sein desquels nous n'identifions pas de politique de classes de niveau. Une proportion élevée de bons élèves dans la classe est surtout profitable aux plus faibles, et peut même être défavorable pour les autres pairs de niveau élevé. Nous simulons l'effet d'une réallocation des élèves tendant vers plus de mixité scolaire dans les classes pour un établissement, une série et une année donnés. Cet effet est globalement positif, quoique limité. D ans quelle mesure la réussite d'un élève dépend-elle des camarades côtoyés durant sa scolarité ? Peut-on améliorer le niveau général des élèves en composant les classes différemment ? Et si oui, quelle composition d'élèves dans la classe bénéficie aux élèves de différents niveaux initiaux ? Ces questions liées aux effets de pairs sont au coeur des politiques d'éducation, notamment celles visant à agir sur la mixité scolaire. Mesurer et comprendre les effets de pairs est un enjeu essentiel pour lutter contre les inégalités scolaires. D'une part, les effets de pairs peuvent en théorie conduire à un renforcement des inégalités. Si être scolarisé dans une meilleure classe a toujours un effet positif, en présence de ségrégation scolaire les meilleurs élèves, bénéficiant des composition
The Coordinate Sampler: A Non-Reversible Gibbs-like MCMC Sampler
5 figuresIn this article, we derive a novel non-reversible, continuous-time Markov chain Monte Carlo (MCMC) sampler, called Coordinate Sampler, based on a piecewise deterministic Markov process (PDMP), which can be seen as a variant of the Zigzag sampler. In addition to proving a theoretical validation for this new sampling algorithm, we show that the Markov chain it induces exhibits geometrical ergodicity convergence, for distributions whose tails decay at least as fast as an exponential distribution and at most as fast as a Gaussian distribution. Several numerical examples highlight that our coordinate sampler is more efficient than the Zigzag sampler, in terms of effective sample size
FRIBS : un nouveau cadre commun pour les statistiques d’entreprises européennes
International audienceThe Framework Regulation Integrating Business Statistics (FRIBS), adopted in2019, is the result of a long process of preparation and negotiation at European level.Three fundamental principles guide it: common methodological basis, definitionsand quality criteria; greater flexibility to adapt to economic changes and emergingstatistical needs; synergies between domains and simplifications in the data requestedin order to reduce the burden on businesses. In fact, FRIBS replaces ten sectoralregulations or decisions currently in force. It creates a common legal framework forbusiness statistics, reducing inconsistencies between domains and redundancies,without removing them completely. Beyond this integrated approach, it introducesseveral developments and innovations, the main ones aimed at better coveringcertain sectors in the tertiary sector and certain themes such as globalisation orgroups. FRIBS will apply mainly from the 2021 reference year: many of the changesrequested in this context have already been anticipated and implemented by France.But the remaining part will still require significant adjustments.Le règlement-cadre sur les statistiques d’entreprises, nommé FRIBS (FrameworkRegulation Integrating Business Statistics) et adopté en 2019, est le résultat d’un longprocessus de préparation et de négociation au niveau européen. Trois principesfondateurs le guident : s’appuyer sur des bases méthodologiques, des définitionset des critères de qualité communs ; permettre une plus grande flexibilité pours’adapter aux changements économiques et aux besoins émergents de statistiques ;rechercher des synergies entre domaines et des simplifications dans les donnéesdemandées afin de réduire la charge sur les entreprises. De fait, FRIBS remplacedix règlements ou décisions sectoriels actuellement en vigueur. Il crée un cadrejuridique commun pour les statistiques d’entreprises, réduisant les incohérencesentre domaines et les redondances, sans les supprimer totalement. Au-delà de cetteapproche intégrée, plusieurs évolutions et innovations vont permettre de mieuxcouvrir certains secteurs du tertiaire et certains thèmes comme la mondialisation oules groupes. FRIBS s’appliquera pour l’essentiel à partir de l’année de référence 2021:une bonne partie des évolutions demandées dans ce cadre ont déjà été anticipéeset mises en œuvre par la France. Mais la partie restante demandera encore desadaptations conséquentes