Friday, February 10, 2017

Egen Group In Stata Forex

Im using Stata, et Im essayant de calculer le prix moyen des rivaux d'entreprises dans un marché. J'ai des données qui ressemble à: Et Im essayant de calculer le prix moyen de chaque concurrents rivaux, donc je veux générer un nouveau champ qui est la moyenne des valeurs des autres entreprises sur un marché. Il semblerait que: Pour faire la moyenne par groupe, je pourrais utiliser la commande egen: Mais cela n'empêcherait pas le prix propre des entreprises dans la moyenne, et à ma connaissance, l'utilisation du qualificatif if changerait seulement les observations qu'elle exploitait Sur les groupes sur lesquels il n'a pas été calculé. Existe t il un moyen simple de le faire, ou dois je créer des boucles et de générer chaque moyenne manuellement demandé Mar 6 12 à 4:16 Il s'agit d'un vieux thread toujours d'intérêt, donc les matériaux et les techniques négligées première fois encore s'appliquent. La technique plus générale est de travailler avec les totaux. À son plus simple, total d'autres total de tous cette valeur. Dans une structure egen qui va ressembler à La fonction total () d'egen ignore les valeurs manquantes dans son argument. S'il y a des valeurs manquantes, nous ne voulons pas les inclure dans le compte, mais nous pouvons utiliser missing () qui donne 1 si pas manquant et 0 si manquant. Egen s count () est une autre façon de le faire. Le code donné précédemment donne une mauvaise réponse si des oublis sont présents car ils sont inclus dans le comptage N. Même si une valeur est manquante, la moyenne des autres valeurs a toujours un sens. Si aucune valeur n'est manquante, la dernière ligne ci dessus simplifie à Jusqu'à présent, cela peut ressembler à pas plus qu'une petite variante sur le code précédent, mais il se prolonge facilement à l'aide de poids. On peut supposer que nous voulons une moyenne pondérée des autres prix donnés un peu de poids. Nous pouvons exploiter le fait que total () fonctionne sur des expressions, ce qui peut être plus compliqué que les noms de variables seulement. En effet le code ci dessus l'a fait déjà, mais il est souvent négligé. Comme avant, si le prix ou le poids est toujours manquant, vous avez besoin de code plus compliqué, ou tout simplement pour vous assurer d'exclure de telles observations des calculs. Voir aussi Stata FAQ Comment puis je créer des variables résumant pour chaque propriété individuelle des autres membres d'un groupe pour une discussion plus large. AVIS: Le groupe de consultation IDRE Statistical migrera le site Web vers le WordPress CMS en février pour faciliter la maintenance et la création de nouveaux contenus. Certaines de nos anciennes pages seront supprimées ou archivées de sorte qu'elles ne seront plus conservées. Nous essaierons de maintenir les redirections afin que les anciennes URL continuent à fonctionner de la meilleure façon possible. Bienvenue à l'Institut pour la recherche et l'éducation numériques Aider le groupe de consultation Stat en donnant un cadeau Stata Class Notes Comptage de n à N Introduction Stata a deux variables intégrées appelées n et N. N est la notation Stata pour le numéro d'observation actuel. N est 1 dans la première observation, 2 dans la seconde, 3 dans la troisième, et ainsi de suite. N est la notation Stata pour le nombre total d'observations. Voyons comment n et N fonctionnent. Comme vous pouvez le constater, l'identifiant de la variable contient le numéro d'observation allant de 1 à 7 et nt le nombre total d'observations, qui est 7. Comptage par L'utilisation de n et N en conjonction avec la commande par peut produire des résultats très utiles. Bien sûr, pour utiliser la commande par, nous devons d'abord trier nos données sur la variable par. Maintenant n1 est le nombre d'observation dans chaque groupe et n2 est le nombre total d'observations pour chaque groupe. Pour énumérer le score le plus bas pour chaque groupe, utilisez ce qui suit: Pour énumérer le score le plus élevé pour chaque groupe, utilisez ce qui suit: Autre utilisation de n Utilise n pour savoir s'il existe des numéros d'identification en double dans les données suivantes: Les observations 6 et 7 ont les mêmes numéros d'identification et mais des valeurs de score différentes. Trouver des doublons Maintenant, utilisez N pour trouver des observations en double. Dans cet exemple, nous classons les observations par toutes les variables. Ensuite, nous utilisons toute la variable dans l'instruction par et définissons set n égal au nombre total d'observations qui sont identiques. Enfin, nous énumérons les observations pour lesquelles N est supérieur à 1, identifiant ainsi les observations en double. Si vous avez beaucoup de variables dans l'ensemble de données, cela peut prendre beaucoup de temps pour les taper toutes deux deux fois. Nous pouvons utiliser le caractère générique pour indiquer que nous souhaitons utiliser toutes les variables. En outre dans les dernières versions de Stata, nous pouvons combiner sort et par en une seule déclaration. Ci dessous est une version simplifiée du code qui donnera les mêmes résultats exacts que ci dessus. Le contenu de ce site Web ne doit pas être interprété comme un endossement d'un site Web particulier, d'un livre ou d'un produit logiciel par l'Université de Californie.


No comments:

Post a Comment