martes, 15 de septiembre de 2009

Horarios Reuniones Individuales 16 de Septiembre

Reuniones Miércoles 16 de Septiembre

Olmos, Carlos 18:30
Fagalde, Mariano 18:50
Arqueros, Soledad 19:10
Zorraquín, Esteban 19:50
Lucchini, Gabriela 20:10
Nebuloni, Nicolás 20:30
Basile, Vicente 20:50
Dengra, Cristina 21:10


Si alguno en la lista tiene algún inconveniente para asistir, por favor le pido que me escriba.

Recuerden que las reuniones son de 20 minutos, un tiempo más corto de lo que me gustaría, asi que nuevamente les sugiero que intenten preparar la reunión anotando sus inquietudes y dudas, de manera que aprovechemos el tiempo.

lunes, 27 de julio de 2009

Preguntas y Respuestas Práctico de STATA II

PREGUNTA: ¿La base cómo te la entregamos? ¿te la mandamos por
mail con copia a Stella? Luego, yo trabajé todo el práctico en SPSS y
excepto las regresiones que las hice en STATA porque es más sencilla
la salida. Las syntaxis las copié todas en un word así que no hay
problemas, y las tablas las pasé a un excel así que tampoco hay
problema. Lo que quería saber es si vos tenés SPSS para que te mande
la base en .sav o si la paso a excel u otra cosa.

RESPUESTA: No es necesario que me mandes la base. Puedes mandarme el word con las sintaxis, y los resultados que pasaste al excel también por favor te pido que las incluyas en el mismo word. Gracias.

PREGUNTA: Me falta la pregunta V referida a las tablas con las características por barrio.La única forma que encontré de hacerlo es casi artesanal: por cada variable hago [by barrio, sort : table jardíndummy, c(freq)] una tabla ordenada por barrio que me da las fecuencias de las variables dummys (1 y 0) después tendría que sumar cada variable a mano y sacar el porcentaje.

RESPUESTA: No es necesario que utilices el comando by para el punto V (para el punto VI si va a ser necesario). Como bien señalas, el comando table te permite separar las observaciones de acuerdo a alguna variable, en este caso barrio, y lo unico que necesitarias es poder calcular el porcentaje. Pero aqui viene lo que no te estás dando cuenta: simplemente tienes que tomar el promedio de la respectiva variables dummy, ya que cada variable toma valores 0 o 1 y al promediarla lo que vas a estar haciendo es precisamente sumar el número de1s y dividir el resultado en la cantidad de observaciones, es decir, vas a estar calculando el porcentaje.


PREGUNTA: Respecto a las regresiones, tomé las variables dummy y con las variables de calidadnotabarrio las puse directamente como están.

RESPUESTA: Hiciste bien.

PREGUNTA: Por último, dado mi nula experiencia en este tipo de trabajos, necesitaría que me precises como se entrega el trabajo. Los resultados finales se pueden grabar en archivo dta, pero las tablas y regresiones?? Te paso las lineas de comando en Word con las conclusiones en los casos en que se piden??


RESPUESTA: Para entregar el trabajo armas un documento word con el siguiente contenido. Para cada punto del práctico vas a incluir: i) el comando que utilizaste, ii) lo que surgió como salida del programa (en el caso de una tabla o regresion), iii) una explicacion o interpretación de los resultados.



PREGUNTA: Consigna VI: Una vez generada la variable clasificatoria, ¿qué hago con las observaciones que en alq tenían missing values? Yo considero que lo más adecuado sería dejarlas missing, ya que si en alq no dicen nada, no puedo clasificar las viviendas como baratas, medianas o caras. Y ya que por defecto me aparecen clasificadas como caras (no sé por qué, pero eso me ocurre después de haber hecho todos los replace), le agregué esto:


replace tipocasa = . if alq == .


RESPUESTA: Me parece bien que arregles ese error usando ese comando (dejando a los missing como missing). Que aparezcan por defecto como caras tiene que ver con la forma en que definiste quienes son caras. No se como lo hiciste, pero esta bien corregir ese tema asi.


PREGUNTA:Consigna VII: Para el modelo de regresión, ¿la variable propietario es la original que refleja condición de propiedad (condprop) o la dummy que yo generé diciendo si el respondente era propietario? Entiendo que es la primera, suena más lógico.


RESPUESTA: Tienes que usar la dummy propietario. Esto va a diferenciar un efecto para los propietarios distinto de todos los demás. Podría tener algun sentido utilizar la otra variable si esperas ver un signo negativo en el resultado del coeficiente (un mayor valor en la variable condprop se relaciona con un menor alquiler, pero esto implicaría suponer una relacion lineal entre el alquiler y pasar de 1 a 2 a 3 etc en las categorias de propietario que no tiene mucho sentido suponer)


PREGUNTA: A veces me ocurre que cuando pongo Save para guardarle los cambios a mi archivo .dta, pierdo variables. Para recuperarlas hago un joinby con la base original calidad.dta. ¿Qué puede estar ocurriendo? ¿Puede que mi versión de Stata esté fallada?

RESPUESTA: No deberías perder variables cuando haces el save. Lo unico que se me ocurre es que el programa no este correctamente registrado y que no estes grabando los cambios realmente. Lo mejor para ese caso es guardar todos los comandos que corriste en un do-file (no es mas que un archivo de texto, ver el icono para crear un do-file en la barra de herramientas), trabajar siempre con la base original, y al principio correr todos los comandos juntos (seleccionas todos y con el boton derecho puedes correrlos, tambien en la barra de herramientas de la ventana del do.file hay una opcion para correrlos todos juntos) que lleva solo un segundo y te asegura de que si cometiste algun error lo curas rapidamente.

jueves, 16 de julio de 2009

Preguntas y Respuestas de Ayuda Práctico de Stata

Pregunta: Debemos generar variables dummies por i) Jardin, ii) cochera, iii) casa, iv) propietario.
El tema es que cuando en cada caso se generan tantas dummies como respuestas posible hay en la columna (en función de la codificación numérica con la que están ingresadas las respuestas)
La consulta es si dejamos esto así, o nos enfocamos en la pirmer dummy que es la que agrupa la mayoría de las respuestas, para cada caso. O, si existe algún comando, que no estoy en el help que contemple esta diversidad de respuestas en una sola columan.
Todavía no avancé con los puntos posteriores y no sé como puede influir esto.
Se entiende?

Respuesta: La dummy en cada caso tiene que estar definida como:

Dummy jardín:
1 si tiene jardín
0 si no tiene jardín


Dummy cochera:
1 si tiene cochera
0 si no tiene cochera

Dummy casa:
1 si el hogar encuestado es casa
0 si el hogar enucestado no es una casa

Dummy propietario:
1 si el jefe de hogar declara ser propietario
0 si no lo es



Pregunta: En la primera consigna del trabajo se pide generar una nueva variable que reuna los valores de "valalq" y "propalq", pero cuando ejecuto el comando
gen alq = valalq + propalq
Me genera una nueva variable con casi todos los valores de tipo "missing values". Sólo tres de sus celdas tienen números, son aquellas en las cuales en valalq y propalq había números. Para las demás, al sumar un campo vacío de valalq + uno lleno de propalq (o al revés) me arroja resultado vacío.
¿Qué hago?

Respuesta: Descubriste que sumar missing values devuelve missing values.
Tienes que definir la variable utilizando el condicional if. Si se cumple la condición de ser propietario entonces le asignas el valor propalq a la variable alq, si se cumple la condición de ser inquilino, entonces le asignas el valor de valalq.
Espero te sirva la ayuda. Avisame cualquier otro problema
saludos
Ricardo




Pregunta: Hola Ricardo, me encuentro haciendo el práctico de stata pero me surgio una duda cuando pides que genere la regresion, utilizó las variables dummys que genere para jardin, cochera o debo de usar las iniciales. Y bueno lo que si no `puedo resolver aun es cuando pides que califiquemos por barato, mediano y caro. Estaba viendo como generar otra variable no sé si este ejemplo sirva generate crisis="antes" if time <=tq(2001q4) no recuerdo que es el tq. Bueno sólo esas son mis dudas. Saludos

Respuesta:
Van algunas ayudas:

* Para la regresión, debes usas las variables dummies que generaste (toma valores 1 o 0). No las variables originales (toma valores 1, 2 o 99).

* Para la clasificación de barato mediano y caro, lo primero que tienes que hacer es generar una variable que contenga el percentil 33 para cada barrio. Para ello tienes que utilizar uno de los comandos para generar variables (de los dos que vimos), y combinarla con otro comando que te permita trabajar con subgrupos de observaciones (en este caso el barrio). Así en cada subgrupo de observaciones calcularás el percentil 33. Esa es la ayuda por ahora...

* El ejemplo que pusiste (utilizando el condicional if) no te va a servir o te va a complicar mucho el cálculo.

* De paso te recuerdo que tq() servía para definir que lo que escribes está en un formato de fecha determinado, para no tener que escribir el número de serie de la fecha.