Hola a todos, llevo un tiempo dándole vueltas a un tema que considero fundamental en nuestro campo: la ética en la recolección de datos para entrenar modelos de IA. Cada vez veo más proyectos que scrapean redes sociales, foros o webs públicas sin un consentimiento explícito, amparándose en que la información es 'pública'. Pero, ¿eso lo hace ético? ¿Dónde trazamos la línea entre datos abiertos y violación de privacidad? Me gustaría escuchar sus opiniones, experiencias o incluso contraargumentos. Por ejemplo, yo he usado datasets de Twitter para análisis de sentimiento, y aunque son públicos, me pregunto si los usuarios saben que sus tuits pueden terminar en un modelo comercial. ¿Debería haber regulaciones más estrictas? ¿O es una exageración?