El software de código abierto, democratizando el análisis estadístico en la ciencia de datos
DOI:
https://doi.org/10.62305/alcon.v4i5.361Palabras clave:
código abierto; análisis de datos; democratizaciónResumen
El software de código abierto revolucionó el análisis estadístico al democratizar el acceso a herramientas avanzadas en la ciencia de datos. Este modelo permitió que usuarios de diversas disciplinas accedieran, modificaran y adaptaran tecnologías de alto nivel para satisfacer sus necesidades específicas, promoviendo la equidad y la innovación. Entre las tecnologías destacadas estuvieron Apache Hadoop y Apache Sqoop, que facilitaron la gestión y el análisis de grandes volúmenes de datos en entornos distribuidos. Hadoop proporcionó un marco escalable y eficiente para el almacenamiento y procesamiento masivo de datos, mientras que Sqoop ha permitido la transferencia de datos entre bases de datos relacionales y Hadoop, integrando fuentes heterogéneas en flujos de trabajo analíticos. La democratización del software de código abierto se vio impulsada por iniciativas como la Free Software Foundation (FSF), y el concepto de copyleft, que han garantizado que el código permaneciera accesible y reutilizable para cualquier usuario. Este movimiento se basó en las cuatro libertades fundamentales del software libre: la libertad de ejecutar el programa para cualquier propósito, la libertad de estudiar cómo funciona y adaptarlo a las necesidades propias, la libertad de distribuir copias para ayudar a otros y la libertad de mejorar el programa y publicar esas mejoras para beneficio de la comunidad. Estas libertades aseguraron que las mejoras en el software beneficiaran a toda la comunidad, fortaleciendo la colaboración y la transparencia en la investigación.
Descargas
Citas
Cifras, E. e. (2024). Ecuador en Cifras . Obtenido de Ecuador en Cifras : https://www.ecuadorencifras.gob.ec/
Danilov, H. (2024). Execution of sql-like queries in distributed heterogeneous systems based on Apache Hadoop. Boletín de la Universidad Técnica Estatal de Voronezh, 2-8.
Demchenko, Y. (2024). Big Data Algorithms, MapReduce and Hadoop ecosystem. Oklahoma: Springer.
Jiang, P. (2024). Application Status of Hadoop in Data Cloud Computing. International Journal of Computer Science and Information Technology, 279-282.
Kim, S.-Y. (2024). Optimizing hadoop data locality: performance enhancement. Scalable Computing: Practice and Experience, 4558–4575.
Kusuma, D. (2024). Perbandingan Uji Performa Impala dan Hive-Hadoop. Journal Syntax Dmiration, 4837-4845.
Picarella, L. (2024). Critical Education and Digital Media: A Binomial for the Exercising of Human Rights. Review of human rights, 86-114.
Rahmani, A. M. (2024). Scheduling of Big Data Workflows in the Hadoop Framework with Heterogeneous Computing Cluster. Arabian Journal for Science and Engineering , 1-9.
Salah, H. (2024). From Micro-benchmarks to Machine Learning: Unveiling the Efficiency and Scalability of Hadoop and Spark. iJIM journal, 46-60.
Varde, A. (2024). HaaS in Environmental Computing: Hadoop-as-a-Service for Big Data Mining in Environmental Computing Applications. ACM SIGWEB Newsletter, 1-19.
Publicado
Cómo citar
Número
Sección
Licencia
Derechos de autor 2024 Revista Científica de Innovación Educativa y Sociedad Actual "ALCON"

Esta obra está bajo una licencia internacional Creative Commons Atribución-NoComercial-CompartirIgual 4.0.




