El software de código abierto, democratizando el análisis estadístico en la ciencia de datos

Autores/as

DOI:

https://doi.org/10.62305/alcon.v4i5.361

Palabras clave:

código abierto; análisis de datos; democratización

Resumen

El software de código abierto revolucionó el análisis estadístico al democratizar el acceso a herramientas avanzadas en la ciencia de datos. Este modelo permitió que usuarios de diversas disciplinas accedieran, modificaran y adaptaran tecnologías de alto nivel para satisfacer sus necesidades específicas, promoviendo la equidad y la innovación. Entre las tecnologías destacadas estuvieron Apache Hadoop y Apache Sqoop, que facilitaron la gestión y el análisis de grandes volúmenes de datos en entornos distribuidos. Hadoop proporcionó un marco escalable y eficiente para el almacenamiento y procesamiento masivo de datos, mientras que Sqoop ha permitido la transferencia de datos entre bases de datos relacionales y Hadoop, integrando fuentes heterogéneas en flujos de trabajo analíticos. La democratización del software de código abierto se vio impulsada por iniciativas como la Free Software Foundation (FSF), y el concepto de copyleft, que han garantizado que el código permaneciera accesible y reutilizable para cualquier usuario. Este movimiento se basó en las cuatro libertades fundamentales del software libre: la libertad de ejecutar el programa para cualquier propósito, la libertad de estudiar cómo funciona y adaptarlo a las necesidades propias, la libertad de distribuir copias para ayudar a otros y la libertad de mejorar el programa y publicar esas mejoras para beneficio de la comunidad. Estas libertades aseguraron que las mejoras en el software beneficiaran a toda la comunidad, fortaleciendo la colaboración y la transparencia en la investigación.

Descargas

Los datos de descargas todavía no están disponibles.

Citas

Cifras, E. e. (2024). Ecuador en Cifras . Obtenido de Ecuador en Cifras : https://www.ecuadorencifras.gob.ec/

Danilov, H. (2024). Execution of sql-like queries in distributed heterogeneous systems based on Apache Hadoop. Boletín de la Universidad Técnica Estatal de Voronezh, 2-8.

Demchenko, Y. (2024). Big Data Algorithms, MapReduce and Hadoop ecosystem. Oklahoma: Springer.

Jiang, P. (2024). Application Status of Hadoop in Data Cloud Computing. International Journal of Computer Science and Information Technology, 279-282.

Kim, S.-Y. (2024). Optimizing hadoop data locality: performance enhancement. Scalable Computing: Practice and Experience, 4558–4575.

Kusuma, D. (2024). Perbandingan Uji Performa Impala dan Hive-Hadoop. Journal Syntax Dmiration, 4837-4845.

Picarella, L. (2024). Critical Education and Digital Media: A Binomial for the Exercising of Human Rights. Review of human rights, 86-114.

Rahmani, A. M. (2024). Scheduling of Big Data Workflows in the Hadoop Framework with Heterogeneous Computing Cluster. Arabian Journal for Science and Engineering , 1-9.

Salah, H. (2024). From Micro-benchmarks to Machine Learning: Unveiling the Efficiency and Scalability of Hadoop and Spark. iJIM journal, 46-60.

Varde, A. (2024). HaaS in Environmental Computing: Hadoop-as-a-Service for Big Data Mining in Environmental Computing Applications. ACM SIGWEB Newsletter, 1-19.

Descargas

Publicado

2024-12-16

Cómo citar

Nuñez Laje , E. A. ., Estrella de las Mercedes Baquero Tapia, Rengel Sandoval , H., & Noboa Ramírez , M. Y. (2024). El software de código abierto, democratizando el análisis estadístico en la ciencia de datos . Revista Científica De Innovación Educativa Y Sociedad Actual "ALCON", 4(5), 179–188. https://doi.org/10.62305/alcon.v4i5.361

Número

Sección

Artículos originales