Mostrando entradas con la etiqueta datos. Mostrar todas las entradas
Mostrando entradas con la etiqueta datos. Mostrar todas las entradas

miércoles, 6 de mayo de 2026

Appen

Mucho antes de que Google Translate, Siri o ChatGPT fueran nombres conocidos por todos, Appen ya estaba ayudando a construir los sistemas que nos permiten hablar con nuestros ordenadores. Fundada en Sídney en 1996, Appen se convirtió en líder del mercado en la venta de datos que se utilizarían para ayudar a las computadoras a "aprender" un idioma mediante el reconocimiento de patrones en texto o voz.Cuando un usuario de iPhone le pide a Siri que configure un recordatorio, el proceso parece totalmente automatizado. En realidad, este diálogo solo es posible porque empresas como Appen han suministrado a Apple material producido tras incontables horas de trabajo manual realizado por trabajadores eventuales mal pagados. Los trabajadores de Appen, muchos de ellos radicados en países más pobres, ayudaron a la empresa a crear un extenso catálogo de conjuntos de datos de texto y voz. Estos se vendieron posteriormente a empresas que desarrollaban software capaz de procesar, traducir y transcribir el lenguaje humano. Estas tecnologías también han sido de gran interés para el gobierno estadounidense, que durante décadas ha invertido cientos de millones de dólares en programas de investigación lingüística. (De hecho, el asistente de voz Siri de Apple tiene su origen en un proyecto de investigación militar).
Appen es solo una de las muchas empresas que proporcionan datos de entrenamiento a las compañías tecnológicas más poderosas del mundo. Estos proveedores de datos, aunque poco conocidos fuera del sector, desempeñan un papel crucial en el auge de la IA. Dan empleo a millones de trabajadores independientes como Ismail, que saben poco sobre los sistemas que desarrollan y, a menudo, reciben una remuneración baja por su trabajo. La Asociación de Etiquetadores de Datos, fundada en Kenia el año pasado, afirma que estos trabajadores, a quienes denomina "los arquitectos invisibles que dan forma al futuro de la tecnología", también se enfrentan a contratos precarios, problemas de salud mental y oportunidades de crecimiento limitadas.

Referencia: The Bureau of Investigative Journalism. Reporteros: Niamh McIntyre, Edwin Okoth y Cam Wilson.

miércoles, 5 de junio de 2024

Ciberataque

El 24 de febrero de 2022, el mismo día en que Rusia invadió Ucrania, un ciberataque dirigido al satélite de comunicaciones KA-SAT interrumpió las comunicaciones militares de Ucrania. El ataque, que las autoridades estadounidenses atribuyeron a la agencia de espionaje militar rusa, se extendió más allá de las fronteras de Ucrania. Dejó sin acceso a internet a decenas de miles de personas en toda Europa, desde Francia hasta Ucrania. Un mes después del ataque, unas 2.000 turbinas eólicas en Alemania seguían sin funcionar. Al día siguiente, un puesto de control fronterizo entre Ucrania y Rumanía fue atacado por un malware de eliminación de datos, un programa informático malicioso, que ralentizó los trámites de las personas refugiadas que intentaban huir del país. Estos son solo dos de los 35 importantes ciberataques contra infraestructuras esenciales y civiles en Ucrania que, desde el inicio de la guerra, la ONG con sede en Ginebra CyberPeace Institute ha registrado en su sitio web. Bruno Halopeau, jefe de tecnología y análisis cibernético de la organización, afirma que, aunque la mayoría de los ataques han sido contra objetivos militares, instituciones públicas y medios de comunicación, las personas civiles también se han visto afectadas. Según el derecho internacional humanitario, los ataques contra civiles pueden constituir crímenes de guerra.  
El 26 de febrero de 2022, el Gobierno de Ucrania hizo un llamamiento a los piratas hackers del mundo para que se unieran a su ejército informático y lanzaran ataques contra objetivos rusos. El primer día de la guerra, el colectivo mundial de hackers Anonymous declaró que estaba participando en una ciberguerra contra Moscú. Estos “guerreros cibernéticos” no son conscientes de lo que implica su participación en el conflicto según el derecho internacional humanitario. “Al tomar parte activa en este conflicto, sin saberlo, pueden perder su protección legal como civiles y ser tratados como combatientes. Se exponen a las represalias del Estado al que atacan y son susceptibles de ser perseguidos después de la guerra”.



viernes, 8 de octubre de 2021

Existe un aumento cada vez más desmesurado de las cookies en nuestro navegador


Existe un  aumento cada vez más desmesurado de las cookies en nuestro navegador, que registran prácticamente todo lo que hacemos al utilizar Chrome, Safari, Opera o incluso Firefox. Cientos y cientos de webs conocen a la perfección todos nuestros hábitos de navegación, nuestros intereses e incluso las horas a las que nos conectamos a internet, una información a todas luces desmedida que, además, suele compartirse con muchos otros terceros de los que, en la mayoría de los casos, no sabemos ni quiénes son. Todo esto se agrava en los smartphones, donde apps con hábitos depredadores de datos privados como Facebook o Instagram se apropian prácticamente de toda la información que tenemos en nuestro teléfono. Por eso, a la hora de instalar algunas de estas apps se nos solicita el acceso a la cámara, las fotografías, los micrófonos, los mensajes de texto, la ubicación, y muchos otros datos que realmente no deberían estar en manos de empresas o desarrolladores de apps de los que no sabemos prácticamente nada.


Los peligros a los que nos exponemos al facilitar nuestros datos privados allá donde vamos son extensos y van mucho más allá del mero hecho de recibir publicidad no deseada en casi cada página web que visitamos. Al facilitar información como nuestra ubicación, nuestros intereses y nuestros datos personales, nos exponemos a ciberataques como el phishing e incluso al acoso. Toda la información que compartimos online puede volverse en nuestra contra, de ahí que sea tan importante tomar las precauciones necesarias para protegernos en la red.Tus dispositivos pueden estar infectados por malware capaz de recopilar tus datos privados y enviarlos a terceros. Recuerda tener siempre instalado un antivirus profesional y escanear tus dispositivos de forma regular para prevenir este problema y eliminar cualquier forma de malware que puedas tener en tus equipos.

viernes, 27 de noviembre de 2020

La privacidad es importante


La filósofa Carissa Véliz ha escrito el libro "Privacy Is Power”. Para ella  “la privacidad es importante porque la falta de ésta le da poder a otros sobre nosotros.Cuando otras personas saben demasiado sobre nosotros pueden interferir en nuestras vidas.La privacidad nos protege de los abusos de poder.Por ejemplo, nos protege contra la discriminación injusta.Si tu jefe no sabe qué religión profesas, no puede discriminar en tu contra. La privacidad es como la venda que cubre los ojos de la justicia para que el sistema nos trate con igualdad e imparcialidad”.



“Si damos nuestros datos a las empresas, que no nos sorprenda que los ricos sean los que escriben las reglas de nuestra sociedad.Si damos demasiados datos a los gobiernos, que no nos sorprenda que nos controlen.Para que la democracia sea fuerte, la ciudadanía tiene que tener el control de los datos. Por eso la privacidad es una preocupación política y no solo individual”.



“Los daños pueden ser tanto individuales (que alguien te robe el número de tu tarjeta de crédito y compre algo con ella, o que alguien te robe la identidad y vaya cometiendo crímenes en tu nombre), hasta daños colectivos (que hackeen nuestra democracia, como lo intentó Cambridge Analytica, mandando propaganda personalizada, incentivando a algunas personas a votar y desincentivando a otras, o mandado fake news para confundir a la población y generar desconfianza). En casos extremos, la falta de privacidad mata; desde suicidios como resultado de una humillación pública hasta regímenes autoritarios que usan los datos personales para perseguir a ciertos colectivos (China usa datos biométricos y personales para perseguir a los uigures)”.


                                    


“No se puede garantizar la libertad de pensamiento cuando todo lo que leemos está siendo vigilado. No se puede garantizar la confidencialidad entre abogados y clientes, o médicos y pacientes, cuando todo lo que decimos se convierte en un dato que se recolecta, analiza, y vende. La falta de privacidad amenaza nuestra autonomía, nuestra capacidad de autogobernarnos, como individuos y como ciudadanía”.


martes, 23 de julio de 2019

Las ideologías ofrecen marcos generales en los que deben hallar significado los hechos particulares


Recordaba Ortega que la realidad no se nos presenta como un amontonamiento de datos, pues nuestra mente ejerce sobre ellos una inmediata ordenación, los relaciona y jerarquiza en un marco más amplio para darles sentido. De otro modo la mente se perdería en un caos de impresiones. Las ideologías ofrecen marcos generales en los que deben hallar significado los hechos particulares.



Nunca hay total acuerdo entre hechos e ideologías, pero sí grados de concordancia, desde la manifiesta falsedad a una certeza suficiente. Debemos notar que la necesidad psíquica de orden y sentido es acuciante y por ello va subtendida por una fuerte emotividad. El temor a la desorientación hace que una vez adoptamos una teoría tendamos a rechazar cualquier cuestionamiento de ella, de modo que si los hechos la desmienten suelen ser rechazados o deformados para acoplarlos a su marco.

miércoles, 6 de marzo de 2019

El hombre irritado o asustado comete errores.


Cuando somos presa de la ira o del miedo, nuestros centros cerebrales primitivos inferiores impiden en gran medida el funcionamiento de nuestro nuevo cerebro humano. Dice Manuel Smith que el torrente sanguíneo se desvía automáticamente de nuestro cerebro y de nuestro estómago para regar los músculos del esqueleto y prepararlos así para la acción física. Nuestro cerebro humano solucionador de problemas se encuentra imposibilitado para ordenar sus datos. Cuando somos presa de la ira o del miedo, somos incapaces de pensar con claridad y eficacia. Cometemos errores. Para un hombre irritado o asustado, dos y dos dejan de ser cuatro.

Por otro lado, escribe Smith, muchas personas temen exhibir sus sinceros sentimientos de amor y de comprensión porque piensan que serán avasallados y que no podrán reaccionar frente al rechazo de los demás. Si pensaran confiadamente que sí, que sin duda habrá que resolver ciertas dificultades, pero que serán perfectamente capaces de reaccionar asertivamente frente a esas dificultades, y hasta frente al rechazo de los demás, habría menos temor a exhibir sentimientos de ternura, de afecto y de amor.

jueves, 15 de marzo de 2018

Nuestras percepciones son sólo una ilusión.


Eben Alexander, neurocirujano estadounidense y profesor de la Escuela de Medicina de Harvard, manifiesta que la imagen de la conciencia humana que sostiene la mayor parte los científicos en nuestros días es que está compuesta de información digital. Datos, en esencia, como los que utilizan los ordenadores. Aunque algunos tipos de datos, ver una puesta de sol espectacular, oír una hermosa sinfonía por primera vez o incluso enamorarse, nos pueden parecer más profundos o especiales que otros, en realidad no es más
Eben Alexander
que una ilusión. Cualitativamente, todos los incontables datos que se crean y almacenan en nuestro cerebro son iguales. Nuestro cerebro modela la realidad exterior cogiendo la información que recibe a través de los sentidos y transformándola en un rico tapiz digital. Pero nuestras percepciones son sólo un modelo, no la propia realidad. Una ilusión.

martes, 17 de octubre de 2017

El poder y la política se están separando.

El poder y la política se están separando. El poder actual existe en el espacio global y extraterritorial, pero la política, que tiene que unir los intereses públicos y privados, sigue siendo local, e incapaz de actuar a un nivel planetario. Sin control político, el poder se convierte en una importante fuente de incertidumbre, mientras que los políticos se vuelven irrelevantes para responder a la mayor parte de los problemas y temores de la gente, dice Zygmunt Bauman. Incluso las fronteras nacionales, que antes tenían un emplazamiento geográfico están ahora en aeropuertos, alejados de los límites del territorio y, de manera aún más significativa, se encuentran en las bases de datos, que pueden no encontrarse siquiera dentro del país en cuestión.

la política, que tiene que unir los intereses públicos y privados es incapaz de actuar a un nivel planetario
Siguiendo con este ejemplo, el tema de las fronteras móviles provoca una gran incertidumbre en muchas personas. Es ese momento de ansiedad que uno siente al caminar por el aeropuerto, sin saber exactamente en qué jurisdicción se encuentra o quién puede estar leyendo sus datos personales, especialmente aquellos que pertenecen a una población sospechosa. Y si tiene la mala suerte de ser detenido o descubre que ha sido incluido en una lista de personas que no están autorizadas a volar, le resulta difícil saber qué debe hacer.

Sin control político, el poder se convierte en una importante fuente de incertidumbre, mientras que los políticos se vuelven irrelevantes para responder a la mayor parte de los problemas y temores de la gente

domingo, 21 de mayo de 2017

El pensamiento requiere un espacio en el que sea posible olvidar, elegir, borrar, aislar, eliminar.

La memoria no puede sino acumular datos carentes de objeto y de significado. Recuérdese “Funes el memorioso”, el cuento filosófico de Jorge Luis Borges. Funes es un joven que, volteado por un caballo que no había sido completamente domado, es víctima de una extraña enfermedad; posee una memoria súper desarrollada; está privado de toda facultad de olvido; lo retiene todo; su mente se ve transformada en una especie de enorme vertedero, un monstruoso depósito atestado de fragmentos dispares, de instantes inconexos; es un gigantesco amontonamiento de imágenes sin contexto; ningún detalle puede ser eliminado, por insignificante que sea. Esta capacidad permanente e implacable de recuerdo total y absoluto es una maldición; excluye toda posibilidad de reflexión, pues el pensamiento requiere un espacio en el que sea posible olvidar, elegir, borrar, aislar, eliminar, poner de relieve. Si no pudiéramos desechar nada del desván de la memoria, no podríamos abstraer ni generalizar. Sin abstracción ni generalización, no puede haber pensamiento.

lunes, 17 de abril de 2017

Lo invasivas que pueden llegar a ser las capacidades de vigilancia de EE.UU.

El Senado de EEUU
Los senadores demócratas Ron Wyden, de Oregón, y Mark Udall, de Nuevo México, avisaron de que los americanos se quedarían atónitos si conocieran la interpretación secreta de la ley que la administración Obama estaba utilizando para investirse de inmensos y desconocidos poderes de espionaje. Pero como esas actividades de espionaje e interpretaciones secretas eran de carácter confidencial, los dos senadores, que eran miembros del Comité de Inteligencia del Senado, decidieron no hacer público lo que habían encontrado tan preocupante a pesar de la inmunidad de que gozaban como miembros del Senado.

Instalaciones generales de la NSA 
Glenn Greenwald en su libro Snowden cuenta que “INFORMANTE SIN LÍMITES” era el nombre del programa de la NSA concebido para cuantificar las actividades de vigilancia diaria de la agencia con exactitud matemática. Un mapa del archivo ponía de manifiesto que, durante un período que finalizaba en febrero de 2013, una unidad de la NSA había recogido más de tres mil millones de datos solo de los sistemas de comunicación de EE.UU. La fuente presentaba pruebas inequívocas de que los funcionarios de la NSA habían mentido al Congreso, de manera descarada y reiterada, sobre las actividades de la agencia.James Clapper, funcionario de alto rango de la administración Obama, director de Inteligencia Nacional, mintió al Congreso cuando, el 12 de marzo de 2013, el senador Ron Wyden le preguntó lo siguiente: “¿La NSA recoge alguna clase de datos de millones o cientos de millones de norteamericanos?”. La contestación de Clapper fue tan sucinta como falsa: “No, señor”.

Durante la etapa presidencial de Obama,contó Snowden, se podía observar drones en tiempo real mientras vigilaban a gente a la que quizá matarían. Se veía pueblos enteros y lo que hacía todo el mundo. Veía a la NSA haciendo el seguimiento de actividades de ciertas personas en internet mientras tecleaban. Llegué a ser consciente de lo invasivas que eran las capacidades de vigilancia de EE.UU. Reparé en la auténtica dimensión de ese sistema. Y casi nadie sabía que estaba pasando.”Me di cuenta de que estaban creando un sistema cuya finalidad era eliminar la privacidad a escala mundial, de tal manera que toda comunicación electrónica pudiera ser recogida, almacenada y analizada por la NSA”. 

La NSA obtiene a diario registros telefónicos de millones de clientes de Verizon. Se emitió por parte de la administración Obama una orden secreta de un tribunal a Verizon para que entregue todos los datos de las llamadas lo cual pone de manifiesto el aumento de la vigilancia interna bajo el mandato de Obama.La orden exige a Verizon que, a diario y de forma regular, procure a la NSA información sobre todas las llamadas telefónicas realizadas en sus sistemas, tanto dentro de EE.UU. como entre EE.UU. y otros países. El documento pone de manifiesto que, bajo la administración Obama, se están recogiendo registros de comunicaciones de millones de ciudadanos norteamericanos en masa y de manera indiscriminada.


domingo, 19 de marzo de 2017

Los buscadores que usamos son ficheros virtuales que utilizan las palabras clave ingresadas para recorrer sus monstruosas bases de datos.

Los buscadores que usamos, como Google, Yahoo, Bing o Dudckduckgo, son una suerte de ficheros virtuales muy mejorados que utilizan las palabras clave ingresadas para recorrer sus monstruosas bases de datos. Algunos incluso aprovechan información sobre dónde nos encontramos, qué idioma hablamos y nuestras preferencias personales para afinar la búsqueda y darnos un listado de opciones más ajustada a nuestros intereses. Al hacer click sobre una de ellas, el navegador envía un mensaje a nuestro proveedor de internet y allí le indica la página solicitada y desde qué
computadora lo hacemos, es decir, nuestra dirección en internet (la dirección IP). El proveedor busca en sus servidores si tiene la información solicitada, y si no la posee lo reenvía a instancias superiores hasta que, finalmente, nuestro pedido llega a su objetivo. Una vez que la solicitud alcanza a quien tiene la información, esta se divide en paquetes que recorren la red de regreso a nuestras pantallas. Este complejo proceso puede ocurrir en instantes ya que pulsos de luz actúan como mensajeros.

jueves, 23 de febrero de 2017

Datos salvajes.

La razón por la que el sistema de traducción de Google funciona bien no es porque disponga de un algoritmo más inteligente. Funciona bien porque sus creadores, como hicieron Banko y Brill en Microsoft, lo abastecieron de más datos, y no sólo de alta calidad. Google fue capaz de usar un conjunto de datos decenas de miles de veces mayor que el del Candide de IBM porque aceptó la confusión. El corpus de un billón de palabras que Google dio a conocer en 2006 se recopiló a partir de todo el aluvión de contenido de internet; “datos salvajes”, por así decir. Ese fue el “conjunto de datos de entrenamiento” mediante el cual el sistema pudo calcular la probabilidad, por ejemplo, de que una palabra siguiese a otra en inglés. Era muy distinto de su abuelo en este campo, el célebre corpus de Brown de la década de 1960, que suponía un total de un millón de palabras inglesas. 

Peter Norvig
El usar el conjunto de datos más amplio permitió grandes avances en el procesamiento de lenguajes naturales, sobre el que se basan los sistemas para tareas como el reconocimiento de voz y la traducción por ordenador. “Los modelos simples y con un montón de datos vencen a los sistemas más elaborados basados en menos datos”, escribió Peter Norvig, gurú de la inteligencia artificial de Google, junto con unos colaboradores en un artículo titulado “La efectividad irrazonable de los datos”. Como explicaron Norvig y sus coautores, la clave estaba en la confusión: “De alguna forma, este corpus supone un paso atrás respecto al corpus de Brown: procede de páginas web sin depurar, por lo que contiene oraciones truncadas, errores ortográficos, gramaticales y de todo tipo. No se ha anotado, etiquetado ni corregido cuidadosamente a mano las distintas partes de la oración. Aun así, el hecho de ser un millón de veces más amplio que el corpus de Brown compensa.

viernes, 9 de diciembre de 2016

Estadísticas.

Kenneth Cukier and Viktor Mayer-Schonberger
Los estadísticos han demostrado que la precisión de la muestra mejora acusadamente con la aleatoriedad, no con el mayor tamaño de la muestra. En realidad, aunque pueda parecer sorprendente, una muestra aleatoria de 1.100 observaciones individuales sobre una pregunta binaria(sí o no,con aproximadamente las mismas probabilidades de darse) es notablemente representativa de toda la población. En 19 de cada 20 casos, presenta un margen de error inferior al 3 por 100, tanto si el tamaño de la población total es de cien mil como si es de cien millones, escribe Mayer-Schönberger y Kenneth Cukier. La razón resulta algo complicada de explicar en términos matemáticos, pero en resumen lo que ocurre es que, superado cierto punto, al principio, conforme las cifras van haciéndose mayores, la cantidad marginal de informaciones nuevas que se consigue de cada observación es cada vez menor. El hecho de que la aleatoriedad se impusiera al tamaño de la muestra supuso una revelación sorprendente. Allanó el camino para un nuevo enfoque de la recolección de información. Los datos que usan muestras aleatorias podían recopilarse a bajo coste y, sin embargo, extrapolarse para el conjunto con gran exactitud.
Su exactitud depende de que se haya garantizado la aleatoriedad al recopilar los datos de la muestra, pero el logro de esa aleatoriedad resulta peliagudo. Se producen sesgos sistemáticos en la forma de recopilar los datos que pueden hacer que los resultados extrapolados sean muy incorrectos. Las encuestas electorales efectuadas por teléfono fijo dan fe, por ejemplo, de algunos de estos problemas. La muestra está sesgada en contra de la gente que sólo usa teléfonos móviles (que suelen ser más jóvenes y más progresistas), como ha señalado el estadístico Nate Silver. Esto se ha constatado en pronósticos electorales erróneos. En la elección presidencial de 2008 entre Barack Obama y John McCain, las principales empresas de sondeos electorales de Gallup, Pew y ABC/Washington Post hallaron diferencias de entre uno y tres puntos porcentuales al efectuar las encuestas, con y sin ajuste a los usuarios de teléfono móvil. Un margen excesivo, considerando lo ajustado de la contienda. De forma aún más preocupante, el muestreo aleatorio no resulta sencillo de extrapolar para incluir subcategorías, por lo que al parcelar los resultados en subgrupos cada vez menores aumenta la posibilidad de llegar a predicciones erróneas. 


Supongamos que se le pregunta a una muestra aleatoria de mil personas por su intención de voto en las siguientes elecciones. Si la muestra es lo suficientemente aleatoria, existen posibilidades de que los pareceres de toda la población estén recogidos con un margen de error del 3 por 100 en las opiniones de la muestra. Pero, ¿qué ocurre si más o menos 3 por 100 no es lo bastante preciso? ¿O si después se quiere dividir el grupo en subgrupos más pequeños, por sexo, localidad, o nivel de renta? ¿Y qué pasa si se desea combinar esos subgrupos para determinar un nicho de la población? En una muestra global de mil personas, un subgrupo como el de “mujeres ricas votantes del nordeste” tendrá menos de cien miembros. Usar sólo unas pocas docenas de observaciones para pronosticar las intenciones de voto de todas las mujeres pudientes en el nordeste resultará impreciso, aun con una aleatoriedad cuasiperfecta. Y estos pequeños sesgos en la muestra global harán que los errores de los subgrupos sean más pronunciados. Por consiguiente, el muestreo deja de ser útil en cuanto se quiere ahondar más, para escrutar minuciosamente alguna subcategoría de datos que nos llame la atención. Lo que funciona en el nivel macro se viene abajo en el micro. El muestreo es como una copia fotográfica analógica. A cierta distancia, se ve muy bien, pero cuando se mira más de cerca, enfocando algún detalle particular, se vuelve borrosa.