Sunday, August 9, 2009

Facebook: privacy issues


A social Network is an umbrella term that defines the various activities that integrate technology, social interactions and the construction of words, pictures, video and audio. Facebook (FB) is a social networking website that is owned and operated privately by FB Inc. It’s supposed that FB links people through social networks at schools. In its early version it was a way for student to connect with people they know, go to school with, share interests with, etc.
FB was founded in 2004 by Mark Zuckerberg and 3 of his colleagues while they were students at Harvard University. Website membership was initially limited to Harvard students; later expanded further to include any university student, then high school students, and, finally, to anyone aged 13 and over. The website currently has more than 250 million active users worldwide; 120 million users log on to FB at least once each day and more the third of users are outside colleges. 12 millions of Canadian use FB


Privacy
Internet Designers try to make user friendly applications; though, they invented what they called “Default Settings”. Each time when you sign up for a new membership you’ll see this feature. When you sign up as a user of FB, and you use default settings this means you allow all other FB users to find you in searches.

FB’s information philosophy — and default settings — is to share almost everything that you’ve included in your FB account. That means if you’ve never changed your privacy settings, your FB profile is shared with not only all your friends and groups, but also with everyone in every network you join. That’s a lot of sharing. And, according to the FB users’ agreement policy: entered information is belonging to FB.
Meanwhile, FB provides their users with an arsenal of privacy control and settings.
You should control over:
• Information you share in your profile
• Information people see when they search for you
• Information on actions you take with other people
• Information available to others when you contact them
• Privacy controls for applications you’ve added to your account
Search settings: By default, everyone can find our profile listing in a public search. This includes users on FB, and potentially people searching on Google, Yahoo, and MSN.
If you insist to keep yourself searchable, you should strictly limit the information you’re leaving on that public listing. More, it’s highly recommend, that you don’t “go public”.
Profile settings: Here’s where you have control over the contact information you provide to other people. If you’re in one or more of FB’s Networks, you have the option of either displaying your contact information to only your friends, or to everyone. Again, we recommend that you limit sharing information to only friends and you should specify that “no one” can see your e-mail and contact information.
Therefore, there is several privacy concerns related to FB. One the first was the Beacon initiative. Lunched in 2007 as marketing product, this feature allowed websites to publish a user's activities to their FB profile as "Social Ads" and promote products. FB’s users had to decide whether they want or not to exclude companies from getting their profiles “opt-out”. FB decided to adopt an “opt-in” politics which mean users should subscribe to this service with companies.
Other issue was raised regarding the use of FB as a means of surveillance and data mining. Two MIT students were able to download over 70,000 FB profiles from four schools using an automated shell script, as part of a research project on FB privacy published on December 14, 2005.
Problems have also been reported regarding the difficulty of deleting user accounts. Previously, FB only allowed users to "deactivate" their accounts so that their profile was no longer visible. However, any information the user had entered into the website and on their profile remained on the website's servers. This outraged many users who wished to remove their accounts permanently. FB changed its account deletion policies on February 29, 2008, allowing users to contact the website to request that their accounts be permanently deleted. In July 2009 it came to light that there are concerns by the Canadian Privacy Commission that FB is not respecting several Canadian privacy laws by not deleting a user's information when their account is deactivated and by giving "confusing or incomplete" information to subscribers. FB’s Chief Privacy Officer Chris Kelly was quoted as saying that FB was working with the commission to resolve the issues. The CPC have given FB 30 days before they make a further review and recommendations. If FB don't comply with the Canadian statutes it's possible that the issue could be taken to the federal courts.

Monday, June 29, 2009

Collective Intelligence


Collective intelligence
is a shared or group intelligence that emerges from the
collaboration and competition of many individuals. Collective intelligence appears
in a wide variety of forms of consensus decision making in bacteria, animals, humans,
and computer networks. The study of collective intelligence may properly be considered
a subfield of sociology, of business, of computer science, of mass communications and
of mass behavior—a field that studies collective behavior from the level of quarks to
the level of bacterial, plant, animal, and human societies.


Collective Intelligence means many things to many people. It may refer to the capacity of human communities to evolve towards higher order complexity and integration through collaboration and innovation.
One of the most intriguing aspects of collective intelligence is its relative independence from individual intelligence.


One measure sometimes applied, especially by more artificial intelligence focused theorists,
is a "collective intelligence quotient" (or "cooperation quotient")—which presumably can
be measured like the "individual" intelligence quotient (IQ)—thus making it possible to
determine the marginal extra intelligence added by each new individual participating in
the collective, thus using metrics to avoid the hazards of group think and stupidity.

In 2001, Tadeusz (Ted) Szuba from the AGH University in Poland proposed a formal model for
the phenomenon of Collective Intelligence. It is assumed to be an unconscious, random,
parallel, and distributed computational process, run in mathematical logic by the social
structure.


In this model, beings and information are modeled as abstract information molecules
carrying expressions of mathematical logic. They are quasi-randomly displacing due to
their interaction with their environments with their intended displacements.
Their interaction in abstract computational space creates multithread inference process
which we perceive as Collective Intelligence. Thus, a non-Turing model of computation is
used. This theory allows simple formal definition of Collective Intelligence as the
property of social structure and seems to be working well for a wide spectrum of beings,
from bacterial colonies up to human social structures. Collective Intelligence considered
as a specific computational process is providing a straightforward explanation of several
social phenomena. For this model of Collective Intelligence, the formal definition of IQS
(IQ Social) was proposed and was defined as "the probability function over the time and
domain of N-element inferences which are reflecting inference activity of the social
structure." While IQS seems to be computationally hard, modeling of social structure in
terms of a computational process as described above gives a chance for approximation.
Prospective applications are optimization of companies through the maximization of their
IQS, and the analysis of drug resistance against Collective Intelligence of bacterial
colonies.

Monday, June 22, 2009

Catalogue de donees Geo saptiales


Un exemple d’implémentation Open Source : le catalogue de données géospatiales MEGAPHONE

MEGAPHONE est un groupe de recherche en santé publique du Centre de recherche du Centre hospitalier de l’Université de Montréal (CHUM). MEGAPHONE, c’est l’acronyme pour « Modèles épidémiologiques et géographiques d’analyse des populations humaines pour l’optimisation de nos environnements ». Il s'agit d'un petit groupe de recherche formé de chercheurs issus de disciplines diverses: épidémiologistes, géomaticiens, statisticiens, etc. Par extension, MEGAPHONE est aussi le nom de l’interface Web qu’ils ont élaborée. Le catalogue MEGAPHONE est une infrastructure de données spatiales développée pour soutenir le travail de documentation, d’analyse et de compréhension de l’influence du milieu sur la santé des populations dans la région de Montréal.

Pour les fins de leur recherches, les chercheurs ont rassemblé un ensemble de bases de données spatialement référencées et travaillé à l’élaboration d’un catalogue en ligne permettant notamment de faire de la gestion des métadonnées, de les classifier, les créer, les éditer, les visualiser, les décrire et les publier, en plus d’offrir les outils pour faire des recherches sur ces métadonnées. Rappelons que ces métadonnées, quant à elles, peuvent être définies comme des informations permettant de décrire et de localiser (dans le temps et dans l’espace) une donnée ou une information, et de faire en sorte qu’il soit facile de retrouver les sources sur lesquelles elle porte. En somme, les métadonnées sont des données sur les données – dans ce cas-ci des données spatiales. Ce qui suit est donc une description du catalogue MEGAPHONE.

Pourquoi un catalogue MEGAPHONE?

MEGAPHONE est un SIG qui gère une variété de bases de données géospatiales et aspatiales. Ces données caractérisent les facteurs environnementaux (pollution atmosphérique, mauvaise qualité de l’air intérieur, problèmes d’aménagement urbain, etc.) impliqués dans les mécanismes influençant les habitudes de vie menant à des problèmes sociaux (1) . Ainsi, MEGAPHONE contient des outils et méthodes permettant de faire toutes sortes d’analyse spatiale (autocorrélation spatiale, Krigeage, Tesselation, kernel, etc.). Les chercheurs utilisent souvent des méthodes statistiques telles l’analyse multi-niveaux, la régression multiple, etc.

Le but de ce SIG est de répondre à des questions du genre : comment les caractéristiques Socio-économiques d’un quartier peuvent-elles modifier les relations entre l’environnement bâti et les habitudes de vie (par exemple, proximité d’établissements de restauration rapides des écoles)? Quels sont les processus qui mènent à des modifications des politiques et des environnements et quel est le rôle pour la recherche et les données probantes dans ces processus? Etc. Ce faisant, MEGAPHONE offre aux chercheurs les finalités suivantes :

  • Mesurer les caractéristiques sociales et environnementales de certaines unités spatiales ;
  • Soutenir l’élaboration de plans d’échantillonnage tenant compte des caractéristiques sociales et environnementales de la région métropolitaine de recensement (RMR) de Montréal, et plus particulièrement de la ville de Montréal même;
  • Analyser les liens entre les différentes caractéristiques en utilisant les méthodes et les outils appropriés.

Description

La réalisation du catalogue a nécessité une démarche complète de développement de systèmes d’information. Une partie de l’analyse permet de déceler les besoins immédiats des chercheurs, que l’on peut résumer comme suit :

  • Outils permettant de faire la collecte, structurer et analyser des informations en tenant compte de leurs caractéristiques géographiques;
  • Environnement distribué, permettant de connecter de nombreuses bases de données provenant de différentes sources et utilisant des standards, interopérabilité, flexibilité, etc.
  • Interface d’utilisation - plateforme Web - du géocatalogue, avec liens entre les catégories d’information et visualisation cartographique.
  • Possibilité d’échange et transfert de connaissance avec les partenaires.

Étant donné les critères mentionnés plus haut, les contraintes financières, le temps alloué et les avantages envisagés, notre équipe a opté pour un « framework » Open Source. GeoNetwork (GN) sert d’ossature et supporte le catalogue de données, qui pourra être enrichi au fur et à mesure de l’ajout de nouvelles données. En partant, GeoNetwork présente les fonctionnalités suivantes :

· Service de portail. GeoNetwork fournit l’accès et l’administration des usagers (authentifications, contrôle d’accès, gestion de privilèges, etc.). Ce module fournit aussi un éditeur de métadonnées (Dublin-Core, FGDC et ISO) en plus d’un outil de visualisation de cartes géographiques. GeoNetwork suit, à ce niveau, les standards de l’OGC (Open Geospatial Consortium). GeoNetwork peut aussi se connecter à des applications ESRI en utilisant les protocoles d’ArcIMS.

· Service de catalogage. Il est possible de faire la saisie, l’enregistrement et la maintenance de métadonnées stockées dans des bases de données selon le standard CSW 2.0. Le service de catalogage fournit un outil pour faire des recherches d’information sur des données spatiales faites par d’autres outils (protocoles Z39.50, WebDAV, etc.) et vice versa. Cela signifie que GeoNetwork peut aussi, à son tour, être accédé à distance par d’autres applications (on parlera ici de nœuds).

· Service de traitement des données. GeoNetwork fournit l’accès au contenu spatial des bases de données et autres registres de données, pour en permettre le traitement. Ce service peut être local ou distribué à travers l‘Internet. Le stockage de donnés est fait (dans notre catalogue) dans une base de données PostgreSQL avec l’extension PostGIS.

Étant donné que ces fonctionnalités ne suffisent pas à répondre aux besoins des chercheurs, la personnalisation commence par l’ajout de deux fonctionnalités suivantes :

· Gestion de signets par les utilisateurs : un utilisateur peut (selon le groupe auquel il appartient et les privilèges qui lui sont assignés) créer, éditer et visualiser des signets des métadonnées les plus visitées selon les catégories existantes dans la base de données.

· Gestion des relations entre les métadonnées : un utilisateur peut chercher à lier des métadonnées entre elles : création, visualisation et édition.

· Le géocatalogue MEGAPHONE utilise aussi un module de visualisation des relations (« Explorateur de relations ») qui permet de mettre en valeur les différentes entités d’un catalogue : il s’agit d’un module Flash (développé en partenariat avec la compagnie montréalaise GeoStem) qui permet, selon un système de classification donné, de visualiser des relations hiérarchiques entre les entités liées. Ce module permet une visualisation des relations à plusieurs niveaux.

De plus, dans l’optique d’avoir un géocatalogue distribué, le groupe MEGAPHONE a développé, pour les besoins de ses recherches, des patrons (templates) de métadonnées pour les catégories « Chercheurs » et « Projets ». Cela permettra aux nœuds partenaires de MEGAPHONE de moissonner notre catalogue.

Dans cet esprit, il n’y presque plus de centralisation de données, il y a plutôt une série de nœuds. Chaque partenaire devient un nœud producteur ou utilisateur, avec des rôles qui peuvent ressembler a ce qui suit :

Nœud producteur :

  • Produire des fiches de métadonnées standardisées pour les données
  • Associer les données à leur fiche descriptive

Nœud moissonnant ou utilisateur :

  • Recherche par type de données
  • Recherche cartographique
  • Recherche par multicritères (Quoi, Où, Quand)
  • Recherche multi-catalogue via le protocole CSW

Architecture

Le « framework » GeoNetwork (développé par un consortium d’organismes des Nations Unies) est conçu selon une architecture J2EE à trois couches, développée en Java/XML/JDBC, et est distribuée sous une licence GPL. Son architecture se compose de essentiellement de trois modules :

  • Moteur XML_XSL : ce module appelé Jeeves sépare la couche présentation de la couche application et assure un accès Client-Serveur selon plusieurs modes : HTML, XML, Z39.50, SOAP, etc;
  • une couche métier pour la gestion des métadonnées supportant plusieurs standards (FGDC, ISO, Dublin Core et des normes personnalisées) et les services qui permettent l’accès et les manipulations sur ces métadonnées;
  • un moteur de recherche pour l’indexation des métadonnées et facilitant les recherches distantes (protocoles Z39.50, etc.).




Le contenu de la base de données visible en ligne reflète une partie des activités des chercheurs. Ces données ont été divisées en trois catégories : « Chercheurs », « Projets de recherches » et « Jeux de données ». Les deux premières catégories ont été implémentées suivant des patrons (« Templates ») MEGAPHONE répondant aux besoins des chercheurs, tandis que la dernière est implémentée selon le patron ISO 19115/19139.

Défis et développements futurs

Plusieurs défis ont été rencontrés durant pour la mise en ligne de la version Beta actuelle. En voici quelques-uns :

  • Gérer ce qui est standard et ce qui ne l’est pas au sein du même catalogue. Par exemple, notre catalogue, se voulant répondre complètement aux normes OGC et standards ISO, devait aussi héberger des données qui ne sont pas décrites par des normes reconnues internationalement (comme c’est le cas des catégories « Chercheur », « Projets de recherche », etc.). Un travail important a été réalisé à ce niveau pour essayer de trouver un patron exhaustif qui décrit les données spatiales. Ce patron n’est pas encore implémenté.
  • La personnalisation de l’application a requis un temps important : personnaliser l’architecture afin de répondre à nos besoins tout en gardant à l’esprit les mises à jour (une nouvelle version de GeoNetwork est annoncée pour le mois de mars 2009) et les collaborations avec d’autres entités (ou nœuds).

Pour ce qui est des développements futurs, nous en prévoyons plusieurs, dont :

1- Une gestion de l’affichage selon l’usager : dans l’état actuel de notre catalogue une métadonnée est affichée en entier peu importe le profil de l’usager. Il serait pour nous important, dans la deuxième étape, de faire un affichage qui dépend des privilèges de l’usager.

2- Une gestion complète des langues : actuellement, une métadonnée est stockée soit en français, soit en anglais. Puisque l’interface est bilingue, si l’on veut voir une métadonnée dans les deux langues, il faut la stocker en double (comme s’il s’agissait de deux enregistrements différents dans la BD). Nous voudrions éviter ce genre de situation et en arriver à ce qu’un affichage dans les deux langues puisse se faire de manière appropriée.

En conclusion, nous pouvons dire que la première phase de développement du catalogue MEGAPHONE a été réalisée avec succès. Elle nous a permis de voir (et aussi de prouver) à quel point un catalogue de données en ligne peut être utile. Les chercheurs ont dorénavant un outil de mise à jour de connaissances (ce qui est important pour lutter contre l’obsolescence des données) et de se maintenir conformes aux standards internationaux. Ce catalogue permet aux chercheurs (de plusieurs groupes) de travailler sur un système unique et de centraliser les informations, réduire les risques de pertes (échange par email) et les coûts de diffusion (impression papier); garantir l’intégrité, la sécurité et l’exactitude des données.


(1)

« …environnementaux et leur rôle dans les mécanismes qui engendrent des habitudes de vie, qui se transforment elles-mêmes en problèmes sociaux. En somme, l’influence du milieu sur la santé, par le biais du mode de vie »

Sunday, March 29, 2009

Why this blog

Bonjour. (English below)
Ce blog se veut un essai parmi des millions d'autres pour promouvoir la liberalisation de données. A l'aube du Web 3.0 il faut regarder bien l'avenir. Les données produites avec l'argent des contribuables ne doivent pas etre payantes: astronomique, geospatiale, santé, etc.

Hi.
This blog is a trial among millions others to promote the liberalization of data. At the dawn of Web 3.0 we must be looking the future. The data produced with taxpayer money should not be paying off (we pay it twice). These data (astronomical, geospatial, health, etc.) should be free of charge.

Données de Landsat Gratuites


Finalement, les données de LandSat (1-5 et 7) sont telechargeable gratuitement sur le site de USGS: http://glovis.usgs.gov/.
Les utilisations de ces données sont nombreuses et peuvent profiter à tout le monde.
J'espere que cela encourage d'autres gouvernements a en faire autant.
Ces timides tentatives que l'on voit ci et là vont finir, espererons le, vont finir par convaincre les réticents à la liberation de données.