Strumenti fondamentali nei sistemi per il knowledge management delle organizzazioni sono quelli che permettono alle persone di comunicare e interagire senza barriere, nelle varie modalità oggi consentite, soprattutto attraverso i pc e la rete internet. per questo si parla di Computer Mediated Communication.
Bisogna distinguere due tipi di Computer Mediated Communication:
- Sincrona, in cui la comunicazione avviene in tempo reale, come ad es. in un dialogo telefonico o in uno scambio conversazionale face to face e gli interlocutori sono presenti in rete nel medesimo istante. I mezzi tipici della CMC sincrona sono le videoconferenze, le chat, l'Internet Phone e i servizi di Instant Messaging. Le caratteristiche proprie della CMC sincrona sono: la multimedialità, l'ipertestualità, l'uso di pacchetti di dati per trasferire le informazioni, la sincronicità e l'interattività.
- Asincrona, nella quale lo scambio di messaggi avviene in tempi differenti e gli interlocutori non devono essere necessariamente connessi contemporaneamente. Tra i mezzi che presentano un tipo di CMC asincrona vi sono: la posta elettronica, le mailing list e i newsgroup. Esistono, inoltre, dei sistemi misti denominati MUD (Multi User Dungeon o Multi User Domain), che sono giochi di ruolo, ambienti virtuali di tipo testuale all'interno dei quali i partecipanti hanno la possibilità di conversare tra loro, come in una chat, ma anche di visitare lo spazio in cui si trovano e di interagire con gli oggetti che sono collocati in quel luogo.
Gli strumenti per la Computer Mediated Communication sono:
1. L’ E-Mail o Electronic Mail . È l'applicazione Internet più conosciuta e più utilizzata attualmente. La sua nascita risale al 1972, quando Ray Tomlinson installò su ARPANET un sistema in grado di scambiare messaggi fra le varie università, ma chi ne ha realmente definito il funzionamento fu Jon Postel. Lo scopo del servizio di e-mail è il trasferimento di messaggi da un utente ad un altro. Ciascun utente può possedere una o più caselle e-mail, su cui può ricevere messaggi, che vengono conservati per lui. Quando lo desidera, l'utente può consultare il contenuto della sua casella, organizzarlo, inviare messaggi a uno o più utenti. L'accesso alla casella di posta elettronica è normalmente controllato da una password o da altre forme di autenticazione. La modalità di accesso al servizio è quindi asincrona, ovvero per la trasmissione di un messaggio non è necessario che mittente e destinatario siano contemporaneamente attivi o collegati. La consegna al destinatario dei messaggi inviati non è garantita. Nel caso un server SMTP non riesca a consegnare un messaggio che ha ricevuto, tenta normalmente di inviare una notifica al mittente per avvisarlo della mancata consegna, ma anche questa notifica è a sua volta un messaggio di e-mail (generato automaticamente dal server) e quindi anche questa consegna non è garantita.
2. IM - Instant Messaging o sistema di messaggistica istantanea è un sistema di comunicazione solitamente client-server per computer che consente di scambiare in tempo reale, fra utenti di due computer connessi in rete, frasi e brevi testi: è la moderna versione del vecchio servizio talk di UNIX. È differente dalla e-mail perché lo scambio è istantaneo ed è più evoluto del suo predecessore perché le frasi compaiono istantaneamente e non lettera per lettera. Inoltre, spesso vengono offerti anche altri servizi oltre al semplice invio di messaggi. Sostanzialmente, un moderno sistema di IM consiste in un programma server centrale, che gira su una macchina apposita, a cui si collegano i programmi client su ciascun computer collegato in rete: il server tiene traccia di quali computer e quali utenti sono connessi al sistema e gestisce le comunicazioni fra i vari programmi client. Per motivi di sicurezza, ai vari client non viene in generale fornito l'indirizzo di rete del corrispondente con cui sono in comunicazione, tuttavia per motivi di efficienza, durante lo scambio di file oppure di flussi streaming (audio e video in tempo reale fra client) il server comunica a ciascun client l'indirizzo di rete dell'altro per permettere ai due di scambiarsi i dati direttamente senza farli passare per il server. In alcune applicazioni di IM se un utente contattato non è connesso in quel momento, il server memorizza il messaggio per alcune ore e lo recapita all'utente chiamato appena questi si connette, se lo fa entro un tempo limite.
3. Videoconferencing o sistema per la videoconferenza è la combinazione delle tecnologie:
- videotelefonia, che permette di vedere soltanto il proprio interlocutore;
- videoconferenza vera e propria, che permette a più persone di condividere un unico canale di comunicazione;
- videoconferenza per la didattica a distanza, per l'apprendimento di gruppo, che avviene in aule attrezzate e l'ausilio di un tutor in presenza che garantisce e stimola l'interazione in tempo reale col docente e tra gli allievi e per l’apprendimento individuale con studenti collegati contemporaneamente e un docente che interagisce in tempo reale tramite comunicazioni internet (e-mail, chat).
Oltre alla possibilità di vedere il proprio interlocutore, la videoconferenza permette di disporre di:
- un pannello di controllo dove sono indicati i soggetti partecipanti;
- uno spazio di lavoro virtuale comune, in cui tutti i partecipanti possono condividere testi, immagini, tabelle ed altre informazioni;
- un ausilio di tutor in aula.
La videoconferenza rappresenta l'interazione sincrona in audio, video e dati fra due o più soggetti. La possibilità di comunicare in videoconferenza dipende dalla disponibilità di apparati che supportino la cattura, codifica, trasmissione e decodifica di audio e video e dalla capacità degli apparati stessi di colloquiare secondo un protocollo standard comune.
venerdì 14 maggio 2010
venerdì 7 maggio 2010
I Sistemi di Business Intelligence nei progetti di knowledge management
La Business Intelligence è quell'insieme di strumenti e metodi che consentono e agevolano la ricerca e la trasformazione dei dati aziendali in informazioni utili, a supporto dell'attività decisionale del management.
Le applicazioni di Business Intelligence consentono la manipolazione e l'integrazione delle informazioni in tempo reale e in maniera interattiva, riducendone i costi di accesso. Aiutano a prevenire la potenziale perdita di conoscenza derivante dall'accumulo dei dati conservati in vari sistemi e non realmente fruibili.
Le aree aziendali coinvolte per l'implementazione di progetti di Business Intelligence possono essere diverse:
- il marketing, con le esigenze di analisi delle attività del settore (analisi della concorrenza, per lo sviluppo di nuovi prodotti, per rilevare e migliorare la customer satisfaction, per le analisi di geo-marketing, per lo studio delle potenzialità di mercato, di un prodotto o di un punto vendita, profiling del consumatore, segmentazioni, analisi del comportamento d'acquisto dei propri clienti, individuazione dei migliori gruppi target per azioni promozionali o per attività di direct marketing);
- le vendite, per tutta l'attività di monitoraggio del canale al fine di migliorarne le performances;
- il controllo finanziario e di gestione, per le esigenze di pianificazione controllo dei budget e dei costi aziendali;
- la supply chain, per il monitoraggio dei processi e il miglioramento dell'efficienza.
Un sistema di Business Intelligence prevede una metodologia composta da varie fasi:
- analisi di fattibilità (lato tecnico ed economico, definizione degli obiettivi, analisi dell' impatto organizzativo)
- definizione del business model (definizione delle esigenze informative e funzionali, identificazione delle informazioni e delle dimensioni di analisi rilevanti per il target identificato)
- mappatura delle sorgenti dati
- identificazione delle criticità tra obiettivi e dati disponibili
- definizione e scelta della piattaforma tecnologica e delle infrastrutture
- creazione del prototipo
- sviluppo e implementazione del sistema di Business Intelligence.
L'architettura di un sistema di Business Intelligence prevede tre livelli di intervento:
1. ad un primo livello troviamo i sistemi informativi alimentanti di tipo operativo (On-Line Transaction Processing) che contengono dati strutturati e destrutturati (sistemi ERP, portali, applicazioni varie, e-commerce, sistemi di CRM) dai quali, con software specialistici (ECTL - Extraction, Cleaning Transformation and Loading) viene effettuata l'estrazione, la mappatura, la cernita, la trasformazione e il trasferimento dei dati elementari nelle basi dati di tipo data warehouse e data mart;
2. al secondo livello troviamo le basi dati direzionali (data warehouse e data mart), nelle quali i dati vengono integrati e archiviati sia in db di tipo relazionale, sia in db di tipo multidimensionale. Queste basi dati alimentano i sistemi di business intelligence che si trovano al livello successivo dell'architettura;
3. in questo terzo livello, si posizionano le applicazioni (Analytic Applications e Decision Support System tools) e i tools (Executive Information System, On-Line Analytical Processing, Geographic Information System, Multidimensional Analysis, Data Mining) per l'attività di business intelligence vera e propria.
Un sistema di Business Intelligence persegue un obiettivo principale che è il taglio dei costi e dei tempi di accesso alle informazioni strategiche per l'azienda, attraverso l'integrazione dei dati storici e la loro successiva manipolazione secondo fini diversificati.
I benefici della sua implementazione derivano dalla valutazione dei seguenti parametri:
- vantaggi strategici, miglioramento delle capacità di decision making, aumento delle revenues, riduzione dei costi, distribuzione di strumenti più efficaci agli utenti, capacità di storicizzazione e analisi dei dati transazionali;
- vantaggi tattici, capacità di fare analisi multidimensionali e di interagire con scenari specifici;
- vantaggi operativi, capacità di intervento immediato a fronte di scostamenti rilevati tra risultati attesi ed effettivi;
- vantaggi funzionali, perseguiti con specifiche applicazioni per i settori aziendali di riferimento.
Gli sviluppi naturali di un sistema di Business Intelligence sono tutti quegli applicativi in grado di integrare e condividere, attraverso una piattaforma unificata, sia le informazioni strutturate che quelle destrutturate, andando a realizzare un sistema di Business Performance Management, finalizzato allo sviluppo di strategie, processi e programmi per la valutazione e la misurazione delle prestazioni individuali e per il relativo collegamento con modelli e indicatori di risultato a livello aziendale.
I punti di forza di un sistema di Business Performance Management sono:
- la capacità previsionale;
- l'analisi in tempo reale contemporaneamente al verificarsi dell'evento;
- il coinvolgimento di diverse funzioni aziendali nell'analisi;
- l'elevata capacità di integrazione con le altre applicazioni aziendali.
Un progetto di Business Intelligence può, ad esempio, essere impiegato per: l’ottimizzazione dei processi aziendali con l'ausilio e l'implementazione di sistemi di georeferenziazione della situazione analizzata; la realizzazione di sistemi informativi territoriali per la strutturazione e il monitoraggio di attività di distribuzione a livello nazionale; la realizzazione di cruscotti direzionali; l’implementazione di sistemi informativi volti a fornire monitoraggio e report statistici di specifiche attività aziendali; il monitoraggio del rapporto commerciale con i clienti, relativo ad esempio alla customer value o alla profittabilità del cliente, ai trend di fatturato; l’analisi della concorrenza; il monitoraggio del livello di produzione e rendimento delle risorse umane.
Le applicazioni di Business Intelligence consentono la manipolazione e l'integrazione delle informazioni in tempo reale e in maniera interattiva, riducendone i costi di accesso. Aiutano a prevenire la potenziale perdita di conoscenza derivante dall'accumulo dei dati conservati in vari sistemi e non realmente fruibili.
Le aree aziendali coinvolte per l'implementazione di progetti di Business Intelligence possono essere diverse:
- il marketing, con le esigenze di analisi delle attività del settore (analisi della concorrenza, per lo sviluppo di nuovi prodotti, per rilevare e migliorare la customer satisfaction, per le analisi di geo-marketing, per lo studio delle potenzialità di mercato, di un prodotto o di un punto vendita, profiling del consumatore, segmentazioni, analisi del comportamento d'acquisto dei propri clienti, individuazione dei migliori gruppi target per azioni promozionali o per attività di direct marketing);
- le vendite, per tutta l'attività di monitoraggio del canale al fine di migliorarne le performances;
- il controllo finanziario e di gestione, per le esigenze di pianificazione controllo dei budget e dei costi aziendali;
- la supply chain, per il monitoraggio dei processi e il miglioramento dell'efficienza.
Un sistema di Business Intelligence prevede una metodologia composta da varie fasi:
- analisi di fattibilità (lato tecnico ed economico, definizione degli obiettivi, analisi dell' impatto organizzativo)
- definizione del business model (definizione delle esigenze informative e funzionali, identificazione delle informazioni e delle dimensioni di analisi rilevanti per il target identificato)
- mappatura delle sorgenti dati
- identificazione delle criticità tra obiettivi e dati disponibili
- definizione e scelta della piattaforma tecnologica e delle infrastrutture
- creazione del prototipo
- sviluppo e implementazione del sistema di Business Intelligence.
L'architettura di un sistema di Business Intelligence prevede tre livelli di intervento:
1. ad un primo livello troviamo i sistemi informativi alimentanti di tipo operativo (On-Line Transaction Processing) che contengono dati strutturati e destrutturati (sistemi ERP, portali, applicazioni varie, e-commerce, sistemi di CRM) dai quali, con software specialistici (ECTL - Extraction, Cleaning Transformation and Loading) viene effettuata l'estrazione, la mappatura, la cernita, la trasformazione e il trasferimento dei dati elementari nelle basi dati di tipo data warehouse e data mart;
2. al secondo livello troviamo le basi dati direzionali (data warehouse e data mart), nelle quali i dati vengono integrati e archiviati sia in db di tipo relazionale, sia in db di tipo multidimensionale. Queste basi dati alimentano i sistemi di business intelligence che si trovano al livello successivo dell'architettura;
3. in questo terzo livello, si posizionano le applicazioni (Analytic Applications e Decision Support System tools) e i tools (Executive Information System, On-Line Analytical Processing, Geographic Information System, Multidimensional Analysis, Data Mining) per l'attività di business intelligence vera e propria.
Un sistema di Business Intelligence persegue un obiettivo principale che è il taglio dei costi e dei tempi di accesso alle informazioni strategiche per l'azienda, attraverso l'integrazione dei dati storici e la loro successiva manipolazione secondo fini diversificati.
I benefici della sua implementazione derivano dalla valutazione dei seguenti parametri:
- vantaggi strategici, miglioramento delle capacità di decision making, aumento delle revenues, riduzione dei costi, distribuzione di strumenti più efficaci agli utenti, capacità di storicizzazione e analisi dei dati transazionali;
- vantaggi tattici, capacità di fare analisi multidimensionali e di interagire con scenari specifici;
- vantaggi operativi, capacità di intervento immediato a fronte di scostamenti rilevati tra risultati attesi ed effettivi;
- vantaggi funzionali, perseguiti con specifiche applicazioni per i settori aziendali di riferimento.
Gli sviluppi naturali di un sistema di Business Intelligence sono tutti quegli applicativi in grado di integrare e condividere, attraverso una piattaforma unificata, sia le informazioni strutturate che quelle destrutturate, andando a realizzare un sistema di Business Performance Management, finalizzato allo sviluppo di strategie, processi e programmi per la valutazione e la misurazione delle prestazioni individuali e per il relativo collegamento con modelli e indicatori di risultato a livello aziendale.
I punti di forza di un sistema di Business Performance Management sono:
- la capacità previsionale;
- l'analisi in tempo reale contemporaneamente al verificarsi dell'evento;
- il coinvolgimento di diverse funzioni aziendali nell'analisi;
- l'elevata capacità di integrazione con le altre applicazioni aziendali.
Un progetto di Business Intelligence può, ad esempio, essere impiegato per: l’ottimizzazione dei processi aziendali con l'ausilio e l'implementazione di sistemi di georeferenziazione della situazione analizzata; la realizzazione di sistemi informativi territoriali per la strutturazione e il monitoraggio di attività di distribuzione a livello nazionale; la realizzazione di cruscotti direzionali; l’implementazione di sistemi informativi volti a fornire monitoraggio e report statistici di specifiche attività aziendali; il monitoraggio del rapporto commerciale con i clienti, relativo ad esempio alla customer value o alla profittabilità del cliente, ai trend di fatturato; l’analisi della concorrenza; il monitoraggio del livello di produzione e rendimento delle risorse umane.
Etichette:
business intelligence,
business performance maangement,
cruscotti direzionali,
knowledge management
venerdì 30 aprile 2010
I Sistemi di Information Retrieval e i Search Engines nei progetti di knowledge management
Un progetto focalizzato sulla gestione della conoscenza aziendale non può prescindere dall'inserimento di sistemi per la ricerca delle informazioni, anzi questi ne costituiscono un tassello fondamentale. Vengono implementati sistemi per ricerche sulle informazioni interne ad una organizzazione, da integrare con sistemi per la ricerca di informazioni esterne, secondo un criterio testuale o semantico.
In linea generale, l'Information Retrieval è l'insieme delle tecniche utilizzate per il recupero mirato dell’informazione in formato elettronico. Per "informazione" si intendono tutti i documenti, i metadati, i file presenti all'interno di banche dati o nel world wide web. L'IR è un campo interdisciplinare che nasce dall'incrocio di discipline diverse: coinvolge la psicologia cognitiva, l'architettura informativa, la filosofia, il design, la linguistica, la semiotica, la scienza dell'informazione e l'informatica. Per recuperare l'informazione, i sistemi IR usano i linguaggi di interrogazione basati su comandi testuali.
Due concetti sono di fondamentale importanza:
1. le query o "interrogazioni" che sono stringhe di parole-chiavi rappresentanti l'informazione richiesta e vengono digitate dall'utente in un sistema IR (per esempio un motore di ricerca);
2. l’oggetto che è un'entità che mantiene o racchiude informazioni in una banca dati (un documento di testo, per esempio, è un oggetto di dati).
Una tipica ricerca di IR ha come input un comando dell'utente. Poi la sua query viene messa in relazione con gli oggetti presenti nella banca dati. In risposta, il sistema fornisce un insieme di record che soddisfano le condizioni richieste. Spesso i documenti stessi non sono mantenuti o immagazzinati direttamente nel sistema IR, ma vengono rappresentati da loro surrogati. I motori di ricerca del Web (ad es. Google) sono le applicazioni più note di Information Retrieval.
Un motore di ricerca o search engine è un sistema automatico che analizza un insieme di dati, spesso da lui stesso raccolti, e restituisce un indice dei contenuti disponibili classificandoli in base a formule matematiche che ne indichino il grado di rilevanza data una determinata chiave di ricerca.
Il lavoro dei motori di ricerca si divide principalmente in tre fasi:
- Analisi del campo d'azione. Per analizzare il web i motori di ricerca utilizzano dei programmi detti crawler o spider o robot, che si occupano di visitare automaticamente gli URI* contenuti nel database e seguire i successivi URI che trovano all'interno dei documenti analizzati, inserendo di volta in volta nel database tutte le informazioni "sensibili" della pagina: il contenuto testuale, varie informazioni su di essa come la data di ultimo aggiornamento e altre informazioni;
- Catalogazione del materiale ottenuto. Dopo l'analisi delle pagine, a seconda di criteri che variano da motore a motore, alcune di esse vengono inserite nel database e nell'indice del motore di ricerca. La parte testuale archiviata durante la fase di analisi verrà in seguito analizzata per fornire le risposte alle ricerche degli utenti. Molti motori di ricerca sul web rendono anche disponibile una copia dei dati testuali di ogni pagina archiviata per quando la risorsa originale sia irraggiungibile, funzione è denominata “Copia cache”.
- Risposta alle richieste dell'utente. Rispondere alle richieste degli utenti implica la necessità di elencare i siti (o i db in caso di Intranet) in ordine di rilevanza rispetto alla richiesta ricevuta. Per stabilire la rilevanza di un sito vengono cercate nel database quei documenti che contengono la parola chiave inserita dall'utente, dopodiché ogni motore di ricerca sfrutta propri algoritmi per classificare le pagine, controllando, per esempio, quante volte le parole chiave vengono ripetute, quanti link riceve quel documento, in quali punti della pagine sono poste le parole chiave, quanti siti del database contengono link verso quella pagina o quante volte un utente ha visitato quel sito dopo una ricerca.
Per le ricerche sul web, i motori di ricerca forniscono anche risultati sponsorizzati, ovvero mostrano in maggiore evidenza nelle SERP (Search Engine Result Pages, Pagine dei risultati dei motori di ricerca) siti web di aziende che pagano per risultare tra i primi risultati quando si cercano termini (keywords o parole chiave) che sono in relazione all'ambito di competenza dell'azienda stessa. I risultati sponsorizzati dei motori possono apparire anche sui siti che partecipano al loro programma di affiliazione. In particolar modo, Google permette di far apparire nelle proprie SERP, chiaramente distinti dai risultati "naturali", risultati a pagamento comprati con il programma AdWords. In aggiunta a questo offre anche un servizio di sponsorizzazione che si rivolge a tutti i siti che hanno determinati requisiti, chiamato AdSense. Google AdSense (spesso abbreviato con Google AS) usa le capacità del motore di ricerca di interpretare il tema della pagina in cui è posizionato l'apposito codice per fornire annunci a tema.
La possibilità di raffinazione della ricerca varia da motore a motore, ma la maggior parte permette di utilizzare operatori booleani. Su Google e sui motori più moderni è possibile raffinare la ricerca a seconda della lingua del documento, delle parole o frasi presenti o assenti, del formato dei file (Microsoft Word, PDF, PostScript, ecc.), ad esempio a seconda della data di ultimo aggiornamento. È anche possibile cercare contenuti presenti in un determinato sito. Su Exalead , un motore di ricerca aziendale, è possibile raffinare la ricerca più intuitivamente, attraverso un sistema di “filtraggio”.
Le più recenti innovazioni nella produzione di algoritmi e di sistemi di Information Retrieval si basano sull'analisi semantica dei termini e sulla conseguente creazione di reti semantiche. Lo stesso Google ha adottato sistemi per la prevenzione dell'errore e la contestualizzazione dei risultati. È lecito prevedere che nel giro di alcuni anni i motori di ricerca baseranno le proprie tecnologie sia sull'analisi quantitativa dei contenuti (le parole in sé), sia soprattutto su quella qualitativa (il senso delle parole).
Alcuni tra i motori di ricerca semantica più conosciuti e diffusi sono:
- Exalead;
- Autonomy;
- Expert System;
- Polyspot;
- Omnifind.
La nuova frontiera dei motori di ricerca è il web 2.0. Adottando questa logica molti motori e directory internazionali puntano a una maggiore partecipazione degli utenti nella creazione dei contenuti dei motori di ricerca, in modo da eliminare qualsiasi ricorso a spider o a link sponsorizzati. Con questa logica gli utenti possono segnalare essi stessi i link e decidono se dare o meno popolarità ai siti segnalati.
*Un Uniform Resource Identifier (URI, acronimo più generico rispetto ad "URL") è una stringa che identifica univocamente una risorsa generica che può essere un indirizzo Web, un documento, un'immagine, un file, un servizio, un indirizzo di posta elettronica, ecc. L'URL è un URI, o più comunemente chiamato indirizzo web. Gli URI rendono disponibili le risorse secondo una varietà di protocolli quali HTTP, FTP, ecc. Un URI può essere classificato come URL o come URN.
- Un URL (Uniform Resource Locator) è un URI che, oltre a identificare una risorsa, fornisce mezzi per agire su o per ottenere una rappresentazione della risorsa descrivendo il suo meccanismo di accesso primario o la sua "ubicazione" ("location") in una rete. Per esempio, l'URL http://www.wikipedia.org/ è un URI che identifica una risorsa (l'home page di Wikipedia) e lascia intendere che una rappresentazione di tale risorsa (il codice HTML della versione corrente di tale home page) è ottenibile via HTTP da un host di rete chiamato www.wikipedia.org.
- Un URN (Uniform Resource Name) è un URI che identifica una risorsa mediante un "nome" in un particolare dominio di nomi ("namespace"). Un URN può essere usato per parlare di una risorsa senza lasciar intendere la sua ubicazione o come ottenerne una rappresentazione. Per esempio l'URN urn: isbn: 0-395-36341-1 è un URI che consente di individuare univocamente un libro mediante il suo nome 0-395-36341-1 nel namespace dei codici ISBN, ma non suggerisce dove e come possiamo ottenere una copia di tale libro.
In linea generale, l'Information Retrieval è l'insieme delle tecniche utilizzate per il recupero mirato dell’informazione in formato elettronico. Per "informazione" si intendono tutti i documenti, i metadati, i file presenti all'interno di banche dati o nel world wide web. L'IR è un campo interdisciplinare che nasce dall'incrocio di discipline diverse: coinvolge la psicologia cognitiva, l'architettura informativa, la filosofia, il design, la linguistica, la semiotica, la scienza dell'informazione e l'informatica. Per recuperare l'informazione, i sistemi IR usano i linguaggi di interrogazione basati su comandi testuali.
Due concetti sono di fondamentale importanza:
1. le query o "interrogazioni" che sono stringhe di parole-chiavi rappresentanti l'informazione richiesta e vengono digitate dall'utente in un sistema IR (per esempio un motore di ricerca);
2. l’oggetto che è un'entità che mantiene o racchiude informazioni in una banca dati (un documento di testo, per esempio, è un oggetto di dati).
Una tipica ricerca di IR ha come input un comando dell'utente. Poi la sua query viene messa in relazione con gli oggetti presenti nella banca dati. In risposta, il sistema fornisce un insieme di record che soddisfano le condizioni richieste. Spesso i documenti stessi non sono mantenuti o immagazzinati direttamente nel sistema IR, ma vengono rappresentati da loro surrogati. I motori di ricerca del Web (ad es. Google) sono le applicazioni più note di Information Retrieval.
Un motore di ricerca o search engine è un sistema automatico che analizza un insieme di dati, spesso da lui stesso raccolti, e restituisce un indice dei contenuti disponibili classificandoli in base a formule matematiche che ne indichino il grado di rilevanza data una determinata chiave di ricerca.
Il lavoro dei motori di ricerca si divide principalmente in tre fasi:
- Analisi del campo d'azione. Per analizzare il web i motori di ricerca utilizzano dei programmi detti crawler o spider o robot, che si occupano di visitare automaticamente gli URI* contenuti nel database e seguire i successivi URI che trovano all'interno dei documenti analizzati, inserendo di volta in volta nel database tutte le informazioni "sensibili" della pagina: il contenuto testuale, varie informazioni su di essa come la data di ultimo aggiornamento e altre informazioni;
- Catalogazione del materiale ottenuto. Dopo l'analisi delle pagine, a seconda di criteri che variano da motore a motore, alcune di esse vengono inserite nel database e nell'indice del motore di ricerca. La parte testuale archiviata durante la fase di analisi verrà in seguito analizzata per fornire le risposte alle ricerche degli utenti. Molti motori di ricerca sul web rendono anche disponibile una copia dei dati testuali di ogni pagina archiviata per quando la risorsa originale sia irraggiungibile, funzione è denominata “Copia cache”.
- Risposta alle richieste dell'utente. Rispondere alle richieste degli utenti implica la necessità di elencare i siti (o i db in caso di Intranet) in ordine di rilevanza rispetto alla richiesta ricevuta. Per stabilire la rilevanza di un sito vengono cercate nel database quei documenti che contengono la parola chiave inserita dall'utente, dopodiché ogni motore di ricerca sfrutta propri algoritmi per classificare le pagine, controllando, per esempio, quante volte le parole chiave vengono ripetute, quanti link riceve quel documento, in quali punti della pagine sono poste le parole chiave, quanti siti del database contengono link verso quella pagina o quante volte un utente ha visitato quel sito dopo una ricerca.
Per le ricerche sul web, i motori di ricerca forniscono anche risultati sponsorizzati, ovvero mostrano in maggiore evidenza nelle SERP (Search Engine Result Pages, Pagine dei risultati dei motori di ricerca) siti web di aziende che pagano per risultare tra i primi risultati quando si cercano termini (keywords o parole chiave) che sono in relazione all'ambito di competenza dell'azienda stessa. I risultati sponsorizzati dei motori possono apparire anche sui siti che partecipano al loro programma di affiliazione. In particolar modo, Google permette di far apparire nelle proprie SERP, chiaramente distinti dai risultati "naturali", risultati a pagamento comprati con il programma AdWords. In aggiunta a questo offre anche un servizio di sponsorizzazione che si rivolge a tutti i siti che hanno determinati requisiti, chiamato AdSense. Google AdSense (spesso abbreviato con Google AS) usa le capacità del motore di ricerca di interpretare il tema della pagina in cui è posizionato l'apposito codice per fornire annunci a tema.
La possibilità di raffinazione della ricerca varia da motore a motore, ma la maggior parte permette di utilizzare operatori booleani. Su Google e sui motori più moderni è possibile raffinare la ricerca a seconda della lingua del documento, delle parole o frasi presenti o assenti, del formato dei file (Microsoft Word, PDF, PostScript, ecc.), ad esempio a seconda della data di ultimo aggiornamento. È anche possibile cercare contenuti presenti in un determinato sito. Su Exalead , un motore di ricerca aziendale, è possibile raffinare la ricerca più intuitivamente, attraverso un sistema di “filtraggio”.
Le più recenti innovazioni nella produzione di algoritmi e di sistemi di Information Retrieval si basano sull'analisi semantica dei termini e sulla conseguente creazione di reti semantiche. Lo stesso Google ha adottato sistemi per la prevenzione dell'errore e la contestualizzazione dei risultati. È lecito prevedere che nel giro di alcuni anni i motori di ricerca baseranno le proprie tecnologie sia sull'analisi quantitativa dei contenuti (le parole in sé), sia soprattutto su quella qualitativa (il senso delle parole).
Alcuni tra i motori di ricerca semantica più conosciuti e diffusi sono:
- Exalead;
- Autonomy;
- Expert System;
- Polyspot;
- Omnifind.
La nuova frontiera dei motori di ricerca è il web 2.0. Adottando questa logica molti motori e directory internazionali puntano a una maggiore partecipazione degli utenti nella creazione dei contenuti dei motori di ricerca, in modo da eliminare qualsiasi ricorso a spider o a link sponsorizzati. Con questa logica gli utenti possono segnalare essi stessi i link e decidono se dare o meno popolarità ai siti segnalati.
*Un Uniform Resource Identifier (URI, acronimo più generico rispetto ad "URL") è una stringa che identifica univocamente una risorsa generica che può essere un indirizzo Web, un documento, un'immagine, un file, un servizio, un indirizzo di posta elettronica, ecc. L'URL è un URI, o più comunemente chiamato indirizzo web. Gli URI rendono disponibili le risorse secondo una varietà di protocolli quali HTTP, FTP, ecc. Un URI può essere classificato come URL o come URN.
- Un URL (Uniform Resource Locator) è un URI che, oltre a identificare una risorsa, fornisce mezzi per agire su o per ottenere una rappresentazione della risorsa descrivendo il suo meccanismo di accesso primario o la sua "ubicazione" ("location") in una rete. Per esempio, l'URL http://www.wikipedia.org/ è un URI che identifica una risorsa (l'home page di Wikipedia) e lascia intendere che una rappresentazione di tale risorsa (il codice HTML della versione corrente di tale home page) è ottenibile via HTTP da un host di rete chiamato www.wikipedia.org.
- Un URN (Uniform Resource Name) è un URI che identifica una risorsa mediante un "nome" in un particolare dominio di nomi ("namespace"). Un URN può essere usato per parlare di una risorsa senza lasciar intendere la sua ubicazione o come ottenerne una rappresentazione. Per esempio l'URN urn: isbn: 0-395-36341-1 è un URI che consente di individuare univocamente un libro mediante il suo nome 0-395-36341-1 nel namespace dei codici ISBN, ma non suggerisce dove e come possiamo ottenere una copia di tale libro.
Etichette:
information retrieval,
knowledge management,
ricerca semantica,
search engine,
web 2.0,
web sematico
venerdì 23 aprile 2010
E' nato Knowledge Factory, gruppo di ricerca su: Comunicazione Organizzativa, Gestione della conoscenza, Web 2.0
Knowledge Factory è la community del gruppo di ricerca della Cattedra di Comunicazione Organizzativa della Facoltà di Lettere e Filosofia della Università LUMSA - Libera Università Maria SS. Assunta di Roma. Uno spazio virtuale di scambio, confronto su comunicazione organizzativa e gestione della conoscenza, con particolare attenzione allo sviluppo della comunicazione 2.0.
Le attività del gruppo di ricerca sono gestite da studenti ed ex studenti della Facoltà di Lettere e Filosofia della LUMSA di Roma e si svolgono nell'ambito delle attività del Corso di Laurea Specialistica in Comunicazione d'Impresa. Il Progetto è coordinato da Fabrizio Maimone, Ricercatore a tempo determinato di Sociologia dei processi economici e del lavoro presso la LUMSA di Roma.
La missione è contribuire allo sviluppo della conoscenza su modelli, metodologie, strumenti e trend della comunicazione organizzativa, con particolare attenzione allo sviluppo della comunicazione 2.0.
http://knowledgefactory.ning.com/
Le attività del gruppo di ricerca sono gestite da studenti ed ex studenti della Facoltà di Lettere e Filosofia della LUMSA di Roma e si svolgono nell'ambito delle attività del Corso di Laurea Specialistica in Comunicazione d'Impresa. Il Progetto è coordinato da Fabrizio Maimone, Ricercatore a tempo determinato di Sociologia dei processi economici e del lavoro presso la LUMSA di Roma.
La missione è contribuire allo sviluppo della conoscenza su modelli, metodologie, strumenti e trend della comunicazione organizzativa, con particolare attenzione allo sviluppo della comunicazione 2.0.
http://knowledgefactory.ning.com/
Etichette:
comunicazione organizzativa,
knowledge management,
lumsa,
web 2.0
venerdì 9 aprile 2010
Il Groupware nei sistemi per il knowledge management
In un White Paper del 1995 a cura di Lotus (oggi brand IBM), “Groupware: Communication, Collaboration, Coordination”, è ben illustrato cosa si intendeva per groupware , che importanza assumeva e di quali strumenti era necessario dotarsi affinché fosse realizzabile nelle aziende. Nonostante siano passati 15 anni, certi argomenti sono di scottante attualità per il mondo delle organizzazioni complesse e ancor di più nel momento che vengono varati progetti per il knowledge management.
Il termine groupware (dall'inglese group = gruppo, ware = suffisso di software e hardware) fa riferimento al software che supporta il lavoro di gruppo, anche definito software collaborativo.
I punti cardine del groupware, strettamente interrelati, che corrispondono a specifiche categorie di strumenti, sono:
1. communication --> messaging
(e-mail: modello di comunicazione push);
2. collaboration --> shared database
(electronic conferencing, reference publishing systems, virtual workspace, virtual desk: integrazione di un modello push e pull di comunicazione che favorisca la collaborazione);
3. coordination --> development framework e workflow
(un extended transaction model).
Esempi di software di questo tipo, che permettono di condividere il lavoro e comunicare informazione per scopo anche i più diversi, sono:
- sistemi collaborativi di gestione di posta elettronica;
- electronic meeting systems;
- workflow systems;
- BBS (Bulletin Board System);
- Mediawiki, chè è il software che gestisce e controlla la produzione delle pagine della enciclopedia Wikipedia;
- funzionalità cooperative si ritrovano anche all'interno di applicazioni generiche sia di produttività personale che aziendale.
Le letteratura scientifica attribuisce al termine groupware anche un significato più specifico, includendovi strumenti non software (per esempio sistemi di teleconferenza tradizionali), ma implicando, in genere, un’ intima correlazione fra gli strumenti tecnologici e le pratiche d'uso cooperative ipotizzate dai progettisti di tali strumenti.
Per questa ragione sono considerati parte di un "sistema groupware" anche i processi sociali che esso consente o facilita. Il settore dell'informatica che si occupa del supporto per il lavoro cooperativo e da cui quindi derivano molti prodotti groupware è il Computer Supported Cooperative Work (CSCW).
Il software collaborativo diventa tanto potente quante più persone lo utilizzano, proprio come regolato dalla Legge di Metcalfe. Per la Legge di Metcalfe l'utilità e il valore di una rete sono pari ad n^2 - n, dove n è il numero degli utenti.
Pioniera nello sviluppo di software collaborativo è stata Lotus Software, con l'insieme di applicazioni Lotus Notes: un software collaborativo con architettura client-server e con gestione integrata dell'e-mail.
Il termine groupware (dall'inglese group = gruppo, ware = suffisso di software e hardware) fa riferimento al software che supporta il lavoro di gruppo, anche definito software collaborativo.
I punti cardine del groupware, strettamente interrelati, che corrispondono a specifiche categorie di strumenti, sono:
1. communication --> messaging
(e-mail: modello di comunicazione push);
2. collaboration --> shared database
(electronic conferencing, reference publishing systems, virtual workspace, virtual desk: integrazione di un modello push e pull di comunicazione che favorisca la collaborazione);
3. coordination --> development framework e workflow
(un extended transaction model).
Esempi di software di questo tipo, che permettono di condividere il lavoro e comunicare informazione per scopo anche i più diversi, sono:
- sistemi collaborativi di gestione di posta elettronica;
- electronic meeting systems;
- workflow systems;
- BBS (Bulletin Board System);
- Mediawiki, chè è il software che gestisce e controlla la produzione delle pagine della enciclopedia Wikipedia;
- funzionalità cooperative si ritrovano anche all'interno di applicazioni generiche sia di produttività personale che aziendale.
Le letteratura scientifica attribuisce al termine groupware anche un significato più specifico, includendovi strumenti non software (per esempio sistemi di teleconferenza tradizionali), ma implicando, in genere, un’ intima correlazione fra gli strumenti tecnologici e le pratiche d'uso cooperative ipotizzate dai progettisti di tali strumenti.
Per questa ragione sono considerati parte di un "sistema groupware" anche i processi sociali che esso consente o facilita. Il settore dell'informatica che si occupa del supporto per il lavoro cooperativo e da cui quindi derivano molti prodotti groupware è il Computer Supported Cooperative Work (CSCW).
Il software collaborativo diventa tanto potente quante più persone lo utilizzano, proprio come regolato dalla Legge di Metcalfe. Per la Legge di Metcalfe l'utilità e il valore di una rete sono pari ad n^2 - n, dove n è il numero degli utenti.
Pioniera nello sviluppo di software collaborativo è stata Lotus Software, con l'insieme di applicazioni Lotus Notes: un software collaborativo con architettura client-server e con gestione integrata dell'e-mail.
Iscriviti a:
Post (Atom)