Google
email:   hasło:   
zapamiętaj mnie   rejestracja  •   nie pamiętasz hasła?
SG

Bot gromadzi dane dla Wikipedii

Anna Wasilewska-Śpioch, 11-07-2008, 17:16, Komentarzy: 1

Bez względu na rzeczywistą jakość haseł w Wikipedii dość często bywa ona postrzegana jako niezbyt wiarygodne źródło informacji. Dobrym pomysłem wydaje się zaangażowanie do pracy nad nią środowiska naukowego. A gdyby tak stworzyć bota, który pobierałby informacje z renomowanych baz danych i przetwarzał je do formatu Wikipedii? Ideę tę z powodzeniem realizują genetycy.

Naukowcy skupieni wokół Genomics Institute of the Novartis Research Foundation zabrali się do uzupełniania Wikipedii o artykuły związane z genetyką. Co ciekawe, ich praca jest w pełni zautomatyzowana, inicjatorzy projektu wykorzystują bowiem udostępniony na licencji Apache 2.0 skrypt protein-box-bot.

Narzędzie zostało zaprojektowane do pobierania rekordów z internetowych baz danych, takich jak Entrez Gene. O zdobyte w ten sposób informacje tekstowe i wykresy (w galerii można zobaczyć przykład) w pierwszej kolejności wzbogacono 650 artykułów, opublikowanych w Wikipedii wcześniej. Powstało też 7,5 tys. zalążków haseł, które przydałoby się jeszcze rozbudować.

Jedną z ważnych funkcjonalności bota jest uzupełnianie artykułów o dane bibliograficzne (odsyłacze do fachowych publikacji, w których wspomina się interesujący nas gen). W tym zakresie skrypt wymaga dopracowania - uważa John Timmer z serwisu Ars Technica, który sprawdził, dokąd prowadzą poszczególne linki pod jednym z haseł. Jego zdaniem, tylko jedna trzecia z podanych w bibliografii tekstów zawierała istotne informacje o danym genie.

Dane zebrane za pomocą skryptu protein-box-bot
fot. Wikipedia - Dane zebrane za pomocą skryptu protein-box-bot
W opublikowanym na łamach PLoS Biology dokumencie twórcy projektu przyznali się, że początkowo chcieli nawiązać współpracę z konkurencyjnym dla Wikipedii serwisem Citizendium, stworzonym przez Larry'ego Sangera, współzałożyciela "wolnej encyklopedii". Citizendium, wciąż jeszcze oznaczone jako wersja beta, od pierwowzoru różni się tym, że wszyscy autorzy muszą podawać podczas rejestracji prawdziwe dane, artykuły zaś opracowywane są pod czujnym okiem ekspertów.

O przewadze Wikipedii zadecydowała jej większa popularność - inicjatorzy projektu chcieliby zainteresować genetyką jak najwięcej osób, również ze środowiska naukowego. Okazało się też, że próbując odszukać konkretną informację za pomocą Google, w 60% przypadków na pierwszej stronie wyników wyszukiwania znajdziemy umieszczone w Wikipedii zalążki artykułów, stworzone za pomocą protein-box-bota.

Clip to Evernote
Źródło: Ars Technica, PLoS Biology

Warto przeczytać:

Tematy pokrewne  

tag Wikipediatag naukowcytag genetykatag bot
Komentarze    Zobacz wszystkie (1)
Dodaj nowy komentarz (rozwiń)
To warto przeczytać














Najnowsze Programy

F Twitter RSS Gmail m.di24.pl

RSS - Wywiad
Wywiad  
RSS - Interwencje
RSS - Porady
Porady  
RSS - Listy
Listy  
RSS - Recenzje


reklama

Expander
Porównamy dla Ciebie promocje w 26 bankach więcej...

mBank
Najchętniej polecane konto osobiste! więcej...

Archiwum

« Luty 2012 »
PoWtŚrCzwPtSbNd
 12345
6789101112
13141516171819
20212223242526
272829 
Serwisy specjalne:
Wydarzenia: