Le Projet Gutenberg trouve un second souffle et un rayonnement
international avec l’apparition du web en 1990 puis la création de
Distributed Proofreaders en 2000, pour partager la relecture des livres
entre des centaines de volontaires. Les volontaires choisissent un
livre en cours de traitement pour relire et corriger une page donnée,
ou bien plusieurs. A titre indicatif, il est conseillé de relire une
page par jour. C’est peu de temps sur une journée, et c’est beaucoup
pour le projet. Une page multipliée par des centaines de volontaires
représente un chiffre considérable.
# Un site lancé en 2000
Distributed Proofreaders est conçu en octobre 2000 par Charles Franks
pour contribuer à la numérisation des livres du domaine public. À
partir du site web, on accède à un logiciel permettant à plusieurs
correcteurs de travailler simultanément au même livre, chacun
travaillant sur des pages différentes, le but étant bien sûr de
travailler ensemble – de n'importe quelle région du monde - pour
accélérer de manière sensible le processus de révision des livres.
Censé à l'origine aider le Projet Gutenberg dans sa tâche, Distributed
Proofreaders devient rapidement la principale source des livres du
Projet Gutenberg. Après avoir été affilié au Projet Gutenberg en 2002,
il devient une entité indépendante en mai 2006, tout en conservant des
liens étroits avec le Projet Gutenberg.
Distributed Proofreaders comptabilise 3.000 livres numérisés et
corrigés en février 2004, 5.000 livres en octobre 2004, 7.000 livres en
mai 2005, 10.000 livres en décembre 2006, 11.950 livres en janvier 2008
et 18.848 livres le 15 octobre 2010. La production était de 196 livres
en octobre 2010.
# Comment cela se passe, pratiquement
Le volontaire relecteur commence par s’inscrire. Il reçoit des
directives détaillées. Ces directives concernent par exemple les
parties en gras, en italique et soulignées, ou les notes, qui sont
toutes traitées de la même manière. Un forum permet de poser des
questions et de demander de l’aide à tout moment.
Quand le relecteur se connecte au site, il sélectionne le livre de son
choix à partir d'une liste donnée. Une page du livre choisi apparaît
simultanément dans deux versions: d’une part l’image scannée, d’autre
part le texte issu de cette image, produit par un logiciel OCR. Le
relecteur compare les deux versions et corrige les différences. Un
logiciel OCR étant fiable à 99%, cela représente une moyenne de dix
erreurs à corriger par page. Le relecteur sauvegarde ensuite la page,
et peut ensuite soit cesser le travail, soit opter pour la correction
d'une autre page.
Tous les livres sont relus et corrigés deux fois de suite et, la
deuxième fois, uniquement par des correcteurs expérimentés.
Les pages corrigées sont ensuite formatées et assemblées selon des
règles précises par d'autres volontaires (appelés «post-processors»)
pour obtenir un ebook.
Public-domain text, read in full here on John Shaqi.
Reviews
Reviews
No reviews yet
Be the first to share your thoughts on this work.
Join the Discussion
Join the discussion
Sign in to leave a comment or review.
Sign InorCreate an account