|
|
|

Le serveur web doit disposer du module JServ pour utiliser la servlet
rup.
Cette servlet dote le serveur web de moyens pour traiter les requêtes
Http de type mime application/rup.cmd. Le type de la requête
est analysé par la servlet et, en fonction de la commande rup détectée,
le fichier Data.xml est mis à jour. Ce fichier conserve une liste
des tous les robots qui se sont enregistrés. Ainsi, par exemple,
une requête de type application/rup.cmd.register déclenche
l'ajout d'un robot (son id, ses préférences etc ...) dans
le fichier data.xml.
Cette servlet dispose en plus de differents outils comme un parseur d'objets
Soif qui est le corps d'une commande rup.cmd, un parseur de fichier Xml
qui permet à la servlet de localiser les données dont elle
necessite.
Enfin, après le traitement de la requête, une réponse
Http est renvoyée auprès de l'émetteur lui indiquant
le résultat de sa requête.
La Servlet Rup permet de répondre à toutes les requêtes
émises par les moteurs de recherche mais elle n'est jamais à
l'initiative d'une communication avec ces derniers. C'est un inconvénient
technique, en effet, on comprend rapidement qu'un script java, ou autre,
encapsuler dans un serveur web ne peut jamais être à l'initiative
d'ouverture de communications. Ceci n'est en aucun cas son rôle.
Cependant, pour mettre en place le protocol Rup, on a besoin d'un processus
en tâche de fond qui puisse contacter les moteurs de recherche pour
leur émettre des notifications de mises à jour. Ce processus
est réaliser par un scheduler comme Cron, qui à une
période déterminer par l'admisistrateur va lancer un programme
java qui va transmettre aux moteurs de recherche les informations qu'ils
souhaitent recevoir.
|