da ... cam aia este problema ... momentan nu sunt inca la acel pas ... partea aceasta o voi implementa mai tarziu, dupa ce lansez site-ul.
Momentan am implementat cele 2 functii de care vorbeam. Imi e lene sa mai traduc in romana ce am scris in pagina de about de pe site asa ca dau copy paste:
You can remove a site permanently from our index and stop WSIDb Bot to crawl that site through our delete page ( you need to upload a file on your site's root directory ).
You can add a site to our index and tell WSIDb Bot to crawl that site through our add page. If your site was previously removed through our delete page you will have to reauthorize WSIDb BOT by uploading a file on your site's root directory.




Răspunde cu citat
)))
Nu am acces la server, dar eu asa as fi facut. Ti-am zis ca am facut si eu un crawler web distribuit pt un proiect la facultate si se aseamana oarecum cu ce faci tu, chiar daca noi crawleream orice pagina, nu doar domenii. Eventual ai putea sa-l faci si tu distribuit, daca nu l-ai facut deja, si poti sa-l pui mai incolo, cand sa zicem ca se merita ca proiect, pe mai multe servere sa ruleze distribuit si atunci il poti pune sa crawlereasca si pagini si eventual sa ia informatii despre pagina, gen backlink-uri, etc. Chiar daca o sa creasca baza de date, ti-am zis, la Amazon S3 sunt niste preturi modice, gen:
