Poate e dintre membrii Seopedia :) youtube
Versiune printabilă
Poate e dintre membrii Seopedia :) youtube
Cred ca el este :)
Dan Brasoveanu - Romania | LinkedIn
mai e un dan dar nu stiu daca e acelasi:) YouTube - Are nofollow links irrelevant?
da .. a raspuns la intrebare .. dar a cam fentat-o.
Deci in cazul lui dan ii raspun eu. Paginile alea vin din browser.
Adica cineva cauta ceva pe pagina ta link-ul respectiv e trimis la google prin crome sau google toolbar si link-ul daca e nou e pus in lista de indexare.
Oricum nu cred ca vor recunoaste chestia asta :D
asa este mariusx, 100%.
am un cms simplu pe care-l instalez pe site-urile fara cerinte mari si am observat ca atunci cand uit sa pun user and pass via .htaccess pe directorul de admin dupa 3-4 zile googlebot intra pe pagina si sunt sterse articolele - exista un link 'Delete' la fiecare articol pe care il acceseaza.
este exclus sa intre vreun utilizator uman pentru ca pun folderul admin de genul : xyaaaadmin ... chestia asta s-a intamplat de vreo 3 ori (site-uri diferite).
PS: nu am google toolbar instalat si folosesc firefox.
Google poate afla de existenta unor pagini catre care nu exista linkuri daca pe paginile respective exista adsense sau analytics. Este logic ca e suficienta o simpla accesare a unei astfel de pagini pentru ca Google sa afle de ea, iar ulterior sa trimita crawlerul ca sa o citeasca si sa o indexeze (in cazul adsense trimite crawlerul Mediapartners-Google imediat, ca sa vada ce continut exista in pagina pentru a afisa reclamele targhetate).
E posibil ca in cazul Chrome (care este detinut de catre Google) sau chiar in cazul Firefox, in urma accesarii unei anumite pagini browserul sa trimita o notificare 'undeva' si astfel sa se poata afla despre existenta unor pagini catre care nu exista linkuri - asta e insa doar o speculatie, iar cei interesati probabil ca pot verifica aceasta ipoteza utilizand pe local un trafic viewer, de exemplu Wireshark.
@Mar: In cazul in care este vorba de un cms cunoscut, este posibil ca linkul catre pagina de admin sa existe totusi intr-o alta pagina de pe site-ul respectiv, chiar daca denumirea folderului nu a fost lasata cea implicita de "admin". Oricum, e bine sa se utilizeze protejarea cu parola a folderului (prin .htaccess), si eventual si o logare in modulul de administrare inainte de posibilitatea apelarii linkurilor de stergere.
"...daca vrei ca Google sa nu iti indexeze paginile trebuie sa decuplezi calculatorul/laptopul de la Internet... altfel el te gaseste." :goth: True?
Poate ar trebui sa luati in calcul si hostul....si el poate emite semnale privind aparitii noi pe un ip/domeniu/site/pagina. :O
Daca e sa tot luam in calcul tot ce prindem atunci putem pune la socoteala si diverse contoare gen trafic.ro sau wta.ro care afiseaza url-urile de intrare, top pagini, ultimele n pagini vizitate (la un site cu trafic mic raman mult timp) samd.
Dar deja s-a deviat de la ideea topicului: romanul care a emigrat in Canada, cel care a castigat la loteria din Birmingham, care lucreaza la Microsoft sau care are o frma de constructii in Italia/Spania.
Cu alte cuvinte romanul care a f...t lumea asta.
cms-ul este custom si nu are pe el nicun script google (analytics, adsense etc) sau vreun script de contorizare
De dragul testarii, n-ai incercat sa adaugi nofollow pe acele linkuri? Eu banui ca nu se va schimba nimic (adica tot ar fi accesate de Google linkurile, deci sterse articolele respective).
Si tot o intrebare referitoare la script. Butonul Delete cere si confirmare sau sterge pur si simplu in momentul in care este actionat?
Eu zic ca ambele variante "descopera" (abuziv) o pagina respectiva:
browser
google toolbar
Prin 2008, citisem un articol al lui Jerry West care preciza ca google nu are cum sa descopere o pagina care era blocata din htaccess si robots txt. Dupa ce am facut test cu un blog (pe hostgator, inregistrat cu godaddy) nou nout, htaccess si robots text nu mai aveau absolut nici o relevanta.
Observam si in log (pluginul de wp: statpress), cateva zile mai tarziu, ca googlebot deja daduse de pagina, desi era blocat total, chiar cu "noindex; nofollow".
Per ansamblu, "Google is spy".
Pai robots.txt poate fi fentat de Google, dar .htacces cum e fentat? Adica tine de server daca-i livreaza sau nu pagina respectiva, nu?