impresia mea e ca de ceva vreme crawlerul google e suficient de inteligent incat sa descifreze si pagini care nu se valideaza (evident, in cazul unor greseli majore e posibil sa inteleaga altceva decat intentia developerului);

tot parerea asta o am si in ceea ce priveste "code ratio"ul.. cat de "primitiv" sa fii sa nu separi niste chestii intre "<>" de restul?

ceea ce mi se pare mie important e "relevant content ratio", cu alte cuvinte cat continut din domeniul pe care se axeaza cautarea ai fata de continutul total (fara a lua in calcul codul);
nu ma refer la exagerari de felul.. din 10 cuvinte.. 7 sa fie keywordul promovat, dar una e sa ai de 2 ori keywordul intr-un text de 1000 de cuvinte si alta e sa il ai de 7 ori;

problema cu validarea codului si folosirea cssurilor externe mi se pare mai mult o problema de "buna practica" si de "eleganta" a codului.. lucruri care sunt un indiciu pentru un "background" solid al developerului (daca vezi o pagina cu taguri care nu se inchid si cu stiluri inline si cu tabele pentru design si etc.. poti sa deduci ca developerul nu se prea pricepe.. prin urmare e putin probabil sa stie sa faca elementele necesare de otpimizare.. asa ca pagina aia nu are rezultate bune, dar nu in mod direct din cauza html-css)