Znaczniki HTML ważne dla SEO według Google
Znaczniki HTML ważne dla SEO to te, które Google według własnej dokumentacji odczytuje i wykorzystuje: element title, meta description, nagłówki, link kanoniczny, adnotacje hreflang, atrybut alt, reguły meta robots, atrybuty rel przy linkach i dane strukturalne. Żaden z nich nie działa jak przełącznik. Title i description są dla Google źródłami tekstu wyniku, a nie gotowym wynikiem, a canonical jest silnym sygnałem, nie przekierowaniem. Część popularnych znaczników, na czele z meta keywords, Google pomija całkowicie, a wyników rozszerzonych HowTo nie pokazuje od 2023 roku, FAQ zaś od maja 2026 roku.
Które znaczniki HTML Google naprawdę czyta
Znacznik HTML to polecenie w kodzie strony zapisane w nawiasach ostrych, które mówi przeglądarce, czym jest dany element: <p> oznacza akapit, <a> link, <img> obraz. Podstawowe znaczniki HTML służą przede wszystkim przeglądarce i czytelnikowi. Dla SEO liczą się dwie grupy. Pierwsza to znaczniki w sekcji <head>, niewidoczne w treści, które opisują stronę dla wyszukiwarek i przeglądarek. Należą do nich meta tagi, czyli znaczniki meta. Druga grupa to znaczniki i atrybuty w treści: nagłówki, linki z atrybutem rel, obrazy z atrybutem alt.
Google prowadzi listę meta tagów i atrybutów HTML, które obsługuje. Są na niej: description, robots i googlebot, notranslate, nopagereadaloud, google-site-verification, deklaracja typu treści i kodowania znaków (charset), refresh, viewport oraz rating. Przy refresh, czyli przekierowaniu w meta tagu, Google od razu zaleca zamiast niego przekierowanie 301 po stronie serwera. Meta tagi spoza tej listy Google według tej samej strony po prostu ignoruje. Z atrybutów HTML wyszukiwarka używa src i href do odkrywania obrazów i URL-i, atrybutów rel do opisania linków wychodzących oraz atrybutu data-nosnippet do wyłączenia fragmentów strony z opisu w wynikach.
Z tej samej strony wynikają dwie rzeczy, o których rzadko się mówi. Sekcja <head> musi być poprawnym HTML-em, a przy atrybutach wszystkie nadrzędne znaczniki muszą być poprawnie zamknięte, inaczej maszyna może ich nie odczytać. Google odradza też wstrzykiwanie i zmienianie meta tagów JavaScriptem, a jeśli nie da się tego uniknąć, każe dokładnie przetestować wdrożenie. Do sprawdzania meta tagów i atrybutów na stronie dokumentacja wskazuje narzędzie do sprawdzania URL-a (URL Inspection) w Search Console.
Title i link tytułowy w wynikach wyszukiwania
Element <title> to tytuł strony zapisany w sekcji <head>. Tekst, który Google wyświetla jako klikalny tytuł wyniku, nazywa linkiem tytułowym i w dokumentacji o linkach tytułowych pisze wprost, że tworzy go automatycznie. Treść elementu title jest pierwszym, ale nie jedynym źródłem. Google bierze pod uwagę także główny tytuł widoczny na stronie, nagłówki takie jak <h1>, znacznik og:title, inny duży i wyróżniony tekst, pozostały tekst strony, tekst linków na stronie i linków, które do niej prowadzą, oraz dane strukturalne WebSite.
Stąd biorą się sytuacje, w których wynik w Google ma inny tytuł niż karta przeglądarki. Dokumentacja opisuje najczęstsze przyczyny: title w połowie pusty (na przykład sama nazwa witryny), nieaktualny (rok z poprzedniej edycji, gdy na stronie widnieje już nowy) albo niezgodny z tym, o czym strona naprawdę jest. W takich przypadkach Google może zbudować link tytułowy z nagłówków, tekstu strony albo tekstu linków. Zmianę w kodzie zauważy dopiero po ponownym pobraniu i przetworzeniu strony, co według dokumentacji trwa od kilku dni do kilku tygodni.
Zalecenia są krótkie. Każda strona ma mieć własny title, opisowy i zwięzły, bez upychania słów kluczowych i bez tej samej formułki na wszystkich podstronach. Nazwę witryny warto dodać krótko, na początku albo na końcu, oddzieloną myślnikiem, dwukropkiem lub pionową kreską. Title powinien być w tym samym języku i alfabecie co główna treść strony. Często powtarzanej reguły „50–60 znaków” ta dokumentacja nie zawiera. Google pisze, że długość elementu title nie ma limitu, a link tytułowy jest w wynikach skracany w razie potrzeby, zwykle do szerokości ekranu urządzenia. Odradza jedynie tekst niepotrzebnie długi lub rozwlekły.
Meta description i fragment pod wynikiem
Meta description to krótki opis strony w sekcji <head>:
<meta name="description" content="Wszystko do szycia: tkaniny, nici i maszyny. Otwarte od poniedziałku do piątku.">
Pod linkiem tytułowym Google pokazuje fragment (ang. snippet) i, jak czytamy w dokumentacji o fragmentach, tworzy go przede wszystkim z treści samej strony. Opisu z meta description używa czasem: wtedy, gdy lepiej niż tekst strony oddaje jej zawartość. Fragment ma odpowiadać konkretnemu zapytaniu, więc ta sama strona może mieć w wynikach różne fragmenty dla różnych wyszukiwań.
Z tego wynika rola tego znacznika. Dobry opis to według Google trafne, krótkie podsumowanie konkretnej strony. Może zawierać dane, które w tekście są rozproszone: autora i datę przy artykule, cenę i producenta przy produkcie. Opisy identyczne albo podobne na wielu stronach nie pomagają, a opisy złożone z ciągu słów kluczowych mają mniejszą szansę, że Google je pokaże. Przy dużych serwisach dokumentacja dopuszcza opisy generowane programowo z danych konkretnej strony, a gdy nie ma czasu na wszystkie, każe zacząć przynajmniej od strony głównej i najpopularniejszych stron. Długości Google nie ogranicza: fragment jest w wynikach skracany w razie potrzeby, zwykle do szerokości ekranu.
Wyświetlaniem fragmentu sterują też reguły robots. Reguła nosnippet wyłącza go całkowicie, max-snippet ogranicza jego długość w znakach, a atrybut data-nosnippet na elementach span, div i section wyłącza z fragmentu wybrane części strony. Wszystkie trzy opisujemy dokładniej w sekcji o meta robots.
Nagłówki H1–H6
Nagłówki od <h1> do <h6> dzielą treść na sekcje i podsekcje: nagłówek H1 to zwykle tytuł strony, nagłówek H2 otwiera główną sekcję, kolejne poziomy schodzą coraz głębiej. Dla czytelnika to spis treści, dla czytnika ekranu struktura, po której da się nawigować. W przewodniku Google po podstawach SEO nagłówki pojawiają się w dwóch miejscach. Najpierw jako sposób, by dłuższy tekst był łatwy do czytania i przejrzysty. Potem w części o rzeczach, którymi z punktu widzenia wyszukiwarki nie warto się przejmować.
Google pisze tam, że nagłówki ułożone w porządku semantycznym są świetne dla czytników ekranu, ale dla wyszukiwarki nie ma znaczenia, czy są użyte w kolejności. Uzasadnienie jest rzeczowe: sieć w większości nie jest poprawnym HTML-em, więc wyszukiwarka rzadko może polegać na znaczeniach zapisanych w specyfikacji. Ta sama strona dodaje, że nie istnieje idealna liczba nagłówków, choć jeśli wydaje się ich za dużo, to prawdopodobnie tak jest. W dokumentach, na które się tu powołujemy, Google nie formułuje reguły „jeden H1 na stronę”.
Nagłówki mają jednak dla Google znaczenie z innego powodu: są jednym ze źródeł linku tytułowego. Dokumentacja o linkach tytułowych zaleca, żeby główny tytuł strony wyraźnie odróżniał się od reszty tekstu, na przykład większą czcionką albo jako pierwszy widoczny nagłówek <h1>. Problem pojawia się wtedy, gdy kilka nagłówków ma tę samą wagę wizualną i nie wiadomo, który z nich jest tytułem. Porządek nagłówków to więc przede wszystkim sprawa czytelności i dostępności, a dla wyszukiwarki ważne jest, żeby tytuł strony dało się jednoznacznie wskazać.
Canonical i zduplikowane strony
Link kanoniczny (rel canonical) wskazuje, który z kilku URL-i z tą samą lub bardzo podobną treścią ma być tym głównym, pokazywanym w wynikach. Zapis w HTML wygląda tak:
<link rel="canonical" href="https://example.com/sukienki/zielone" />
Google w dokumentacji o wskazywaniu URL-a kanonicznego porządkuje metody według siły wpływu. Przekierowanie jest silnym sygnałem, że kanoniczny ma być jego cel. Adnotacja rel="canonical" to również silny sygnał, a umieszczenie URL-a w mapie witryny to sygnał słaby. Metody się sumują, więc zgodne sygnały zwiększają szansę, że w wynikach pojawi się wybrany przez nas URL. Żadna nie jest obowiązkowa: bez wskazania Google sam wybiera wersję, którą uzna za najlepszą dla użytkowników.
Element canonical Google przyjmuje tylko wtedy, gdy stoi w sekcji <head>, więc przynajmniej ta część kodu musi być poprawnym HTML-em. Dokumentacja zaleca bezwzględne URL-e zamiast względnych oraz canonical wskazujący samego siebie także na stronie kanonicznej. Dla plików bez sekcji <head>, takich jak PDF, ten sam sygnał przekazuje się nagłówkiem HTTP Link. Google wymienia też, czego unikać: robots.txt i narzędzie do usuwania URL-i nie służą do kanonizacji, różne metody nie mogą wskazywać różnych URL-i dla tej samej strony, a noindex nie jest sposobem na wybór wersji kanonicznej w obrębie witryny, bo całkowicie wyłącza stronę z wyników. Linki wewnętrzne powinny prowadzić do wersji kanonicznej, a przy wersjach językowych canonical ma wskazywać stronę w tym samym języku.
Hreflang i wersje językowe
Adnotacje hreflang mówią Google, że strona ma wersje w innych językach lub dla innych regionów. W HTML zapisuje się je w sekcji <head> jako zestaw linków, identyczny na każdej wersji:
<link rel="alternate" hreflang="pl" href="https://example.com/oferta" />
<link rel="alternate" hreflang="en" href="https://example.com/en/offer" />
<link rel="alternate" hreflang="x-default" href="https://example.com/" />
Według dokumentacji Google o wersjach zlokalizowanych te same informacje można przekazać w HTML, w nagłówkach HTTP albo w mapie witryny, a z punktu widzenia Google trzy metody są równoważne. Używanie wszystkich naraz nie daje korzyści, za to utrudnia utrzymanie. Każda wersja musi wskazywać siebie i wszystkie pozostałe, URL-e muszą być pełne, z protokołem, a jeśli dwie strony nie wskazują się nawzajem, Google ignoruje te adnotacje. Wartość x-default oznacza stronę dla języków, których zestaw nie wymienia, na przykład stronę wyboru języka.
Kod to język w formacie ISO 639-1 i opcjonalnie region w formacie ISO 3166-1 Alpha 2; sam kod kraju jest błędem, bo Google nie wyprowadza z niego języka. Dwie informacje z tej dokumentacji przeczą popularnym przekonaniom. Google nie używa hreflang ani atrybutu lang do rozpoznawania języka strony; robi to algorytmami na podstawie treści. A wersje zlokalizowane są traktowane jako duplikaty tylko wtedy, gdy główna treść pozostała nieprzetłumaczona. Samo pojęcie w skrócie opisuje hasło hreflang w naszym słowniku.
Atrybut alt i obrazy
Atrybut alt w znaczniku <img> to tekst opisujący obraz. Odczytują go czytniki ekranu, a przeglądarka pokazuje go, gdy obraz się nie wczyta. Dokumentacja Google o obrazach nazywa go najważniejszym atrybutem, przez który można przekazać dodatkowe informacje o obrazie. Precyzuje też, jak go wykorzystuje: temat obrazu Google ustala na podstawie tekstu alternatywnego, algorytmów analizy obrazu i treści strony. Alt jest więc jednym z kilku źródeł, nie jedynym.
Google zaleca tekst opisowy i bogaty w informacje, ze słowami kluczowymi użytymi tam, gdzie pasują, w kontekście treści strony. Lista słów kluczowych w alt pogarsza doświadczenie użytkownika i może sprawić, że strona zostanie uznana za spam. Różnicę dobrze pokazuje przykład wzorowany na tym z dokumentacji:
<!-- źle: upychanie słów kluczowych -->
<img src="szczeniak.jpg" alt="szczeniak pies psy szczenięta piesek dalmatyńczyk karma tanio">
<!-- dobrze: opis tego, co widać -->
<img src="szczeniak.jpg" alt="Szczeniak dalmatyńczyka bawi się w aportowanie">
Jeśli obraz jest linkiem, Google według dokumentacji o linkach używa jego atrybutu alt jako tekstu linku, więc pusty alt na obrazie-linku zostawia link bez opisu. Dla grafik SVG osadzonych bezpośrednio w kodzie odpowiednikiem jest element <title>. Nazwa pliku daje Google tylko bardzo lekką wskazówkę co do tematu; ważniejsze jest to, żeby obraz stał przy tekście, który go dotyczy, na stronie o tym samym temacie.
Meta robots: noindex, nofollow i podgląd w wynikach
Reguły robots ustawia się meta tagiem w sekcji <head> albo nagłówkiem HTTP X-Robots-Tag, który działa także dla plików innych niż HTML, na przykład PDF i obrazów:
<meta name="robots" content="noindex, nofollow">
Specyfikacja Google dla meta tagu robots opisuje między innymi takie reguły:
noindex: nie pokazuj tej strony w wynikach wyszukiwania;nofollow: nie podążaj za linkami na tej stronie;none: to samo conoindex, nofollow;nosnippetimax-snippet: brak fragmentu tekstowego albo limit jego długości w znakach;max-image-preview: największy podgląd obrazu w wynikach, z wartościaminone,standardalbolarge(większy podgląd, do szerokości ekranu);noimageindex: nie indeksuj obrazów z tej strony;unavailable_after: nie pokazuj strony w wynikach po wskazanej dacie.
Domyślnie obowiązuje index, follow i tych wartości nie trzeba wpisywać. Gdy reguły są sprzeczne, Google stosuje bardziej restrykcyjną. Reguła max-image-preview dotyczy według specyfikacji wszystkich form wyników Google, w tym Grafiki Google i Discover, a bez niej Google może pokazać podgląd w domyślnym rozmiarze. Z kolei nosnippet obejmuje także AI Overviews i AI Mode: specyfikacja podaje, że reguła wyłącza treść strony jako bezpośrednie dane wejściowe dla tych funkcji.
Najważniejsza zasada stoi w końcowej części specyfikacji: reguły robots Google odczytuje dopiero przy pobraniu strony. Jeśli robots.txt blokuje jej skanowanie, Google nie zobaczy noindex, więc strona z tą regułą nie może być jednocześnie zablokowana w robots.txt. Reguła noindex dotyczy strony, która działa, ale ma zostać poza wynikami: Google musi ją pobrać, żeby tę regułę w ogóle zobaczyć.
Atrybuty linków: nofollow, sponsored i ugc
Google pobiera linki z elementów <a> z atrybutem href, co opisuje dokumentacja o linkach, które da się skanować. Linków w innej formie, na przykład elementów uruchamianych wyłącznie zdarzeniem JavaScript, bez href, Google nie potrafi niezawodnie odczytać. Tekst linku mówi ludziom i Google coś o stronie docelowej. Gdy element <a> jest pusty, Google może w zastępstwie użyć jego atrybutu title.
Relację z linkowaną stroną opisuje atrybut rel. Według dokumentacji Google o kwalifikowaniu linków wychodzących:
rel="sponsored"oznacza linki reklamowe i płatne;nofollowjest dla nich nadal dopuszczalny, choć Google wolisponsored;rel="ugc"Google zaleca przy linkach z treści tworzonych przez użytkowników, takich jak komentarze i wpisy na forum;rel="nofollow"służy sytuacjom, w których pozostałe wartości nie pasują, a nie chcemy, by Google kojarzył witrynę ze stroną docelową albo skanował ją z naszej strony.
Wartości można łączyć, na przykład rel="ugc nofollow". Linki z tymi atrybutami zwykle nie są śledzone, ale strona docelowa może zostać znaleziona inną drogą, na przykład z mapy witryny albo z linków na innych witrynach. Dla linków wewnętrznych dokumentacja wskazuje inne narzędzia. Jeśli Google ma nie pobierać strony z naszej witryny, służy do tego reguła disallow w robots.txt. Jeśli strona ma nie trafić do indeksu, potrzebna jest reguła noindex przy dozwolonym skanowaniu.
Dane strukturalne w 2026 roku
Dane strukturalne to ustandaryzowany opis strony zapisany w kodzie, najczęściej w formacie JSON-LD ze słownikiem schema.org. Według wprowadzenia Google do danych strukturalnych dają one wyszukiwarce wyraźne wskazówki co do znaczenia treści, a Google używa ich, żeby zrozumieć stronę i zebrać informacje o osobach, książkach czy firmach, które opisują. Mogą też umożliwić wyniki rozszerzone, czyli bogatszą prezentację wyniku. Dokumentacja stawia przy tym zasadę dla wszystkich typów: dane opisują stronę, na której są umieszczone, i nie mogą dotyczyć informacji niewidocznych dla użytkownika, nawet prawdziwych.
Lista wyników rozszerzonych jest dziś krótsza niż kilka lat temu. W sierpniu 2023 roku Google ograniczył wyniki rozszerzone FAQ do znanych, wiarygodnych witryn rządowych i medycznych, a wyniki HowTo do komputerów (wpis o zmianach w wynikach FAQ i HowTo). Od 13 września 2023 roku przestał pokazywać HowTo także na komputerach. W rejestrze zmian dokumentacji pod datą 8 maja 2026 roku Google podał, że wynik rozszerzony FAQ przestaje się pojawiać w wyszukiwarce od 7 maja 2026 roku, a w czerwcu 2026 roku usunął jego dokumentację. Znacznik FAQPage nie da więc rozwijanych pytań pod wynikiem.
Co z danymi, które już są na stronie? We wpisie z 2023 roku Google napisał, że nie trzeba ich usuwać: nieużywane dane strukturalne nie powodują problemów w wyszukiwarce, ale też nie mają w niej widocznego efektu. Dane strukturalne nadal mają sens jako jawny opis tego, co jest na stronie, i przy typach, które dokumentacja Google wciąż opisuje. Warto przy tym czytać ją dosłownie: dane strukturalne mogą umożliwić wynik rozszerzony, a nie gwarantują, że się pojawi.
Znaczniki, których Google nie używa
Część znaczników przetrwała w szablonach i starych poradnikach, choć Google od dawna z nich nie korzysta. Najbardziej znany to meta keywords. We wpisie z września 2009 roku Google napisał, że nie używa tego znacznika w rankingu wyników wyszukiwania. Powodem były nadużycia: łatwo było upchać w nim słowa, których odwiedzający nigdy nie widzieli. Wpis ma dziś dopisek, że Google nadal tego znacznika nie obsługuje, a aktualna lista obsługiwanych tagów stwierdza, że meta keywords nie ma żadnego wpływu ani na indeksowanie, ani na ranking.
Na tej samej liście elementów nieobsługiwanych są jeszcze trzy pozycje. Atrybut lang: język strony Google rozpoznaje z jej tekstu, nie z adnotacji w kodzie. Wartości rel="next" i rel="prev" przy stronach paginacji: Google już ich nie używa i nie mają wpływu na indeksowanie. Reguła nositelinkssearchbox: pole wyszukiwania w linkach do podstron zniknęło z wyników, więc reguła nie ma czym sterować. Specyfikacja robots dopisuje do tej grupy noarchive, której Google nie używa już do sterowania linkiem do kopii strony, bo tej funkcji w wynikach nie ma, oraz nocache, której nie używa w ogóle.
Dokumentacja nie każe tych znaczników usuwać, mówi tylko, że Google ich nie wykorzystuje. Wniosek dla SEO jest więc prosty: od żadnego z nich nie należy oczekiwać efektu w Google.
Czego szukamy w audycie znaczników
W audytach regularnie trafiamy na znaczniki przeniesione z szablonu albo z wersji testowej, których po wdrożeniu nikt nie sprawdził: noindex, który został po uruchomieniu nowej strony, canonical skopiowany z innej podstrony, ten sam title powtórzony w całej sekcji serwisu. Każdy z nich wygląda w kodzie niewinnie, a każdy zmienia to, co Google robi ze stroną. Dlatego przegląd znaczników zaczynamy od tego, co wyszukiwarka faktycznie dostała, a dopiero potem oceniamy, czy jest poprawne.
Kod po wyrenderowaniu, nie tylko źródło. Porównujemy znaczniki w surowym HTML z tym, co pokazuje narzędzie do sprawdzania URL-a w Search Console. Skrypty potrafią dopisać albo zmienić meta tagi i canonical, a Google odradza takie zmiany.
Reguły robots w dwóch miejscach. Sprawdzamy meta tag i nagłówek X-Robots-Tag, a przy stronach z noindex także to, czy robots.txt nie blokuje ich pobrania, bo wtedy reguła jest dla Google niewidoczna.
Spójność sygnałów kanonicznych. Canonical, mapa witryny, linki wewnętrzne i przekierowania mają wskazywać ten sam URL. Przy wersjach językowych sprawdzamy, czy adnotacje hreflang są wzajemne i czy canonical każdej wersji wskazuje stronę w tym samym języku.
Title i description w szablonach. Szukamy powtórzeń, pustych tytułów z samą nazwą witryny i dat, które przestały być aktualne, bo to dokładnie te sytuacje, w których Google według dokumentacji buduje tytuł wyniku z innych źródeł.
Alt na obrazach, które niosą treść. Wykresy, zdjęcia produktów i obrazy będące linkami muszą mieć opis; lista słów kluczowych w alt to sygnał do poprawy, nie optymalizacja.
Dane strukturalne zgodne z tym, co widać. Sprawdzamy, czy opisują treść widoczną na stronie. W rozmowach przy audytach wciąż wraca pytanie o rozwijane FAQ pod wynikiem, więc odpowiadamy wprost: Google przestał je pokazywać w maju 2026 roku, a sam znacznik FAQPage tego nie zmieni.
Podsumowanie
Znaczniki HTML ważne dla SEO to krótka lista: title, meta description, nagłówki H1–H6, canonical, hreflang, alt, reguły meta robots, atrybuty rel przy linkach i dane strukturalne. Dokumentacja Google powtarza przy każdym z nich tę samą myśl: znacznik to sygnał albo źródło, które wyszukiwarka zestawia z treścią strony i z resztą witryny. Title i description bywają zastępowane tekstem ze strony, canonical jest silnym sygnałem, a nie przekierowaniem, wyniki FAQ i HowTo zniknęły, a meta keywords od lat nie robi w Google nic.
Dlatego przegląd znaczników nie zaczyna się od listy kontrolnej, tylko od pytania, co Google zobaczył i jak to zinterpretował. Takie sprawdzenie robimy w ramach pozycjonowania SEO i audytów. Jeśli znaczniki w Twoim serwisie mają przejść taki przegląd, poproś o wycenę.