HTTP

HTTP (Hypertext Transfer Protocol) je pravidlo domluvy, podle kterého si prohlížeč a server předávají obsah webové stránky: klient pošle požadavek, server vrátí odpověď. Když si otevřete e-shop, proběhne během jedné vteřiny několik desítek takových výměn — jedna na HTML dokument, další na každý obrázek, styl a skript.

Pro majitele webu to není akademie. Chybně nastavená odpověď serveru umí vyhodit stránku z indexu během několika dní, a přitom není nikde vidět — v prohlížeči se stránka tváří normálně. Rozdíl mezi kódem 200 a 404 nepozná návštěvník ani redaktor, pozná ho jenom Googlebot.

Co HTTP určuje a co ne

HTTP je poštovní služba, ne autor dopisu. Doručí, co jste napsali, a přidá razítko o tom, jak to dopadlo. O obsahu uvnitř obálky nerozhoduje.

Co HTTP určuje

Přenos
  • +Jestli robot obsah dostane, nebo narazí na chybu
  • +Kterou adresu má vyhledávač považovat za tu platnou
  • +Jak dlouho si smí prohlížeč soubor podržet v mezipaměti

Co HTTP neurčuje

Mimo
  • Jestli je obsah relevantní k dotazu
  • Jestli se stránka zaindexuje — kód 200 to nezaručuje
  • Jakou pozici stránka dostane
⚠️

Pro vyhledávač je http:// a https:// jiný web

Adresy http://vasedomena.cz/produkt/ a https://vasedomena.cz/produkt/ jsou dvě různé URL. Pokud obě vrací 200 se stejným textem, vyrobili jste si duplicitní obsah na celém webu naráz. Po přechodu na HTTPS musí nezabezpečená verze odpovídat trvalým přesměrováním, ne obsahem.

Anatomie požadavku a odpovědi

Klient pošle metodu a adresu (GET /produkt/), server vrátí odpověď. Stačí znát její čtyři části — uvidíte je v konzoli prohlížeče na záložce Network.

Část Co obsahuje Proč to v SEO řešíte
Metoda GET, POST, HEAD a další Roboti používají jen GET a HEAD; obsah za POSTem vyhledávač neuvidí
Stavový kód Tříciferné číslo, 200 až 5xx Rozhoduje o zařazení i vyřazení adresy z indexu
Hlavičky Content-Type, Cache-Control, Link a další Nesou pokyny k indexaci souborů bez HTML značek
Tělo HTML, obrázek, PDF, JSON Samotný obsah ke zpracování

Odpověď serveru — hlavičky

HTTP/2 200 content-type: text/html; charset=utf-8 cache-control: max-age=3600 content-encoding: br

Stránka se vrátila v pořádku, je to HTML v UTF-8, prohlížeč si ji smí hodinu podržet a přenáší se komprimovaně.

HTTP je přitom bezstavové: server si mezi dvěma požadavky nepamatuje, kdo jste. Googlebot proto přichází pokaždé načisto — co mu server pošle v tomhle jednom požadavku, to je pro něj celá pravda o dané adrese.

HTTP/1.1, HTTP/2 a HTTP/3

Význam metod, kódů a hlaviček popisuje pro všechny verze společně RFC 9110 z června 2022. Liší se jen to, jak se data dostanou po síti.

Verze Čím se liší Co s tím
HTTP/1.1 Požadavky se zpracovávají za sebou Funguje, u webů s mnoha soubory brzdí
HTTP/2 Více požadavků po jednom spojení naráz, komprimované hlavičky Dnešní standard, na většině hostingů stačí zapnout
HTTP/3 Místo TCP používá QUIC, snáší nestabilní sítě Přínos hlavně u mobilní návštěvnosti

Funkci Server Push, kterou HTTP/2 nabízel a která se dlouho doporučovala jako zrychlovač, prohlížeče opustily — Chrome ji vypnul ve verzi 106 v září 2022. Pokud na ni váš web spoléhá, nedělá nic.

Jak Google reaguje na stavové kódy

Detaily rozebírá samostatný pojem stavové kódy, tady stačí obrysy z dokumentace Googlu.

Skupina Jak se k tomu Google staví
2xx Obsah jde do zpracování, indexace tím ale zaručená není.
3xx Roboti následují zpravidla nejvýše deset přesměrování za sebou. 301 je silný signál pro cíl, 302 slabý.
4xx Obsah se ignoruje, indexovaná adresa zmizí. Rychlost procházení to neovlivní, výjimkou je 429.
5xx Google zpomalí procházení. Zaindexované adresy chvíli vydrží, pak vypadnou.

Z toho plyne závěr, který jde proti rozšířené obavě: 404 na zrušené stránce není chyba k honemu zalepení, ale správná odpověď. Problém je tam, kde 404 dostávají adresy, které existovat mají — nebo kde server na neexistující stránku vrátí 200 s textem „nenalezeno“, což Search Console označí jako soft 404.

Hlavičky, které v SEO něco řeší

Hlavičky jsou jediný způsob, jak dát vyhledávači pokyn u souboru bez HTML značek — typicky PDF nebo XML.

Přesměrovat HTTP na HTTPS

Jedním skokem na finální adresu, ne přes mezistanici. Nastavuje se na serveru nebo v .htaccess.

http://vasedomena.cz/a/ → 301 → https://www.vasedomena.cz/a/

Zakázat indexaci PDF

U souboru bez HTML hlavičky se noindex předává hlavičkou odpovědi.

X-Robots-Tag: noindex

Kanonická adresa u neHTML souboru

Značku canonical lze poslat i hlavičkou, když soubor nemá <head>.

Link: <https://vasedomena.cz/navod.pdf>; rel="canonical"

Plánovaná odstávka

Po dobu údržby vracejte 503 s odhadem návratu, nikdy 404 ani 200.

HTTP/1.1 503 Service Unavailable Retry-After: 3600

Mezipaměť pro statické soubory

Obrázky a styly s verzí v názvu smí ležet v cache dlouho, HTML dokument krátce.

Cache-Control: max-age=31536000, immutable

Správný typ obsahu

Špatný typ u XML nebo u sitemap.xml vede k tomu, že soubor nikdo nezpracuje.

Content-Type: application/xml

Co platí o HTTPS a pozicích

Co platí. Google v srpnu 2014 oznámil, že zabezpečené spojení zařadil mezi hodnotící signály — a hned dodal, že jde o velmi lehký signál ovlivňující méně než procento dotazů. Aktuální dokumentace jde dál: mimo Core Web Vitals ostatní složky dojmu ze stránky podle ní k lepšímu umístění přímo nepomáhají. A procházení přes HTTP/2 podle Googlu žádnou rankingovou výhodu nepřináší, což napsal výslovně při jeho spuštění v roce 2020.

Co doložit nejde. Tvrzení, že přechod na HTTPS zvedne pozice — ani opačné, že nepřinese nic. Veřejná data pro žádnou z verzí neexistují a migrace s sebou vždy nese další změny naráz.

Závěr, který platí tak jako tak. HTTPS nasaďte, ale ne kvůli pozicím: Chrome označuje nezabezpečené stránky jako „Nezabezpečeno“ a data zákazníků nemají cestovat otevřeně.

Nejčastější chyby z našich auditů

Výčet vychází z auditů, kterými začínáme spolupráci. Všechny tyhle chyby se na stránce nijak neprojeví — najdete je jenom v hlavičkách.

Duplicita

Obě verze vrací 200

Po instalaci certifikátu zůstane funkční i původní nezabezpečená verze. Vznikne kopie celého webu na druhé sadě adres.

Řetězec

Přesměrování na dva skoky

Nezabezpečená adresa vede na verzi bez www a ta teprve na cílovou s www. Každý skok stojí čas.

Smíšený obsah

Obrázky zůstaly na http://

Stránka běží zabezpečeně, ale natvrdo odkazuje na nezabezpečené soubory. Prohlížeč je zablokuje.

Nekonzistence

Sitemapa a canonical míří na starou verzi

Po migraci zůstanou v XML souboru a v kanonických značkách adresy s http://. Vyhledávač dostane protichůdné pokyny.

Soft 404

Neexistující stránka vrací 200

Šablona zobrazí hlášku „stránka nenalezena“, ale server odpoví kódem 200. Robot ji zaindexuje jako platnou.

Odstávka

Během údržby se vrací 200 s obrázkem

Robot si uloží prázdnou stránku jako platný obsah. Správně je 503, po kterém se index sám zotaví.

💡

Jak si to ověříte za pět minut

Projděte si web ve Screaming Frogu přes sloupce Status Code a Redirect Chain. Pak v Google Search Console otevřete zprávu o indexaci stránek a kategorie „Nenalezeno (404)“ a „Chyba serveru (5xx)“. Většina zmíněných chyb je vidět hned.

HTTP a AI vyhledávání

V GEO se toho hodně slibuje, ale tahle část je nudně technická a o to spolehlivější: roboti jazykových modelů chodí pro obsah stejným protokolem jako Googlebot. Když server vrátí 403, 503 nebo si vyžádá JavaScript k zobrazení textu, nezískají nic — bez ohledu na to, jak dobře je obsah napsaný. Čistě odpovídající server je tedy stejná vstupenka jako u klasického technického SEO. Jestli model obsah ocituje, už HTTP neovlivní a doložený recept na to zatím nikdo nemá.

Časté dotazy

Jaký je rozdíl mezi HTTP a HTTPS?

Jde o stejný protokol, jen HTTPS přenáší data šifrovaně přes TLS. Metody i stavové kódy zůstávají identické — liší se jen to, že data po cestě nikdo cizí nepřečte ani nezmění. Nezabezpečený provoz běží standardně na portu 80, zabezpečený na 443.

Pro vyhledávač jsou to ale dvě různé sady adres. Proto se při přechodu nastavuje trvalé přesměrování ze staré na novou.

Je HTTPS rankingový faktor?

Google v roce 2014 potvrdil, že zabezpečené spojení do hodnocení zahrnul, a rovnou dodal, že jde o velmi lehký signál ovlivňující méně než procento dotazů. Aktuální dokumentace navíc uvádí, že mimo Core Web Vitals ostatní složky dojmu ze stránky k lepšímu umístění přímo nepomáhají. Nasaďte ho tedy kvůli bezpečnosti a důvěře uživatelů, ne kvůli pozicím.

Zlepší se mi pozice, když zapnu HTTP/2 nebo HTTP/3?

Přímo ne. Google při spuštění procházení přes HTTP/2 v roce 2020 výslovně napsal, že z toho žádná rankingová výhoda neplyne a že weby na HTTP/1.1 nejsou znevýhodněné.

Nepřímý přínos ale existuje: novější verze načítají stránku rychleji a rychlost vstupuje do hodnocení přes Core Web Vitals. Zapnout je tedy rozumné, jen z jiného důvodu, než se obvykle uvádí.

Škodí webu chyby 404?

Samotné 404 nejsou penalizace. Google adresu vyřadí z indexu a postupně na ni přestane chodit; kódy řady 4xx podle jeho dokumentace rychlost procházení neovlivňují, výjimkou je 429.

Řešit je potřeba jiný případ: když 404 vrací stránka, která existovat má — vyprodané zboží, kategorie po nepovedené migraci, adresa s příchozími odkazy.

Jak zjistím, jaký stavový kód moje stránka vrací?

Nejrychleji v prohlížeči: stiskněte F12, přepněte na záložku Network a stránku znovu načtěte. První řádek seznamu je samotný dokument a u něj vidíte kód i všechny hlavičky. Pro celý web použijte crawler; výběrově pomůže i nástroj Kontrola adresy URL v Search Console, který ukáže, co viděl Googlebot.

🔧

Nevíte, co váš server vlastně odpovídá?

Chyby v hlavičkách a stavových kódech nejsou vidět a přitom dokážou odstřihnout celé sekce webu od indexu. Projdeme to s vámi na půlhodinovém hovoru a řekneme rovnou, jestli něco takového máte.

Termín si vyberete v kalendáři.

Michal Binka, SEO PRAKTICKY

Autor článku

Michal Binka

Zakladatel SEO PRAKTICKY s.r.o.

Hlavičky a stavové kódy patří k tomu, co u nových klientů kontroluje jako první — právě proto, že je nikdo nevidí. Nejdražší technické chyby bývají ty, které se na webu nijak neprojeví.

Přes 20 let se věnuje SEO pro české e-shopy, je autorem tří knih o SEO a Zlatým Shoptet Partnerem. Přednáší na oborových konferencích a vede tým specialistů v Brně.

  • Zlatý Shoptet Partner
  • Certifikovaný specialista Collabim
  • Autor tří knih o SEO

Zdroje

Dokumentace vyhledávačů se mění. U technických detailů si vždy ověřte aktuální znění přímo u zdroje.