Przejdź do treści

Python. Funkcja re.search(). Wyciąganie gclid z adresu landing page.

Na czym to polega w sklepie

Funkcja re.search() z modułu re szuka wzorca w tekście i zwraca pierwsze dopasowanie. W e-commerce służy do parsowania parametrów URL, identyfikatorów kliknięć i niestandardowych kodów w query string.

Przykład ze sklepu internetowego

Z pełnego adresu wejścia na landing chcesz wyciągnąć wartość gclid do raportu atrybucji:

import re

landing_url = (
    "https://sklep.example/pl/oferta?"
    "utm_source=google&utm_medium=cpc&gclid=EAIaIQobChMIx"
)

match = re.search(r"[?&]gclid=([^&]+)", landing_url)
gclid = match.group(1) if match else None
gclid.startswith("EAIa")  # True

Co zrobić po stronie biznesu

  • Parsowanie fbclid / gclid / msclkid z logów serwera.
  • Wykrywanie ID kuponu w polu page_location z GA4.
  • Ekstrakcja kodu kraju z wielojęzycznego slug URL.

W skrócie

Gdy dane są ukryte w URL-u lub nieustrukturyzowanym polu, re.search() to precyzyjne narzędzie. Używaj go tam, gdzie split() już nie wystarcza - ale trzymaj wzorce w stałych lub konfiguracji, nie w rozproszonym kodzie.