Multimodal / Google Cloud / BigQuery

Google Gemini

3.8 Flash (kod/agenci), 3.1 Pro, Vertex AI, Zero Data Retention

Gemini 3.8 Flash (02.09.2026) to aktualny workhorse Google do kodu, agentów i reasoning: 1M kontekstu, multimodalność (tekst, audio, obraz, wideo). To trzeci Flash w sześciu tygodniach (po 3.6 i 3.7). Promo API do 31.12.2026: $0.75/$3.75 za 1M tok., od 01.01.2027: $1.50/$7.50.

Gemini 3.8 Flash Cyber (02.09.2026) to wariant pod cyberbezpieczeństwo (wykrywanie podatności, patching), dostępny przez program Fairwind dla wybranych organizacji. Flagowy reasoning nadal to Gemini 3.1 Pro (19.02.2026); Gemini 3.5 Pro zapowiedziany, bez GA.

Dostęp przez Gemini API, AI Studio, Vertex / Agent Platform; opcje Zero Data Retention zależnie od konfiguracji.

  • Zweryfikowano2026-09-03
  • Modele w profilu4
  • Źródła8
  • Kanały wdrożenia4

Decyzja zakupowa (kiedy wybrać / kiedy uważać)

Wybierz, jeśli…

  • Jesteś w ekosystemie Google (GCP/BigQuery/Looker/Vertex) i chcesz spójnego governance.
  • Masz przypadki multimodalne (teksty + obrazy + audio/wideo) i agentowe workflowy.
  • Wymagasz model cards i materiałów do compliance (AI Act/GPAI).

Unikaj, jeśli…

  • Nie używasz GCP i chcesz minimalnej złożoności operacyjnej - porównaj inne SaaS.
  • Masz bardzo restrykcyjne wymagania regionów/retencji - upewnij się w ustawieniach usługi (ZDR).

Koszt w praktyce (scenariusze)

Zespół analityczny w GCP

Najczęściej: Vertex AI + rozliczenia w GCP.

  • BigQuery/Looker
  • governance i IAM
Multimodal (audio/wideo/obrazy)

Koszt zależy od modalności i długości kontekstu; planuj limity.

  • analiza materiałów
  • pipeline’y
Marketing (copy + briefy)

Gemini App/Workspace + ewentualnie API do automatyzacji.

  • codzienna praca
  • umiarkowany wolumen
To są widełki/scenariusze (nie faktura). Dokładny koszt zależy od długości kontekstu, liczby użytkowników, limitów i polityk retencji.

Wdrożenie / dane / enterprise

Kanały wdrożenia

  • Gemini App
  • Gemini API (AI Studio)
  • Vertex AI (Google Cloud)
  • Integracje w ekosystemie Google (np. Workspace)

Polityka danych

Trening na danych
Paid tiers zwykle bez użycia danych do poprawy produktu (sprawdź warunki).
Retencja
Zależnie od usługi i konfiguracji (AI Studio vs Vertex).
Data residency
Regiony zależne od GCP/Vertex; możliwe ustawienia retencji/ZDR.
Najlepiej działa, gdy i tak jesteś w GCP - wtedy governance i billing są spójne.

Enterprise readiness

Admin
GCP/Vertex: centralny billing i IAM.
Dobry wybór dla firm, które mają dane w BigQuery i chcą agentowych workflowów.

Najlepsze zastosowania

  • projekty w Google Cloud (BigQuery, Looker, Sheets, Docs, Vertex AI)
  • kod i agenci przy niskim koszcie tokena - Gemini 3.8 Flash (promo do końca 2026)
  • scenariusze multimodalne i pipeline’y ML z wymogami governance/retencji (ZDR).
  • asystenci i automatyzacje oparte na danych z GCP z potrzebą dokumentacji modelu (AI Act/GPAI).

Mocne strony

  • Natywna multimodalność i dojrzałość enterprise przez Vertex AI; opcje Zero Data Retention.
  • Gemini 3.8 Flash - kod/agenci/reasoning, promo $0.75/$3.75 do 31.12.2026; 3.5 Flash-Lite $0.30/$2.50 do wolumenu; 3.1 Pro - flagowy reasoning.
  • Zarządzanie uprawnieniami i billingiem w jednym koncie GCP.

Słabe strony / ryzyka

  • Zależność od platformy; governance wrażliwe na region i politykę danych. PaLM 2 (legacy) w kontekście dochodzenia regulatora ochrony danych (UE).
  • Brak GA Gemini 3.5 Pro; 3.1 Pro pozostaje najnowszym Pro. 3.8 Flash Cyber tylko przez Fairwind, nie dla każdego developera.
  • Szybka rotacja wariantów Flash (3.6, 3.7, 3.8 w kilka tygodni) wymaga śledzenia deprecacji w API.

Aktualne modele (przykłady)

  • Gemini 3.8 Flash - 02.09.2026; kod/agenci/reasoning; promo $0.75/$3.75 do 31.12.2026, potem $1.50/$7.50; API: gemini-3.8-flash.
  • Gemini 3.8 Flash Cyber - 02.09.2026; wykrywanie podatności i patching; dostęp przez Fairwind Program.
  • Gemini 3.7 Flash - 13.08.2026; Gemini 3.6 Flash - 21.07.2026; Gemini 3.1 Pro - 19.02.2026.
  • Gemini 3.5 Flash-Lite - wolumen $0.30/$2.50; Gemini 3.5 Pro - zapowiedziany, bez GA.

Alternatywy (jeśli ten model nie pasuje)