Modele AI. PLLuM
Język polski / administracja / self‑host

PLLuM

polska rodzina 4B-70B; modele base, instruct i chat

PLLuM (Polish Large Language Model) to rodzina modeli rozwijana przez konsorcjum polskich instytucji naukowych i publicznych. Projekt objął budowę polskiego korpusu liczącego około 140 mld tokenów, zbioru instrukcji oraz danych preferencji do dostrajania odpowiedzi. Aktualna druga generacja (v2.2, oznaczenie 2512) obejmuje modele 4B, 8B i 12B w wersjach base, instruct oraz chat, a model 70B w wersjach instruct i chat. Wcześniejsza generacja zawierała również architekturę MoE 8×7B i warianty niekomercyjne. Licencja zależy od repozytorium: bieżące modele 4B i 12B mają Apache 2.0, a 8B i 70B korzystają z licencji Llama 3.1.

Zweryfikowano: 2026-06-23

Decyzja zakupowa (kiedy wybrać / kiedy uważać)

Wybierz, jeśli…

  • Priorytetem jest język polski, możliwość self‑hostingu i kontrola nad danymi.
  • Budujesz RAG lub asystenta na dokumentach urzędowych, edukacyjnych albo branżowych.
  • Chcesz porównać aktualne warianty 4B, 8B, 12B i 70B oraz świadomie dobrać licencję.

Unikaj, jeśli…

  • Nie możesz przeanalizować licencji konkretnego wariantu - rodzina obejmuje Apache 2.0, Llama 3.1 oraz starsze wydania CC BY-NC 4.0.
  • Potrzebujesz gotowej usługi SaaS z administracją użytkowników, SLA i rozliczeniem per seat.
  • Najważniejsze są możliwości frontier w kodowaniu, multimodalności lub złożonym reasoning.

Koszt w praktyce (scenariusze)

Pilotaż 4B lub 12B

Koszt infrastruktury GPU i utrzymania; brak jednej oficjalnej stawki API dla całej rodziny.

  • self‑host
  • RAG lub wewnętrzny asystent
  • dobór kwantyzacji i silnika inferencyjnego
Wariant 70B

Znacznie wyższe wymagania pamięci i koszt inferencji; potrzebna kalkulacja pod docelowy ruch i SLA.

  • wydajna infrastruktura wielo-GPU
  • monitoring i zespół MLOps
To są widełki/scenariusze (nie faktura). Dokładny koszt zależy od długości kontekstu, liczby użytkowników, limitów i polityk retencji.

Wdrożenie / dane / enterprise

Kanały wdrożenia

  • Self‑host z wag opublikowanych przez CYFRAGOVPL na Hugging Face
  • Wdrożenie przez własny stos inferencyjny zgodny z architekturą wybranego modelu
  • Dobór aktualnego wariantu 4B, 8B, 12B albo 70B zależnie od zasobów i licencji

Polityka danych

Trening na danych
Przy self‑hostingu dane i ewentualne dalsze dostrajanie pozostają po stronie wdrażającego.
Retencja
Przy self‑hostingu zależy od konfiguracji organizacji.
Data residency
Pełna kontrola przy wdrożeniu on‑prem lub w wybranej polskiej/europejskiej chmurze.
Karty modeli i publikacja opisują architektury, korpus oraz proces alignmentu; licencję trzeba sprawdzać per wariant.

Enterprise readiness

Admin
Po stronie organizacji wdrażającej.
SSO/SCIM
Po stronie wybranej platformy lub aplikacji.
Audit
Po stronie infrastruktury, warstwy aplikacyjnej i systemu logowania.
DPA
Zależne od umów z dostawcą infrastruktury.
Certyfikacje
Zależne od hostingu i sposobu wdrożenia.
Największą zaletą jest kontrola, ale gotowość enterprise trzeba zbudować wokół modelu.

Najlepsze zastosowania

  • asystenci i systemy RAG pracujące głównie na polskich dokumentach
  • projekty administracji publicznej, edukacji i badań nad językiem polskim
  • organizacje, które chcą wdrażać polski model na własnej infrastrukturze i kontrolować przepływ danych.

Mocne strony

  • Rozbudowany polski korpus, dane instrukcyjne i preferencyjne oraz publicznie opisana metodyka budowy modeli.
  • Kilka skal i architektur pozwala dobrać model do dostępnej infrastruktury i rodzaju zadania.
  • Projekt obejmuje mechanizmy korekty, filtrowania i ewaluacji bezpieczeństwa oraz prototyp zastosowania w administracji.

Słabe strony / ryzyka

  • Licencja nie jest jednolita dla całej rodziny; starsze warianty z oznaczeniem „-nc” nie są przeznaczone do zastosowań komercyjnych.
  • Samodzielne wdrożenie większego wariantu 70B wymaga kosztownej infrastruktury i kompetencji MLOps.
  • Specjalizacja w języku polskim nie czyni PLLuM bezpośrednim zamiennikiem modeli frontier w złożonym reasoning i multimodalności.

Aktualne modele (przykłady)

  • PLLuM‑4B‑2512 i PLLuM‑12B‑2512 - aktualne warianty base, instruct i chat na licencji Apache 2.0.
  • Llama‑PLLuM‑8B‑2512 i Llama‑PLLuM‑70B‑2512 - aktualne warianty na licencji Llama 3.1; 8×7B i modele „-nc” należą do wcześniejszych wydań.

Alternatywy (jeśli ten model nie pasuje)