PLLuM
polska rodzina 4B-70B; modele base, instruct i chat
PLLuM (Polish Large Language Model) to rodzina modeli rozwijana przez konsorcjum polskich instytucji naukowych i publicznych. Projekt objął budowę polskiego korpusu liczącego około 140 mld tokenów, zbioru instrukcji oraz danych preferencji do dostrajania odpowiedzi. Aktualna druga generacja (v2.2, oznaczenie 2512) obejmuje modele 4B, 8B i 12B w wersjach base, instruct oraz chat, a model 70B w wersjach instruct i chat. Wcześniejsza generacja zawierała również architekturę MoE 8×7B i warianty niekomercyjne. Licencja zależy od repozytorium: bieżące modele 4B i 12B mają Apache 2.0, a 8B i 70B korzystają z licencji Llama 3.1.
Zweryfikowano: 2026-06-23
Decyzja zakupowa (kiedy wybrać / kiedy uważać)
Wybierz, jeśli…
- Priorytetem jest język polski, możliwość self‑hostingu i kontrola nad danymi.
- Budujesz RAG lub asystenta na dokumentach urzędowych, edukacyjnych albo branżowych.
- Chcesz porównać aktualne warianty 4B, 8B, 12B i 70B oraz świadomie dobrać licencję.
Unikaj, jeśli…
- Nie możesz przeanalizować licencji konkretnego wariantu - rodzina obejmuje Apache 2.0, Llama 3.1 oraz starsze wydania CC BY-NC 4.0.
- Potrzebujesz gotowej usługi SaaS z administracją użytkowników, SLA i rozliczeniem per seat.
- Najważniejsze są możliwości frontier w kodowaniu, multimodalności lub złożonym reasoning.
Koszt w praktyce (scenariusze)
Koszt infrastruktury GPU i utrzymania; brak jednej oficjalnej stawki API dla całej rodziny.
- self‑host
- RAG lub wewnętrzny asystent
- dobór kwantyzacji i silnika inferencyjnego
Znacznie wyższe wymagania pamięci i koszt inferencji; potrzebna kalkulacja pod docelowy ruch i SLA.
- wydajna infrastruktura wielo-GPU
- monitoring i zespół MLOps
Wdrożenie / dane / enterprise
Kanały wdrożenia
- Self‑host z wag opublikowanych przez CYFRAGOVPL na Hugging Face
- Wdrożenie przez własny stos inferencyjny zgodny z architekturą wybranego modelu
- Dobór aktualnego wariantu 4B, 8B, 12B albo 70B zależnie od zasobów i licencji
Polityka danych
- Trening na danych
- Przy self‑hostingu dane i ewentualne dalsze dostrajanie pozostają po stronie wdrażającego.
- Retencja
- Przy self‑hostingu zależy od konfiguracji organizacji.
- Data residency
- Pełna kontrola przy wdrożeniu on‑prem lub w wybranej polskiej/europejskiej chmurze.
Enterprise readiness
- Admin
- Po stronie organizacji wdrażającej.
- SSO/SCIM
- Po stronie wybranej platformy lub aplikacji.
- Audit
- Po stronie infrastruktury, warstwy aplikacyjnej i systemu logowania.
- DPA
- Zależne od umów z dostawcą infrastruktury.
- Certyfikacje
- Zależne od hostingu i sposobu wdrożenia.