Modele AI. Sakana Fugu
Orkiestracja modeli / multi-agent / API

Sakana Fugu

orkiestracja wielu modeli przez jedno API; Fugu i Fugu Ultra

Sakana Fugu, udostępniony komercyjnie 22.06.2026, nie jest typowym pojedynczym LLM-em. To system, który z zewnątrz działa jak jeden model, a wewnętrznie może dobierać, uruchamiać i koordynować kilka modeli-agentów. Fugu sam rozstrzyga, czy wystarczy prosta odpowiedź, czy zadanie warto podzielić, zweryfikować i scalić z wyników wielu agentów. Dostęp odbywa się przez API zgodne z formatem OpenAI. Producent pozycjonuje Fugu jako wariant do codziennej pracy, a Fugu Ultra do trudnych, długich i wieloetapowych problemów. Usługa nie jest obecnie oferowana użytkownikom w UE/EOG.

Zweryfikowano: 2026-06-23

Decyzja zakupowa (kiedy wybrać / kiedy uważać)

Wybierz, jeśli…

  • Działasz poza UE/EOG i chcesz zlecać długie, złożone zadania przez jeden endpoint.
  • Nie chcesz samodzielnie projektować routingu, ról agentów, weryfikacji i syntezy odpowiedzi.
  • Akceptujesz zamkniętą warstwę orkiestracji w zamian za prostszą integrację wielu modeli.

Unikaj, jeśli…

  • Użytkownicy lub organizacja znajdują się w UE/EOG - Sakana AI obecnie nie świadczy tam usługi Fugu.
  • Musisz znać model użyty do każdego zapytania albo szczegółowo audytować przebieg routingu.
  • Potrzebujesz niezależnie potwierdzonych benchmarków i długiej historii wdrożeń produkcyjnych.

Koszt w praktyce (scenariusze)

Testy i lekka praca indywidualna

Standard $20/mies.; producent opisuje ten plan jako wariant do okazjonalnych wywołań i małych eksperymentów.

  • usługa poza UE/EOG
  • niewielka liczba krótszych sesji
Regularna praca techniczna lub badawcza

Pro $100/mies. albo Max $200/mies.; publiczny cennik podaje relatywne limity 10× i 20× względem Standard.

  • kod, review, research
  • dłuższe sesje w ciągu tygodnia
Fugu Ultra w PAYG

$5 input / $30 output / $0.50 cached input za 1M tokenów; powyżej 272k kontekstu: $10 / $45 / $1.

  • model fugu-ultra-20260615
  • bez dodatkowych opłat sumowanych za każdego agenta
To są widełki/scenariusze (nie faktura). Dokładny koszt zależy od długości kontekstu, liczby użytkowników, limitów i polityk retencji.

Wdrożenie / dane / enterprise

Kanały wdrożenia

  • OpenAI-compatible API przez konsolę Sakana AI
  • Fugu - konfigurowalna pula z możliwością wykluczania wybranych agentów
  • Fugu Ultra - stała, pełna pula agentów nastawiona na maksymalną jakość

Polityka danych

Trening na danych
Prompty i inne dane użycia mogą służyć do trenowania i ulepszania systemów; można zrezygnować w konsoli. Rezygnacja nie działa wstecz.
Retencja
Dane są przechowywane tak długo, jak jest to racjonalnie potrzebne; polityka nie podaje jednego stałego okresu.
Data residency
Dane mogą być przekazywane m.in. do Japonii i USA. Usługa nie jest obecnie dostępna w UE/EOG.
Fugu pozwala wykluczać wybrane modele z puli; Fugu Ultra korzysta z pełnej, stałej puli.

Enterprise readiness

Admin
Konsola, rozliczenia PAYG i raportowanie kosztu per zapytanie.
SSO/SCIM
Brak jednoznacznej informacji na publicznej stronie produktu.
Audit
Koszt i użycie tokenów są raportowane per zapytanie; szczegółowy routing modeli nie jest ujawniany.
DPA
Do potwierdzenia bezpośrednio z Sakana AI przed wdrożeniem.
Certyfikacje
Brak jednoznacznej listy na publicznej stronie produktu.
Dla zastosowań regulowanych ograniczeniem jest brak jawności modeli użytych w konkretnym zapytaniu.

Najlepsze zastosowania

  • wielostopniowe zadania, w których przydają się podział pracy, kontrola wyniku i synteza odpowiedzi
  • kodowanie, code review, analizy badawcze oraz przeglądy literatury i patentów
  • zespoły, które chcą korzystać z puli modeli przez jeden interfejs API zamiast budować własny router agentów.

Mocne strony

  • Jedno API ukrywa techniczną złożoność wyboru modeli, delegowania zadań i łączenia rezultatów.
  • W zwykłym Fugu można wykluczać wybranych dostawców lub modele z puli, co ogranicza zależność od jednego źródła.
  • API jest zgodne z formatem OpenAI, więc integracja może wymagać mniej zmian niż autorski system multi-agent.

Słabe strony / ryzyka

  • Brak dostępności w UE/EOG oznacza, że nie jest to dziś praktyczna opcja dla większości polskich organizacji.
  • Sakana AI nie ujawnia, które modele zostały użyte w konkretnym zapytaniu ani jak dokładnie je skoordynowano.
  • Najmocniejsze wyniki benchmarkowe pochodzą od producenta; część wyników modeli porównawczych również zaczerpnięto z deklaracji ich dostawców.
  • Koszt i czas odpowiedzi mogą być mniej intuicyjne niż przy bezpośrednim wywołaniu jednego, z góry wybranego modelu.

Aktualne modele (przykłady)

  • Fugu - wariant równoważący jakość i opóźnienie; pozwala wykluczać wybrane modele z puli agentów.
  • Fugu Ultra (fugu-ultra-20260615) - wariant nastawiony na jakość w trudnych zadaniach; korzysta ze stałej, pełnej puli agentów.

Alternatywy (jeśli ten model nie pasuje)