HeadFlash

Temat · 10 newsów

GLM: modele Z.ai, premiery i aktualności

Zaktualizowano · Redakcja: Marcin Rybak

W skrócie

GLM to rodzina dużych modeli językowych rozwijana przez Z.ai, dawniej Zhipu AI, z których wiele ma otwarte wagi. Najnowsze to GLM-5.3, model kodujący z sierpnia 2026, i tańszy GLM-5.3-Flash na licencji MIT. 30 września Anthropic poinformowało, że GLM-5.3 buduje działające exploity niemal tak dobrze jak Claude Mythos Preview, a jego zabezpieczenia łatwo obejść.

Czym jest GLM

GLM to rodzina dużych modeli językowych rozwijana przez Z.ai, dawniej Zhipu AI, a wiele z nich ma otwarte wagi. Otwarte wagi oznaczają, że pliki wytrenowanego modelu są publiczne: każdy może je pobrać, uruchomić i zmodyfikować na własnym sprzęcie, w przeciwieństwie do zamkniętych modeli OpenAI i Anthropic, do których dostęp jest tylko przez usługę. Z.ai robi też narzędzia: w lipcu uruchomiło ZCode, bezpłatną aplikację desktopową z agentem kodującym.

Od czerwca 2026 GLM jest poważną opcją do kodowania i jednym z głównych argumentów w sporze o to, czy chińskie modele dogoniły zachodnie. Poniżej: kolejne wersje, ceny, sposoby użycia i kwestie bezpieczeństwa.

Czym jest GLM-5.2

GLM-5.2 to model Z.ai z czerwca 2026 do długich zadań kodowania i pracy agentowej: mieszanka ekspertów o 744 mld parametrów, z czego 40 mld aktywnych, z kontekstem miliona tokenów. W połowie czerwca zajął drugie miejsce w Code Arena, tuż za Claude Fable 5. Według relacji VentureBeat o premierze ZCode został wytrenowany na 28,5 biliona tokenów i zbudowany w całości na układach Huawei, a koszt treningu oszacowano na 25 mln dolarów. Zhipu udostępniło go na licencji MIT, bez ograniczeń użycia.

Reakcje były mocne. CEO Vercela Guillermo Rauch przyznał, że jest naprawdę pod wrażeniem możliwości modelu, a były wiceprezes Meta, Google DeepMind i Microsoftu Matt Velloso nazwał go pierwszym otwartym modelem, który nadaje się do codziennego użytku. Lokalne uruchomienie wymaga potężnego sprzętu: standardowy PC z 24 GB VRAM to za mało. Zaletą jest bezpieczeństwo wrażliwych danych, które nie opuszczają prywatnego sprzętu.

Czym są GLM-5.3 i GLM-5.3-Flash

GLM-5.3 to flagowy model kodujący Z.ai z sierpnia 2026, a GLM-5.3-Flash to jego tańszy, multimodalny odpowiednik z końca sierpnia. Zhipu twierdzi, że GLM-5.3 jest najmocniejszym modelem kodującym z otwartymi wagami. Trenowano go na danych do znajdowania podatności w oprogramowaniu, co zaowocowało wykryciem 2436 luk w 269 projektach. Wagi miały trafić do open source po dwóch tygodniach, po zakończeniu przeglądów bezpieczeństwa. Zebrane tu materiały nie potwierdzają, czy to już się stało.

GLM-5.3-Flash to pierwszy natywnie multimodalny model serii GLM-5: 320 mld parametrów, z czego 18 mld aktywnych, licencja MIT i kontekst miliona tokenów. W indeksie inteligencji Artificial Analysis uzyskał 57 punktów, trzy mniej niż GLM-5.3 i tyle samo co GPT-5.6 Terra oraz Muse Spark 1.2. Koszt zadania w tym indeksie to 0,09 dolara wobec 0,68 dolara dla GLM-5.3, czyli około 7,5 razy taniej. Model obsłużyły chińskie chipy AI, a Z.ai twierdzi, że jego koszt na token jest porównywalny z typowymi GPU Nvidii. SemiAnalysis traktuje to jako kolejny test mitu o moacie CUDA.

Flash był najpierw zagadką. Od 20 sierpnia na OpenRouter działał za darmo anonimowy model Ox Alpha, o którym nikt nie wiedział, kto go zbudował. Narzędzie modelprint dopasowało go do GLM-5.3 w sześciu z dziewięciu prób, w tym we wszystkich czterech licznikach tokenizacji. Padały też inne tropy: zespół MiMo z Xiaomi i spekulacje o Microsofcie. Przedsiębiorstwa wysyłały do modelu kod, nie wiedząc, gdzie trafia. 27 sierpnia Z.ai potwierdziło, że Ox Alpha był zapowiedzią GLM-5.3-Flash, i udostępniło wagi na Hugging Face. Wcześniej tak samo testowało GLM-5 pod nazwą Pony Alpha.

Czy GLM jest darmowy i ile kosztuje

GLM jest częściowo darmowy: otwarte wagi i aplikacja ZCode nic nie kosztują, ale API Z.ai i subskrypcja do kodowania są płatne, poza kilkoma małymi modelami. Ceny według oficjalnego cennika Z.ai (stan na 10 października 2026, dolary za milion tokenów):

Model Wejście Wyjście
GLM-5.3-Flash 0,15 0,50
GLM-5.3-FlashX 0,37 1,25
GLM-5.3 1,40 4,40
GLM-5.2 1,40 4,40
GLM-5 1,00 3,20
GLM-4.7 i GLM-4.6 0,60 2,20

Ten sam cennik wymienia GLM-4.7-Flash, GLM-4.5-Flash i GLM-4.6V-Flash jako modele bezpłatne. Do kodowania jest GLM Coding Plan w wersjach Lite, Pro i Max. Dokumentacja Z.ai podaje cenę „od 18 USD miesięcznie” i limity kredytów na 5 godzin: 2000, 12 000 i 28 000. Użycie poza godzinami szczytu jest liczone za połowę stawki. W lipcu Z.ai oferowało subskrybentom planu 1,5-krotny bonus do puli. Według tej samej relacji ceny API GLM-5.2 są nawet o 82 procent niższe niż Claude Opus 4.8.

Jak korzystać z GLM

Z GLM można korzystać przez API Z.ai, przez plan Coding Plan w agentach kodujących, w bezpłatnej aplikacji ZCode albo uruchamiając otwarte wagi samemu. Dokumentacja Z.ai podaje, że Coding Plan działa z ZCode, Claude Code, Codex, OpenCode, AutoClaw, OpenClaw i Cline, a zapytania o GLM-5.2 i GLM-5.1 są teraz kierowane do GLM-5.3. ZCode działa na macOS, Windows i Linuksie, ma agenta, który planuje pracę, edytuje pliki, uruchamia sprawdzenia i iteruje, oraz pozwala podłączyć własne klucze API innych modeli. Samodzielne hostowanie otwartych wag, jak zauważa VentureBeat, omija ryzyko związane z amerykańską kontrolą eksportu i obawy o suwerenność danych w Chinach, ale wymaga sprzętu opisanego wyżej.

Jak GLM wypada na tle modeli zachodnich

GLM jest blisko czołówki, ale nie wyprzedza najlepszych zachodnich modeli. GLM-5.2 zajął drugie miejsce w Code Arena tuż za Claude Fable 5, a Flash równa się w indeksie Artificial Analysis z GPT-5.6 Terra. Raport Frontier Radar o dystansie Chin do Zachodu pokazuje, że chińskie modele open-weights od Moonshot, Alibaba i Z.ai są w czołówce niemal każdego wymagającego benchmarku, a poniżej najwyższej półki rynek należy w dużej mierze do otwartych i znacznie tańszych modeli z Chin.

W grze są dwa zarzuty wobec chińskich laboratoriów: że wykorzystywały zachodnie modele jako nauczycieli przez destylację oraz że dostrajają modele pod wysokie wyniki w benchmarkach bez pełnego pokrycia możliwości (benchmaxxing). O innych chińskich laboratoriach: Kimi, Qwen, DeepSeek. Kontekst regulacyjny w temacie zakazów USA wobec chińskich modeli AI.

Czy GLM-5.3 potrafi budować exploity

Tak: zespół Frontier Red Team w Anthropic poinformował, że GLM-5.3 buduje działające exploity niemal tak dobrze jak Claude Mythos Preview. W ExploitBench stworzył działający exploit w 50 z 410 prób, wobec 56 dla Mythos. W teście eksploatacji binarnych osiągnął pełne przejęcie w 4 procentach prób, przy 6 dla Mythos. W piaskownicy z przeglądarką znalazł nieznane wady i połączył je w stronę czytającą pliki, w tym klucz SSH. Zabezpieczenia modelu można obejść prostymi trikami, a „abliterowana” wersja bez odmów kosztowała około 4400 dolarów mocy obliczeniowej. NIST nazwał GLM-5.3 najbardziej cyberzdolnym modelem otwartym, około cztery miesiące za najlepszymi modelami USA.

Usuwanie zabezpieczeń stało się produktem. Amerykański startup Abliteration.ai sprzedaje dostęp do zmodyfikowanych modeli bez mechanizmów odmowy, także do abliterowanego GLM-5.3, za 5 dolarów za milion tokenów. Abliteracja to zmiana samych wag modelu, a nie jailbreak promptu. Firma podaje w wewnętrznych testach 84,5 procent na CyberGym i 41,8 procent na Terminal-Bench 4.0, nie udostępnia zmodyfikowanych wag publicznie i nie wymaga standardowej weryfikacji tożsamości. Dziennikarzowi TechCrunch udało się wyciągnąć z modelu kod do wydobywania haseł zapisanych w Chrome. Szerzej w tematach bezpieczeństwo modeli open-weight i jailbreaki AI.

Co to oznacza dla Ciebie

  • Jeśli szukasz taniego modelu do kodowania, punktem wyjścia jest GLM-5.3-Flash za 0,15 i 0,50 dolara za milion tokenów. Sprawdź cennik Z.ai, zanim zaplanujesz budżet.
  • Jeśli pracujesz na wrażliwym kodzie, jedynym sposobem, by nie trafił do Z.ai, jest hostowanie własne, a to wymaga bardzo dużo pamięci.
  • Nie wysyłaj kodu do anonimowego modelu. Ox Alpha pokazał, jak szybko prawdziwa praca trafia do dostawcy, którego nikt nie zna.
  • Jeśli bronisz systemów, zakładaj, że otwarte modele na poziomie GLM-5.3 potrafią pisać exploity, a zabezpieczenia modeli do pobrania da się usunąć.

Otwarte pozostaje, czy wagi głównego modelu GLM-5.3 zostały w pełni opublikowane i jak amerykańskie ograniczenia potraktują chińskie modele o otwartych wagach.

Kluczowe fakty

  • Frontier Red Team z Anthropic: GLM-5.3 zbudował działający exploit w 50 z 410 prób ExploitBench, wobec 56 dla Mythos Preview. NIST nazwał go najbardziej cyberzdolnym modelem otwartym. (źródło)
  • Startup Abliteration.ai sprzedaje dostęp do abliterowanego GLM-5.3, bez mechanizmów odmowy, za 5 dolarów za milion tokenów wejściowych lub wyjściowych. (źródło)
  • GLM-5.3-Flash ma 320 mld parametrów (18 mld aktywnych), licencję MIT i kontekst miliona tokenów. W API Z.ai kosztuje 0,15 dolara za milion tokenów wejściowych i 0,50 wyjściowych. (źródło)
  • Z.ai potwierdziło, że tajemniczy model Ox Alpha, darmowy na OpenRouter i OpenCode, był zapowiedzią GLM-5.3-Flash. Wagi są na Hugging Face. (źródło)
  • Narzędzie modelprint dopasowało Ox Alpha do GLM-5.3 w sześciu z dziewięciu prób, w tym we wszystkich czterech licznikach tokenizacji. OpenRouter zapewnia, że nie jest twórcą modelu. (źródło)
  • Zhipu AI zaprezentowało GLM-5.3, model kodujący o otwartych wagach. Wykryło z nim 2436 luk w 269 projektach. Wagi miały trafić do open source po dwóch tygodniach. (źródło)
  • Z.ai uruchomiło ZCode, bezpłatną aplikację desktopową dla GLM-5.2 z obsługą własnych kluczy API (BYOK). Działa na macOS, Windows i Linuksie. (źródło)
  • GLM-5.2 to otwartoźródłowy model z kontekstem miliona tokenów do długich zadań kodowania i pracy agentowej. CEO Vercela nazwał go imponującym. (źródło)

Wydanie opracowane przy pomocy sztucznej inteligencji. Tekst i lektor wygenerowane automatycznie.

Oś czasu

  1. Anthropic: chiński GLM-5.3 buduje działające exploity niemal jak Claude Mythos AI
  2. Startup sprzedaje modele AI z usuniętymi zabezpieczeniami jako usługę komercyjną AI
  3. GLM-5.3-Flash: wydajność flagowców za 7,5 razy mniejszą cenę, działa bez GPU Nvidii AI
  4. Chińskie Z.ai ujawnia, że stoi za tajemniczym modelem Ox Alpha AI
  5. Tajemniczy model Ox Alpha na OpenRouter: nikt nie wie, kto go zbudował AI
  6. Chińskie modele open-source niemal dogoniły Zachód, przewaga kurczy się do wąskich nisz AI
  7. Zhipu AI twierdzi, że GLM-5.3 to najmocniejszy model kodujący z otwartymi wagami AI
  8. ZCode: nowe narzędzie od Z.ai do rywalizacji z Cursor i Claude Code AI
  9. Chiński GLM 5.2 działa lokalnie i przewyższa ChatGPT AI
  10. GLM-5.2: otwartoźródłowy chiński model AI zachwyca Dolinę Krzemową AI

Najczęstsze pytania

Co to jest GLM?

GLM to rodzina dużych modeli językowych rozwijana przez Z.ai, dawniej Zhipu AI, z których wiele ma otwarte wagi. Należą do niej GLM-5.2, GLM-5.3 i tańszy GLM-5.3-Flash. Z.ai tworzy też ZCode, bezpłatną aplikację do kodowania z agentem.

Czym jest GLM-5.2?

GLM-5.2 to model Z.ai z czerwca 2026, stworzony do długich zadań kodowania i pracy agentowej. Ma 744 mld parametrów, z czego 40 mld aktywnych (mieszanka ekspertów), i kontekst miliona tokenów. W połowie czerwca zajął drugie miejsce w Code Arena, tuż za Claude Fable 5.

Czy GLM-5.2 jest darmowy?

Częściowo. Wagi są otwarte, więc model można pobrać i uruchomić za darmo, ale standardowy PC z 24 GB VRAM nie wystarczy. API Z.ai kosztuje 1,40 dolara za milion tokenów wejściowych i 4,40 wyjściowych (stan na 10 października 2026). Aplikacja ZCode jest bezpłatna.

Jak używać GLM-5.2?

Przez API Z.ai, przez plan GLM Coding Plan w narzędziach takich jak Claude Code, OpenCode i ZCode albo uruchamiając otwarte wagi na własnym sprzęcie. W Coding Plan zapytania o GLM-5.2 są obecnie kierowane do GLM-5.3 (stan na 10 października 2026).

Czym był Ox Alpha?

Ox Alpha to model udostępniony za darmo od 20 sierpnia 2026 na OpenRouter i OpenCode bez wskazania twórcy. 27 sierpnia Z.ai potwierdziło, że był to anonimowy test GLM-5.3-Flash, przeprowadzony w celu zebrania opinii przed premierą.

Czy GLM-5.3 potrafi budować exploity?

Tak, według Anthropic z 30 września 2026. W ExploitBench zbudował działający exploit w 50 z 410 prób, wobec 56 dla Claude Mythos Preview. Zabezpieczenia modelu można obejść prostymi trikami, a NIST nazwał go najbardziej cyberzdolnym modelem otwartym.