Modele LLM, które warto znać
Pełna mapa rynku modeli językowych z perspektywy polskiego biznesu. Ośmiu kluczowych dostawców, kilkanaście aktywnych modeli, ceny od półtora dolara do kilkudziesięciu dolarów za milion tokenów. Informacje zweryfikowane na 12 czerwca 2026, uzupełniane na bieżąco z naszego strumienia codziennych newsów AI.
Kto liczy się na rynku LLM
Ośmiu dostawców, których modele faktycznie używasz lub powinieneś rozważyć w polskim biznesie. Klikalne karty prowadzą do oficjalnych stron.
Anthropic
Flagship: Claude Opus 4.8 (maj 2026, okno 1M tokenów) - czołówka rankingu Artificial Analysis, 88,6% w SWE-bench Verified. Tańszy do codziennej pracy: Sonnet 4.6. Nowy model kreatywny: Fable 5.
claude.ai ->OpenAI
Flagship: GPT-5.5 (kwiecień 2026), w wariantach Pro i Instant, okno 1M tokenów. Najbardziej rozbudowany ekosystem (ChatGPT, Codex, Operator). Ponad 800 mln użytkowników tygodniowo.
openai.com ->Google DeepMind
Flagship: Gemini 3.1 Pro z dynamicznym myśleniem i oknem 1M tokenów ($2/$12 za 1M). Nowość: Gemini 3.5 Flash (maj 2026, $1,50/$9) - szybki i tani przy tym samym oknie 1M.
gemini.google.com ->Meta AI
Flagship: Llama 4 z architekturą Mixture-of-Experts. Warianty: Scout (okno aż 10M tokenów) i Maverick (400B total / 17B active). Open weights na licencji Llama Community License, darmowa do 700 mln MAU.
open weights ->Mistral AI
Flagship: Mistral Large 3 (123B parametrów, okno 128K, ponad 80 języków), wydany na licencji Apache 2.0. Europejski suweren AI: tańszy i możliwy do uruchomienia na własnej infrastrukturze.
mistral.ai ->DeepSeek
Aktualne modele: DeepSeek V3.2 (wydajny, agentowy) i DeepSeek R1 (rozumowanie). Open source, wyniki zbliżone do czołowych modeli przy znacznie niższym koszcie. Mocny wybór przy wymaganiach suwerenności danych.
open source ->Alibaba Qwen
Rodzina Qwen3 (od 4B do 235B) oraz Qwen 3.7 Max. Modele open-weight na licencji Apache 2.0. W naszych newsach często wskazywane jako model, który bije znacznie większe LLM-y przy dużo niższym koszcie.
open source ->Bielik
Flagship: Bielik 3.0 (styczeń 2026, 11B parametrów). Tokenizer APT4 zoptymalizowany pod polski, trenowany na ponad 292 mld tokenów. Rodzina: 1.5B, 4.5B, 11B. Powstał na superkomputerach Cyfronet AGH (Athena, Helios).
polski / open source ->Najważniejsze premiery 2025-2026
Wybór punktów zwrotnych z naszego archiwum codziennych newsów AI, od Llama 4 do Claude Opus 4.8.
Meta Llama 4 - pierwszy MoE Mety
Pierwsza rodzina Llama z architekturą Mixture-of-Experts (Scout, Maverick). Scout z rekordowym oknem 10M tokenów. Licencja Llama Community License, komercyjna powyżej 700 mln MAU.
Mistral Large 3
Francuski flagship: 123B parametrów, okno 128K, ponad 80 języków, na licencji Apache 2.0. Pozycjonowany jako europejska suwerenna alternatywa dla GPT i Claude.
Bielik 3.0 - polski model językowy 11B
Wydany przez fundację SpeakLeash i Cyfronet AGH. Tokenizer APT4 zoptymalizowany pod polski, trenowany na ponad 292 mld tokenów. Open source na Hugging Face.
Gemini 3.1 Pro i Claude Sonnet 4.6
Gemini 3.1 Pro wprowadza dynamiczne myślenie: model sam decyduje, ile rozumowania potrzebuje na zadanie. Sonnet 4.6 obniża próg wejścia, oferując flagshipową jakość po $3/$15 za 1M tokenów przy oknie 1M.
OpenAI GPT-5.5
OpenAI wprowadza GPT-5.5 w wariantach Pro i Instant, z oknem 1M tokenów i około 60% mniej halucynacji niż GPT-5.4. W parze idzie wzrost ceny do $5/$30 za 1M tokenów.
Gemini 3.5 Flash - tani model klasy 1M kontekstu
Google wypuszcza szybki i tani model: $1,50/$9 za 1M tokenów przy oknie 1M, około 25% taniej niż Gemini 3.1 Pro na zadaniach kodowania. Mocna opcja pod RAG i analizę dokumentów.
Claude Opus 4.8 - nowy lider dla agentów
Opus 4.8 wskakuje na szczyt: 88,6% w SWE-bench Verified i czoło Artificial Analysis Intelligence Index, prowadzi też w Humanity's Last Exam. Cena $5/$25 za 1M, okno 1M. Model projektowany pod agentów i wieloetapowe rozumowanie.
Claude Fable 5 - kreatywny szczyt rankingu
Wyspecjalizowany model do długich form (fikcja, scenariusze, głos postaci), lżejszy i tańszy towarzysz Opus i Sonnet. Z najwyższym wynikiem w Artificial Analysis Intelligence Index (około 65).
DeepSeek V3.2 i R1 - chiński open source
DeepSeek V3.2 (wydajny, agentowy) i R1 (rozumowanie) osiągają wyniki zbliżone do czołowych modeli przy dużo niższym koszcie. Open source, możliwe do uruchomienia na własnej infrastrukturze.
Porównanie kluczowych modeli
Co porównujesz, gdy wybierasz LLM do swojego zastosowania: okno kontekstu, cena, dostęp.
| Model | Dostawca | Premiera | Kontekst | Cena (in/out per 1M tok) | Dostęp |
|---|---|---|---|---|---|
| Claude Opus 4.8 | Anthropic | 2026-05 | 1M | $5 / $25 | API + Claude.ai |
| Claude Sonnet 4.6 | Anthropic | 2026-02 | 1M | $3 / $15 | API + Claude.ai |
| GPT-5.5 | OpenAI | 2026-04 | 1M | $5 / $30 | API + ChatGPT |
| Gemini 3.1 Pro | 2026-02 | 1M | $2 / $12 | API + Gemini app | |
| Gemini 3.5 Flash | 2026-05 | 1M | $1,50 / $9 | API | |
| Mistral Large 3 | Mistral | 2025-12 | 128K | Apache 2.0 | API + self-host |
| Llama 4 Scout | Meta | 2025-04 | 10M | open weights | HuggingFace + self-host |
| DeepSeek V3.2 / R1 | DeepSeek | 2026 | 128K | open weights | API + open weights |
| Bielik 3.0 (11B) | SpeakLeash | 2026-01 | 128K | open weights | HuggingFace |
Cztery rzeczy, które zmieniają się szybciej niż myślisz
Cena rozjeżdża się według klasy modelu. Frontier drożeje (GPT-5.5 podskoczył do $5/$30, dwukrotnie względem GPT-5.4), a jednocześnie modele klasy 1M kontekstu tanieją (Gemini 3.5 Flash $1,50/$9). Wybór wyłącznie po cenie jest ryzykowny: za pół roku układ cen może być zupełnie inny.
Open weights doganiają frontier. DeepSeek (V3.2, R1), Llama 4 i Qwen osiągają wyniki zbliżone do GPT-5.5 i Claude Opus przy dużo niższym koszcie. Dla firm z wymaganiami suwerenności danych (RODO, sektor finansowy) to game-changer: model klasy frontier możesz hostować na własnej infrastrukturze.
Okno 1M tokenów to nowy standard. Claude Opus 4.8, GPT-5.5 i Gemini 3.1 Pro - wszystkie z oknem 1M, a Llama 4 Scout sięga 10M. To koniec ery wyłącznie RAG: cały korpus dokumentacji wstrzykujesz do prompta. Ale uwaga, 1M tokenów na wejściu to realny koszt per zapytanie. Architektura aplikacji wciąż wymaga myślenia.
Specjalizacja modeli wraca. Fable 5 (kreatywne pisanie), Bielik (polski), Codex (programowanie), modele do obrazu - każdy pod swoje zadanie. Strategia jednego modelu do wszystkiego ustępuje miejsca routingowi: mniejsze wyspecjalizowane modele pod konkretne zadania, koordynowane przez orkiestratora.
Co dziś dzieje się w świecie AI
Codziennie publikujemy newsy z całego rynku AI: modele LLM to tylko jeden z wątków. Znajdziesz tu też narzędzia, inwestycje, agentów, regulacje. Aktualizacja codziennie.

21 sierpnia 2026 | Projektowanie białek, tańsza robotyka, złoto danych i automatyzacja pracy: Claude Opus 4.8, Mythos Preview, GEN-1.5, Micro1, Replit, ChatGPT, Meibel, Ramp Router, Meta Pocket i OpenBot

20 sierpnia 2026 | Syntetyczni influencerzy, dane Spirit Airlines na sprzedaż i chipy AI za miliardy: Janie, Harvey II, Cursor Origin, Etched i Ornith-1.5

19 sierpnia 2026 | 3 biliony dolarów długu Big Techu, rekordowe przychody Anthropic, wycena Higgsfield i wirusy umysłu agentów AI: Sonic-3.6, Hermes Agent, MAI-Image-2.6 i GLM-5.3

18 sierpnia 2026 | Chińskie modele open-weight, przełomowy dowód matematyczny i inwestycje w infrastrukturę AI: Kimi K3, GPT-5.6 Sol, Omni, Clears, Vendo, Origin i Wispr Canto

17 sierpnia 2026 | AI napędza gospodarkę, przejęcie Decart AI, Gemini 3.7 Flash i ryzyka agentów: Anthropic, Google, OpenAI, Inferock Bench, GLM-5.3, Zetik, Big Mike

16 sierpnia 2026 | Stripe przejmuje OpenRouter za 7 mld dolarów, Claude Fable 5 kontra GPT-5.6 Sol, IPO OpenAI i ryzyko prompt injection – plus nowości Blume, HarnessRouter, Vidaya i Expeditione

15 sierpnia 2026 | Wojny agentów AI, przejęcie Cursor przez SpaceX i pamięć modeli Metis: Claude Mythos 5, Gemini 3.7 Flash, LLMRouter i inne narzędzia AI, które zmienią Twoją firmę

14 sierpnia 2026 | Tańszy Gemini, błyskawiczny GPT-5.6 i ostrzeżenia przed bańką AI: Gemini 3.7 Flash, GPT-5.6 Sol, Databricks, Writer Palmyra X6, Kane CLI, Ito, Gamgee

13 sierpnia 2026 | Ceny, ryzyka i wyceny w świecie AI: Grok 4.6, wyciek ukrytego rozumowania, Unsloth Desktop, Lettertrace, Dograh i miliardowe rundy Cognition i Anthropic

12 sierpnia 2026 | Sanders kontra AI, 1,1 mld dolarów dla River AI i Nemotron 3.5 Lightning od NVIDII: co nowego w sierpniu 2026 dla Twojej firmy
Pytasz o konkretny model lub porównanie? Zapytaj asystenta.
Mamy RAG-search po wszystkich naszych newsach. Konkretne pytania w naturalnym języku, odpowiedź z datami i linkami do oryginałów.
Otwórz asystenta