LLM-y, które używamy
Lista modeli językowych, do których wracamy w naszych projektach: Anthropic, OpenAI, Google, Meta, Mistral i polski Bielik. Każdy z innym profilem siły — kontekst, koszt, prędkość, niezależność od chmury. Aktualizowane gdy rynek się zmienia (czyli niemal co tydzień).
Mistral Mistral Large 2 / OCR
Francuska platforma LLM oferująca wydajne modele o otwartych wagach oraz rozwiązania komercyjne. Specjalizuje się w zadaniach wielojęzycznych, kodowaniu i zaawansowanym rozumowaniu, zapewniając wysoką efektywność kosztową.
Mureka O2
Mureka to innowacyjna platforma AI specjalizująca się w generowaniu muzyki, ścieżek dźwiękowych oraz mowy. Umożliwia użytkownikom tworzenie unikalnych kompozycji audio i eksperymentowanie z dźwiękiem przy użyciu zaawansowanych algorytmów generatywnych.

Nemotron 3
NVIDIA Nemotron 3 to rodzina wydajnych modeli open-source zoptymalizowanych pod kątem agentów AI, wykorzystująca hybrydową architekturę Mamba-Transformer MoE. Modele te oferują wysoką precyzję rozumowania, okno kontekstowe do 1 miliona tokenów oraz wyjątkową efektywność obliczeniową.
Nova Nova 2 Sonic
Amazon Nova to rodzina nowoczesnych modeli fundamentowych oferująca wysoką inteligencję oraz wiodący na rynku stosunek wydajności do ceny. Modele te obsługują wiele modalności, w tym tekst, obraz, wideo i mowę, zapewniając przy tym zaawansowane możliwości rozumowania i integracji z narzędziami.
Szybki model językowy typu Mixture of Experts (MoE) zoptymalizowany pod kątem zadań agenturalnych i wysokiej precyzji dziedzinowej. Charakteryzuje się wyjątkową wydajnością i niskimi opóźnieniami w ramach platformy NVIDIA NIM.

o3 pro
OpenAI o3 to rodzina modeli typu reasoning, zaprojektowana do zaawansowanego wnioskowania i rozwiązywania złożonych problemów z zakresu matematyki, nauki i kodowania. Wersja pro oferuje największą moc obliczeniową w tej serii, pozwalając na głębokie procesy myślowe przed udzieleniem odpowiedzi.
OpenAI GPT Image 1.5
Zaawansowana platforma umożliwiająca generowanie i edycję obrazów na podstawie promptów tekstowych przy użyciu modeli z rodziny GPT Image oraz DALL·E. Obsługuje zaawansowane funkcje, takie jak renderowanie tekstu, wieloetapowa edycja obrazów oraz integracja z narzędziami konwersacyjnymi.
Operator to agent AI od OpenAI, który potrafi samodzielnie korzystać z przeglądarki internetowej do wykonywania złożonych zadań za użytkownika. Wykorzystuje model Computer-Using Agent (CUA), łącząc możliwości wizyjne GPT-4o z zaawansowanym rozumowaniem do interakcji z interfejsami graficznymi.
Poe Apps
Poe to platforma agregująca ponad 100 modeli AI od różnych dostawców, umożliwiająca interakcję tekstową oraz tworzenie własnych aplikacji wizualnych. Pozwala na korzystanie z modeli tekstowych, graficznych, wideo i audio w ramach jednego spójnego interfejsu i systemu punktowego.
Poster Lab
Perplexity to zaawansowany silnik odpowiedzi AI, który łączy wyszukiwanie informacji w czasie rzeczywistym z generatywnymi modelami językowymi. Funkcja Poster Lab pozwala użytkownikom na tworzenie wizualnych i interaktywnych treści, takich jak personalizowane plakaty i wpisy w księdze gości.
SchedX
SchedX to zaawansowany agent AI typu Inbound SDR, który prowadzi rozmowy głosowe z użytkownikami strony internetowej w czasie rzeczywistym. Platforma automatycznie kwalifikuje leady, odpowiada na pytania dotyczące produktu oraz umawia spotkania bezpośrednio w kalendarzach handlowców.

Sonar Sonar Pro
Zaawansowana platforma LLM zoptymalizowana pod kątem wyszukiwania informacji w czasie rzeczywistym i wysokiej faktografii. Oferuje funkcje takie jak cytowanie źródeł, tryb JSON oraz filtry domen, łącząc moc modeli językowych z aktualnymi danymi z internetu.
Spark 4.0 Ultra
Zaawansowany chiński model językowy (LLM) opracowany przez firmę iFlytek, wspierający multimodalność oraz zaawansowane zadania logiczne i programistyczne. Platforma oferuje szerokie możliwości integracji poprzez API i jest jedną z głównych alternatyw dla modeli serii GPT w regionie azjatyckim.
Stable Stable Virtual Camera
Stable Virtual Camera to zaawansowany model dyfuzyjny typu multi-view, który przekształca obrazy 2D w immersyjne filmy 3D z precyzyjną kontrolą trajektorii kamery. Model umożliwia generowanie spójnych wizualnie sekwencji wideo o długości do 1000 klatek bez konieczności skomplikowanej rekonstrukcji sceny.
SubQ 1M-Preview
SubQ to pierwsza platforma LLM oparta na w pełni subkwadratowej architekturze sparse-attention, oferująca okno kontekstowe o rozmiarze 12 milionów tokenów. Model charakteryzuje się wysoką wydajnością obliczeniową i niskimi kosztami, umożliwiając agentom AI pracę na całych repozytoriach kodu bez utraty jakości.
TantyAI
TantyAI to platforma agregująca wiele modeli językowych, takich jak GPT, Gemini i Claude, umożliwiająca jednoczesne wysyłanie zapytań i porównywanie odpowiedzi. Narzędzie optymalizuje pracę z AI, oferując dostęp do różnych technologii w jednym interfejsie.

Vapi
Vapi to platforma programistyczna do budowania, testowania i wdrażania zaawansowanych asystentów głosowych AI w czasie rzeczywistym. Pozwala deweloperom na integrację modeli LLM z technologiami rozpoznawania i syntezy mowy za pomocą jednego API o niskich opóźnieniach.
VL2 Small
DeepSeek-VL2-Small to zaawansowany model multimodalny typu Mixture-of-Experts (MoE), zaprojektowany do precyzyjnego rozumienia obrazów i tekstu. Wspiera zaawansowane zadania, takie jak lokalizacja obiektów na obrazach (visual grounding) oraz analiza wielu grafik jednocześnie.