LLM-y, które używamy
Lista modeli językowych, do których wracamy w naszych projektach: Anthropic, OpenAI, Google, Meta, Mistral i polski Bielik. Każdy z innym profilem siły — kontekst, koszt, prędkość, niezależność od chmury. Aktualizowane gdy rynek się zmienia (czyli niemal co tydzień).
OpenAI GPT Image 1.5
Zaawansowana platforma umożliwiająca generowanie i edycję obrazów na podstawie promptów tekstowych przy użyciu modeli z rodziny GPT Image oraz DALL·E. Obsługuje zaawansowane funkcje, takie jak renderowanie tekstu, wieloetapowa edycja obrazów oraz integracja z narzędziami konwersacyjnymi.
Operator to agent AI od OpenAI, który potrafi samodzielnie korzystać z przeglądarki internetowej do wykonywania złożonych zadań za użytkownika. Wykorzystuje model Computer-Using Agent (CUA), łącząc możliwości wizyjne GPT-4o z zaawansowanym rozumowaniem do interakcji z interfejsami graficznymi.
Poe Apps
Poe to platforma agregująca ponad 100 modeli AI od różnych dostawców, umożliwiająca interakcję tekstową oraz tworzenie własnych aplikacji wizualnych. Pozwala na korzystanie z modeli tekstowych, graficznych, wideo i audio w ramach jednego spójnego interfejsu i systemu punktowego.
Poster Lab
Perplexity to zaawansowany silnik odpowiedzi AI, który łączy wyszukiwanie informacji w czasie rzeczywistym z generatywnymi modelami językowymi. Funkcja Poster Lab pozwala użytkownikom na tworzenie wizualnych i interaktywnych treści, takich jak personalizowane plakaty i wpisy w księdze gości.

Sonar Sonar Pro
Zaawansowana platforma LLM zoptymalizowana pod kątem wyszukiwania informacji w czasie rzeczywistym i wysokiej faktografii. Oferuje funkcje takie jak cytowanie źródeł, tryb JSON oraz filtry domen, łącząc moc modeli językowych z aktualnymi danymi z internetu.
Spark 4.0 Ultra
Zaawansowany chiński model językowy (LLM) opracowany przez firmę iFlytek, wspierający multimodalność oraz zaawansowane zadania logiczne i programistyczne. Platforma oferuje szerokie możliwości integracji poprzez API i jest jedną z głównych alternatyw dla modeli serii GPT w regionie azjatyckim.
Stable Stable Virtual Camera
Stable Virtual Camera to zaawansowany model dyfuzyjny typu multi-view, który przekształca obrazy 2D w immersyjne filmy 3D z precyzyjną kontrolą trajektorii kamery. Model umożliwia generowanie spójnych wizualnie sekwencji wideo o długości do 1000 klatek bez konieczności skomplikowanej rekonstrukcji sceny.
TantyAI
TantyAI to platforma agregująca wiele modeli językowych, takich jak GPT, Gemini i Claude, umożliwiająca jednoczesne wysyłanie zapytań i porównywanie odpowiedzi. Narzędzie optymalizuje pracę z AI, oferując dostęp do różnych technologii w jednym interfejsie.

Vapi
Vapi to platforma programistyczna do budowania, testowania i wdrażania zaawansowanych asystentów głosowych AI w czasie rzeczywistym. Pozwala deweloperom na integrację modeli LLM z technologiami rozpoznawania i syntezy mowy za pomocą jednego API o niskich opóźnieniach.
VL2 Small
DeepSeek-VL2-Small to zaawansowany model multimodalny typu Mixture-of-Experts (MoE), zaprojektowany do precyzyjnego rozumienia obrazów i tekstu. Wspiera zaawansowane zadania, takie jak lokalizacja obiektów na obrazach (visual grounding) oraz analiza wielu grafik jednocześnie.