Kategoria
Sztuczna inteligencja
AI i agenci w realnej pracy firmy, nie w teorii.

Przetestowałem image-blaster i World Labs Marble: wirtualny spacer 3D z jednego zdjęcia na stronie dewelopera. Koszty, czas, co AI dorysowuje i kiedy to ma sens.

Evale w AI na moim przykładzie: AI, które wybiera mi tematy na bloga, miało zgadzać się ze mną w 90%. Ślepy test pokazał 48%. Jak zbudowałem eval w n8n, co poprawiłem i ile to kosztowało.

Premiera 29 września 2026. Co OpenAI pokazało, jak działa dot, dlaczego pokaz na żywo utknął i kto w Polsce może z dots korzystać.

Premiera 30 września 2026. Co Google powiedziało o Gemini 4 Argon, jak zareagował internet, co pokazały niezależne testy i dlaczego modelu prawie nikt jeszcze nie ma.

Jev od TypeSafe to model AI, który nie pisze tekstu, tylko odpowiada tak albo nie i wybiera z listy. Wdrożyłem go 30 września 2026 w automacie n8n i pokazuję liczby z 239 prawdziwych wpisów.

Premiera 28 września 2026. Sprawdziłem Claude Sonnet 5.5 w automacie n8n i jako subagenta w Claude Code: szybkość, koszt, polszczyzna i co psuje się przy przełączeniu modelu.

Nowy model Anthropic sprawdzony nie na benchmarku, tylko na produkcie: Shot Prep, narzędzie do zrzutów ekranu z darmową wersją, wystartowało po dwóch dniach pracy w sesjach Claude Code w chmurze, za kredyty promocyjne. Ceny, terminy, oś czasu, wpadki i rachunek.

Co z AI Act obowiązuje w automatyzacjach z LLM od 2 sierpnia 2026, co przesunął Omnibus i kiedy integrator API odpowiada za art. 50.

Claude Sonnet 5 obiecuje jakość Opusa taniej. Sprawdzamy, co nowy model Anthropic zmienia dla małej firmy, ile kosztuje i czy warto przełączać automaty.
Claude Opus 4 ustanawia nowe standardy w AI kodowaniu z 72,5% wynikiem w SWE-bench. Sprawdź funkcje, wydajność i cennik najlepszego AI dla programistów.