Przejdź do treści

Notatnik

Notatki z pracy nad AI

Na bieżąco testujemy nowe modele, benchmarki i wzorce wdrożeń. Piszemy o tym, co sprawdza się w firmach.

Najnowszy wpis

Najnowsze5 min czytania

Jev: model, który zwraca decyzję zamiast zdania

TypeSafe AI wypuściło 15 września model, który nie pisze tekstu. Oddaje wybraną opcję i prawdopodobieństwo, kosztuje 0,042 dolara za milion tokenów wejściowych, a za wyjście nie płaci się nic. Sprawdzamy, co z tego zostaje po odjęciu marketingu.

ModeleKosztyKlasyfikacja
Czytaj

Wszystkie wpisy

6 min czytania

Umiejętności agenta: dlaczego pięć działa lepiej niż sto

Przy puli pięciu skilli właściwy stanowi 29,6% tych, po które agent faktycznie sięga, przy stu już tylko 3,3%. W sierpniu publiczny rejestr skilli rozdawał klony, które kradły klucze SSH. Cztery zasady dla zespołu, który pracuje z agentami.

Czytaj
8 min czytania

Ile naprawdę kosztuje model językowy

Od 0,40 do 50 dolarów za milion tokenów w cennikach z września 2026, okno kontekstu, z którego model korzysta tylko częściowo, i dwie różne liczby opisujące opóźnienie. Liczby, które da się pomnożyć przez własny proces.

Czytaj
4 min czytania

Modele fundamentalne uczą się liczb, nie tylko słów

TabPFN przewiduje na tabelach bez uczenia modelu, Revolut wytrenował model na 24 miliardach zdarzeń, a Synthefy zbiera pieniądze na modele do szeregów czasowych. Co z tego wynika dla firmy z danymi, ale bez zespołu AI.

Czytaj
7 min czytania

Agenci w e-commerce: co dziś działa, zmierzone

W publicznym teście branży sklepowej agent zalicza 79 procent spraw za pierwszym razem i 60 procent, gdy tę samą sprawę powtórzyć cztery razy. Ta druga liczba decyduje, czy możesz postawić go przed klientem.

Czytaj
7 min czytania

Cleora: rekomendacje bez modelu językowego

Otwarty silnik embeddingów grafowych zbudowany w Polsce. Co dokładnie zmierzyli jego autorzy, ile taka rekomendacja kosztuje w porównaniu z modelem językowym i w których miejscach ta metoda przestaje działać.

Czytaj
8 min czytania

Skąd wiesz, że agent naprawdę działa

Agent zaliczył 69 procent spraw za pierwszym podejściem i 46 procent, gdy każdą sprawę powtórzono cztery razy. Liczby, zgodność ocen i koszt pomiaru w systemach, które nigdy nie odpowiadają dwa razy tak samo.

Czytaj

Opisz proces, który zabiera najwięcej czasu

Wystarczy kilka zdań. Odpowiemy, czy da się go usprawnić, ile to mniej więcej kosztuje i czy w ogóle potrzebujesz do tego AI.