Wrzesień 2026: nowa fala flagowców
Claude Fable 5.1 (1 września), Gemini 3.8 Flash (2 września) i GPT-6 Astra (3 września) w trzy dni. Trzy premiery, jedno pytanie: czy naprawdę potrzebujesz któregoś z nich.
Poradnik dla ludzi, którzy płacą za AI z własnej kieszeni albo z firmowego budżetu i chcieliby wiedzieć, na co dokładnie idą te pieniądze.
Zanim zaczniesz płacić, zrozum, za co płacisz. Pięć kroków, bez matematyki.
Kliknij, żeby odtworzyć jeszcze raz. Każdy klocek to jedna jednostka rozliczeniowa.
Wklej tekst i zobacz, ile tokenów pójdzie na licznik.
To szacunek na podstawie długości tekstu. Realny wynik może się różnić o ±20%, zależnie od tokenizera modelu. Claude Sonnet 5 liczy ok. 30% więcej niż Sonnet 4.6.
Sześć zdań, które oszczędzą ci więcej niż każdy kurs o promptach.
Większość ludzi używa AI źle. Płacą za GPT-5.6 Sol albo Claude'a Fable 5.1, żeby zapytać, jaka jest stolica Francji. To po prostu głupie.
Nie kibicuj firmom. OpenAI, Anthropic i Google nie odda ci ani złotówki za lojalność. Bierz to, co zrobi robotę taniej.
Trzystronicowy prompt nie jest lepszy od pięciu zdań. Jest tylko droższy i częściej gubi sedno.
Wklejasz cały PDF przy każdej wiadomości? Model czyta go od zera za każdym razem i za każdy raz wystawia rachunek.
Darmowy plan też ma cenę: twoje dane, twoje limity albo twój czas na obchodzenie limitów.
Tu nie ma nic na sprzedaż. Żadnego kursu, mentoringu ani „wersji dla firm”. Korzystaj i idź dalej.
AI Psychosis. 16 pytań, dwie minuty, zero rejestracji.
Najdroższy błąd w pracy z AI to nie zły model. To człowiek, który przestał sprawdzać, co ten model mu mówi. Zaczynamy od testu, bo reszta narzędzi na tej stronie nie ma sensu, jeśli traktujesz czat jak wyrocznię, wspólnika albo przyjaciela.
To nie jest narzędzie medyczne. „Psychoza AI” to potoczne określenie, opisywane od 2025 r. przez psychiatrów: chatbot nie wywołuje psychozy sam z siebie, ale potrafi ją podsycić, bo potakuje i wzmacnia przekonania (sykofancja). Jeśli martwisz się o siebie albo o kogoś bliskiego — zgłoś się do psychiatry lub psychologa. W kryzysie w Polsce: 800 70 2222 (całodobowe wsparcie) albo 112.
Rzeczy, do których ludzie odpalają Claude'a Fable 5.1. I co powinni zrobić zamiast tego.
Pytać GPT-5.6 Sol o stolicę Francji.
Wygooglować. Zajmie dwie sekundy i nie kosztuje 1200 tokenów.
Wysyłać do Fable’a „napisz mi kod, który robi wszystko”.
Rozbić na trzy małe zadania i puścić przez Haiku 4.5 albo DeepSeek V4.
Wrzucać 400-stronicowy PDF do każdej wiadomości.
Policzyć embeddingi raz, potem korzystać z RAG. Płacisz za 2 tys. tokenów zamiast 300 tys.
„Bądź, proszę, pomocnym asystentem, który…” (500 słów promptu systemowego).
Trzy zdania: rola, format, zakaz preambuły. Reszta to szum.
Odpalać model rozumujący do poprawiania literówek.
Haiku, Flash albo Luna. Model rozumujący to Ferrari na zakupy do Biedronki.
Puszczać agenta w pętli bez limitu na firmowej karcie.
Twardy max_steps, max_tokens i budżet. Agent bez hamulca to pożar.
Generować to samo pięć razy „dla pewności”.
Obniżyć temperaturę i zaufać pierwszej odpowiedzi. Albo włączyć cache.
Płacić za GPT-6 Astrę, żeby streszczał maile.
Gemini 3.8 Flash. Kilkanaście razy taniej, a przy streszczeniach różnicy nie zauważysz.
Wklej długi prompt, dostaniesz krótszy, który robi to samo.
Za odpowiedź płacisz 3–6 razy więcej niż za pytanie, a prawie nikt tego nie kontroluje.
Ustaw max_tokens. Zawsze. Bez limitu model dopisze wszystko, co mu przyjdzie do głowy — a płacisz za każde słowo.
Zakaż preambuły: „Odpowiedz od razu, bez wstępu, bez powtarzania pytania i bez podsumowania na końcu”.
Klasyfikacja? Zwracaj samą etykietę. Ekstrakcja? Wyłącznie JSON. Nie zostawiaj modelowi miejsca na ciekawostki.
Format wymuś w promptcie systemowym: „maksymalnie 3 punkty, każdy do 12 słów”. Krótko i stanowczo.
Ustrukturyzowane wyjście i JSON Schema. Model nie dopisze nic na końcu, jeśli schemat tego nie przewiduje.
Nie proś o tok rozumowania w odpowiedzi („wyjaśnij swoje rozumowanie”). Zapłacisz za setki tokenów, których nie wykorzystasz.
Sekwencje stopu. Zdefiniuj, gdzie model ma przestać (np. „\n\n” albo „###END”). Reszta w ogóle się nie wygeneruje.
Strumieniowanie i przerwanie w kodzie, gdy masz już odpowiedź. Nie czekaj grzecznie do końca.
Modele rozumujące (o3, o4-mini) liczą też niewidoczne tokeny rozumowania jako wyjście. Gdzie się da, ustaw reasoning_effort='low'.
Nie łącz zadań w jednym wywołaniu. Zamiast „streść, przetłumacz i oceń” zrób trzy tanie wywołania zamiast jednego drogiego z długim wyjściem.
Wybierz cel i budżet. Powiem ci, co brać, a czego nie ruszać.
Weź Claude Sonnet 5. Sonnet 5 to obecnie najlepszy stosunek ceny do jakości w kodowaniu. Codex jest droższy i rzadko lepszy. Claude Fable 5.1 kosztuje 5× więcej i nie zrobi tego istotnie lepiej.
Napisz, nad czym siedzisz, a dostaniesz model dopasowany do zadania, nie do marketingu.
Policz miesiąc albo jedną rozmowę. Liczby zwykle wychodzą wyższe, niż się ludziom wydaje.
Zaczyna boleć. Zastanów się nad tańszym modelem.
Każdy prompt chłodzi się wodą. Zobacz, ile jej wypijasz przy typowych zadaniach.
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
mniej niż łyk wody
44 ml — pół szklanki
222 ml — pół szklanki
0.44 l — butelka wody
0.57 l — butelka wody
0.82 l — butelka wody
To szacunki rzędu wielkości, nie faktura z wodociągów. Zużycie zależy od centrum danych, klimatu i sposobu chłodzenia, a operatorzy podają twarde liczby niechętnie. Wniosek jest prosty: pojedynczy prompt to nic, a pętla agenta puszczona na noc to już prysznic.
Lokalny model nie płaci abonamentu. Płaci prądem i twoim czasem. Zobacz, czy to się spina.
Ile miesięcy zajmie, zanim własny sprzęt zwróci się względem chmury.
Na granicy. Zwrot jest, ale dopiero po latach — kupuj tylko, jeśli zależy ci też na prywatności.
Prywatność, brak limitów i praca offline to realne korzyści, których ten kalkulator nie wycenia. Wliczaj je świadomie, a nie na wyrost.
Stan na wrzesień 2026. Co się zmieniło w cennikach i modelach.
Claude Fable 5.1 (1 września), Gemini 3.8 Flash (2 września) i GPT-6 Astra (3 września) w trzy dni. Trzy premiery, jedno pytanie: czy naprawdę potrzebujesz któregoś z nich.
OpenAI i Anthropic zeszły się na tej samej cenie: 10 USD za milion tokenów wejścia i 50 USD za wyjście. To pięć razy więcej niż Sonnet 5 i ponad sto razy więcej niż tanie modele.
GPT-5.6 Luna, Claude Haiku 4.5, Gemini 3.8 Flash obsłużą za ułamek ceny 90% zadań, do których odpalasz GPT-6 Astrę czy Fable’a 5.1. Sprawdź to sam.
0,75/3,75 USD obowiązuje do 31 grudnia 2026, potem podwójnie. Tokeny „myślenia” liczą się jako wyjście, więc realny koszt zadania bywa wyższy, niż wynika z cennika.
Wrześniowa podwyżka potroiła stawki, a ceny szczytowe zostały. Qwen 3.8 Flash za 0,15/0,47 USD robi teraz masówkę taniej.
Claude Sonnet 5 liczy o ok. 30% więcej tokenów niż Sonnet 4.6 za ten sam tekst. Za to jego cena 2/10 USD została na stałe.
o4-mini, o3 i Gemini 3.1 Pro są świetne do trudnych problemów. Do „napisz maila” to czyste palenie kasy.
Robią to dwie osoby, po godzinach. Nie stoi za tym żadna firma ani inwestor. Powstało po którymś z rzędu spotkaniu, na którym ktoś dumnie pokazywał fakturę za AI, nie umiejąc wyjaśnić, skąd wzięła się kwota.
Wszystko tutaj jest darmowe i zostanie darmowe. Nie ma logowania ani analityki. Jak się przyda, podeślij dalej.
Paweł Kuras. Pracuję z technologią na co dzień i widzę, jak ludzie i firmy przepalają pieniądze na modele, których nie potrzebują. Ta strona to zbiór narzędzi, których sam bym chciał używać — bez rejestracji, bez płatnych tierów, bez cyrków.
Napisz do mnie na LinkedIn↗