aizmiana.Opisz zadanie

NEWSLETTER · WYDANIE #2

Nowy model nie naprawi starego wejścia

Opus 5.5 i GPT-6 Sol wyszły tego samego dnia. Karta testu, którą zrobisz na własnym zadaniu.

Krzysiek, IT Manager, aizmiana.pl · Wysłane 27 września 2026

Cześć,

22 września Anthropic i OpenAI pokazały nowe modele tego samego dnia.

Anthropic wypuściło Claude Opus 5.5. Według firmy na większości zadań pracuje na poziomie Claude Fable 5.1, a jego użycie kosztuje o 40% mniej niż Opus 5. Jest w planach Pro, Max, Team i Enterprise oraz w API.

OpenAI udostępniło GPT-6 Sol i GPT-6 Luna, tańsze i szybsze modele z rodziny GPT-6. Działają w ChatGPT Work i Codex dla planów Plus, Pro, Business, Enterprise i Edu. Luna jest też dostępna dla kont Free i Go w aplikacji desktopowej. W zwykłym czacie jeszcze ich nie ma.

Obie firmy mówią to samo: podobna jakość, niższy koszt, większa szybkość. Pokusa jest oczywista. Przełączyć wszystko i od jutra pracować na nowym.

Nowy model, stare wejście

Na co dzień dostaję od AI poranny brief ze stanem spraw i zadań. Poprawiam go kilka razy dziennie, bo model nie ma kompletu danych albo status tematu zmienił się od wczoraj i nikt tego nie zapisał.

Lepszy model tego nie naprawi. Poda nieaktualny status szybciej i pewniej. Dlatego przed przesiadką warto zadać sobie dwa pytania. Czy nowy model daje lepszy wynik na moim zadaniu? I skąd biorą się poprawki, które robię: z modelu czy z wejścia?

Na pierwsze odpowiada test. Na drugie odpowiada zapis każdej poprawki. Oba opisuję niżej.

Radar: dwa sygnały z ostatnich dni

Tym razem dwa. W ostatnim tygodniu z Azji i ze świata modeli otwartych nie wyszło nic, co zmienia codzienną pracę.

1. Google: Dokumenty piszą na podstawie Twoich źródeł (23 września)

W Dokumentach Google można teraz wskazać notatnik z Gemini Notebook. Wpisujesz „@” w panelu bocznym, a Gemini opiera tekst na materiałach z notatnika i dodaje cytaty w treści. Funkcja jest m.in. w planach Business i Enterprise oraz w Google AI Pro i Ultra. Jeśli firma ma włączone Gemini w Dysku, działa domyślnie.

To druga w tym miesiącu funkcja Gemini w Workspace włączona domyślnie. O pierwszej, połączeniu z CRM, pisałem w #1.

Mój wniosek: w #1 proponowałem prosić model o dosłowny cytat ze źródła. Tu Google robi to za Ciebie, ale cytat pokazuje tylko, skąd model wziął zdanie. Nie mówi, czy źródło jest aktualne. Przy wspólnym notatniku ustal, kto pilnuje aktualności materiałów.

2. Polska: Komisja do spraw AI ma powstać jesienią

Ustawa o systemach sztucznej inteligencji obowiązuje od 11 sierpnia. Według Ministerstwa Cyfryzacji przewodniczący Komisji Rozwoju i Bezpieczeństwa Sztucznej Inteligencji ma zostać powołany w październiku, a Komisja ma ruszyć w listopadzie. To ona będzie wydawać opinie indywidualne, czyli potwierdzać przed wdrożeniem, czy rozwiązanie jest zgodne z przepisami. Przypominam też termin z #1: od 28 października obowiązują przepisy o kontrolach i karach.

Mój wniosek: jeśli planujesz wdrożenie AI, co do którego masz wątpliwości prawne, opinia indywidualna realnie będzie możliwa najwcześniej po starcie Komisji. Nie planuj na niej terminu w październiku.

Zasada na ten tydzień: karta testu przesiadki

Zanim przełączysz pracę na nowy model, zrób jeden test:

1. Zadanie, które robisz co tydzień. 2. Takie, przy którym wiesz, jak wygląda dobry wynik. 3. To samo wejście na obu modelach: te same materiały i polecenie. 4. Trzy kryteria spisane przed uruchomieniem. Na przykład: fakty zgodne ze źródłem, format do wysłania bez przeróbek i jedna rzecz, której w wyniku być nie może. 5. Ocena każdego kryterium osobno, TAK albo NIE. 6. Liczba poprawek, których wymagał wynik. Przy każdej dopisz, czy wynikała z modelu, czy z wejścia.

Punkt 6 jest najważniejszy. Jeśli większość poprawek wynika z wejścia, nowy model niewiele zmieni. Wtedy lepiej poprawić źródła i instrukcje, a dopiero potem porównywać modele.

Kartę z kryteriami zapisz obok polecenia. Przy następnej premierze wystarczy powtórzyć ten sam test, zamiast zaczynać od zera.

Spokojnego tygodnia,

Krzysiek, IT Manager, aizmiana.pl

ps. Które zadanie warto by u Ciebie sprawdzić takim testem jako pierwsze? Odpowiedz na maila z newslettera, czytam każdą wiadomość.

Źródła

Kolejne wydania w Twojej skrzynce

Jeden ważny temat, trzy sprawdzone sygnały i jedna zasada do zastosowania od razu.

Zapisz się na newsletter

Ustawienia prywatności

Fonty i grafiki są lokalne. Newsletter korzysta ze skryptu Brevo i po wysłaniu formularza przekazuje tam adres e-mail oraz zgodę. Nie dodajemy Google Analytics ani pikseli reklamowych.

Hosting Tiiny dodaje statystyki odwiedzin. Zmiana poniżej działa po przeładowaniu strony.

Przeczytaj zasady cookies