Cześć,
W ciągu trzech tygodni trzy duże laboratoria wypuściły modele z oknem około miliona tokenów. Anthropic dał Claude Fable 5.1 (1 września), OpenAI dał GPT-6 Astra (3 września), a Alibaba Qwen3.8-Omni-Flash (18 września).
Według dokumentacji Anthropic milion tokenów to około 555 tysięcy słów. Do jednej rozmowy mieści się cały przetarg, komplet umów albo raporty roczne z kilku lat.
Na LinkedIn widzę teraz dużo wpisów w stylu „wrzuć 500 stron i po kwadransie masz analizę”. Mam za sobą 25 lat w korporacji, z czego 16 w IT. Dla mnie to prosta droga do wpadki przed zarządem albo klientem.
Model nie powie, czego nie przeczytał
Duże okno kusi, żeby uznać, że model przeczytał i zrozumiał całość. Tego nie wiesz.
W 2023 roku zespół badaczy ze Stanfordu opisał zjawisko nazwane „lost in the middle”. Ówczesne modele najlepiej wykorzystywały informacje z początku i z końca długiego tekstu. Fragmenty ze środka wypadały wyraźnie gorzej. Dzisiejsze modele radzą sobie lepiej i nie przenoszę tamtych wyników jeden do jednego.
Jedna rzecz się jednak nie zmieniła. Model nie napisze Ci, że pominął paragraf 42 na stronie 180. Odpowie gładko i profesjonalnie. Błąd będzie brzmiał wiarygodnie, a Ty go nie zauważysz, bo przecież AI przeanalizowało całość.
Dla mnie większe okno nie zwalnia z kontroli. Przesuwa ją w inne miejsce. Zamiast czytać cały dokument, sprawdzasz, na czym model oparł swoje wnioski.
Radar: trzy sygnały z ostatnich dni
Zamiast dwudziestu linków trzy rzeczy, które warto odnotować.
1. Google: Gemini w Workspace sięga do CRM (15 września)
Gemini w Gmailu, Dokumentach i Arkuszach może teraz pobierać dane z Salesforce, HubSpot, Asany, Monday i kilku innych narzędzi. Połączenie działa przez MCP, czyli standard łączenia asystentów AI z innymi systemami. Ważny szczegół: w firmach, które mają Gemini, funkcja jest domyślnie włączona.
Dla mnie to zadanie na poniedziałek. Jeśli Twoja firma pracuje na Google Workspace, sprawdź albo poproś administratora o sprawdzenie ustawienia Third-Party Connectors. Najlepiej zanim ktoś podłączy asystenta do bazy klientów.
2. DeepSeek V4.1 Flash z otwartymi wagami (10 września)
Chiński DeepSeek udostępnił nowy model na licencji MIT. Model czyta tekst i obraz, a jego wagi są publicznie dostępne na Hugging Face. Można go więc uruchomić na własnej infrastrukturze, bez wysyłania danych do zewnętrznego dostawcy.
Uruchomienie modelu u siebie rozwiązuje jeden problem: wiesz, gdzie trafiają dane. Nie mówi natomiast, czy model poradzi sobie z Twoimi dokumentami ani czy ufasz jego pochodzeniu. To sprawdza się testem na własnym materiale.
3. Polska: 28 października kolejna część ustawy o systemach AI
Ustawa z 3 lipca 2026 r. obowiązuje od 11 sierpnia. Od 28 października zaczynają obowiązywać jej przepisy o kontrolach, postępowaniach i karach administracyjnych. Ustawa powołuje Komisję Rozwoju i Bezpieczeństwa Sztucznej Inteligencji. Komisja będzie wydawać opinie indywidualne, dzięki którym firma może sprawdzić rozwiązanie przed wdrożeniem. Małe i średnie firmy mogą bezpłatnie testować rozwiązania AI w piaskownicach regulacyjnych.
Do 28 października zostało około sześciu tygodni. To dobry moment, żeby spisać, jakich narzędzi AI używa Twój zespół i do czego.
Bramka jakości: cytat i kotwica
Gdy w poniedziałek analizujesz w Claude albo ChatGPT raport, ofertę czy specyfikację, nie kończ promptu na „podsumuj najważniejsze ryzyka”.
Dopisz dwa zdania:
„Dla każdego wniosku, ryzyka lub kwoty, którą wymienisz, podaj dosłowny cytat z dokumentu i wskaż stronę albo numer sekcji, z której pochodzi. Jeśli dokument nie zawiera tej informacji wprost, napisz wyraźnie: brak danych w źródle”.
Ta instrukcja pokazuje, na czym model oparł odpowiedź. Nadal trzeba porównać cytat z dokumentem i ocenić, czy rzeczywiście uzasadnia wniosek.
Spokojnego tygodnia,
Krzysiek, IT Manager, aizmiana.pl
ps. Jaki był najdłuższy dokument, który trafił od Ciebie do AI? I czy ktoś potem sprawdził, co model pominął? Odpowiedz na maila z newslettera, czytam każdą wiadomość.
Źródła
- Claude Fable 5.1, dokumentacja modelu: https://platform.claude.com/docs/en/models/fable-5-1/overview
- GPT-6 Astra, dokumentacja API: https://developers.openai.com/api/docs/models/gpt-6-astra
- Qwen3.8-Omni-Flash, blog Qwen: https://qwen.ai/blog?id=qwen3.8-omni-flash
- Liu i in., Lost in the Middle: How Language Models Use Long Contexts, 2023: https://arxiv.org/abs/2307.03172
- Google Workspace Updates, 15 września 2026: https://workspaceupdates.googleblog.com/2026/09/connect-to-more-tools-with-gemini-in-Google-Workspace.html
- DeepSeek V4.1 Flash, ogłoszenie: https://api-docs.deepseek.com/news/news260910
- DeepSeek V4.1 Flash, Hugging Face: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
- Ustawa o systemach sztucznej inteligencji, Dz.U. 2026 poz. 1003: https://isap.sejm.gov.pl/isap.nsf/DocDetails.xsp?id=WDU20260001003
- Ministerstwo Cyfryzacji o ustawie: https://www.gov.pl/web/cyfryzacja/ustawa-o-systemach-ai--bezpieczny-rozwoj-sztucznej-inteligencji-w-polsce
- Anthropic, ograniczanie halucynacji: https://platform.claude.com/docs/en/test-and-evaluate/strengthen-guardrails/reduce-hallucinations
Kolejne wydania w Twojej skrzynce
Jeden ważny temat, trzy sprawdzone sygnały i jedna zasada do zastosowania od razu.
Zapisz się na newsletter