AI Digest - 9 maja 2026
Dziś mocno w stronę narzędzi deweloperskich - dwie duże aktualizacje CLI, przeciek dokumentów Anthropic i delikatna bomba: model, który nie ujrzał światła dziennego, bo twórcy sami uznali go za zbyt niebezpieczny. Do tego trochę filozofii o roli AI w open source.
NARZĘDZIA DLA DEWELOPERÓW
CODEX CLI 0.128.0 - NOWA KOMENDA /GOAL
OpenAI dodało do swojego agenta CLI tryb /goal, który pozwala zdefiniować cel wysokopoziomowy i pozwolić narzędziu samodzielnie zaplanować kroki do jego realizacji. To zmiana jakościowa - do tej pory Codex CLI działał bardziej reaktywnie. Dla tych, którzy już używają Codexa w codziennej pracy, warto zaktualizować i przetestować w praktyce. Simon Willison
LLM 0.32 - DUŻY REFACTOR, WSTECZNA KOMPATYBILNOŚĆ ZACHOWANA
Simon Willison wydał wersję alfa 0.32 swojego narzędzia llm - czyli pythonowego CLI i biblioteki do wywoływania modeli językowych. To nie jest kosmetyczna aktualizacja: 0.32a0 to major refactor architektury wewnętrznej, ale z pełną wsteczną kompatybilnością API. Jeśli używasz llm w skryptach lub własnych toolingach, warto śledzić dalszy rozwój alfy przed przejściem na stable. Link https://simonwillison.net/2026/Apr/29/llm/#atom-[everything oraz bugfixy](https://simonwillison.net/2026/Apr/29/llm-3/#atom-everything)
WYCIEKŁY PLIKI KONFIGURACYJNE CLAUDE CODE
Ben's Bites opisuje wyciek wewnętrznych plików dotyczących Claude Code - chodzi o system prompty i instrukcje bazowe sterujące zachowaniem agenta. Dla praktyków to interesująca lektura (dużo wzorców promptowania), ale przy okazji przypomnienie: system prompty to dziś de facto własność intelektualna firm AI i ich ochrona staje się poważnym problemem operacyjnym. Ben's Bites
BEZPIECZEŃSTWO I AI
GPT-5.5 POD LUPĄ: CO POTRAFI W CYBERSECURITY?
Opublikowano ocenę zdolności GPT-5.5 w kontekście cyberataków - zarówno ofensywnych, jak i defensywnych. Wyniki sugerują, że model radzi sobie z zadaniami z zakresu analizy podatności i automatyzacji recon, choć ma wyraźne ograniczenia przy bardziej złożonych exploitach. Dla zespołów security to lektura obowiązkowa, niezależnie od stanowiska w debacie o AI w pentestingu. Simon Willison
ANTHROPIC ZBUDOWAŁO MODEL, KTÓREGO NIE WYPUŚCI
To jedno z ważniejszych doniesień tygodnia. Anthropic potwierdził, że model Claude Mythos okazał się zbyt ryzykowny, by go udostępnić publicznie, i wstrzymał jego wydanie. Samo przyznanie tego faktu przez firmę, a nie wyciek czy spekulacje, jest precedensem. Pokazuje, że safety review nie jest tylko marketingiem, a "release" nie jest jedynym możliwym wynikiem treningu. Ben's Bites
OPEN SOURCE I POLITYKA AI
ZIG MÓWI TWARDE "NIE" DLA KODU GENEROWANEGO PRZEZ LLM
Projekt Zig ogłosił formalną politykę zakazującą wkładu generowanego przez modele językowe - i co ważne, opublikował szczegółowe uzasadnienie. Nie chodzi tylko o jakość kodu, ale o odpowiedzialność autora, zdolność do recenzji i długoterminowe utrzymanie. To ciekawa kontra dla narracji "AI jako narzędzie do PR-ów" - warto przeczytać ich argumentację nawet jeśli się z nią nie zgadzasz. Simon Willison
ANDREW KELLEY: DA SIĘ WYKRYĆ KOD NAPISANY PRZEZ LLM
Twórca Zig komentuje przekonanie, że "nie można rozróżnić kodu ludzkiego od AI". Kelley twierdzi, że można - i wskazuje konkretne wzorce. Kontekst to oczywiście polityka Zig, ale obserwacje są szersze i przydatne dla każdego, kto robi code review w erze AI-assisted development. Simon Willison
RÓŻNE
RSS DLA APLIKACJI "VIBES-CODED" - CZY TO MA SENS?
Willison stawia tezę, że skoro AI generuje masowo małe aplikacje webowe, potrzebujemy standardu ich syndykacji - coś jak RSS dla apek. Brzmi abstrakcyjnie, ale dotyka realnego problemu: jak odkrywać i śledzić ten ocean jednorazowych narzędzi? Na razie propozycja bez konkretnego RFC, ale warto mieć to z tyłu głowy. Simon Willison
PODSUMOWANIE
Dziś wyróżniają się dwie rzeczy: dojrzewanie toolingu (Codex /goal, LLM 0.32), czyli AI przestaje być eksperymentem i wchodzi w fazę narzędzi engineering-grade, oraz rosnące napięcie wokół bezpieczeństwa i odpowiedzialności: model Anthropic, który nie trafił do release, polityka Zig i ocena GPT-5.5 w cybersecurity to wszystko sygnały, że branża poważnie zmierzyła się z pytaniem "co wolno, a co nie".
Ten wpis to archiwalne wydanie newslettera AI Digest, wygenerowane automatycznie przez AI i wysłane 9 maja 2026. Treść zachowana w oryginalnej postaci, oczyszczona jedynie z artefaktów wersji mailowej.
Ten wpis powstał automatycznie: treść przygotował model AI na podstawie źródeł podlinkowanych w tekście. Zanim coś wdrożysz, sprawdź w źródle.