Wygenerowane przez AI

Dakarda AI Newsletter · 2 września 2026

Wydanie środowe

Ten sam model, dwa światy zabezpieczeń

Anthropic zrobił coś, czego nie spodziewałam się tak szybko: wypuścił dwa modele tej samej architektury, ale z diametralnie różnymi zabezpieczeniami — Fable 5.1 dla wszystkich i Mythos 5.1 dla wybranych. W tle Bruksela po raz pierwszy używa AI Act przeciwko największym laboratoriom.

Treść tej strony została w całości wygenerowana przez system sztucznej inteligencji, bez udziału redakcyjnego człowieka (art. 50 ust. 4 Rozporządzenia (UE) 2024/1689 — AI Act).

Wstęp · Alex

Witajcie po przerwie. Minęły 72 godziny, a świat AI zdążył się przesunąć — nie tylko o kolejne punkty procentowe w benchmarkach, ale o cały model dystrybucji. Anthropic pokazał, że ten sam rdzeń modelu może trafić do ogółu w wersji z ograniczeniami i do wyselekcjonowanych organizacji w wariancie Mythos z luźniejszymi barierami. To nie jest kwestia „więcej mocy" — to kwestia tego, komu i jak chcemy ją oddać. W tym wydaniu prześledzę dla Was nową parę modeli Anthropica, pierwszą realną egzekucję AI Act przez Brukselę i zapowiedź modelu Astra od OpenAI, który jest tak zdolny, że sam twórca mówi o nim „wymaga dodatkowych zabezpieczeń". Do tego Atlas od World Labs — model rozumiejący przestrzeń 3D — i praktyczne narzędzie do edycji wideo Genjutsu. Będzie o architekturze, prawie i jednym błędzie, który dostał maksymalną ocenę CVSS 10.0.

Co warto wiedzieć

01

Anthropic wypuszcza Claude Fable 5.1 i Mythos 5.1 — ten sam rdzeń, dwa światy zabezpieczeń

Anthropic oficjalnie udostępnił dwa modele: ogólnodostępnego Fable 5.1 oraz Mythos 5.1 — wariant z luźniejszymi ograniczeniami, dostępny wyłącznie dla zweryfikowanych organizacji w programie Project Glasswing (cyberbezpieczeństwo i nauki o życiu). Fable 5.1 podwaja wynik poprzednika w benchmarku agentowych badań naukowych Terminal-Bench-Science (52,6% vs 24,7%), obniża koszt czytania cache o 75% i realnie redukuje koszt pracy agentowej o 25–45%. To sygnał, że rywalizacja przesuwa się z samych wyników benchmarków na ekonomię działania i model dystrybucji.

02

OpenAI potwierdza: model Astra wymaga mocniejszych zabezpieczeń — jest zbyt zdolny, by go od razu wypuścić

OpenAI ujawnił, że nadchodzący model Astra osiąga znacząco wyższe wskaźniki arbitralnego wykonywania kodu niż publiczny GPT-5.6 Sol, w tym użycie dwóch zero-day w łańcuchach exploitów. Sam Altman zapowiedział start modelu „wkrótce", ale dopiero po wdrożeniu dodatkowych warstw bezpieczeństwa. To pierwszy tak jawny przypadek, gdy producent deklaruje, że model ma krytyczne zdolności cybernetyczne i wymaga kontrolowanego wdrożenia — wzmacnia to debatę o audytach zewnętrznych i regulacjach.

03

World Labs (Fei-Fei Li) pokazuje Atlas — omnimodel, który łączy wideo 3D i generowanie scen

World Labs zaprezentował Atlas, nowy omni world model pretrenowany na tekście, obrazach, wideo i danych 3D. To multimodalny autoregresyjny transformer dyfuzyjny, który generuje wideo z piksel-doskonałym sterowaniem kamerą (do 1440p, 60 sekund) i równocześnie rekonstruuje sceny w 3D jako chmury punktów i Gaussian splats. Model trafia do wczesnego dostępu i łączy dwie dotąd osobne dziedziny — generatywne wideo i rekonstrukcję 3D — w jeden krok w stronę przestrzennej inteligencji.

04

Bruksela wysyła pierwsze formalne żądania ws. AI Act — starcie z USA na G20

Komisja Europejska potwierdziła wysłanie pierwszych formalnych żądań informacji do ponad 30 firm budujących modele ogólnego przeznaczenia (OpenAI, Google, Anthropic) — to krok przed ewentualnym wszczęciem postępowań za naruszenie AI Act. Pytania dotyczą bezpieczeństwa modeli, niezależnych audytów i monitorowania po wdrożeniu. Tego samego dnia na G20 w Chapel Hill Amerykanie naciskali na lekką regulację (Carolina Principles), a Elon Musk skrytykował politykę UE jako hamującą postęp.

05

Higgsfield uruchamia Genjutsu — video-to-video bez promptów, z przenoszeniem ruchu i podmianą obiektów

Higgsfield udostępnił Genjutsu, model wideo typu video-to-video z dwiema funkcjami: Motion Transfer przenosi ruch z dowolnego klipu do nowej sceny, a Object Swap podmienia wskazany element w kadrze, zachowując resztę ujęcia. Wszystko działa bez promptów tekstowych — wystarczy nagranie do 30 sekund i do 30 zdjęć referencyjnych. Ceny startują od ok. 2 USD za 15-sekundowy klip w 480p, co eliminuje kosztowne poprawkowe nagrania w produkcji reklam i filmów.

Ze świata tech

01

Krytyczna podatność w Ruflo — CVSS 10.0 w platformie do zarządzania agentami AI

Badacze z Noma Labs odkryli lukę (CVSS 10.0) w platformie open-source Ruflo (67k+ gwiazdek na GitHub), w komponencie MCP Bridge — serwerze Express.js udostępniającym 233 narzędzia, w tym dostęp do powłoki i baz danych. Luka pozwalała na zdalne wykonanie kodu i całkowite przejęcie środowiska agentów AI.

02

TerminalFix — fałszywe CAPTCHA Cloudflare roznoszą backdoor z tunelem zwrotnym

Kampania malware'owa TerminalFix wykorzystuje fałszywe strony CAPTCHA udające Cloudflare, by nakłonić ofiary do kliknięcia (ClickFix), uruchamiając DLL sideloading i Pythonowy backdoor z odwróconym tunelem. Backdoor pozwala na tunelowanie dowolnego ruchu TCP, omijając firewalle i dając dostęp do sieci wewnętrznej ofiary.

Wskazówka dnia

Jak testować modele AI pod kątem bezpieczeństwa nim wdrożysz je do agenta

Widząc historię Mythos 5.1 i Astry — modele z zaawansowanymi zdolnościami agentowymi mogą wykonywać kod i dostęp do systemu, zanim zorientujesz się, że coś poszło nie tak. Zamiast polegać wyłącznie na obietnicach producenta, warto wdrożyć prosty protokół testowy: uruchom model w izolowanym kontenerze Docker bez dostępu do sieci i daj mu zestaw zadań wymagających dostępu do plików, zmiany konfiguracji lub komunikacji z zewnętrznymi API. Sprawdź, czy model próbuje wyjść poza dozwolone granice. Konkretny krok: zanim wrzucisz agenta opartego na Fable 5.1 czy dowolnym modelu do workflow produkcyjnego, stwórz zestaw promptów testowych, które sprawdzają, czy model próbuje uruchomić polecenia systemowe, zmienić zmienne środowiskowe albo połączyć się z nieznanym hostem. Jeśli tak — przynajmniej wiesz, że potrzebujesz dodatkowej warstwy policy (jak np. Google SA Key constraints lub Vault Agent sidecar) zanim oddasz mu realne uprawnienia.

Do przeczytania

Anthropic otwiera Fable 5.1 i Mythos 5.1 — bliźniacza premiera w cieniu bezpieczeństwa

Pełna analiza premiery z The Verge — dlaczego Anthropic zdecydował się na dwie wersje tego samego modelu i co to oznacza dla przyszłości dystrybucji AI.

Krytyczna podatność Ruflo — co każdy deweloper agentów AI wiedzieć powinien

Sekurak rozkłada na części pierwsze błąd w MCP Bridge — lektura obowiązkowa, jeśli pracujesz z platformami do orkiestracji agentów.

Świat AI dzieli się dziś nie na modele lepsze i gorsze, ale na te, którym ufamy — i te, które musimy kontrolować.

Informacja wymagana na mocy art. 50 Rozporządzenia (UE) 2024/1689 (AI Act): cała treść tej strony została wygenerowana automatycznie przez system sztucznej inteligencji działający w imieniu Dakarda Studio, bez weryfikacji ani udziału redakcyjnego człowieka przed publikacją. Za publikację odpowiada Dakarda Studio, Dawid Bińkowski, ul. Piotrkowska 35, 90-410 Łódź, NIP: 9492074226, contact@dakarda.com.

Chcesz następne wydanie na skrzynkę?

Subskrybuj — każde wydanie prosto do Ciebie.

Regulamin newslettera · Polityka prywatności