AI
AI w ogniu: biobron, ucieczki z piaskownicy i wyścig z Chinami
Cisco obnaża słabości zabezpieczeń modeli AI, Claude Cowork ucieka z sandboxa, a Dario Amodei ostrzega przed chińską AI.
Cisco: żaden model AI nie jest odporny na pytania o broń biologiczną
Cisco zademonstrowało, że zabezpieczenia modeli AI można obejść w zaledwie pięciu rundach konwersacji. Badacze przetestowali 15 modeli od OpenAI, Anthropic, Google, Amazon i xAI, uzyskując wskaźnik skuteczności ataku od 8% do 88%. Amy Chang z Cisco podkreśliła, że żaden model nie może być całkowicie chroniony przed wystarczająco uporczywym użytkownikiem. Eksperci ds. biologii i terroryzmu uznali uzyskane informacje za niebezpiecznie dokładne.
No AI model is fully resistant to bioweapon queries, Cisco found. Attack success rates hit 88%. →
Claude Cowork uciekł z sandboxa na Macu, zyskując pełny dostęp do plików
Luka ShareRoot w Claude Cowork umożliwiła agentowi AI opuszczenie wirtualnej maszyny Linux i uzyskanie nieograniczonego dostępu do odczytu i zapisu plików na Macu, w tym danych logowania. Około pół miliona użytkowników było narażonych przed załataniem luki. Anthropic zareagował, ale użytkownicy uruchamiający agenta lokalnie wciąż są zagrożeni, chyba że wzmocnią konfigurację. Nowa wersja domyślnie korzysta z chmury, co omija lokalny wektor ataku.
Claude Cowork escaped sandbox on Mac, gain full access to all files →
Microsoft uruchamia własny model cyberbezpieczeństwa MAI-Cyber-1-Flash
Microsoft wprowadził MAI-Cyber-1-Flash, kompaktowy model cyberbezpieczeństwa wbudowany w system wieloagentowy MDASH. Osiąga on 96% skuteczności w benchmarku CyberGym, o 12 punktów więcej niż Mythos i przewyższając Gemini oraz GPT. Firma szacuje 50% redukcję kosztów, ponieważ model obsługuje 90% zadań, przekazując trudniejsze przypadki GPT-5.4. Microsoft wciąż polega na OpenAI w zakresie złożonego rozumowania. Wprowadzono też system Perception do monitorowania i neutralizacji zagrożeń w czasie rzeczywistym, wykorzystujący ponad 100 bilionów dziennych sygnałów bezpieczeństwa.
Anthropic: nie jesteśmy przeciwni otwartym modelom, ale boimy się chińskiej AI
CEO Anthropic, Dario Amodei, zapewnił, że jego firma nigdy nie opowiadała się za zakazem modeli open-weight. Obawia się jednak, że autorytarne rządy, zwłaszcza Chiny, zbudują modele potężniejsze od amerykańskich, by osiągnąć trwałą przewagę militarną. Amodei podkreślił, że otwarte modele są bardziej niebezpieczne w kontekście ataków biologicznych, ponieważ trudno nałożyć na nie zabezpieczenia. Zaproponował ograniczenie dostępu Chin do wydajnych chipów oraz formalne zwalczanie destylacji modeli. Poparł też tworzenie organizacji testującej bezpieczeństwo modeli, pod warunkiem że podda się jej cały świat, w tym Chiny.
Anthropic’s Dario Amodei responds: doesn’t oppose open-weight models, but fears Chinese AI →
Moonshot AI udostępnia otwarte wagi Kimi K3 i infrastrukturę
Moonshot AI opublikowało wagi modelu Kimi K3 na Hugging Face wraz z częścią infrastruktury, w tym jądrami uwagi wysokiej wydajności i biblioteką komunikacji MoE. Firma twierdzi, że nowa architektura zapewnia 2,5 razy więcej inteligencji na jednostkę mocy obliczeniowej. Model od połowy lipca 2026 roku uzyskuje wyniki zbliżone do zachodnich modeli granicznych, takich jak Fable 5 i GPT-5.6 Sol, przy nieco niższym koszcie. Niezależny test brytyjskiego Cyber Institute wykazał jednak, że umiejętności cybernetyczne i matematyczne modelu pozostają daleko w tyle za modelami granicznymi, co może sugerować wykorzystanie destylacji.