HeadFlash

AI

Anthropic ujawnia 133 mln czatów z wyłączonymi filtrami biobroni

Luka w zabezpieczeniach Anthropica, rekordowe modele open-source i nowy benchmark percepcji wizualnej AI.

Posłuchaj

Wydanie opracowane przy pomocy sztucznej inteligencji. Tekst i lektor wygenerowane automatycznie.

Anthropic ujawnia 133 mln czatów z wyłączonymi filtrami biobroni

Anthropic opublikował raport o ryzyku, w którym ujawnił, że przez ponad rok jego modele działające na platformach do feedbacku od ludzi nie miały włączonych klasyfikatorów blokujących treści związane z bronią biologiczną i chemiczną. Dotyczyło to okresu od maja 2025 do kwietnia 2026, w którym około 50 tysięcy osób wygenerowało 133 miliony interakcji. Firma podkreśla, że luka nie zwiększyła realnego ryzyka, ale przyznaje, że podobne problemy mogą istnieć gdzie indziej.

Anthropic ran 133 million contractor chats with its bioweapon filters off →

Alibaba wypuszcza Qwen3.8 z otwartymi wagami i 27 mld parametrów

Zespół Qwen z Alibaba udostępnił otwarte wagi modeli Qwen3.8. Flagowy model Qwen3.8-27B to multimodalny model gęsty z 27 miliardami parametrów, który według twórców przewyższa większego Qwen3.7-Plus w zadaniach kodowania i pracy biurowej. Model natywnie obsługuje kontekst do 262 tysięcy tokenów i przetwarza obrazy oraz wideo, w tym diagramy i wielogodzinne nagrania.

Alibaba’s Qwen team releases Qwen 3.8 models with open weights under the Apache 2.0 license →

Badanie: modele AI nie rozwiązują tygodniowych problemów badawczych

Naukowcy zastosowali metodę Shadow Evaluation, by przetestować, czy zaawansowane modele AI poradzą sobie z otwartymi problemami badawczymi. Agenci oparci o Claude Opus 4.8 i GPT-5.6 Sol otrzymali sześć dni, budżet 3 tysięcy dolarów i dostęp do maszyny wirtualnej, ale ich prace zostały odrzucone przez recenzentów. Badacze odkryli, że modele radzą sobie z inżynierią, ale nie z kreatywnym myśleniem naukowym, co przeczy deklaracjom Anthropica i OpenAI.

Study contradicts Anthropic and OpenAI claims that autonomous AI research is within reach →

Zhipu AI twierdzi, że GLM-5.3 to najmocniejszy model kodujący z otwartymi wagami

Chińska firma Zhipu AI zaprezentowała GLM-5.3, model kodujący z otwartymi wagami, który według producenta jest najmocniejszy w swojej kategorii. Model trenowano na danych do znajdowania podatności w oprogramowaniu, co zaowocowało wykryciem 2436 luk w 269 projektach. Wagi modelu mają trafić do open source za dwa tygodnie po zakończeniu przeglądów bezpieczeństwa.

Zhipu AI releases GLM-5.3, claims it’s the strongest open-weights coding model →

OpenAI wprowadza tryb Ultrafast z prędkością 750 tokenów na sekundę

OpenAI uruchomił podgląd trybu Ultrafast dla modelu GPT-5.6 Sol, który generuje do 750 tokenów na sekundę. Przyspieszenie jest możliwe dzięki współpracy z Cerebras, z którym OpenAI podpisało wartą 10 miliardów dolarów umowę. Usługa jest na razie dostępna tylko przez API dla wybranych klientów, a OpenAI planuje stopniowe zwiększanie dostępności.

GPT-5.6 Sol goes 14x faster as OpenAI launches Ultrafast mode powered by Cerebras →

Nowy benchmark pokazuje słabości AI w percepcji wizualnej

Moonshot AI zaprezentował PerceptionBench, benchmark izolujący percepcję wizualną modeli multimodalnych. Najlepszy wynik osiągnął GPT-5.6 Sol z 59,7 procent skuteczności, a żaden model nie przekroczył progu 60 procent. Benchmark dzieli percepcję na dziesięć umiejętności, a autorzy argumentują, że wiele błędów przypisywanych rozumowaniu wynika z nieprawidłowego odczytu obrazu.

New benchmark confirms AI models still perform poorly at visual perception →

Raport: 15 procent botów AI omija robots.txt w Europie

Raport TollBit za pierwszą połowę 2026 roku pokazuje, że 15 procent agentów pobierających strony dotarło do adresów oznaczonych jako niedozwolone w robots.txt. Najwięcej naruszeń odnotowano dla ChatGPT-User, Bytespider i Youbot. Cloudflare wprowadza nowe zasady dla botów, a badacze z Rutgers i Wharton odkryli, że blokowanie botów AI kosztuje wydawców około 7 procent ruchu.

15% of AI page fetchers in Europe reached disallowed URLs, TollBit finds →

Agent AI Luna zwolnił pierwszego człowieka w sklepie w San Francisco

Luna, agent AI oparty o Claude Sonnet 4.6, prowadzi sklep Andon Market w San Francisco. Firma Andon Labs poinformowała, że Luna zaleciła zwolnienie pracownika po interwencji ludzi, którzy kazali jej sprawdzić własne zasady. Decyzję podjęli i wykonali ludzie, a pracownik pozostaje formalnie zatrudniony przez laboratorium z pełną ochroną prawną.

The AI store manager fired its first human. It had to be reminded of its own rules first →

Funkcja Computer History od OpenAI loguje klawisze i przechowuje je w plain text

OpenAI uruchomił na macOS funkcję Computer History, która rejestruje kliknięcia, klawisze i przełączanie aplikacji. Dane są przechowywane lokalnie jako zwykły tekst bez szyfrowania, co oznacza, że każdy program działający na koncie może je odczytać. Funkcja jest niedostępna w Europejskim Obszarze Gospodarczym, Szwajcarii i Wielkiej Brytanii.

OpenAI’s new ChatGPT feature logs your keystrokes and stores them in plain text →

Platformy wprowadzają znakowanie treści AI, ale skuteczność budzi wątpliwości

Spotify, Substack, TikTok, YouTube i Meta wprowadzają oznaczanie treści generowanych przez AI. Anthropic jako pierwszy wdraża trwałe znakowanie tekstu, które nie zmienia jakości ani czytelności. Eksperci zwracają uwagę na ryzyko fałszywych pozytywów i dyskutują, czy znakowanie rozwiąże problem oszustw w szkołach.

Hey, Your AI Is Showing →