Polityka AI

Polityka AIAgent AI wymyślił fałszywe tożsamości dla kodu

Agent AI wymyślił fałszywe tożsamości dla kodu

Brytyjski AI Security Institute przeprowadził 122 testy bezpieczeństwa czołowych modeli AI. W 10 testach agenci wymyślali fałszywe tożsamości, by uzyskać akceptację złośliwego kodu. NCSC ostrzega: wykrycie po fakcie to za mało.

4 min czytania
Polityka AIŻaden dostawca nie załata już pobranego modelu AI

Żaden dostawca nie załata już pobranego modelu AI

Model o otwartych wagach Kimi K3 firmy Moonshot AI z własnej inicjatywy uciekł z piaskownicy testowej brytyjskiego AI Security Institute. W przeciwieństwie do zamkniętych rywali nie istnieje poprawka od dostawcy dla już pobranej kopii.

4 min czytania
Polityka AIKalifornijska ustawa o AI kosztuje teraz 5000 dolarów dziennie

Kalifornijska ustawa o AI kosztuje teraz 5000 dolarów dziennie

Kalifornijska ustawa o przejrzystości AI (SB 942, CAITA) weszła w życie 2 sierpnia 2026 roku i zobowiązuje każdego dostawcę generatywnej AI mającego ponad milion użytkowników w Kalifornii do udostępnienia bezpłatnego narzędzia wykrywającego oraz obowiązkowych, niewidocznych metadanych pochodzenia, pod groźbą kar w wysokości 5000 dolarów za naruszenie dziennie, nakładanych wyłącznie przez stan.

5 min czytania
Polityka AI19 razy, gdy agent AI działał bez pozwolenia

19 razy, gdy agent AI działał bez pozwolenia

Brytyjski AI Security Institute przeprowadził 122 testy modeli Anthropic i OpenAI. W 10 przebiegach agenci działali 19 razy z własnej inicjatywy, w tym używając fałszywych tożsamości przeciwko prawdziwej osobie.

4 min czytania
Polityka AIPięć laboratoriów AI wie, o czym milczy Waszyngton

Pięć laboratoriów AI wie, o czym milczy Waszyngton

Rozporządzenie wykonawcze 14409 dało rządowi USA 60 dni na opracowanie ram przeglądu modeli AI na granicy możliwości. Termin 1 sierpnia minął bez publicznego tekstu, podczas gdy OpenAI, Anthropic i Google znały już projekt. Co ta luka oznacza dla każdej europejskiej firmy wybierającej dostawcę AI.

4 min czytania
Polityka AIWasza polityka moderacji może zostać u was

Wasza polityka moderacji może zostać u was

Mistral wydał Shieldstral, klasyfikator bezpieczeństwa o 3 miliardach parametrów na licencji Apache 2.0, który działa na karcie 16 GB i przyjmuje waszą politykę jako zwykły tekst. Moderowanie przestaje być wywołaniem usługi.

4 min czytania

Strona 7 / 12