Co Mistral wydał 4 sierpnia
Mistral wydał 4 sierpnia Shieldstral, klasyfikator bezpieczeństwa o 3 miliardach parametrów, opublikowany z otwartymi wagami na licencji Apache 2.0 i dostępny na Hugging Face. Obsługuje tekst, obrazy oraz treści łączące tekst i obraz, a Mistral podaje, że dorównuje lub przewyższa otwarte modele straży nawet siedmiokrotnie większe w zakresie bezpieczeństwa tekstu, wykrywania odmów, przystosowalności polityk i prób wielomodalnych. Działa na jednym procesorze graficznym NVIDIA o 16 GB.
Ciekawa jest decyzja projektowa leżąca pod tym. Zamiast modelu wyuczonego do stosowania jednej stałej klasyfikacji szkód, Shieldstral traktuje moderację jako zadanie pytania i odpowiedzi: dostarczacie politykę w zwykłym języku w czasie wnioskowania, a model odpowiada w oparciu o tę politykę, nie będąc uczony ponownie. Mistral ujmuje pobudkę wprost, zauważając, że każdy produkt dostarczający model musi odpowiadać na pytania tego rodzaju i że właściwa odpowiedź zależy od produktu i odbiorców. Wydanie zbiega się także z tym, że Mistral występuje jako członek założyciel Open Secure AI Alliance obok NVIDIA.
Liczbą, która ma znaczenie, jest 16 gigabajtów
Większość relacji o wydaniu modelu otwiera się próbą porównawczą. Dla operatora nośną liczbą jest tu 16 GB, bo to granica między zdolnością wynajmowaną a posiadaną. Klasyfikator o 3 miliardach parametrów, który mieści się na jednym zwykłym akceleratorze, może stać w waszej własnej sieci, obok chronionego programu, bez ruchu wychodzącego i bez licznika za wywołanie. Moderacja przestaje być kosztem zmiennym rosnącym wraz z ruchem i staje się kosztem stałym, który nie rośnie z niczym.
Druga konsekwencja dotyczy danych, a nie pieniędzy, i dla europejskiego operatora jest większa. Jeśli dziś korzystacie z hostowanej usługi moderacji, przy każdym wywołaniu wasz budynek opuszczają dwie rzeczy: treść użytkownika, która was niepokoi, często najwrażliwszy materiał, jaki przechowujecie, oraz sama wasza polityka, będąca dość dokładnym opisem tego, co wasza firma uznaje za niebezpieczne. Prowadzenie tego u siebie usuwa oba transfery. Każdy, kto pisał rejestr czynności przetwarzania obejmujący łańcuch moderacji, rozpozna, o ile ten dokument staje się prostszy, gdy odpowiedź na pytanie, gdzie trafiają dane, brzmi: nigdzie.
Skalibrowana ocena przenosi próg do was
Shieldstral zwraca skalibrowane prawdopodobieństwo zamiast dwuwartościowego orzeczenia, a ten szczegół po cichu przenosi decyzję. Model straży, który wydaje zezwól albo zablokuj, ma próg zagrzebany w środku, wybrany przez dostawcę, a wy dziedziczycie tolerancję na fałszywe trafienia i przeoczenia, którą ten dostawca wybrał. Model, który wydaje ocenę, zmusza was do samodzielnego ustawienia odcięcia, dla każdej polityki, każdej powierzchni i być może każdego rynku.
To więcej pracy i lepsze rządzenie, bo w progu mieszka prawdziwy sąd redakcyjny. Tam też osadza się odpowiedzialność. Gdy ustalicie liczbę, uzasadnienie należy do was i możecie je przedstawić: ta powierzchnia blokuje przy 0,7, tamta przy 0,9, oto powód, oto data przeglądu. W ramach obowiązków dla modeli sztucznej inteligencji ogólnego przeznaczenia, które stały się wykonalne w Unii Europejskiej 2 sierpnia 2026 roku, możliwość okazania udokumentowanego i świadomego progu warta jest znacznie więcej niż możliwość powiedzenia, że zajął się tym dostawca. Niewygodny wniosek jest taki, że nie wskażecie już domyślnego ustawienia dostawcy, gdy coś przejdzie.
Dlaczego 37 członków stało się ponad 120 w osiem dni
Open Secure AI Alliance rozpoczęła działalność 27 lipca z 37 członkami i NVIDIA na czele, a 4 sierpnia liczyła ponad 120 organizacji, czyli około trzykrotnie więcej w osiem dni. Na Black Hat w Las Vegas grupa zaproponowała to, co nazywa wytycznymi SAFE dotyczącymi przejrzystości w cyberbezpieczeństwie. Lista członków czyta się jak odczytanie stosu korporacyjnego, z Microsoftem, IBM, Cisco, CrowdStrike, Palo Alto Networks, Cloudflare, Dell, Adobe, Salesforce, Hugging Face i Linux Foundation.
Wzrost w takim tempie to nie zapał do normy, której nikt nie przeczytał. To grono dostawców uznające, że obrońcy muszą móc badać i uruchamiać modele na własnej infrastrukturze i że zamknięty model czołowy osiągany przez interfejs nie może być całą odpowiedzią na pracę w bezpieczeństwie. Shieldstral jest tym, jak ten argument wygląda, gdy zostaje dostarczony: mechanizmem o otwartych wagach, który można prowadzić u siebie, wydanym przez europejskie laboratorium w tym samym tygodniu, w którym sojusz uczynił przejrzystość swoim tytułem. Dla kupujących praktyczny odczyt jest taki, że otwarta warstwa zabezpieczeń jest już rzeczywistą opcją zakupową, a nie postawą badawczą, a jej ocena kosztuje jeden akcelerator.
Czytaj dalej: Snapchat postawił granicę na czyim narzędziu | Amerykański próg dla granicznej AI jest teraz tajny



