Co naprawdę wylądowało na Hugging Face

Moonshot AI opublikował wagi Kimi K3 na Hugging Face i tym razem pliki rzeczywiście tam są. Repozytorium zawiera 96 fragmentów safetensors, plik config.json oraz plik LICENSE, a zestawienie podaje łącznie 1,56 terabajta. Ta ostatnia liczba waży więcej, niż wygląda, bo wagi przechowywane są w precyzji MXFP4 z aktywacjami MXFP8. Nie czeka żadna mniejsza wersja na kwantyzację: to już jest skompresowana dystrybucja.

Architektura to mieszanka ekspertów o 2,8 biliona parametrów łącznie i 104 miliardach aktywowanych na token, wybieranych z 896 ekspertów, z których za każdym razem wskazuje się 16. Stos liczy 93 warstwy, w tym 69 KDA i 24 gated MLA, na słowniku 160.000 tokenów, z domyślnym oknem kontekstu 1.048.576 tokenów. To model widzący, wpisany jako obraz i tekst do tekstu, a nie wyłącznie tekstowy.

Opublikowane wyniki są mocne w kategoriach, które liczą się dla pracującego zespołu: 93,5 w GPQA Diamond, 88,3 w Terminal-Bench 2.1, 91,2 w BrowseComp, 67,5 w DeepSWE oraz od 81,6 do 83,4 w MMMU-Pro dla części obrazowej. Moonshot podaje, że zarówno repozytorium kodu, jak i wagi modelu wychodzą na licencji Kimi K3 License, i tu zaczyna się ciekawsza część.

Dwa progi, a ten mniejszy z pozoru jest tym wiążącym

Kimi K3 License to nie Apache i nie MIT. Zawiera dwa osobne wyzwalacze komercyjne, a relacje prasowe niemal na pewno je pomieszają. Pierwszy jest w sekcji trzeciej: jeśli oprogramowanie albo utwór pochodny jest używany w komercyjnym produkcie lub usłudze mającej ponad 100 milionów aktywnych użytkowników miesięcznie albo ponad 20 milionów dolarów przychodu miesięcznego, słowa Kimi K3 muszą być widocznie wyświetlone w interfejsie tego produktu. To obowiązek oznaczenia, dotyczy bardzo krótkiej listy firm i nie ogranicza tego, co możesz zbudować.

Drugi jest w sekcji drugiej i działa inaczej pod każdym względem. Jeśli ty albo któryś z podmiotów powiązanych prowadzicie działalność typu model jako usługa, a zagregowany przychód całości przekroczy łącznie 20 milionów dolarów w dowolnych dwunastu następujących po sobie miesiącach, musisz zawrzeć osobną umowę z Moonshot AI, zanim w ogóle użyjesz oprogramowania komercyjnie. Nie logotyp. Podpisany kontrakt, i to jako warunek wstępny użycia.

Przelicz obie liczby, bo nie są tej samej wielkości. Dwadzieścia milionów dolarów miesięcznie to 240 milionów rocznie. Dwadzieścia milionów dolarów w ciągu dwunastu miesięcy to jedna dwunasta tego wyzwalacza, przy dzisiejszych kursach około 18 milionów euro przychodu grupy. Rentowna polska firma softwarowa z pięćdziesięcioma osobami może być powyżej klauzuli warunkującej użycie i daleko poniżej tej, która warunkuje oznaczenie. Próg, który brzmi łagodniej, jest tym, który naprawdę sięga rynku średniego.

Przy 1,56 terabajta otwarte wagi to nie uruchamialny model

Odłóż licencję na chwilę i spójrz na logistykę. Pobranie 1,56 terabajta to nie popołudnie programisty: to zaplanowany transfer ze skutkami dla ruchu wychodzącego, a na końcu zostaje model, który aktywuje 104 miliardy parametrów na token i wymaga poważnej pamięci akceleratora, żeby odpowiadać z sensownym opóźnieniem. Otwarta publikacja jest prawdziwa i ma znaczenie dla możliwości audytu oraz dla badań, ale nie stawia tego modelu wewnątrz większości firm.

W praktyce oznacza to, że większość europejskich przedsiębiorstw, które ostatecznie użyją Kimi K3, dotrze do niego przez cudzą infrastrukturę: neochmurę, punkt końcowy hiperskalera albo dostawcę inferencji. Słowo otwarty wykona w tym układzie bardzo niewiele pracy. Będziesz kupować tokeny u dostawcy, dokładnie tak jak dziś przy modelach zamkniętych, a otwartość pojawi się jako argument cenowy, nie jako kontrola.

To nie zarzut wobec Moonshotu. To zwykły skutek skali czołowej i dotyczy każdego dużego wydania otwartych wag. Błąd, którego trzeba uniknąć, to traktowanie opublikowanych wag jako dowodu, że masz drogę wyjścia. Wyjście wymaga miejsca, do którego można pójść, a 1,56 terabajta fragmentów MXFP4 to miejsce, które utrzyma bardzo niewiele bilansów.

Co rozstrzygnąć, zanim ktoś skieruje na to aplikację

Sekcja czwarta licencji zawiera klauzulę, na której większość czytelników rzeczywiście się oprze. Wymogi komercyjne nie dotyczą użycia wewnętrznego ani dostępu przez własne oficjalne produkty Moonshotu lub jego certyfikowanych partnerów inferencji. To zwolnienie jest szczerze użyteczne, a zarazem przenosi problem: jeśli twoja droga do modelu wiedzie przez hosting, o zgodności decyduje status tego dostawcy i treść umowy z nim. Karta modelu nie odpowie na to za ciebie.

Trzy rzeczy przed wdrożeniem. Ustal własną liczbę przychodu grupy wobec testu dwunastu miesięcy i zapisz odpowiedź, bo klauzula liczy podmioty powiązane, a większość grup nigdy nie policzyła tej liczby w tym celu. Zapytaj prawników, czy cokolwiek, co sprzedajesz, stanowi działalność typu model jako usługa, skoro odsprzedaż inferencji w dowolnym opakowaniu jest właśnie tym ryzykiem, a zespoły produktowe rzadko tak siebie widzą. Potem, jeśli idziesz przez dostawcę, wymagaj pisemnego potwierdzenia, że jest certyfikowanym partnerem inferencji i że zwolnienie sięga także ciebie.

Zrób wszystkie trzy rzeczy, zanim kod wyjdzie, bo sekcja druga jest warunkiem komercyjnego użycia oprogramowania, a nie sankcją nakładaną później. Odkrycie tego w trakcie badania przed przejęciem kosztuje znacznie więcej niż odkrycie tego teraz.