Największy dotychczasowy skok Meta i liczba ważniejsza niż benchmark

Meta wdrożyła Muse Spark 1.3 2 września 2026 roku w Muse Code i Meta Model API, opisując go jako największe pojedyncze usprawnienie firmy w zakresie kodowania i pracy agentowej do tej pory. Tryb maksymalnego rozumowania pojawi się wkrótce, wstrzymany do czasu, aż Meta zakończy dodatkowe testy bezpieczeństwa.

Nagłówkowe benchmarki liczą się tu mniej niż leżąca pod nimi zmiana wydajności: własne porównanie Meta z Muse Spark 1.2 pokazuje około 20 procent mniej wywołań narzędzi i 25 procent mniej potrzebnych tokenów do ukończenia równoważnych zadań kodowania, przy czystszym stylu kodu i mniejszej liczbie tur rozmowy do gotowego wyniku.

To samo zadanie, mniej kroków

Każda liczba poniżej porównuje ten sam rodzaj zadania kodowania wykonanego na Muse Spark 1.2 wobec 1.3, przy niezmienionej cenie za token.

WskaźnikMuse Spark 1.2Muse Spark 1.3
Wywołania narzędzi na zadanieWartość bazowaOkoło 20 procent mniej
Tokeny na zadanieWartość bazowaOkoło 25 procent mniej
Tury rozmowy do zakończeniaWartość bazowaMniej potrzebnych tur
Cena APIBez zmianBez zmian

Prawdziwa zmiana to to, czego model nie zrobi bez pytania

Zmiana zachowania liczy się bardziej niż przyspieszenie. Muse Spark 1.3 teraz aktywnie zadaje pytania doprecyzowujące i prosi użytkownika o potwierdzenie przed podjęciem istotnych lub trudnych do cofnięcia działań, zamiast działać wyłącznie według własnego osądu. Meta zgłasza też większą odporność na ataki przeciwstawne i lepszą odporność na próby wstrzykiwania poleceń - wadę, przez którą złośliwa instrukcja ukryta w dokumencie lub na stronie internetowej porywa agenta wbrew zamiarowi jego operatora.

Te dwie zmiany dotyczą dokładnie tego, co dziś powstrzymuje większość firm przed dopuszczeniem agenta do systemów produkcyjnych: nie surowej zdolności, lecz ryzyka, że agent zrobi coś nieodwracalnego na podstawie złych instrukcji, własnych albo napastnika.

Co to oznacza dla każdego, kto uruchamia obciążenia agentowe na API Meta

Dwadzieścia procent mniej wywołań narzędzi i dwadzieścia pięć procent mniej tokenów przy niezmienionej cenie to bezpośrednia poprawa marży dla każdego zespołu, który już uruchamia agentowe obciążenia kodowania przez API Meta - to samo zadanie kosztuje teraz mniej do ukończenia, niezależnie od jakiegokolwiek wyniku benchmarku.

Warto uwzględnić dwa zastrzeżenia przed przeniesieniem obciążeń. Tryb maksymalnego rozumowania jeszcze nie działa, więc zadania wymagające najwyższego poziomu rozumowania Meta wciąż czekają na dalsze testy bezpieczeństwa. A obiecana przez Marka Zuckerberga wersja Muse Spark z otwartymi wagami wciąż nie ma daty wydania, więc samodzielny hosting nie jest dziś opcją, którą oferuje ten model - Muse Spark 1.3 to na razie wyłącznie wydanie API i Muse Code.

Servola Journal

Robimy to dla wszystkich, którzy starają się nadążyć za tym, co technologia robi z naszym życiem. Dla ludzi, którzy ją budują, i dla ludzi, którym się to przydarza. Servola Journal istnieje, aby to, czego się uczymy, należało do nich wszystkich.

Nikt nam za to nie płaci. Żadnych reklam, żadnego muru płatności, za darmo dla wszystkich. Po prostu wierzymy, że zrozumienie tego, co dzieje się z nami wszystkimi, nie powinno zależeć od tego, kogo stać na zapłacenie za to.

Jeśli to dało ci dziś coś, powiedz nam, żebyśmy kontynuowali. Obserwuj nas, zostaw polubienie, albo napisz pozytywny komentarz. Czytamy każdy jeden, i to oni sprawiają, że działamy dalej.