Claude Opus 5.5 imponuje, ale największe znaczenie może mieć Muse od Meta

2026-09-25 • Riley Brown • AI zagraniczne •nowość •waga 4/5 •13 min czytania

Opus 5.5 może przyspieszyć pisanie i projektowanie, a Muse pokazuje, dokąd zmierzają osobiści agenci AI. Przydatne dla osób wybierających narzędzia do pracy i codziennych zadań.

Robocza publikacja redakcyjna na podstawie publicznego transkryptu YouTube. Źródło: YouTube.

O czym jest ten film

  1. Riley Brown porównuje nowe modele Anthropic i OpenAI: Claude Opus 5.5 oraz GPT-6 Soul i Luna.
  2. Największą zaletą Opus 5.5 jest według autora bardziej naturalny, zwięzły sposób odpowiadania na złożone pytania.
  3. Autor pokazuje, jak model tworzy animacje za pomocą kodu, projekty interfejsów i prezentacje.
  4. Tryb głosowy ChatGPT potrafi korzystać z połączonych aplikacji; w demonstracji wyszukuje wiadomości, wysyła prywatną wiadomość i edytuje dokument.
  5. Muse od Meta łączy rozmowę z wykonywaniem zadań, dostępem do narzędzi i sugestiami podawanymi z własnej inicjatywy.
  6. Meta zapowiada dostęp do Muse przez okulary oraz niewielkie urządzenie, które można nosić przy kluczach.
  7. Autor omawia inspirację projektem OpenClaw i plany rozbudowy katalogu aplikacji współpracujących z Muse.
  8. Na koniec przytacza pogłoski o konkurencyjnych agentach i wskazuje funkcje, wokół których może toczyć się rywalizacja.

10 najważniejszych takeaways — z kontekstem zastosowania

1.Sprawdzaj modele na własnych zadaniach

Na czym polega: Brown najwyżej ocenia Opus 5.5, szczególnie za pisanie i pracę nad projektami wizualnymi. To wniosek z jego intensywnych testów, a nie dowód, że model będzie najlepszy w każdym zastosowaniu.

Jak stosować: Daj kilku modelom to samo zadanie, na przykład poprawienie trudnego tekstu albo przygotowanie widoku aplikacji. Porównaj wynik, czas pracy i liczbę potrzebnych poprawek.

Na co uważać: Nie wybieraj narzędzia wyłącznie na podstawie pojedynczej prezentacji lub ogólnego rankingu.

2.Zwięzła odpowiedź też oszczędza czas

Na czym polega: Autor zauważa, że Opus 5.5 częściej zaczyna od najważniejszej informacji i łatwiej prowadzi z nim rozmowę o złożonych sprawach.

Jak stosować: Przy analizach i pisaniu oceniaj nie tylko poprawność odpowiedzi, lecz także to, ile pracy wymaga jej przeczytanie i wykorzystanie.

Na co uważać: Krótsza odpowiedź może pominąć istotny wyjątek. Przy ważnych decyzjach poproś o założenia i ograniczenia.

3.Animacje tworzone kodem warto rozwijać etapami

Na czym polega: Opus 5.5 pomógł autorowi przygotować animację, generując kod i poprawiając go w kolejnych rozmowach.

Jak stosować: Zacznij od krótkiego opisu sceny, ruchu i stylu. Obejrzyj pierwszą wersję, a potem zgłaszaj konkretne poprawki dotyczące tempa, kompozycji i czytelności.

Na co uważać: Samo wygenerowanie plików nie gwarantuje dobrego filmu. Wynik trzeba uruchomić i obejrzeć.

4.Projekty wizualne oceniaj w docelowym formacie

Na czym polega: Brown szczególnie chwali Opus 5.5 za projektowanie interfejsów, wersji mobilnych i slajdów.

Jak stosować: Proś o działający projekt lub prezentację, a następnie sprawdź je na ekranie i urządzeniu, dla których powstają. Poprawiaj konkretne elementy w kolejnych wersjach.

Na co uważać: Efektowny podgląd nie wystarczy. Trzeba sprawdzić czytelność treści i zachowanie projektu na telefonie.

5.Agent głosowy ma sens wtedy, gdy wykonuje zadanie

Na czym polega: W pokazie ChatGPT przez rozmowę głosową korzystał ze Slacka, Notion i wyszukiwarki.

Jak stosować: Zacznij od prostego procesu, na przykład zebrania najnowszych ustaleń z jednego kanału i przygotowania krótkiej aktualizacji dokumentu.

Na co uważać: Gdy agent wysyła wiadomość lub zmienia plik, sprawdź odbiorcę, treść i miejsce wprowadzenia zmian.

6.Przekazuj agentowi jedną dobrze opisaną czynność

Na czym polega: W sponsorowanej części filmu pojawia się użyteczna zasada: wybrać zadanie, dostarczyć potrzebne informacje, ocenić rezultat i ustalić zakres własnej kontroli.

Jak stosować: Wybierz powtarzalną czynność, taką jak opracowanie transkryptu na posty albo uporządkowanie opinii klientów. Porównaj czas zaoszczędzony z czasem poświęconym na poprawki.

Na co uważać: Jeśli poprawianie wyniku trwa dłużej niż samodzielna praca, zmień instrukcję lub wybierz inne zadanie.

7.Muse najlepiej poznawać na zadaniach o małej stawce

Na czym polega: Muse łączy połączone aplikacje, korzystanie z komputera, pamięć o celach użytkownika i własne sugestie. Brown przedstawia je jako łatwy punkt wejścia do pracy z agentami.

Jak stosować: Wypróbuj planowanie, porządkowanie materiałów lub inne lekkie zadanie i zobacz, czy sugestie agenta rzeczywiście pomagają.

Na co uważać: Autor ocenia model Muse niżej niż modele OpenAI i Anthropic. Weryfikuj wyniki, zwłaszcza gdy agent sięga do wielu aplikacji.

8.Urządzenie noszone zmienia sposób korzystania z agenta

Na czym polega: Meta zapowiada rozmowę z Muse przez okulary z kamerą, okulary wyłącznie dźwiękowe oraz niewielkie urządzenie noszone przy kluczach.

Jak stosować: Oceniaj takie urządzenia przez pryzmat sytuacji, w których dostęp bez wyjmowania telefonu naprawdę ułatwia zadanie.

Na co uważać: Część sprzętu była w chwili nagrania zapowiedzią. Przed zakupem sprawdź dostępność i działanie gotowego produktu.

9.Porównuj całe systemy agentów, nie tylko modele

Na czym polega: Według autora rywalizacja obejmie pamięć, połączenia z aplikacjami, wykonywanie zadań w tle, głos i obsługę komputera.

Jak stosować: Przy wyborze agenta wypisz czynności, które ma wykonywać, i sprawdź, z jakich Twoich narzędzi potrafi korzystać.

Na co uważać: Długa lista funkcji nie mówi, czy agent działa niezawodnie w Twoim konkretnym procesie.

10.Oddzielaj dostępne funkcje od pogłosek

Na czym polega: Film łączy pokazy istniejących narzędzi, zapowiedzi Meta i niepotwierdzone informacje o planach konkurentów.

Jak stosować: Testuj to, co jest już dostępne, a zapowiadane produkty uwzględniaj dopiero wtedy, gdy będzie można sprawdzić ich rzeczywiste możliwości.

Na co uważać: Nazwa projektu, przewidywana data premiery czy lista funkcji pochodząca z przecieku może się zmienić.

Redakcyjne tłumaczenie

Dwie premiery modeli w jeden dzień

OpenAI i Anthropic wypuściły nowe modele, które wzbudziły duże zainteresowanie. Część użytkowników twierdzi, że Claude Opus 5.5 radzi sobie lepiej od Fable 5.1, a przy tym działa szybciej i kosztuje mniej. Chcę opowiedzieć, co potrafią nowe modele i jak najlepiej z nich korzystać. To jednak tylko część ostatnich zmian. Tryb głosowy OpenAI zyskał możliwość korzystania z połączonych narzędzi, a Muse od Meta szybko zdobywa użytkowników.

Przez ostatnie dwa tygodnie wydałem około 3000 dolarów na korzystanie z modeli podczas testów i wdrażania nowych narzędzi w swojej firmie. Mam więc sporo własnych obserwacji.

Anthropic udostępnił Opus 5.5. Dwie godziny później OpenAI pokazało GPT-6 Soul i GPT-6 Luna. Przypomina mi to sytuację sprzed mniej więcej trzech tygodni, kiedy w odstępie trzech dni pojawiły się Fable 5.1 i GPT-6 Astra. Tamto porównanie wygrało dla mnie OpenAI: Astra była wówczas zdecydowanie najlepszym modelem, z jakiego korzystałem.

Tym razem największe wrażenie zrobił na mnie Opus 5.5. Wszystkie nowe modele mogą pomóc pracować szybciej i zużywać mniej tokenów niż poprzednie wersje, ale skok jakościowy w przypadku Opus jest na tyle duży, że chcę poświęcić mu więcej uwagi.

Opus 5.5: łatwiej się z nim rozmawia

Pierwsza zmiana dotyczy pisania. Anthropic wyraźnie pracował nad sposobem, w jaki model formułuje odpowiedzi. Firma zapowiedziała, że Opus 5.5 ma wypowiadać się naturalniej i uwzględniać uwagi zgłaszane przez użytkowników Opus 5.

Trudno pokazać tę różnicę na jednym slajdzie. Widać ją podczas pracy. Kiedy zadaję pytanie wymagające dłuższej odpowiedzi, model zwykle zaczyna od tego, co najważniejsze. Pisze zwięźlej, a rozmowa o skomplikowanych tematach wymaga mniej wysiłku.

Wiele osób dobrze wspomina Opus 4.6. Siedem miesięcy temu był to ogromny krok naprzód; rozmowa z nim była po prostu przyjemna. Późniejsze wersje nie dawały mi takiego wrażenia. Opus 5.5 znów wydaje się wyjątkowo sprawny: szybko przechodzi do sedna i udziela użytecznych odpowiedzi.

Animacje i projekty tworzone za pomocą kodu

Druga rzecz, która mnie zaskoczyła, to tworzenie animacji programowo. Widziałem film przygotowany przez Opus 5.5, którego podstawą był jeden plik JavaScript. Postanowiłem spróbować sam. W opisie filmu umieszczam instrukcję, od której można zacząć podobny projekt.

Pracowałem z modelem w kilku rundach. Wygenerował około 300 wierszy kodu, przygotował plik HTML, a następnie dodatkowy plik służący do utworzenia filmu. Mój rezultat nie dorównywał materiałom Kevina Ngo, którego animacje polecam obejrzeć, ale samo tempo pracy i możliwości modelu zrobiły na mnie wrażenie.

Najczęściej korzystam jednak z Opus 5.5 do projektowania interfejsów i innych materiałów wizualnych. W nowej funkcji Claude Projects można rozmawiać z głównym agentem, który uruchamia kolejne rozmowy do poszczególnych zadań. Zintegrowano z nią także Claude Design.

Poprosiłem o przeprojektowanie swojej aplikacji. Zamiast zwykłego odnośnika do gotowego widoku dostałem projekt Claude Design, nad którym mogłem dalej pracować. Po wielu poprawkach powstała strona zapowiadająca mój serwis, wraz z wersją mobilną. Taka współpraca sprawia, że dochodzenie do właściwego projektu jest szybsze i przyjemniejsze.

Sprawdziłem również prezentację, o której przygotowanie poprosiłem wcześniej przez telefon. Podoba mi się jej wygląd. Podobną poprawę widzę w dokumentach: łatwiej się je czyta. Sądzę, że dopiero zaczynamy sprawdzać, jak dobre mogą być wizualne projekty przygotowane z pomocą tego modelu.

Które zadania warto oddać agentowi?

Na kanale często mówię o nowych narzędziach dla agentów AI. Przy codziennej pracy pojawia się jednak prostsze pytanie: co właściwie warto im zlecić?

HubSpot, sponsor tego filmu, przygotował bezpłatny poradnik „AI Agents Unleashed”. Pokazuje w nim zastosowania agentów w tworzeniu treści, marketingu, sprzedaży i organizacji pracy. Przykłady obejmują przerobienie transkryptu filmu na posty dla różnych serwisów, zebranie informacji o potencjalnym kliencie przed rozmową oraz uporządkowanie opinii klientów, żeby zobaczyć powtarzające się potrzeby.

Proponowany sposób rozpoczęcia pracy jest prosty: wybierz jedno zadanie, przekaż agentowi potrzebne informacje, sprawdź rezultat i zdecyduj, które etapy nadal chcesz kontrolować. Ta ostatnia część ma znaczenie. Jeśli poprawianie efektu zajmuje więcej czasu niż samodzielne wykonanie zadania, trzeba zmienić sposób pracy. Odnośnik do poradnika znajduje się pod filmem. Dziękuję HubSpotowi za sponsoring.

Głosowy ChatGPT korzysta z połączonych aplikacji

OpenAI wprowadziło zmianę w trybie rozmowy głosowej na telefonie i komputerze. Agent może teraz korzystać z połączonych aplikacji, takich jak poczta, kalendarz czy Slack. Narzędzia dostępne podczas pisania do ChatGPT można więc wykorzystywać również w rozmowie.

W swoim koncie mam połączonych 27 aplikacji. Podczas pokazu uruchomiłem tryb głosowy i poprosiłem o najnowsze informacje ze Slacka. ChatGPT poinformował, że przeszukuje ostatnie wiadomości, po czym przedstawił aktualizację. Następnie poprosiłem go, by przesłał te informacje Emily w prywatnej wiadomości. Agent potwierdził, że wysłał podsumowanie wraz z odnośnikami do wiadomości.

Potem wskazałem dokument w Notion dotyczący tygodniowego przeglądu, w którym pisałem między innymi o Opus 5.5 i GPT-6 Soul. Poprosiłem o uzupełnienie części poświęconej trybowi głosowemu. Mogłem obserwować wywołania narzędzi: agent odnalazł dokument, wyszukał informacje i dodał tabelę pod odpowiednim nagłówkiem.

W kolejnej prośbie chciałem zmienić układ tej części na zakładki z krótkimi tytułami. Doprecyzowałem, że chodzi tylko o sekcję z aktualizacjami. Agent wprowadził zmianę i pozostawił pozostałe wyróżnione fragmenty bez zmian.

Największe wrażenie robi na mnie płynność tej pracy. Rozmawiam z modelem, a on w tym samym czasie korzysta z aplikacji i pokazuje, co robi.

Muse od Meta: osobisty agent, który sam podsuwa działania

Największą zmianą tygodnia może być jednak rosnąca popularność Muse, nowej aplikacji Meta. To osobisty agent: można poprosić go o zajęcie się pocztą, pracę w Notion czy skorzystanie z przeglądarki i komputera. Potrafi również proponować działania z własnej inicjatywy.

W chwili, gdy sprawdzałem ranking App Store, Muse zajmowało pierwsze miejsce wśród pobieranych aplikacji i wyprzedzało ChatGPT. Porównywana przeze mnie aplikacja Grokbot była na miejscu 196. To tylko stan rankingu w danym momencie, ale dobrze pokazuje skalę zainteresowania Muse.

Z agenta można korzystać przez przeglądarkę, aplikację komputerową i iPhone’a. Według moich doświadczeń działa bardzo szybko. Meta używa w nim modelu Muse Spark 1.3; przypuszczam, że w przyszłości może udostępnić jego wagi, ale to na razie moje przewidywanie.

Muse jest też po prostu przyjemne w użyciu. Podsuwa pomysły, pamięta o celach użytkownika i ma bibliotekę rzeczy utworzonych podczas pracy. Obecnie jest dostępne bez opłat, z limitem 100 milionów tokenów miesięcznie. Korzystam z niego w firmie i dotąd nic za to nie zapłaciłem. Połączenie łatwej obsługi, szybkości i takiego limitu może być dla konkurentów trudnym wyzwaniem.

Przygotuję osobny materiał o korzystaniu z Muse. Teraz chcę omówić świeże zapowiedzi z konferencji Meta Connect, która zakończyła się niedługo przed nagraniem.

Muse trafia do okularów

Mark Zuckerberg ogłosił, że Muse zyskuje rozmowę głosową i obraz w czasie rzeczywistym. Będzie można prowadzić z agentem dłuższe rozmowy, podczas gdy on zajmuje się zadaniami w tle. Meta chce też udostępnić Muse w okularach, żeby dało się z niego korzystać bez trzymania telefonu.

Kilka lat temu testowałem okulary Meta Ray-Ban. Były jeszcze dość niewygodne w użyciu: nagrywanie wideo kończyło się po około minucie. Miały jednak kamerę i mikrofon. Można było zadać pytanie dotyczące dokumentu, na który się patrzyło, a system uwzględniał obraz przy formułowaniu odpowiedzi lub szukaniu informacji.

Słabym punktem była wtedy sama AI. Moim zdaniem Meta nie miała modelu, który dobrze wykorzystałby możliwości okularów. Teraz firma chce połączyć je z Muse. To może zmienić sposób korzystania z takiego urządzenia.

Nie każdy chce nosić okulary z kamerą. Meta zapowiedziała więc również lżejszy model przeznaczony do obsługi dźwiękiem, bez kamery i z baterią, która według zapowiedzi ma wystarczać na cały dzień.

Agent przy kluczach

Firma pokazała też małe urządzenie przypominające brelok. Ma zapewniać dostęp do rozmowy z Muse, włącznie z funkcjami głosowymi i awatarem. W zaprezentowanym rozwiązaniu wystarczy dotknąć czytnika linii papilarnych, żeby zacząć rozmowę, bez odblokowywania telefonu i otwierania aplikacji.

Zuckerberg mówił, że powstało dotąd tylko kilka takich urządzeń. Meta planuje przygotować produkt do sprzedaży przed grudniowymi świętami. To plan przedstawiony na konferencji, a nie gotowy sprzęt, który można już ocenić w codziennym użyciu.

Uważam, że to ogromna szansa dla Meta. Firma od dawna szuka sposobu, by użytkownicy mogli korzystać z jej usług bez każdorazowego sięgania po aplikację na telefonie. Okulary i niewielkie urządzenie noszone przy sobie mogą dać jej własny, bezpośredni sposób kontaktu z użytkownikiem.

Od OpenClaw do Muse

Skala inwestycji Meta w AI pokazuje, jak ważny jest dla niej osobisty agent. Firma zatrudniała specjalistów za bardzo duże pieniądze i przejęła Scale AI w ramach transakcji wartej według przytoczonej w filmie kwoty około 15 miliardów dolarów. Celem jest stworzenie łatwo dostępnej aplikacji, przez którą ludzie będą korzystać z zaawansowanej AI.

Jeden z komentatorów ujął to dosadnie: Muse to OpenClaw dla zwykłych użytkowników. Nat Friedman z Meta przyznał, że choć Muse powstało od podstaw, jego twórcy mocno inspirowali się OpenClaw. Po własnych doświadczeniach z tym agentem kupił dla zespołu setki komputerów Mac mini. Chwalił również Petera Steinbergera, twórcę OpenClaw, za rozwiązania, które pomogły innym zobaczyć możliwości osobistych agentów.

Według Friedmana celem było przygotowanie czegoś podobnego, ale łatwiejszego w obsłudze, bezpiecznego i nadającego się do udostępnienia miliardom ludzi. Meta może przy tym korzystać ze swoich istniejących serwisów, między innymi Facebooka i WhatsAppa.

Firma uruchomiła również platformę do tworzenia połączeń Muse z innymi aplikacjami. Można o niej myśleć jak o katalogu narzędzi dla agenta. Według informacji przytoczonych w filmie zgłoszono już około 2000 integracji. Sądzę, że do końca 2026 roku pojawią się tam aplikacje wielu dużych firm, ale jest to moje przewidywanie.

Jeśli dopiero zaczynasz korzystać z osobistych agentów, polecam wypróbować Muse przy własnych, niezbyt wymagających zadaniach. Konfiguracja jest prosta, a obecnie nie trzeba płacić za rozpoczęcie pracy. Jakość samego modelu oceniam niżej niż najlepszych modeli OpenAI i Anthropic, lecz aplikacja daje dobry obraz tego, jak może wyglądać codzienne korzystanie z agenta.

Konkurenci szykują własnych agentów

Na koniec warto przyjrzeć się temu, co mogą zrobić pozostałe firmy. Pojawiają się doniesienia, że OpenAI, Anthropic i Cognition, twórca Devina, pracują nad własnymi osobistymi agentami, których premiery mogłyby nastąpić w najbliższym miesiącu.

W serwisie X krążą pogłoski o projekcie OpenAI o nazwie lub kryptonimie „Aeon”. Według tych doniesień miałby to być konkurent Muse i Grokbota, wyposażony między innymi w profil, prywatne wiadomości i grupy. Wśród możliwych terminów premiery wymienia się czwartek oraz konferencję OpenAI DevDay. To informacje z przecieków; nie są potwierdzoną zapowiedzią produktu.

Jeden z komentatorów trafnie zebrał funkcje, ku którym zmierzają duże firmy: trwała pamięć, dostęp do poczty, kalendarza i wiadomości, korzystanie z przeglądarki i komputera, zadania wykonywane w tle, powiadomienia podawane z własnej inicjatywy, głos oraz połączenia z używanymi już aplikacjami.

Do tego dochodzi wiedza o sytuacji użytkownika. Właśnie dlatego tak ważne mogą okazać się urządzenia noszone i rozmowa głosowa. Jeśli agent lepiej rozumie, czym zajmujesz się w danej chwili, może odezwać się wtedy, gdy jego pomoc rzeczywiście się przyda.

Spodziewam się, że kolejne firmy zaproponują własne wersje łatwego w obsłudze osobistego agenta. Każda będzie jednak musiała wybrać priorytety. Czy postawić na rozbudowane możliwości, nawet jeśli agent zużyje dużo tokenów? Czy ważniejsza będzie szybkość, jak w przypadku Muse? Czy produkt ma służyć przede wszystkim pracy, czy codziennym sprawom?

Będę sprawdzał te narzędzia i przygotowywał instrukcje korzystania z nich. Warto już teraz uczyć się zlecania zadań agentom i oceny ich pracy, bo ta umiejętność będzie coraz bardziej przydatna.