Transcription
Tak moi drodzy, w świecie jaj dzieje się znowu bardzo, bardzo dużo. Między innymi to, że parę dni temu został opublikowany nowy model z chińskiego laboratorium Kimi K3, który na benchmarkach dorównuje tym najlepszym zamkniętym modelom ze Stanów Zjednoczonych. A dzisiaj pozwólcie, że powiem, co to wszystko znaczy i przejdziemy przez wszystkie ciekawsze fakty. Powiem, jak z tego korzystać, gdzie z tego korzystać, jakie ciekawsze zastosowanie znalazłem i generalnie wszystko, co tylko wiem, się podzielę z przyjemnością. Więc zapraszam na ten film serdecznie.
Dobrze moi drodzy, więc taka jedna najważniejsza rzecz w tym wszystkim, co się wydarzyło wokół premiery tego nowego modelu Kimy K3, to jest to, że w końcu możemy przestać być tymi osiołkami i podążać za tą marchewką, którą Anthropic nam daje. Tak mówiąc, że o, Claude Fable 5 będzie dostępny jeszcze przez tydzień, a później mówią, że a nie, jednak jeszcze przez tydzień będzie dostępny i tak dalej, i tak dalej. Tak z nami się bawią po prostu tą taką marketingową gadką. Teraz jest konkurencja. Wielkie dzięki Kimi, że konkurencja istnieje. Dzięki temu, jak na przykład widzicie, Anthropic ogłosił, że Claude Fable 5 będzie dostępny we wszystkich planach Max, Steam i Premium, a plany jak Pro będą mieli jednorazowy kredyt wykorzystania Fable 5 100 dolarowy. Więc no, oczywiście nie jest to idealne rozwiązanie, ale tak widzicie, Claude nie spodziewał tego, że tak dobry model otwartowagowy z Chin może być wypuszczony tak szybko. Więc to jest ten taki przewodni główny wniosek, że mamy po prostu coś świetnego. Mamy świetny model dostępny za 1/3 ceny tego, co Anthropic nam proponuje. Monopol został przełamany, mamy konkurencję. Bardzo się z tego cieszmy.
Jeszcze taki jeden projekt, który chciałem wam pokazać, zanim przejdziemy do omówienia tych faktów krok po kroczku, tak jak ja to lubię najbardziej, chciałem wam pokazać jeden projekt, który zbudował jeden z użytkowników, który bardzo dobrze pokazuje, w czym Kimi K3 jest dobry. A dobry jest przede wszystkim w dwóch rzeczach, czyli tej takiej długodystansowej pracy agentowej, czyli dajesz jedno zadanie i ten Kimi ma po prostu to zrobić. Nieważne ile czasu to zajmie. I dobry jest tak samo w projektowaniu przyjaznych interfejsów użytkownika. I zobaczcie, trwało to 5 godzin, wykorzystało coś takiego, co się nazywa Agent Swarm, czyli takich rój agentów, do którego jeszcze później przejdziemy. I Kimi K3 zbudowało taką makietę systemu operacyjnego MAC, która tak jak widzicie jest w pełni klikalna. Mamy tutaj różne aplikacje, mamy różne etykiety, możemy nawet sobie pisać na czacie, tak napiszemy im "siemasz". Chciał napisać "siemasz", ale rozumiecie o co chodzi. Nie spotkaliśmy tutaj oczywiście, żebym z wami przeklikiwał przez taką makietę. Chciałem wam po prostu to pokazać jako jedną z możliwości, może mniej praktycznych. To jest po prostu jakaś makieta, tak? Nie za dużo z nią możemy zrobić, ale chciałem wam to pokazać jako jedna z takich ciekawszych prezentacji możliwości tego modelu.
Dobra, przechodzimy do pierwszego ważniejszego faktu, czyli tego, że jest to, trzeba to po prostu powiedzieć, bo to jest fakt, że jest to największy, najdroższy. Tutaj nie zdążyłem podkreślać. Największy, najdroższy i najlepszy chiński model do tej pory. Największy, bo ma 2,8 biliona. Po polsku biliona, po angielsku tryliona parametrów. Większego po prostu nie ma. Najdroższy, bo jest to 3 dolary na każde milion tokenów wejściowych i 15 na milion tokenów wyjściowych. I oprócz tego najlepszy. Dlaczego najlepszy? No bo tak mówią benchmarki między innymi. Więc rzućmy szybko okiem na te benchmarki, które zostały nam zaprezentowane. Przede wszystkim zobacz, nie chcę tutaj oczywiście zbyt dużo sprawdzać na tym czasu, ale zobaczcie tak przede wszystkim do czego porównywany jest ten model. Do GPT 5 i 6 SOL i Fable 5, czyli modeli ze Stanów, które jeszcze tydzień temu były po prostu absolutnie bezkonkurencyjne. Nie było szans, żeby jakiś chiński model otwartowagowy jakkolwiek mógł do nich się porównywać. A teraz obudziliśmy się tydzień później i mamy już coś takiego możliwego. Więc te sześć benchmarków są przede wszystkim wokół programowania, wokół kodowania. Deep SWE i Frontier SWE to są sytuacje, w których modelowi dostarczona jest cudza, cudzy projekt, cudzy kod i ma rozwiązać jakiś błąd czy napisać jakąś funkcję. Widzicie, Kimi sobie bardzo przyzwoicie radzi. Oprócz tego Terminal Bench, czyli to, jak dobrze umie obsługiwać komputer wysokości okna terminala. Program BCH, czyli pisanie jakiegoś programu czy funkcji od zera i SWE Marathon, czyli tak jak pokazałem przy okazji Mac OS, jak dobrze radzi sobie w długich, długodystansowych zadaniach programistycznych. Ale takie ciekawsze zastosowania, ciekawsze benchmarki to są te takie General Agents, czyli takie ogólnoagentowe, czyli yyy jak wykonuje pracę nieprogramistyczną, czyli na przykład jak przygotowuje raporty, jak robi różne tabele, jak Spreadsheet Bench, jak potrafi dobrze przeglądać internet, jak BrowsCom. No chyba widzicie, a jak dobrze automatyzuje powtarzalne zadania, jak chyba widzicie, że Kimi sobie po prostu bardzo przyzwoicie z tym wszystkim radzi i w zadaniach takich programistycznych i w takich bardziej agentowych, czyli to, jak wykorzystuje AI to grono nieprogramujących osób pracujących intelektualnie.
Druga rzecz, o której chciałem wam wspomnieć, czyli fakt, że no model jest otwartowagowy, bo to ważne, żeby nie mylić z otwartoźródłowym, z open source, bo żeby był open source, to musiały być opublikowane wszystkie materiały, na których był uczony ten model. Więc model jest otwarto wagowy, ale jego wagi będą możliwe do pobrania dopiero od 27 lipca. Na ten moment jeszcze to nie jest dostępne, nie jest możliwe i jeszcze nie potwierdzone jest na jakiej licencji to będzie dostępne, czyli w jaki sposób będziemy z tego modelu mogli korzystać, czy będziemy mogli robić to w pełni komercjalnie. Taka jeszcze zagadka na dziś, z racji, że jest to model otwartowagowy, czyli taki, który moglibyśmy teoretycznie pobrać na swój komputer. Jak myślicie, ile kosztowałoby odpalenie takiego modelu w domu? Czyli jaki sprzęt musielibyśmy mieć, żeby taki model mógł u nas w domu działać? Więc moi drodzy, tutaj mogę może trochę ostudzę niektórych oczekiwania. Musielibyśmy na to wyłożyć przynajmniej milion złotych, żeby mieć sprzęt, który mógłby pociągnąć taki model. Więc tak jak widzicie, jest to gigantyczny model i hostowanie go lokalnie jest dostępne no tylko dla firm, które mają odpowiednią infrastrukturę. No chyba, że macie bańkę luzem, żeby odpalić taki model.
Punkt numer trzy. i takie trochę bardziej techniczne punkty, ale myślę, że wytłumaczę je najlepiej, jak mogę, tak żebyście zrozumieli też te osoby, które są mniej techniczne. Czyli fakt przede wszystkim numer jeden, że model został zbudowany na architekturze MOE, czyli Mixture of Experts, czyli fakt, że za każdym razem, jak mamy jakieś zapytanie, to nie odpala się cały mózg, cały mózg modelu, cała sieć neuronowa, tylko 16 ekspertów. Na takiej metaforze wielkiego szpitala. Zobaczcie, wyobraźmy sobie, że mamy szpital, 896 lekarzy, bo tyle jest ekspertów wewnątrz tego modelu Kimika 3. I za każdym razem, jak jakieś zapytanie wchodzi czy jakiś pacjent przychodzi, to recepcjonistka czy też rejestratorka, czyli router wewnętrzny, decyduje, którzy lekarze się tym zajmą. Czyli wzywa kardiologa N32 i chirurga 71, a nie jeszcze ortopedę i dentystę. Wie, że ten przypadek potrzebuje tylko tych ekspertów i tak to działa przy każdym kolejnym słowie, przy każdym kolejnym tokenie. Ta rejestratorka, ten router po prostu wybiera 16 z 896 specjalistów z całej tej sieci neuronowej, którzy się tym zajmą. Oprócz tego jeszcze też trochę bardziej techniczne, czyli fakt, że mamy taki nowy mechanizm uwagi, który nazywa się KDA, czyli Kimi Delta Attention, czyli fakt, że jeśli wrzucimy mu, nie wiem, całą książkę, później wrzucimy mu jeszcze jakiś raport i później wrzucimy mu jeszcze jakąś tabelę, to on przy każdej kolejnej odpowiedzi normalnie patrzyłby na właśnie całą tą książkę, na cały ten raport, na cały ten PDF i dopiero udzielał nam odpowiedzi. A to KDA działa tak, że po prostu model prowadzi taką wewnętrzną notatkę odnośnie tego, co wcześniej pojawiło się w rozmowie, dzięki czemu no nie musi patrzeć na wszystko, co się wcześniej pojawiło, tylko ma no takie podsumowanie, tak najprościej upraszczając ten nowy mechanizm uwagi. Oczywiście, jeśli was to ciekawi, to polecam lepiej się z tym zapoznać. Oprócz tego model jest multimodalny, czyli przyjmuje i tekst, i dźwięk, i zdjęcia, i kod. Oprócz tego ma milionowe okno kontekstowe, czyli możemy mu naprawdę dużo po prostu do niego załadować i ma tak samo trzy poziomy zaangażowania. Może to pokażę wam bezpośrednio już w aplikacji. Jak jesteśmy tutaj na kimi.com, to możemy wybrać, jak bardzo się wysili myśląc. Tak, możemy mu wybrać właśnie ten poziom wysiłku przy myśleniu: standardowy, wysoki i maksymalny. Oczywiście, czym wyższy, tym więcej będzie tokenów zużywał na myślenie, tym będzie też yyy wolniejszy. Tak, tego słowa szukałem.
Więc skoro to już wiemy, to myślę, że na pewno was ciekawi jedna taka kwestia, czyli gdzie możemy takowy model odpalić. Przede wszystkim najprościej i no ja też tak z tego po prostu korzystam, to jest wewnątrz aplikacji kimi.com. Yyy, możemy za darmo porozmawiać sobie z Kimi K3, no ale musimy być świadomi, że po prostu długo sobie poczekamy na odpowiedź, bo no jest duże obłożenie tego modelu. Więc ja wykupiłem sobie subskrypcję moderator. Pozwólcie, że wam pokażę, jakie są w ogóle opcje. Mamy subskrypcję. Widzieliście, na bieżąco to się zmieniło przed chwilą. Subskrypcja nazywała się moderator. Tutaj było Allegretto, Allegro, tak bardziej muzycznie. A teraz mamy Plus, Pro, Max i Ultra. No dobra, przyjmijmy to. Chociaż ciekawe, że to też yyy na kamerze się ujęło. Dobra, no nieważne. Mamy subskrypcję Plus, czyli około 75 dolarów, 75 złotych miesięcznie. Ja też ją wykupiłem i myślę, że to jest taka inwestycja naprawdę bardzo przydatna na samym początku i naprawdę bardzo opłacalna. Tego też słowa szukałem, żeby przetestować ten model, żeby zobaczyć, jak trochę inaczej operują te modele z chińskich laboratoriów w porównaniu do tych z amerykańskich laboratoriów. No bo wiecie, ja mogę tutaj do was mówić w nieskończoność, ale i tak najlepiej będzie wam samemu trochę sobie się pobawić i na swoich własnych zastosowaniach przetestować ten model. I jeszcze powiem wam za chwilkę, co warto przetestować. Takie ciekawe zastosowania. Dobra, więc mam subskrypcję Plus i korzystam głównie na ten moment z wysokości czatu, z ze strony kimi.com. Sobie tutaj czatuję i tutaj z niego korzystam. Ale oprócz tego drugie moje zastosowanie, y, drugi sposób wykorzystania to jest przez Kimi Code. To jest taki po prostu odpowiednik Claude Code. Możemy sobie to, możemy sobie go odpalić w terminalu lub bezpośrednio w VS Codzie i rozmawiać i pracować na bieżąco i z Kimi Code i na przykład z Claude Code, porównując to, jak pracują. Bardzo tutaj można się dobrze, przyjemnie pobawić z agentami AI. I tutaj też jestem świadomy, że niektórzy są trochę sceptycznie nastawieni do chińskich modeli, więc jeśli nie chcecie go wpuszczać do plików, do do folderów na który, które macie na swoim głównym profilu, na przykład na Macu, to i na Macu, i na Windowsie takie rozwiązanie, które mogę wam zaproponować, to po prostu stworzenie osobnego profilu, nazwanie go na przykład Agent i tam trzymanie określonych plików i folderów, do których Kimi, czy też Claude Code czy inny agent będzie miał po prostu dostęp i będzie, będzie mieli spokojną głowę, że tam może pracować, że tam nie ma dostępu do waszych prywatnych danych. Trzeba mieć tylko pewność, że tamten oddzielny profil nie jest podłączony ani do Windows OneDrive, chyba jeśli się nie mylę. Dawno nie korzystałem z Windowsa, ani do chmury iCloud z Maca. Tak więc można stworzyć po prostu sobie oddzielne profile i na nich pracować, jeśli tutaj prywatność nas ogranicza i prywatność powoduje, że nie korzystamy z agentów AI, a warto z nich korzystać, bo to jest naprawdę przeskok możliwości AI-owy. No i oczywiście możemy go również odpalić przez API. No to chyba się samo przez się tłumaczy.
Dobra. I takie jedno z zastosowań, które chciałbym, żebyście na pewno przetestowali, to jest takie robocze, sobie tutaj nazwałem: Niech żyje rój. Więc przejdźmy po prostu do Kimi. I właśnie ten rój. Rój to jest taka wewnętrzna umiejętność Kimi do wzywania Swarm, Swarm of Agents, czyli właśnie roju agentów. Czyli na przykład, jeśli wyślę mu polecenie: "Zrób stronę na temat Kimi K3". Może wam pokażę, bo też takie polecenie po prostu mu wysłałem. "Zrób stronę na temat Kimi K3". Niech jeden z agentów przejrzy fora internetowe, inny oficjalną dokumentację, jeszcze inny niech mi przygotuje jedną wersję strony, jeszcze inny drugą i tak dalej. No to po prostu możemy bardzo, bardzo fajnie podejrzeć, jak ci agenci pracują. Jeden agent jest research community, inny jest research oficjalnych źródeł Kimi, inny jest projektantem, inny jest, nie wiem, stres testerem strony i wszyscy sobie razem współpracują, a my możemy zobaczyć, co oni robią, możemy ich moderować i sprawdzać, no właśnie, co się dzieje i uczyć się przy okazji tej pracy multiagentowej. Więc zdecydowanie to K3 Swarm polecam, bo jest to po prostu świetne zastosowanie agentów AI. I jeszcze coś, co jest też bardzo ciekawe w aplikacji webowej, czyli możliwość włączenia My Kimi, dzięki czemu on będzie samemu się ulepszał na podstawie naszych rozmów. My po prostu to odhaczamy. Tutaj trzeba sobie to włączyć. Dzięki czemu, tak widzicie, tutaj mam ten przycisk "Enable self growth", dzięki czemu ten agent będzie razem z nami rósł i uczył się na bieżąco naszych preferencji.
Na sam koniec takie ograniczenia, które warto po prostu znać i które też gdzieś tam samemu zauważyłem ze swojej perspektywy, ze swojego doświadczenia. Przede wszystkim trochę tak bardziej agentowo, jak na przykład korzystamy z Kimi Code. Fakt, że model wymaga zachowania całej historii myślenia, żeby dobrze funkcjonował. Czyli jeśli harness, czyli jeśli ta uprząż, czyli na przykład Claude Code nie przekazuje całej historii myślenia, tego procesu myślenia, to ten Kimi K3 może się trochę rozjechać, więc to trzeba mieć na uwadze. Punkt numer dwa jest nadmiernie proaktywny. To też trochę zauważyłem, jak na przykład wysłałem mu polecenie, żeby przygotował stronę o mnie, stronę, która wyciągnie gdzieś tam, zrobi o mnie research i przygotuje takie portfolio proste, to jak nie mógł znaleźć o czymś informacji w internecie, o jednym z projektów moich, o Eltonie, to po prostu przez kurczę, chyba z pół godziny szukał. Nie, nie potrafił przerwać, nie potrafił powiedzieć: "Okej, odpuszczam, zrobię, nie wiem, tutaj pustą przestrzeń, później zapytam się Mikołaja, żeby uzupełnił". On po prostu leciał i się nie poddawał, więc trzeba mieć to też na uwadze. I oprócz tego sami twórcy przyznają, samo Kimi przyznaje, że na przykład Vuex ustępuje Claude Fable 5 i GPT 5.6 Sol. Oczywiście nie jest to tylko w Vuexie, czyli w tym doświadczeniu użytkownika. W innych kwestiach też odstaje Claude'owi Fable 5 i 5.6 Sol. No ale trzeba też im oddać, że jest to naprawdę bardzo przyzwoity model.
Dobra i jeszcze moi drodzy zadanie na dziś, a dokładnie dwa zadania. Zróbcie, jeśli chcecie, polecam. Pierwsze zadanie to jest przede wszystkim wykupienie sobie subskrypcji w tym Kimi K3. Naprawdę 75 złotych to jest minimalna inwestycja. A nauczymy się, jak ci chińscy agenci, dziwnie to brzmi, ale nauczymy się, jak ci chińscy agenci działają i polecam wam jako pierwsze zadanie zobaczyć, czy znaleźliście jakieś kwestie, w których ten chiński model i ta chińska uprząż, czyli ta Kimi, odbiega od tych amerykańskich. Po prostu porównajcie je ze swoimi codziennymi zastosowaniami i zobaczcie, czym to się, czy to się czymś różni. I oprócz tego drugie zadanie moi drodzy, to przetestujcie ten agent swarm, czyli ten rój agentów, bo jest naprawdę świetna opcja, żeby opanować trochę tą pracę multiagentową. Między innymi dzięki temu, że ta praca tych agentów jest w bardzo ciekawy, tak jak widzicie tutaj sposób zaprezentowana. Każdy ma swój gdzieś oddzielne okno kontekstowe. Każdy pracuje w swój własny sposób, na swój własny sposób.
Dobra, więc co? Więc to by było na tyle dzisiaj. No tutaj też przy okazji chcę was zaprosić na clodmaster.pl na swoje warsztaty z Claude'a dla nieprogramistów, ale chciałem wpisać tutaj zaproszenie na swój newsletter mikoabramczuk.substack.com, chłopski rozum AI. To jest mój newsletter, do którego was serdecznie zapraszam. Wielkie dzięki, bardzo wam na dzisiaj dziękuję. Nie wiem, czy było widać, że trzy razy nagrywałem ten odcinek, bo bo dwa razy po prostu pełen odcinek się nie zapisał, więc miejmy nadzieję, że tym razem się zapisało. Dzięki wielkie za dzisiaj. Widzimy się niedługo. Cześć. Yeah.