📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

How I built an 'OpenClaw' that runs on Claude subscription (without getting banned)

Felix Tay45:36

Transcription

In Ordnung. Viele von euch wissen, wie ich mein Cloud-Abonnement nutze, um Zugang zu Open-Cloud-Funktionen zu erhalten, ohne tatsächlich in Schwierigkeiten zu geraten, ohne tatsächlich von Entropic gesperrt zu werden. Und in diesem Video möchte ich euch zeigen, wie. Also, ich möchte euch hier ein wenig zeigen. Wenn ihr diesen Screenshot seht, äh tatsächlich ist das von meinem Dashboard. Wie zoome ich in dieses Ding hinein? Ähm, ich werde einfach hier hineinzoomen. Es ist tatsächlich von hier. Also, ich werde hier hineinzoomen. Es ist schwer, ein wenig schwer zu sehen. Wenn ich also zusammenrechnen würde, wie viel, wie viel Token ich verbraucht hätte, wie viel API-Kosten im Laufe eines ganzen Monats, wenn ich keine Lösung verwenden würde, hätte mich das 8.318,96 gekostet. Und die Zahl wächst tatsächlich, äh sie wächst tatsächlich von Minute zu Minute. Es sind bereits 84 zum Zeitpunkt dieser Aufnahme. Und das ist eines der Dinge, eines der Vorteile, das tun zu können, was ich tue. Und hier drinnen äh möchte ich euch ein wenig äh von den Qualitätsverbesserungen zeigen, die ich äh mit meinem Cloud-Code vorgenommen habe. Als Beispiel seht ihr hier, dass der Agent hier ein wenig gearbeitet hat. Es steht bash this blah blah blah. Äh, ich zeige euch jetzt die Terminalversion, weil ich sehen möchte, ob wir, ich möchte, dass ihr seht, was im Hintergrund passiert. Plötzlich steht dort error hook pre-tool use task denied this tool und der Agent berichtete: Hier ist, was ich gefunden habe und was behoben werden muss: Problem Nummer drei ist dieses Problem, Problem Nummer eins, Nummer zwei, leer, flash, blah blah blah und dann und dann steht dort: Beide Korrekturen sind in zwei Dateien auf dem BPS, bereit zur Anwendung, wann immer du sagst, tu es. Es muss also tatsächlich mechanisch warten, bis ich buchstäblich sage, tu es, bevor es tatsächlich hingeht und es tut. Dies ist also eine Lösung, die viele von euch, äh, die Open-Cloud verwenden, besonders einige von euch, lieben würden, äh, um sie zu sehen, weil dies tatsächlich verhindert, dass eure Open-Cloud oder was auch immer für ein Bot-Agent ihr verwendet, Amok läuft und Dinge tut, die er nicht tun soll, denn denkt daran, er ist vielleicht nicht bösartig, aber er hat kein Gedächtnis und manchmal, während er komprimiert, vergisst er vollständig, was auch immer, was auch immer ihr ihm sagt, und manchmal halluziniert er sogar, dass ihr ihm Anweisungen gebt, die ihr tatsächlich nie gegeben habt. Etwas wie das "Do it"-Gate ist also tatsächlich sehr notwendig, aber viele Leute reden nicht darüber, sie reden immer darüber, wie KI ihr Geschäft automatisieren kann, aber reden nicht über grundlegende Dinge wie diese. Hier ist ein weiteres Beispiel für eine Qualitätsverbesserung, die ich vorgenommen habe und die Open-Cloud nicht hat. Dies ist also eine Geschwister-Sitzung, richtig? Viele von euch, wenn ihr Open, was auch immer für einen Agenten verwendet, stellt euch vor, er läuft äh, mehrere Agenten-Instanzen auf mehreren Unteragenten, die alle an verschiedenen Facetten eines Projekts arbeiten. Wie wisst ihr eigentlich äh, ob die Arbeit eines Agenten nicht die Arbeit eines anderen Agenten überschreibt? Und wenn ihr nie über diese Frage nachgedacht habt, dann habt ihr ein Problem, denn ehrlich gesagt, meiner Erfahrung nach mit Open-Cloud, der grundlegenden Form von Open-Cloud ohne jegliche Personalisierung und Cockload äh, die Agenten wissen es wirklich nicht. Wenn sie also einfach fröhlich hingehen und überschreiben, was auch immer beide auf demselben, auf demselben Ding tun. Es ist, als hätte man zwei Köche für dasselbe Gericht. Man bekommt also ein Monster, richtig? Was also tatsächlich passieren muss, ist, dass ihr, wenn ihr äh, mehrere Sitzungen wie diese startet. Wenn ihr also fünf verschiedene Arbeiten parallel ausführen würdet, müsste eine Art Orchestrierungsschicht stattfinden. Und was ich hier getan habe, ist, dass ich ein System erstellt habe, äh, wo ihr zum Beispiel hier Nummer vier Geschwister-Sitzungsbewusstsein sehen könnt. Das ist im Grunde eine Liste, die ich meine Cloud gebeten habe, für mich zu erstellen, äh, im Grunde, was sind die Top 10 Qualitätsverbesserungen, die ich vorgenommen habe, wie eine davon WhatsApp ist. Also Nummer vier Geschwister-Sitzungsbewusstsein. Dort haben wir tatsächlich ein Skript dafür. Jedes Cloud-Fenster weiß also, woran die anderen äh, woran die anderen Fenster arbeiten, und das verhindert, dass zwei Sitzungen an derselben Datei arbeiten oder doppelte Arbeit leisten. Wenn das also passiert, richtig, was mein Cloud-Code tatsächlich tut, ist, dass das Skript auslöst, so dass bestimmte Dinge übereinander gestapelt werden. Das sind also einige der Dinge, die tatsächlich passieren können, die äh, viele Leute nicht wirklich wissen. Wie nutzt man also die Cloud-Abonnement für Open-Clouds, um Open-Call-Funktionen zu erhalten, ohne tatsächlich gesperrt zu werden? Es gibt tatsächlich drei Probleme, die dies verhindern, und wir werden sie uns nacheinander ansehen, und ich werde euch eine Lösung äh nach der anderen geben, so dass ihr am Ende dieses Videos eine Vorstellung davon habt, wie ihr es tatsächlich tun könnt. Ich verspreche euch, wenn ihr es selbst tut, ist es tatsächlich kostenlos äh und kostet nicht viel Geld, außer eurer Zeit. Es wird viel Zeit kosten, aber äh, was das Geld angeht, nicht viel, äh, außer vielleicht eurem Entropic-Verbrauch, eurem Kontingent, wisst ihr, also jedenfalls das erste Problem ist das erste Problem ist teuer, richtig? Der Grund, warum wir das tun wollen, ist, dass Entropic alle Bots, die Cloud-Abonnements nutzen, sperrt, und ja, ihr könnt tatsächlich Codeex verwenden, ihr könnt tatsächlich Kimmy und was auch immer verwenden, aber ehrlich gesagt, seid ihr mit diesen Modellen zufrieden, weil ich persönlich nicht damit zufrieden bin, wenn ich mit Codeex spreche, finde ich, dass ich hingehen und es auffordern muss und ihm Persönlichkeit und was auch immer geben muss, damit es äh, dieses Gefühl hat, das ich suche. Und darüber hinaus, wenn es um Codeex geht, finde ich, dass es sehr, sehr, sehr gut im Programmieren ist. Tatsächlich würde ich wetten, dass es beim Programmieren sogar besser ist als Opus. Aber Junge, es gerät in ein Kaninchenloch. Es hat Tunnelblick. Wenn man es bittet, etwas zu tun, tut es nur diese eine Sache und achtet nicht wirklich auf das Gesamtbild, wisst ihr. Das erste Problem ist also, dass wir herausfinden wollen, wie wir das tatsächlich überwinden können. Und wenn ihr euer Cloud-Cloud-Abonnement nutzen könnt, sei es 20 Dollar im Monat oder ein COD-Max-Abonnement, 100, 200 Dollar im Monat, könnt ihr tatsächlich viel Geld sparen, wie ich es getan habe, richtig? Das ist also Problem Nummer eins, das wir lösen können. Problem Nummer zwei, das wir lösen können, indem wir tatsächlich Cloud-Code anstelle von Open-Cloud verwenden. Ihr seht, die beiden größten Probleme, die die Leute mit Open-Cloud lösen, sind im Grunde interne und externe Sicherheit. Interne Sicherheit bedeutet also, dass es Dinge tut, die ihr nicht wollt, was gelöst wird, wenn ihr Dinge wie das "Do it"-Gate und ähnliches erstellt. Und Nummer zwei, Nummer zwei sind die externen Probleme wie Prompt-Injektionen, böswillige Angriffe usw. Wenn ihr also nur Cloud-Code allein verwendet, löst das keine dieser Dinge. Ihr müsst tatsächlich bestimmte Dinge darauf installieren. Aber wenn ihr tut, was ich euch in diesem Video erzähle, werdet ihr verstehen, wie ich es auch mache. Und Problem drei, Problem drei ist nicht das Open-Call-Level, wenn ihr Cloud-Code verwendet, euer grundlegendes Cloud-Abonnement, richtig? Es ist stabil, aber es ist etwas kompliziert. Ihr müsst euch all diese hässlichen CLI ansehen, äh, wisst ihr, wie die Terminals, ihr müsst euch all diese Befehle merken. Als ich es das erste Mal sah, hörte ich davon, als ich Open-Cloud sah, richtig, ich muss hingehen und in Cloud SSH. Was zum Teufel ist SSH? So kompliziert. Und dann macht Cloud-Code es viel einfacher. Die Befehle sind auch viel einfacher. Aber man muss sich immer noch mit einem Terminal auseinandersetzen. Es ist sehr nervig. Dinge nach GitHub pushen und was zum Teufel ist das alles? Ich weiß es nicht. Grundlegender Cloud-Code ist gleichzeitig auch schlecht. Man muss tatsächlich Dinge installieren lassen. Er kommt nicht automatisch mit einer ganzen Reihe von Fähigkeiten, die äh, die man bereits braucht. Als Beispiel, wenn man YouTube-Transkripte abrufen wollte, richtig, was der Hauptweg ist, den ich im Moment nutze, äh, wenn man ihn bittet, YouTube abzurufen, weiß er tatsächlich nicht, dass er es kann, und man muss ihn ein wenig hier und da anleiten. Erst dann merkt man: Oh, das kann ich. Okay. Es ist also wirklich irgendwie süß. Man muss ihn dazu bringen, eine Reihe von Dingen zu installieren. Und auf meinem eigenen persönlichen Cloud-Code habe ich ihn dazu gebracht, über 70 Dinge zu installieren, äh, und es werden immer mehr, die ich brauche, wisst ihr. Wir werden also herausfinden, wie wir eins nach dem anderen. Ich werde euch eins nach dem anderen zeigen, wie ich persönlich all diese Probleme löse. Beginnen wir mit Nummer eins, es ist teuer. Hier ist der Grund, warum äh, hier ist im Grunde die Essenz der Dinge. In Ordnung. Hier ist der Deal. Der Grund, warum Entropic nicht will, dass ihr Open-Cloud verwendet oder äh, ihr Abonnement für Open-Cloud verwendet, ist der Geldbetrag, den es kostet. Cloud-Code ist etwas, das sie veröffentlicht haben, und äh, Codierungsaufgaben verbrauchen viel Rechenleistung. Wenn ihr also nur Codierungsaufgaben durchführt, was beabsichtigt ist, kostet es sie bereits viel, und ich vermute, dass sie oft eine solche Entscheidung treffen, weil sie euch in ihr gesamtes Ökosystem sperren wollen. Also, wie hier Cloud-Code, richtig, wie ihr sehen könnt, wenn ich äh, wenn ich das, was ich gerade getan habe, über API allein codieren würde, hätte es mich diesen ganzen Monat über über 8.000 Dollar gekostet, aber weil ich Cloud-Code verwendet habe, hat es mich nur 200 Dollar gekostet. Ja. Nun, wenn ich es auf äh, wenn jemand dasselbe auf Open-Call machen würde, würde es nicht nur äh, die meisten Leute werden Open-Call nicht zum Programmieren verwenden, sondern sie werden Open-Call verwenden, um Dinge zu bauen, sie werden Open-Cloud verwenden, um zufällige Dinge zu tun, wie abrufen oder was auch immer. Es ist also eher so, als würde man Opus für die härteste Arbeit verwenden. Das ergibt keinen Sinn, und darüber hinaus kostet es sie viel Geld. Sie wollen also nicht wirklich, dass ihr das tut. Was ich also tatsächlich tue, richtig, ist, anstatt äh, eine Kopie von Open-Cloud zu verwenden, die wie das Gehen und Duplizieren des Open-Cloud-Repos und so weiter ist. Was ich tatsächlich getan habe, richtig, ist, dass ich einen Wrapper, eine Schicht über Cloud-Code erstellt habe. Wir nennen es einen Wrapper. Was wir hier nicht wollen, wir wollen nicht die Hässlichkeit. Wir wollen nicht das Benutzerlevel, das technische Niveau, denn man muss sich all diese Befehle und was auch immer merken. Dinge wie anstatt eines Buttons, eines schönen kleinen Buttons, den man drücken kann, muss man tatsächlich /Befehl tippen und starten und so weiter. Was ich eigentlich will, ist, wenn man wirklich darüber nachdenkt, was hindert einen daran, einfach einen Button zu erstellen, der, wenn man den Button drückt, automatisch einen /Befehl für einen ausführt, richtig? Das ist also im Grunde ein Wrapper. Wenn man also etwas wie das erstellt, richtig, ist es nicht nur /Befehl stoppen, Befehl starten, /Befehl Cloud-Code, was auch immer, man kann für alles einen Button erstellen. Was ich also getan habe, ist, anstatt ständig Buttons zu erfinden und ständig Befehle zu erstellen und die KI zu bitten, Dinge zu tun, zeigen wir alles zusammen, die ganze Zeit, auf einmal. Ebenso hier. Das ist eine Konversation, die wir hatten, äh, früher. Das ist eine weitere Sache, die ich äh, die ich oben drauf gelegt habe. Aber anstatt dass dieser Wrapper auf einer Art API im Hintergrund läuft, legen wir ihn tatsächlich über die CLI. Wenn man also darüber nachdenkt, die CLI, das Terminal läuft nur im Hintergrund. Man muss ihm nur Hebel geben, man muss ihm Knöpfe und so weiter geben. Gebt ihm eine schöne GUI, und das ist alles, was es braucht. Wenn ich also sage, Cloud-Code selbst, kann man das so ausführen. Warum nicht einfach einen weiteren Wrapper darauf legen, richtig? Es ist also nur das tun. Es ist tatsächlich ziemlich einfach. Wenn ich es also auf diese Weise mache, richtig, erstellen wir keinen Dienst, was das ist, was nicht erlaubt ist, was ist, als würdet ihr eure eigene Marke erfinden, zum Beispiel Mannheit oder Cursor, wisst ihr, Cursor-Manieren usw. Das sind andere Dinge, die sie in ihre eigene Marke einbringen. Sie bringen ihre eigene Marke ein. Wenn sie so etwas tun, aber ich baue keine eigene Marke darum auf. Ich sage buchstäblich: Okay, das ist Open-Plot. Wir führen hier nichts aus, richtig? Entschuldigung, ich muss diesen Teil hier entfernen, weil er ungenau ist. Das läuft über API, und was nicht erlaubt ist, ist, wie es aussieht. Das ist nicht erlaubt. Man erstellt etwas, das auf einer API laufen soll, aber anstatt eine API auszuführen, wie diese, tauscht man die KI gegen ein Cloud-Abonnement aus. Okay, das ist absolut nicht erlaubt. Das ist nicht erlaubt. Aber wenn man Cloud-Code verwenden und einen Wrapper-Harness darauf legen würde, ist das erlaubt. Ich hoffe, das ergibt Sinn. Und das ist tatsächlich eine normale, eine sehr normale Praxis. Wenn man sich das GitHub-Repo ansieht, wenn man sich GitHub ansieht, richtig, Leute tun das die ganze Zeit. Es gibt all diese schönen GUIs und so weiter, die um Cloud-Code gewickelt sind, und es ist tatsächlich sanktioniert. Es ist tatsächlich von Entropic erlaubt. In Ordnung. Das ist also erlaubt. Das ist nicht erlaubt. Das löst also Problem Nummer eins. Aber wie löst man Problem Nummer zwei? Um ihm äh, mehr Funktionen und so weiter zu geben? Nun, zuerst muss man sich die Sicherheitsseite ansehen. Ich weiß, Cloud hat viele Rückendeckungen für Sicherheit, aber gleichzeitig, wenn man wirklich darüber nachdenkt, ist es so, als hätte Peter das in etwa 2 Monaten gebaut, und er hat angefangen, es zu teilen, und es wurde von selbst viral. Also, anstatt äh, wir müssen ein wenig rücksichtsvoller sein, was solche Dinge angeht, denn wie das, es ist ein so frühes Produkt. Sicherheitsdinge werden definitiv da sein, aber oft passieren viele der Sicherheitsprobleme, weil die Einrichtung falsch ist. Es ist, als würden Leute Open-Cloud auf eine bestimmte Weise einrichten und anfangen, Open-Cloud allen Zugriff auf alle, wisst ihr, alle API-Schlüssel, alle Token-Schlüssel, alle Geheimnisse, alle Passwörter zu geben. Einige von ihnen geben der KI sogar ihre eigene Kreditkarte. Und im Fall von Summer gab sie Open-Cloud ihre E-Mail. Also, es ist, als ob das Sicherheitsproblem hier nicht so sehr das Problem externer Natur ist, auch wenn das passiert, sondern eine Frage der internen Natur. Es ist, als ob es tatsächlich viele Dinge tut, die man nicht will. Die Lösung dafür ist also, mechanische Leitplanken und Isolation zu schaffen. Lassen Sie mich zuerst über Isolation sprechen. Isolation ist tatsächlich ziemlich einfach zu lösen. Die Art und Weise, wie ich es löse, ist tatsächlich sehr einfach. Im Moment sind viele dieser Sicherheitsprobleme, von denen man hört, im Grunde persönlich. Und dann stecken sie Open-Cloud in ihren eigenen persönlichen PC. Das ist die Wurzel von allem. Das ist die Wurzel von allem. Und darüber hinaus, darüber hinaus, geben sie allen Zugriff, weil sie all die Backend-Dinge nicht sehen wollen. Sie wollen nicht über all diese Probleme nachdenken. Also sagen sie: Okay, lass uns Open-Cloud äh, lass uns Open-Cloud vollen Zugriff geben und lass Open-Cloud über alles nachdenken, damit ich nicht darüber nachdenken muss. Das ist der Grund, warum es passiert. Und darüber hinaus haben sie keine Form von Sicherheitshärtung durchgeführt, um zu verhindern, dass Open-Cloud Dinge preisgibt. Und darüber hinaus muss ich tatsächlich zwei Pluspunkte machen. Ja. So. Ich muss tatsächlich diese dummen Modelle machen. Keine Protokolle. Das ist das Problem. Es ist wie eine Kombination aus allen vier. Man steckt Open-Core direkt in seinen Computer. Man gibt ihm allen Zugriff, keine Leitplanken. Und darüber hinaus füttert man ihn mit einem dummen Modell, weil die Leute Geld sparen wollen. Anstatt ihm also ein schönes, wisst ihr, wie Opus oder Codeex 5.2 oder was auch immer das neueste Modell ist, geben sie ihm etwas wirklich, wirklich, wirklich Billiges und erwarten, dass es sich selbst vor Prompt-Injektionen schützen kann. Natürlich nicht, richtig? Und darüber hinaus gibt es keine Protokolle, wie äh, wie wem es tatsächlich zuhören soll. Woher soll es tatsächlich wissen, ob die Anweisungen von euch, dem eigenen Benutzer, dem eigenen Besitzer oder jemand anderem kommen, äh, so etwas. Das ist also im Grunde der Grund, warum es passiert. Die Art und Weise, wie man die Sache tatsächlich löst, ist jedoch, sie direkt zu isolieren. Das ist euer persönlicher Computer, richtig? Wir machen etwas, wir machen etwas namens VPS. VPS ist im Grunde ein Server. Man kann tatsächlich einen Computer online mieten, wie diesen. Und man gibt einfach äh, entweder VPS oder wie man sagt, Leute tun es, sie benutzen einen Mac Mini. Und so gibt man alle Arten von Dingen, richtig? Zugriff plus man gibt ihm äh, Protokolle und gibt ihm ein anständiges Modell. Es muss nicht sehr teuer sein, aber zumindest ein anständiges Modell, und dann ist es so gut wie behoben. Für mich, mein Cloud-Code, richtig, dieses gesamte Setup hier, ich habe es tatsächlich in einem VPS untergebracht. Ich habe keinen Mac Mini und habe nicht vor, einen Mac Mini zu kaufen, aber ein VPS ist tatsächlich sehr günstig. Ich brauche nicht einmal einen Mac Mini, weil ich einen VPS für etwa sechs Dollar im Monat bekomme. Und ich benutze Hostinger, ich glaube, es sind sechs Dollar im Monat. Es ist weniger als 10 Dollar im Monat. Es ist also tatsächlich sehr, sehr günstig. Und mein persönliches, ich installiere auch Cloud-Code, aber die, die ich hier installiere, wenn ich Cloud-Code benutze, benutze ich tatsächlich Opus 4.6, und ich bin tatsächlich sehr überrascht, denn als ich anfing, Opus 4.6 zu benutzen, war es sehr schüchtern. Es ist tatsächlich mein OPUS 4.6. Es war tatsächlich sehr intelligent, wie vorher, wie alles, was ich gerade gezeigt habe, passiert, wenn es anfängt zu halluzinieren, dass ich ihm Anweisungen gebe, wenn es anfängt, wie soll ich sagen, wenn es anfängt zu vergessen und abzudriften, dann arbeitet es mit mir und es gibt eine Kompaktierung. Aber während es Dinge tut, bevor es überhaupt anfängt, irgendwelche Arbeiten zu verrichten, fragt es mich, ob ich fortfahren soll, und wenn ich versuche, ihm äh, einige geheime Schlüssel und was auch immer zu geben, rät es mir, okay, füge es einfach hier ein, vielleicht möchtest du es bereinigen. Es scheint also kein Problem zu sein, in diesem Sinne für mich. Mein persönliches Setup hat einen Cloud-Code auf meinem Computer, damit er Dinge sehr schnell für mich erledigen kann, und wenn er es braucht, kann er meinen Bildschirm steuern und tatsächlich Dinge auf meinem Bildschirm erledigen. Und ich habe auch eine Kopie auf VPS. Ich habe keinen Mac Mini, ich habe tatsächlich eine Kopie auf meinem VPS, dem Hostinger, und so, dass ich, wenn ich reise, wenn ich ausgehe, tatsächlich äh, tatsächlich den VPS benutze. Und ihre Gehirne sind tatsächlich verbunden. Ihre Gehirne sind verbunden. Und die Art und Weise, wie ich ihre Gehirne verbinde, ist, dass ich GitHub benutze. Es gibt also tatsächlich eine automatische Synchronisationsfunktion. Die automatische Synchronisation wird alle 5 Minuten ausgelöst. Wenn ich also mit der KI spreche, wisst ihr über Open-Cloud, über all die Hintergründe, die Speicherdateien, die Seele, das Seelendokument und all diese Dinge, richtig, ich habe eine Version davon auch in meinem eigenen Code. Ich benutze nicht soul.mv, weil ich persönlich keinen Sinn darin sehe. Wenn ihr wollt, könnt ihr es als Teil des Startprotokolls einfügen. Für mich bin ich nicht besonders an KI interessiert, die eine Art Persönlichkeit braucht, persönlich denke ich nicht. Also lege ich äh, ich erstelle einen Ordner, richtig, und was auch immer, jede Sitzung, wann immer äh, sie startet, werden Cloud-Code und Open-Open-Cloud im Grunde mit einer Menge Kontext gefüttert, um zu wissen, wer du bist und so weiter. Das mache ich auch, aber ich lege den gesamten Ordner in GitHub und ich brauche nicht einmal zu GitHub zu gehen. Ich gebe meinem Cloud-Code-Bot Zugriff auf mein GitHub. Er erledigt das für mich. Im Grunde geht er und äh, er geht und äh, es gibt einen Hook, der auslöst. Es hängt nicht wirklich von der KI ab. Ich muss die KI nicht wirklich anweisen, das für mich zu tun. Alle 5 Minuten löst der Hook aus, und und und GitHub wird äh, aktualisiert, und dann erhält der VPS alle 5 Minuten das neueste Update des Speichers von GitHub. Also, es ist tatsächlich umgekehrt. Was auch immer ich hier hineinlege, alle 5 Minuten wird auch dieses hier aktualisiert, automatisch synchronisiert. Auf diese Weise werden die beiden Gehirne quasi eins, richtig? Ich nenne meins hier Next Prime und ich nenne meins hier Next VPS. Das ist also im Grunde, wie ich das Sicherheitsproblem löse, was äh, was mich zum eigentlich wichtigeren Problem bringt, dem internen Sicherheitsproblem, nicht dem externen Sicherheitsproblem. Die mechanischen Leitplanken sind tatsächlich sehr wichtig, wenn es darum geht, äh, zu verhindern, dass euer Agent etwas tut, was ihr nicht wollt. Viele Leute denken, dass sie sehr verwirrt sind, was das Prompting angeht, wisst ihr. Oft, wenn ich mit KI-Bros und wem auch immer spreche, scheinen sie zu denken, dass Prompting alles ist. Es ist nicht alles, denn wie ihr klar sehen könnt, weiß jeder, der umfangreiche Erfahrung mit KI hat, dass KI halluziniert, die KI driftet, und besonders bei langlaufenden Aufgaben, bittet man sie, wisst ihr, wie, sagen wir, man will, das ist der Ausgangspunkt, das ist der Ausgangspunkt und das ist der Endpunkt, und man sagt der KI, dass man hierher gehen wird, und man kann ihr eine Menge äh, Leitplanken geben, richtig? Zuerst werden wir in diese Richtung gehen, wir werden den Hintergrund ein wenig ändern, und dann werden wir äh, Schritt zwei ist hier, und dann Schritt drei ist hier, und dann Schritt vier ist hier, und dann Schritt fünf hier. Man denkt, dass die KI alles erinnern kann, sogar Open-Cloud, man denkt das, aber ich möchte, dass ihr etwas versteht. Open-Cloud, selbst Agenten, Open-Cloud, sie aktualisieren ihr eigenes Gedächtnis nicht automatisch, wisst ihr. Es gibt also diese explizite Anweisung, die ich glaube, in soul.md geschrieben habe, oder ich kann mich nicht erinnern, es ist eine der Anweisungen von Open-Cloud, es steht buchstäblich: Bis zum Ende jedes Tages sperren. Das ist Prompting. Man verlässt sich auf die Wachsamkeit der KI. Und man fragt sich vielleicht, warum, was ist das Problem damit? Nun, hier ist das Problem. Bis die KI Nummer eins erreicht, kurz davor, Nummer zwei zu tun, auf halbem Weg, richtig, auf halbem Weg dieser gesamten Reise vom Anfang bis hierher, okay, erreicht sie ihre Kontextgrenze. Was muss sie also tun, um die Konversation fortzusetzen? Sie muss tatsächlich etwas namens Kompaktierung tun, richtig? Sie wird die Konversation komprimieren. Was bedeutet Kompaktierung? Das bedeutet, dass sie buchstäblich alles bereinigt und in Stichpunkte zusammenfasst. Könnt ihr das Problem sehen? Ich hoffe, ihr seht das Problem. Ihr habt hier viel Arbeit geleistet. Okay, hier ist viel Arbeit. Okay, aber anstatt all diese Dinge zu erinnern, fasst sie es nur hier zusammen. Und das ist es, was Summer passiert ist. Sie sagte irgendwo hier: Handle nichts. Das hat sie der KI gesagt. Und was ist das? Das ist ein Prompt. Sie sagte so etwas am Anfang. Gehe und durchsuche meine E-Mails, äh, suche nach Dingen, die wir löschen können. Handle einfach nichts. Und dann ließ sie die Open-Cloud fröhlich davonlaufen, äh, außer dass nach der Kompaktierung von Open-Cloud nur ein sehr kleiner Bruchteil der gesamten Konversation erhalten bleibt. Also, dieses gesamte Ding, dieses gesamte Ding, ich sehe, ob ich das tun kann, ja, dieses gesamte Ding ist weg. Ich hoffe, das ergibt Sinn. Dieses gesamte Ding ist weg. Alle sorgfältigen, detaillierten Anweisungen, die ihr ihr gebt, sind weg. Die KI ist also nicht bösartig. Aber man muss, wenn man erwartet, dass die KI ein beständiges Gedächtnis hat, nur weil jeder auf allen KI-Bros und allen Schöpfern sagt, dass sie ein beständiges Gedächtnis hat, wird man getäuscht. Ihr tretet alle einer kollektiven Wahnvorstellung bei. Sie hat kein wirklich beständiges Gedächtnis. Was sie tatsächlich hat, ist, dass sie eine Datei hat, sie hat eine Markdown-Datei namens memory.m MV, das ist es, was sie tut, und wenn sie sich erinnert, schreibt sie es in dieses Gedächtnis, wenn sie sich nicht erinnert oder wenn man ihr mehr und mehr Arbeit gibt und man ihr nicht ausdrücklich sagt, sie soll es aufschreiben, tut sie es nicht, oder bis man sie auf ein bestimmtes Problem hinweist, das wie folgt lautet: Tu das nie wieder, dann wird Open-Cloud sagen: Oh ja, lass uns das tun. Und ich möchte, dass ihr etwas versteht. Cloud-Code hat genau das gleiche Problem, denn Cloud-Code verlässt sich immer noch auf Kompaktierung. Das ist der Grund, warum Neo keine Kompaktierung verwendet, weil Kompaktierung Mist ist. Alles, was Wachsamkeit erfordert, wird niemals funktionieren. Ich habe das immer und immer wieder in meinem gesamten Cloud-Workflow gesehen. Alles, was erfordert, dass die KI wachsam ist, wird funktionieren, wenn man nur ein Fenster gleichzeitig laufen hat und sehr, sehr langsam mit der KI ist, aber der ganze Sinn der Nutzung von KI ist, wisst ihr, nicht langsam zu sein, sondern schnell. Persönlich sehe ich es also nicht funktionieren. Was ich tatsächlich benutze, was funktioniert, ist, wie ihr gerade gesehen habt, das "Do it"-Gate. Das "Do it"-Gate funktioniert so, wir nennen es mechanische Durchsetzung. Nehmen wir also hier das gleiche Beispiel, wir können das gleiche Beispiel verwenden. Normalerweise passiert hier, wenn es auch nur um einen Grad abweicht, wenn es auch nur um einen Grad abweicht, wenn man diese beiden extrapolieren würde, um sehr, sehr hoch zu gehen, okay, wenn man das sehr hoch beschleunigt, wenn es hier um einen Grad abweicht, wird es letztendlich abzweigen und sich so entwickeln und mehr und mehr und mehr. Es wird noch weiter abweichen. Ich hoffe, das ergibt Sinn. Ich bin kein guter Zeichner. Was also passieren muss, ist, dass wir anstatt zu versuchen, es aufzufordern, weil wir wissen, dass es nicht wirklich funktioniert, Mauern um es herum schaffen, wir schaffen Hooks, wir schaffen Mauern, also schaffen wir Gates, richtig? Hier ist also ein Beispiel, sagen wir, ich identifiziere, dass sich um diese Stelle herum die KI gerne abzweigt und anfängt, dies zu tun, okay? Also schaffe ich ein Tor, das die KI daran hindert, irgendetwas zu tun. Wenn man dann diesen Punkt hier erreicht, sagt man: Oh, okay, schon abgewichen. Dann wird es sich automatisch selbst korrigieren und zurückgehen. Es wird nicht hierher zurückgehen. Wir wünschten, es würde. Es würde nicht. Es würde hierher zurückgehen, richtig? Ein bisschen ein doppeltes Umweg, aber es passiert. Je stärker das Tor ist, desto früher kann man die Abweichung erkennen, bevor die KI zu viel Schaden anrichtet. Wir können auch Hooks verwenden. Sagen wir also hier, es beginnt abzuweichen, richtig? Anstatt es abweichen zu lassen, schaffen wir einen Mechanismus, bei dem der Hook es aufruft, und man hakt die Sache einfach ein, richtig? Es geht hierher, und dann wird der Hook ausgelöst, weil der Hook hier installiert ist. Er beginnt zu sagen: Oh, die KI weicht vom Kurs ab. Haken wir sie zurück. Dann kann sie sich wieder richtig einhaken. Dinge wie diese sind sehr, sehr, sehr wichtig, sehr notwendig. Und das ist im Grunde das, was ich euch gerade in meinem Screenshot gezeigt habe, richtig? Wie das "Do it"-Gate. Das ist ein Beispiel unter all den Dingen, bei denen sich die KI ständig beschwerte. Mein Cloud, mein Cloud, es ist wie, das ist ein Problem, das "Do it" verlangsamt mich, und ich sage meiner Cloud immer wieder, Agent, schau, der Hook, das "Do it", weißt du, ist kein Problem, das "Do it"-Gate ist die Grundlage, die gesamte Grundlage einer Beziehung, denn wenn ich das "Do it"-Gate nicht habe, kann ich ihm nicht vertrauen. Es gibt so viele Male, wie ihr hier sehen könnt, es steht error pre hook pre-tool use. Was es hier bedeutet ist, dass äh, damit die KI Dinge tun kann, muss sie Werkzeugaufrufe verwenden. Sie muss tatsächlich Bash-Befehle verwenden, sie muss tatsächlich Werkzeuge verwenden, die ihr zur Verfügung stehen. Damit sie das tun kann, wird sie in dem Moment, in dem sie damit beginnt, daran erinnert, dass sie es nicht verwenden kann, und dann prüft das Skript, ob meine letzte Nachricht tatsächlich das Wort "do it" enthält oder nicht, und es ist sehr wichtig, dass die KI weiß, dass es meine ist, nicht die KI, die Automatisierung, die Automatisierung sieht automatisch das Wort "do it" aus meiner letzten Nachricht. Es müssen also zwei Bedingungen erfüllt sein: Stammt die letzte Nachricht von mir oder von der KI oder vom System? Wenn sie nicht von mir stammt, schlägt sie fehl, und die zweite Bedingung ist: Enthält meine letzte Nachricht das Wort "do it"? Wenn sie das Wort "do it" nicht enthält, dann äh, dann erlaubt das "pre-tool use"-Gate Opus buchstäblich nicht, es zu verwenden. Ich hoffe, das ergibt Sinn. Es ist also irgendwie gesperrt. Wir verlassen uns nicht auf Wachsamkeit. Wir verlassen uns auf mechanische Durchsetzung. Ich hoffe, ich hoffe, ihr lernt etwas daraus, denn es ist sehr, sehr wichtig. Okay. Das ist also im Grunde, wie ich das Problem dieser beiden Dinge löse. Wir verwenden Harnesses. Wir schaffen mechanische Leitplanken und darüber hinaus äh, wir setzen es in Isolation, so dass es nur genug Informationen erhält, um seine eigene Arbeit zu tun. Ich persönlich arbeite an etwas, das eine Art Agenten-Schwarm ist. Und jeder einzelne Agent, der gespawnt wird, ist tatsächlich nicht aktiv. Ich arbeite noch daran, aber jeder äh, oh, ihr könnt es nicht sehen, aber dieses 3D-Diagramm hier ist im Grunde eine Darstellung eines Knotens, an dem ich arbeite. Wenn ich also einen neuen Chat erstelle, wird dieser neue Knoten gespawnt, und was unten herauskommt, ist im Grunde der Sub-Agent dieses Chat-Agenten. Wenn ich also äh, fünf verschiedene Chat-Sitzungen erstelle, werden wir fünf verschiedene Knoten unter mir haben. Was ich also letztendlich tun möchte, wo ich damit hin will, ist, dass ich einen Kernaspekt meines Geschäfts an einen dieser Knoten übergeben werde. Es ist also noch nicht aktiv. Ich kann es euch also nicht demonstrieren. Aber im Grunde sind Dinge wie diese Leitplanken noch wichtiger, um einen mehrschichtigen Fluss zu haben, denn wenn ihr jemals von etwas wie dem chinesischen Flüstern gehört habt, wisst ihr, wie schlimm die Dinge werden. Ihr wisst, einer sagt das, und nach 20, 20 Mal bekommt man die Nachricht, dieselbe Nachricht wird weitergegeben. Sie wird zu einer völlig anderen Nachricht. Um das zu tun, ist das Tor absolut notwendig, und das äh, das sexyeste Ding, denke ich, an diesem Zeug ist, dass es nicht auf dem Niveau von Open-Cloud ist. Nun, hier ist die Sache. Grundlegender Cloud-Code ist stabil, aber er ist kompliziert, richtig? Man muss sich mit CLI, GitHub, was auch immer auseinandersetzen. Nicht äh, Open-CL ist immer noch kompliziert, aber man muss nur einmal das Terminal öffnen und den Befehl kopieren und einfügen, und dann gibt es einen ganzen Onboarding-Flow dazu. Nach dem ersten anfänglichen Schmerz ist er tatsächlich ziemlich angenehm zu benutzen, bis er kaputt geht. Aber das können wir lösen. Die zweite Sache, die äh, Cloud-Code nicht auf Open-Cloud-Niveau macht, ist, dass er karg ist, es gibt so viele Dinge, die man selbst installieren muss. Man muss ihn installieren lassen, man muss ihn eine Reihe von Dingen installieren lassen, und meistens sagt er einem nicht einmal proaktiv, dass oh, okay, es gibt eine Fähigkeit, die wir hier erstellen können. Er sagt einem das nicht proaktiv, er geht nicht proaktiv äh, äh, schaut nach, es gibt wahrscheinlich ein Repo dafür, das wir vielleicht stehlen können, es gibt wahrscheinlich einen Open-Source-Code dafür, den wir ausleihen können, wisst ihr, was auch immer. Was man also tatsächlich tut, was ich tatsächlich tue, ist, dass ich Open-Source gehe, ich gehe und finde Open-Source-Repos für jede einzelne Funktion, die ich will, und im Grunde ist es so, als ob ich, als Beispiel, mein YouTube-Skript, richtig, was ich will, was ich will, dass mein Agent tut, ist im Grunde, wenn ich ein interessantes Video online sehe und wissen will, ob, zum Beispiel, ein Video sagen könnte: Entsperre persistentes Gedächtnis für deinen Cloud-Code, wisst ihr, und wie ihr wisst, sind die Leute oft sehr hypy, sehr clickbaity, also wissen wir nicht wirklich, ob es sich lohnt, dieses Video anzusehen oder nicht. Also kopiere ich einfach den Link, schicke ihn an Code, die Cloud wird alles zerlegen und mir sagen, ob es für sie anwendbar ist und ob es für das Projekt, an dem ich arbeite, wie Neo, anwendbar ist. Ich mache das nicht für jeden Creator. Es gibt einige Creator, die ich wirklich gerne von Anfang bis Ende ansehe. Aber für die meisten Creator, denen ich nicht vertraue, ist das im Grunde das, was ich tun möchte. Sonst würde ich 25 Minuten meiner Zeit damit verbringen, nur ein nutzloses Video anzusehen, nur um festzustellen, dass ich geklickt werde, richtig? Wenn es also so ist, dass diese Leute, wisst ihr, etwas Legitimes sagen, dann gibt es normalerweise ein kostenloses GitHub-Repo, denn das sind alles Creator, sie führen kein Geschäft. Es sollte ein kostenloses GitHub-Repo geben, aus dem wir stehlen können. Also gehe ich nicht einmal persönlich zum G-Repo. Ich bitte einfach meinen Agenten, danach zu suchen. Mein Agent sucht danach, mein Agent holt es ab, und dann reißt mein Agent es im Grunde auseinander, und euer Agent kann das auch tun, solange ihr Cloud-Code habt. Cloud-Code kann das tun, denn ich benutze Cloud-Code die ganze Zeit, um genau das Gleiche zu tun. Also wird der Cloud-Code im Grunde hingehen und äh, basierend auf dem Video, das ich sehe, oder vielleicht einem interessanten Artikel, es zerreißen, oder vielleicht sehen wir einen Artikel und haben kein Repo. Das bedeutet also, dass der Creator sich nicht entschieden hat, seinen Code Open-Source zu machen. Gut. Ich werde einfach Cloud-Code bitten, okay, wie diese Architektur, dieses Konzept, funktioniert es, ist es anwendbar, ist es relevant? Wenn es relevant ist, warum, dann werde ich im Grunde die Begründung durchgehen. Wenn ich denke, dass hier etwas Gutes ist, dann werde ich meine bitten, die Arbeit zu skizzieren, und wir werden Zeit damit verbringen, sie zu bauen, wisst ihr, also lass Cloud-Code sie bauen, was auch immer es ist, was du äh, als ich meinen Cloud-Code zum ersten Mal bekam, war das Gedächtnis ehrlich gesagt wirklich schrecklich. Es komprimiert ständig. Aber wir haben viele verschiedene Mechanismen für unsere installiert, also weiß ich nicht warum, aber es scheint, dass mein OBS mein Windows PowerShell-Terminal nicht aufnehmen darf. Hier ist also im Grunde, was ich es gebeten habe. Ich habe es gebeten, mich daran zu erinnern, was alles für sein Gedächtnis erstellt wurde. Wir haben also zuerst das Gedächtnissystem, aber anstatt nur das Gedächtnissystem, anstatt nur Dinge einzufüllen, haben wir eine automatische Sitzungsübergabe erstellt, die automatisch aufgefüllt wird. Das bedeutet, dass kurz bevor die Kompaktierung stattfindet, ein automatisches Skript ausgelöst wird, um nicht nur eine Zusammenfassung, sondern mit voller Nuance zu erfassen, was genau alles während der Sitzung passiert ist. Mal sehen, Entwicklungs-Locker. Okay. Jedes Mal, wenn es aufhört zu arbeiten, wird ein Skript ausgelöst, das ein Haiku sendet, um zu fragen: Gab es eine Entscheidung? Gab es eine Aufgabe? Wenn ja, dann erstellt das Haiku eine einzeilige Zusammenfassung in der täglichen Log-Datei. Die tägliche Log-Datei ist ein Konzept, das direkt von Open-Cloud übernommen wurde, das wie memory.md ist, und dann gibt es im Ordner, der memory.md enthält, wie session one, session two, und oben gibt es wie daily log, also das heutige Datum ist welches und was passiert ist, ist genau wie bei Open-Cloud, wir äh, wir erstellen ein Skript, das ausgelöst wird, um sicherzustellen, dass jedes Mal, wenn eine neue Sitzung beginnt oder sofort nach der Kompaktierung, was auch immer, die KI mit der gesamten Zeitachse dessen gefüttert wird, was heute und gestern passiert ist. Dasselbe wie bei Open, denn eines der ersten Dinge, die ich getan habe, war zu fragen, eine der ersten Dinge, die ich getan habe, war, meinen Pod-Code-Agenten zu bitten, die Dokumentation zu durchgehen, Open-Codes zu zerreißen und herauszufinden, was wir für unseren eigenen Harness verwenden können, Sie wissen schon. Also, komplexer Keeper, derselbe Auslöser, jeder Stopp, jeder Stopp bedeutet jedes Mal, wenn eine Runde endet. Ich sage etwas, die KI sagt etwas, nach jeder Runde, die endet, wird das Skript ausgelöst, um den Kontext zu protokollieren. Was wurde getan, was wurde getestet, offene Punkte. Sie schreibt sie in die Sitzungsübergabe. Es gibt eine Sitzungs-Transkription. Die Sitzungs-Transkription ist für den Fall, dass bestimmte Nuancen verloren gehen. Am Ende jeder Kompaktierung oder was auch immer, speichern wir buchstäblich die gesamte Sitzungs-Transkription, so dass ich, falls etwas verloren geht oder während der Kompaktierung, die KI bitten kann, es über Schlüsselwörter und semantische Suchen abzurufen. Dinge wie Lernsystem, schützende Tore, kontextuelles Abrufen, es gibt eine Menge, eine Menge Dinge hier drin. Die KI sagt, dies ist das wichtigste Stück, der operative Speicher. Das sind also keine Hooks oder Skripte. Diese sind im Grunde ganz oben in der Sitzungsübergabe geparkt, denn so denke ich darüber nach, stellen Sie sich vor, jemand stellt sich vor, ein neuer Mitarbeiter, stellen Sie sich vor, Sie wurden gerade von einem Unternehmen eingestellt. Es ist Ihr erster Tag, Sie wissen nichts über das Unternehmen. Sie kennen wahrscheinlich einige Ideen, aber Sie sind vielleicht noch nicht vollständig in die Unternehmenskultur und so weiter eingearbeitet. Sie können sich nicht vorstellen, wenn Ihr Manager Ihnen 300 Seiten Dokumentation aufdrückt, werden Sie sehr verwirrt sein. Anstatt das zu tun, geben wir nur fünf Geschichten, damit die KI die Schwere dessen, die Wichtigkeit dieser besonderen Regel kennt. Wir geben ihr nicht einfach 50 Regeln auf einmal, auch wenn wir es können, aber das ist nicht der klügste Weg. Wir geben diese Regeln, und danach wird sie sich in diesem gesamten Kontext daran erinnern, dass sie, wenn sie bestimmte Jobs ausführt, bestimmte Hooks auslöst, bestimmte Hooks haben bestimmte Skripte, die ausgeführt werden, um ihr die genauen Regeln zu geben, die sie für diesen speziellen Job befolgen muss. Auf diese Weise können wir in jeder einzelnen Sitzung, die wir durchführen, die Sitzung viel länger als zuvor ausdehnen. Dinge wie Kontextmanagement. Also, das ist im Grunde, was ich heute teilen wollte. Wenn ihr nur viel Geduld braucht, müsst ihr nur sehr detailliert in euren Anweisungen sein und die KI nicht alles für euch denken lassen. Manchmal kann die KI sehr schlechte Ideen haben und sieht nicht einmal ihre eigenen blinden Flecken. Also seid ihr als Mensch, als Benutzer verantwortlich dafür, diese Lücken aufzuzeigen. Und wenn ihr eine Kopie von dem wollt, was ich getan habe, wie ihr wahrscheinlich sehen könnt, habe ich viel Arbeit in die Erstellung dieses Harnesses gesteckt. Wenn ihr eine Kopie davon wollt, könnt ihr das, aber ich werde es verkaufen. Es wird nicht kostenlos sein. Ich werde ein Abonnement dafür anbieten. Wenn das für euch von Interesse ist, lasst es mich in den Kommentaren wissen, und wenn ich die Details bereit habe, werde ich euch die Informationen zusenden. In Ordnung, Leute.