📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Claude Opus 5 is Going to Save You Money

Nate Herk | AI Automation3:56

Transcription

Okay, also Claude Opus 5 ist gerade buchstäblich erschienen. Nun, offensichtlich werde ich den Rest meines Tages damit verbringen, damit herumzuspielen, es mit Fable 5 zu vergleichen und euch Jungs ein Experiment zu bringen. Bleibt also später heute dran. Aber ich wollte hier nur ganz kurz reinkommen und euch das zeigen, weil ich es wirklich, wirklich interessant finde. Bei mehreren Bewertungen für Codierung und Wissensarbeit ist Opus 5 der neue Stand der Technik. Schaut euch also diesen ersten Benchmark hier an, Agentic Terminal Coding. Opus 5 hat 43 %, Fable 5 hatte 33 % und Opus 4.8 hatte 21 %. Das ist also ein großer Sprung bei Agentic Terminal Coding, sowohl über Opus 4.8 als auch über Fable 5. Dasselbe gilt für Wissensarbeit. Dieses Ding zerquetscht Opus 4.8. Ich weiß nicht genau, was der Benchmark für neuartige Problemlösung löst, aber schaut euch das an. Es ging von Opus 4.8 bei 1,5 % auf 30 % bei Opus 5. Diese Benchmarks sind also verrückt. Ihr könnt hier auch Computernutzung sehen, wo ich immer zu Codeex greifen würde. Ich dachte immer, GPT 5.6 oder 5.5 mit Codecs wäre einfach das absolut Beste bei der Computernutzung. Aber schaut euch das mit Opus an. Opus 5. Ich werde es mit Computernutzung ausprobieren müssen.

Was mich wirklich interessiert, ist diese Effizienz, denn wie ihr wisst, ist Opus halb so teuer wie Fable und Fable wird eure Credits wie verrückt verbrauchen. Aber schaut euch das an. Agentic Computernutzung Opus 5 schneidet besser ab als Fable und das günstiger. Schaut euch das an. Agentic Business Workflows. Opus 5 ist besser als Fable und das günstiger, was für mich wirklich, wirklich interessant ist. Multidisziplinäres Denken nach Anstrengungslevel. Opus 5 schneidet besser ab als Fable und ist günstiger als Fable.

Wie gesagt, ich werde jetzt eine Menge Nutzungsguthaben verbrauchen. Wenn ihr euch das hier in meinem Claude anschaut, bin ich bereits an meinem wöchentlichen Fable-Limit und ich werde Tausende von Dollar an zusätzlichen Nutzungsguthaben ausgeben, aber ich werde hier eine Menge Experimente durchführen und euch meinen Konsens bringen. Aber ich wollte hier nur kurz reinkommen und euch das zeigen. Es ist wirklich interessant.

Wenn ihr also ganz kurz in euren VS Code geht, in Claude Code geht, es aktualisiert, auf Opus 5 umsteigt und einfach anfangt, eure Fähigkeiten und Dinge auszuführen und zu sehen, wie es sich anfühlt, denn wie wir wissen, sind diese Benchmarks unterhaltsam anzusehen, aber nehmt sie immer mit Vorsicht. Es kommt immer auf euren Anwendungsfall an, wie ihr mit Agenten sprecht, welche Art von Arbeit ihr leistet, solche Dinge.

Claude Opus 5 bietet eine stark verbesserte Leistung zum gleichen Preis wie sein Vorgänger Opus 4.8. Opus 5 glänzt bei wertvollen Softwareentwicklungsaufgaben wie dem Frontier Bench auf dem Cursor Bench. Ich möchte wirklich sehen, wie es sich bei der Deep Suite schlägt, denn das ist diejenige, die ein ziemlich echter, führender Indikator war. Aber die ganze Sache mit den Kosten ist für mich im Vergleich zu Fable 5 wirklich interessant, denn ich weiß, dass viele von euch irgendwie dachten: "Oh Mann, es ist schade, dass wir Fable verlieren werden oder dass wir nur ein bestimmtes anderes Limit dafür bekommen." Aber es ist für die meisten Dinge übertrieben und es ist wirklich teuer. Wenn Opus 5 also besser für allgemeine Wissensarbeit ist, dann ist das ein riesiger Gewinn. Und das ist für mich wirklich aufregend.

Opus 5 ist viel stärker darin, seine Arbeit zu überprüfen und sorgfältig zu iterieren, bis es erfolgreich ist. Ich habe diese wirklich lustige Analogie auf X gehört, die ehrlich gesagt ziemlich zutreffend ist. Sie sagten im Grunde: "Hey, Fable 5 ist wie eine weise alte Eule. Es ist wirklich gut im Planen, Managen und Ideen entwickeln. Während GBD 5.6 Soul wie ein Rottweiler ist, weil dieses Ding sich an eine Aufgabe klammert und sie nicht loslässt, bis die Aufgabe erledigt ist, was ich definitiv gefühlt habe. Es hat mehr Tests gestartet und es gab eine bessere Verifizierung als Fable, richtig? Aber jetzt hat Opus 5 das vielleicht gesehen und dachte: "Oh wow, wir müssen etwas von dieser GBD 5.6 Soul-Verifizierung einbauen." Und jetzt, wenn wir das haben, ist das riesig, denn Verifizierung ist sozusagen das, was all diese agentischen Schleifen antreibt, über die alle reden. Und wenn ihr ein Modell verwendet, das wirklich gut in der Verifizierung ist, werden eure Schleifen besser und eure Ergebnisse werden besser sein. Ich bin also wirklich gespannt darauf, Opus 5 mit etwas Verifizierung zu testen.

Und hier sind einige Beispiele, bei denen sie Opus 5 reale Szenarien gegeben haben und es Fehler finden, verifizieren, verschiedene Ansätze verfolgen und letztendlich ein gutes Ergebnis liefern ließ. Aber wie auch immer, das ist jetzt für alle auf allen Plattformen vollständig verfügbar. Gleicher Preis wie Opus 4.8. Also, wie gesagt, ich werde jetzt sofort loslegen und es gegen Fable 5 testen. Und ich werde euch später heute das vollständige Experiment bringen. Haltet also die Augen offen für dieses Video. Aber wie auch immer, wir sehen uns dort. Danke an alle.